Codesota · Models2,268 models indexed · 896 match filter
Editorial · Models

Models with recorded evidence.

Start with a research area, drill into a vendor, or page through the full index. Vendor aliases and legacy area IDs are grouped here; original model IDs and model links stay unchanged. Only models with at least one benchmark score appear — a model without a recorded score can’t be ranked.

Vendor:Areas overviewSpeakLeash · 263Alibaba · 104Google · 102OpenAI · 86Meta · 68Microsoft · 49Anthropic · 44DeepSeek · 34Mistral · 30mistralai · 19CYFRAGOVPL · 14NVIDIA · 14Zhipu AI · 13internlm · 10xAI · 10ByteDance · 9Baidu · 8ibm-granite · 8PLLuM · 8allenai · 7Amazon · 7MiniMax · 7Mistral AI · 7Remek · 7Shanghai AI Lab · 7utter-project · 7CohereForAI · 6Salesforce · 601-ai · 5Cohere · 5Moonshot AI · 5NousResearch · 5THUML · 5gguf-iq · 4IBM · 4Meituan · 4openchat · 4Stanford · 4THUDM · 4tiiuae · 4UC San Diego · 4VikParuchuri · 4Allen AI · 3BAAI · 3Du et al. · 3ForgeCode · 3Fudan University · 3gguf · 3gguf11bv30 · 3gguf7bv30 · 3IDEA Research · 3Liao et al. · 3Moonshot.AI · 3Nam Tuan Ly / NII · 3OpenDataLab · 3OPI-PG · 3upstage · 3ViCoS Lab Ljubljana · 3Xiaomi · 3Zhao et al. · 3+ 243 smaller vendors (288 models)
§ 01 · Computer Vision models

896 models in Computer Vision · page 14 of 18.

#ModelVendorParametersArchitectureBenchmarksResults
651idefics3-8bUnknownUnknownUnknown11
652IGTR-ARYongkun Du et al.UnknownInstruction-Guided Transformer (Auto-Regressive variant)11
653InternImage-HShanghai AI LabUnknownDeformable Convolution v3 + Cascade Mask R-CNN11
654InternImage-H (OneFormer)PJLab & Tsinghua——11
655InternVL3 14BOpenGVLab—Vision-Language Model11
656internvl3.5-14bUnknownUnknownUnknown11
657InternVL3.5-241BShanghai AI Lab——11
658InternVL3-76BShanghai AI Lab——11
659JDeskewUnknownUnknownUnknown11
660JT-OCRUnknown——11
661KHCRUnknownUnknownUnknown11
662L3i++UnknownUnknownUnknown11
663LandingAILandingAIUnknownAgentic document extraction (ADE) service11
664LayoutLMv2BASEUnknownUnknownUnknown11
665LayoutLMv2 Large———11
666LayoutLMv2LARGEUnknownUnknownUnknown11
667LayoutLMv2 Large + QG———11
668LayoutLMv3MicrosoftUnknownMultimodal Transformer (text + layout + image)11
669LayoutLMv3UnknownUnknownUnknown11
670LayoutLMv3BASEUnknownUnknownUnknown11
671LayoutLMv3-LargeMicrosoftUnknownMultimodal Transformer (text + layout + image unified pre-training)11
672LayoutLMV3LargeUnknownUnknownUnknown11
673LayoutXLMUnknownUnknownUnknown11
674LexRank (query: method + article + steps titles)UnknownUnknownUnknown11
675LexRank (query: method + article titles)UnknownUnknownUnknown11
676LexRank (query: method title)UnknownUnknownUnknown11
677LexRank (query: step + method + article titles)UnknownUnknownUnknown11
678LexRank (query: step + method titles)UnknownUnknownUnknown11
679LexRank (query: step title)UnknownUnknownUnknown11
680LightOnOCR-1B-1025———11
681LiLT[EN-R]BASEUnknownUnknownUnknown11
682LISTERCheng et al.UnknownLength-Insensitive Scene TExt Recognizer with Neighbor Decoder11
683llama-3.1-nemotron-nano-vl-8bUnknownUnknownUnknown11
684LlamaParse AgenticLlamaIndexUnknownAgentic multi-step LlamaParse pipeline11
685LlamaParse Cost EffectiveLlamaIndexUnknownCost-optimised LlamaParse pipeline (<$0.004/page)11
686llava-ov-7bUnknownUnknownUnknown11
687LPV-SResearchUnknownLanguage-Guided Progressive Vison transformer (Small)11
688MAEDetIJCAI 2025——11
689MAERecJiang et al.UnknownViT backbone + Transformer decoder, MAE self-supervised pre-training on Union14M-U11
690MAERec-SResearchUnknownMasked AutoEncoder for scene text Recognition (ViT-Small)11
691MambaVision-L2NVIDIA241MHybrid Mamba-Transformer11
692Marker 1.10.1VikParuchuri—PDF Parser11
693Marker 1.8.2VikParuchuri——11
694Mask2Former + ResNet-50———11
695Mask2Former (Swin-L)MetaUnknownMasked-attention Mask Transformer + Swin-L11
696Mask2Former + Swin-L-FaPN———11
697Mask2Former (Swin-L) LVISMetaUnknownMasked-attention Mask Transformer + Swin-L11
698Mask2Former + Swin-T———11
699MaskFormer (Swin-T)———11
700MaskOCR-LUnknownUnknownUnknown11