Codesota · Models2,268 models indexed · 896 match filter
Editorial · Models
Models with recorded evidence.
Start with a research area, drill into a vendor, or page through the full index. Vendor aliases and legacy area IDs are grouped here; original model IDs and model links stay unchanged. Only models with at least one benchmark score appear — a model without a recorded score can’t be ranked.
Vendor:Areas overviewSpeakLeash · 263Alibaba · 104Google · 102OpenAI · 86Meta · 68Microsoft · 49Anthropic · 44DeepSeek · 34Mistral · 30mistralai · 19CYFRAGOVPL · 14NVIDIA · 14Zhipu AI · 13internlm · 10xAI · 10ByteDance · 9Baidu · 8ibm-granite · 8PLLuM · 8allenai · 7Amazon · 7MiniMax · 7Mistral AI · 7Remek · 7Shanghai AI Lab · 7utter-project · 7CohereForAI · 6Salesforce · 601-ai · 5Cohere · 5Moonshot AI · 5NousResearch · 5THUML · 5gguf-iq · 4IBM · 4Meituan · 4openchat · 4Stanford · 4THUDM · 4tiiuae · 4UC San Diego · 4VikParuchuri · 4Allen AI · 3BAAI · 3Du et al. · 3ForgeCode · 3Fudan University · 3gguf · 3gguf11bv30 · 3gguf7bv30 · 3IDEA Research · 3Liao et al. · 3Moonshot.AI · 3Nam Tuan Ly / NII · 3OpenDataLab · 3OPI-PG · 3upstage · 3ViCoS Lab Ljubljana · 3Xiaomi · 3Zhao et al. · 3+ 243 smaller vendors (288 models)
§ 01 · Computer Vision models
896 models in Computer Vision · page 3 of 18.
| # | Model | Vendor | Parameters | Architecture | Benchmarks | Results |
|---|---|---|---|---|---|---|
| 101 | DiffusionSTR | Unknown | Unknown | Unknown | 6 | 6 |
| 102 | DPAN | Unknown | Unknown | Unknown | 6 | 6 |
| 103 | EK-Net | Zhu et al. | Unknown | ResNet-18 + Expand Kernel Distance | 2 | 6 |
| 104 | FOTS MS | Unknown | Unknown | Unknown | 2 | 6 |
| 105 | FTSN + MNMS | Unknown | Unknown | Unknown | 2 | 6 |
| 106 | GLAM | Unknown | Unknown | Unknown | 1 | 6 |
| 107 | GNNets | Unknown | Unknown | Unknown | 2 | 6 |
| 108 | Habitat-Web | Unknown | Unknown | Unknown | 2 | 6 |
| 109 | HTR-ConvText | DAIR-Group | 65.9M | CNN+Transformer hybrid (ConvText block) | 3 | 6 |
| 110 | HTR-VT | Unknown | Unknown | Unknown | 3 | 6 |
| 111 | Hybrid DLA (Shehzadi et al.) | DFKI / TU Kaiserslautern | Unknown | Transformer object detector with query encoding + hybrid one-to-one/one-to-many matching | 1 | 6 |
| 112 | Intern-S1-Pro | Shanghai AI Lab | — | — | 5 | 6 |
| 113 | InternVL3-78B | Shanghai AI Lab | 78B | Vision-Language Model | 5 | 6 |
| 114 | LayoutLMv3-B | Unknown | Unknown | Unknown | 1 | 6 |
| 115 | Mistral OCR 3 | Mistral | — | Vision-Language Model | 2 | 6 |
| 116 | PAN-640 | Unknown | Unknown | Unknown | 2 | 6 |
| 117 | PixelLink+VGG16 2s | Unknown | Unknown | Unknown | 2 | 6 |
| 118 | PMTD* | Unknown | Unknown | Unknown | 2 | 6 |
| 119 | REL-RWMD k-NN | Unknown | Unknown | Unknown | 6 | 6 |
| 120 | ResNext-101-32×8d | Unknown | Unknown | Unknown | 1 | 6 |
| 121 | SBD | Unknown | Unknown | Unknown | 2 | 6 |
| 122 | S-GTR | Unknown | Unknown | Unknown | 6 | 6 |
| 123 | SLPR | Unknown | Unknown | Unknown | 2 | 6 |
| 124 | StackMix+Blots | Unknown | Unknown | Unknown | 6 | 6 |
| 125 | TextBoxes++_MS | Unknown | Unknown | Unknown | 2 | 6 |
| 126 | TextBPN++ (ResNet-50+DCN) | Zhang et al. | Unknown | ResNet-50 with Deformable Convolution + Boundary Transformer | 2 | 6 |
| 127 | TextMamba | Zhao et al. | Unknown | Mamba (SSM) + CNN | 2 | 6 |
| 128 | Transformer | Unknown | Unknown | Unknown | 6 | 6 |
| 129 | TRDLU | Unknown | Unknown | Unknown | 1 | 6 |
| 130 | TrOCR-base 334M | Unknown | Unknown | Unknown | 6 | 6 |
| 131 | TrOCR-large 558M | Unknown | Unknown | Unknown | 6 | 6 |
| 132 | UDoc | Unknown | Unknown | Unknown | 1 | 6 |
| 133 | USYD NLP_CS29-2 | Unknown | Unknown | Unknown | 1 | 6 |
| 134 | VAN | Unknown | Unknown | Unknown | 3 | 6 |
| 135 | VideoLLaMA3 2B | — | — | — | 6 | 6 |
| 136 | VSR | Unknown | Unknown | Unknown | 1 | 6 |
| 137 | WordSup (VGG16-synth-icdar) | Unknown | Unknown | Unknown | 2 | 6 |
| 138 | ABINet-LV | Fang et al. | Unknown | ResNet + Bidirectional Language Model (LV) | 5 | 5 |
| 139 | BART-base (STSM) | Meta | 139M | Transformer | 1 | 5 |
| 140 | BiLSTM (Europarl) | Unknown | Unknown | Unknown | 5 | 5 |
| 141 | CCD-ViT-Small | Unknown | Unknown | Unknown | 4 | 5 |
| 142 | clearOCR | TeamQuest | — | Traditional OCR | 1 | 5 |
| 143 | CodeBERT (RTD) | Unknown | Unknown | Unknown | 5 | 5 |
| 144 | DPText-DETR (ResNet-50) | Unknown | Unknown | Unknown | 2 | 5 |
| 145 | EasyOCR | JaidedAI | — | Deep Learning OCR | 3 | 5 |
| 146 | FactJointGT | Unknown | Unknown | Unknown | 1 | 5 |
| 147 | FactT5B | Unknown | Unknown | Unknown | 1 | 5 |
| 148 | FLAN-T5-base (STSM) | 250M | Transformer | 1 | 5 | |
| 149 | GLASS | Unknown | Unknown | Unknown | 2 | 5 |
| 150 | GPT-2-Large (prefix-tuning) | OpenAI | 774M | Transformer | 1 | 5 |