Codesota · Models2,268 models indexed · 896 match filter
Editorial · Models
Models with recorded evidence.
Start with a research area, drill into a vendor, or page through the full index. Vendor aliases and legacy area IDs are grouped here; original model IDs and model links stay unchanged. Only models with at least one benchmark score appear — a model without a recorded score can’t be ranked.
Vendor:Areas overviewSpeakLeash · 263Alibaba · 104Google · 102OpenAI · 86Meta · 68Microsoft · 49Anthropic · 44DeepSeek · 34Mistral · 30mistralai · 19CYFRAGOVPL · 14NVIDIA · 14Zhipu AI · 13internlm · 10xAI · 10ByteDance · 9Baidu · 8ibm-granite · 8PLLuM · 8allenai · 7Amazon · 7MiniMax · 7Mistral AI · 7Remek · 7Shanghai AI Lab · 7utter-project · 7CohereForAI · 6Salesforce · 601-ai · 5Cohere · 5Moonshot AI · 5NousResearch · 5THUML · 5gguf-iq · 4IBM · 4Meituan · 4openchat · 4Stanford · 4THUDM · 4tiiuae · 4UC San Diego · 4VikParuchuri · 4Allen AI · 3BAAI · 3Du et al. · 3ForgeCode · 3Fudan University · 3gguf · 3gguf11bv30 · 3gguf7bv30 · 3IDEA Research · 3Liao et al. · 3Moonshot.AI · 3Nam Tuan Ly / NII · 3OpenDataLab · 3OPI-PG · 3upstage · 3ViCoS Lab Ljubljana · 3Xiaomi · 3Zhao et al. · 3+ 243 smaller vendors (288 models)
§ 01 · Computer Vision models
896 models in Computer Vision · page 17 of 18.
| # | Model | Vendor | Parameters | Architecture | Benchmarks | Results |
|---|---|---|---|---|---|---|
| 801 | SenseTime Basemodel | SenseTime | — | — | 1 | 1 |
| 802 | Siamese_MHCA_SA | Unknown | Unknown | Unknown | 1 | 1 |
| 803 | Siamese_MultiHeadCrossAttention_SoftAttention (Siamese_MHCA_SA) | Unknown | Unknown | Unknown | 1 | 1 |
| 804 | Siamese Small-E-Czech (Electra-small) | Unknown | Unknown | Unknown | 1 | 1 |
| 805 | SigNet-F (SVM) | Unknown | Unknown | Unknown | 1 | 1 |
| 806 | SLDD-Model | Unknown | Unknown | Unknown | 1 | 1 |
| 807 | SoViT-400m/14 | 400M | Vision Transformer (Shape-Optimized) | 1 | 1 | |
| 808 | SoViT-400M/14 | 400M | Compute-optimal ViT shape | 1 | 1 | |
| 809 | SPRINT | IIT Bombay LEAP-OCR | Unknown | OTSL (Optimized Table Structure Language) sequence prediction; script-agnostic design | 1 | 1 |
| 810 | SRFormer | AAAI 2024 | — | — | 1 | 1 |
| 811 | STaR-8B | Unknown | — | — | 1 | 1 |
| 812 | StarCoder-LoRA | BigCode / Salesforce | 15.5B | Transformer decoder | 1 | 1 |
| 813 | step-1v | Unknown | Unknown | Unknown | 1 | 1 |
| 814 | STN-OCR | Unknown | Unknown | Unknown | 1 | 1 |
| 815 | STREET | Unknown | Unknown | Unknown | 1 | 1 |
| 816 | StrucTexTv2 (large) | Unknown | Unknown | Unknown | 1 | 1 |
| 817 | Surya | VikParuchuri | — | — | 1 | 1 |
| 818 | SVTR-B (Base) | Unknown | Unknown | Unknown | 1 | 1 |
| 819 | SVTR-L (Large) | Unknown | Unknown | Unknown | 1 | 1 |
| 820 | SVTR-S (Small) | Unknown | Unknown | Unknown | 1 | 1 |
| 821 | SVTR-T (Tiny) | Unknown | Unknown | Unknown | 1 | 1 |
| 822 | SVTRv2-B | Du et al. | Unknown | SVTR Base + Multi-Size Resizing + Feature Rearrangement + Semantic Guidance (CTC) | 1 | 1 |
| 823 | SVTRv2-S | Du et al. | Unknown | SVTR Small + Multi-Size Resizing + Feature Rearrangement + Semantic Guidance (CTC) | 1 | 1 |
| 824 | SVTRv2-T | Du et al. | Unknown | SVTR Tiny + Multi-Size Resizing + Feature Rearrangement + Semantic Guidance (CTC) | 1 | 1 |
| 825 | swin_large.ms_in22k_ft_in1k | Microsoft | — | Swin-L, IN22K pre-train, IN1K fine-tune | 1 | 1 |
| 826 | Swin-L (Cascade R-CNN) | Microsoft | — | — | 1 | 1 |
| 827 | Swin-L + UperNet | Microsoft | Unknown | Swin Transformer Large backbone + UperNet head | 1 | 1 |
| 828 | Swin Transformer Large | Microsoft | 197M | Hierarchical Vision Transformer | 1 | 1 |
| 829 | Swin Transformer V2 Large | Microsoft | 197M | Hierarchical Vision Transformer | 1 | 1 |
| 830 | TableNet | Unknown | Unknown | Unknown | 1 | 1 |
| 831 | Tab-PoT | Unknown | Unknown | Unknown | 1 | 1 |
| 832 | TabSQLify (col+row) | Unknown | Unknown | Unknown | 1 | 1 |
| 833 | TabTracer | Unknown | — | — | 1 | 1 |
| 834 | TCM | CLIP-based | — | — | 1 | 1 |
| 835 | TextBlockV2 (GPT-2) | Jiahao Lyu et al., Fudan University | Unknown | GPT-2 LM decoder for detection-free scene text spotting | 1 | 1 |
| 836 | TextCohesion | Unknown | Unknown | Unknown | 1 | 1 |
| 837 | TextMonkey | Huawei | — | — | 1 | 1 |
| 838 | Thinker | UBTECH | — | — | 1 | 1 |
| 839 | TILT-Base | Unknown | Unknown | Unknown | 1 | 1 |
| 840 | TILT-Large | Unknown | Unknown | Unknown | 1 | 1 |
| 841 | TransferDoc | Unknown | Unknown | Unknown | 1 | 1 |
| 842 | Transfer Learning from AlexNet, VGG-16, GoogLeNet and ResNet50 | Unknown | Unknown | Unknown | 1 | 1 |
| 843 | Transfer Learning from VGG16 trained on Imagenet | Unknown | Unknown | Unknown | 1 | 1 |
| 844 | Transformer + CNN | Unknown | Unknown | Unknown | 1 | 1 |
| 845 | Transformer w/ CNN | Unknown | Unknown | Unknown | 1 | 1 |
| 846 | Transformer w/ CNN (+synth) | Unknown | Unknown | Unknown | 1 | 1 |
| 847 | TransOCR | Unknown | Unknown | Unknown | 1 | 1 |
| 848 | T-REX (Phi-4) | Unknown | — | — | 1 | 1 |
| 849 | TrOCR-small 62M | Unknown | Unknown | Unknown | 1 | 1 |
| 850 | TSRFormer | Unknown | Unknown | Unknown | 1 | 1 |