Codesota · Models2,268 models indexed · 896 match filter
Editorial · Models

Models with recorded evidence.

Start with a research area, drill into a vendor, or page through the full index. Vendor aliases and legacy area IDs are grouped here; original model IDs and model links stay unchanged. Only models with at least one benchmark score appear — a model without a recorded score can’t be ranked.

Vendor:Areas overviewSpeakLeash · 263Alibaba · 104Google · 102OpenAI · 86Meta · 68Microsoft · 49Anthropic · 44DeepSeek · 34Mistral · 30mistralai · 19CYFRAGOVPL · 14NVIDIA · 14Zhipu AI · 13internlm · 10xAI · 10ByteDance · 9Baidu · 8ibm-granite · 8PLLuM · 8allenai · 7Amazon · 7MiniMax · 7Mistral AI · 7Remek · 7Shanghai AI Lab · 7utter-project · 7CohereForAI · 6Salesforce · 601-ai · 5Cohere · 5Moonshot AI · 5NousResearch · 5THUML · 5gguf-iq · 4IBM · 4Meituan · 4openchat · 4Stanford · 4THUDM · 4tiiuae · 4UC San Diego · 4VikParuchuri · 4Allen AI · 3BAAI · 3Du et al. · 3ForgeCode · 3Fudan University · 3gguf · 3gguf11bv30 · 3gguf7bv30 · 3IDEA Research · 3Liao et al. · 3Moonshot.AI · 3Nam Tuan Ly / NII · 3OpenDataLab · 3OPI-PG · 3upstage · 3ViCoS Lab Ljubljana · 3Xiaomi · 3Zhao et al. · 3+ 243 smaller vendors (288 models)
§ 01 · Computer Vision models

896 models in Computer Vision · page 8 of 18.

#ModelVendorParametersArchitectureBenchmarksResults
351WordSup (VGG16-synth-coco)UnknownUnknownUnknown13
352XMUnknown (ICDAR 2021 participant)——13
353Yao et al.UnknownUnknownUnknown13
354YOLOv10-XTsinghua University—CNN (Real-time)13
355ABCNetUnknownUnknownUnknown12
356ABINet++UnknownUnknownUnknown12
357ABINet-LV+TPS++UnknownUnknownUnknown22
358Accurate Content Copying———12
359AONUnknownUnknownUnknown22
360BEiT-L+———22
361BertUnknownUnknownUnknown22
362BERT classifier w/o TableUnknownUnknownUnknown12
363Bert-to-Bert———12
364Bi+UnknownUnknownUnknown22
365biCVM+UnknownUnknownUnknown22
366Biinclusion (Euro500kReuters)UnknownUnknownUnknown22
367BilBOWAUnknownUnknownUnknown22
368BioGPTUnknownUnknownUnknown12
369BioLinkBERT (large)UnknownUnknownUnknown12
370CA-FCNUnknownUnknownUnknown22
371CHARUnknownUnknownUnknown22
372ChuLoUnknownUnknownUnknown22
373claude-3.5-sonnetUnknownUnknownUnknown12
374CLIP4STR-H (DFN-5B)UnknownUnknownUnknown22
375CNKIUnknownUnknownUnknown12
376CodeBERTMicrosoftUnknownBERT22
377CodeT5-baseSalesforce—T5 encoder-decoder pretrained on code22
378CodeTrans-TF-LargeUnknownUnknownUnknown22
379ConvNeXt V2 HugeMeta650MCNN22
380CV-GroupUnknownUnknownUnknown12
381Decouple Attention NetworkUnknownUnknownUnknown12
382DeepPyramidionUnknownUnknownUnknown22
383DeepSeek-OCR-2———22
384DEERUnknownUnknownUnknown12
385DeiT-B DistilledMeta86MVision Transformer22
386DINO (ViT-B/8)———22
387DINO-XIDEA ResearchUnknownUnified vision model with DINO-based detection head + large language model12
388DNTextSpotter (ResNet-50)Academic—Denoising Transformer, ResNet-50 backbone12
389DNTextSpotter (ViTAEv2-S)Academic—Denoising Transformer, ViTAEv2-S backbone12
390dots.mocr———22
391DRetHTR-baseUnknownUnknownDecoder-only Retentive Network (RetNet)12
392DTrOCRUnknownUnknownUnknown22
393EfficientNet-B7Google66MCNN22
394EVA-02-LBAAI / PKU—ViT-L with EVA-CLIP pre-training (O365 + ImageNet-21K)12
395Falcon-OCR———22
396FA+RL———12
397Faster R-CNN (VGG-16)Microsoft~137MTwo-stage detector: RPN + Fast R-CNN with VGG-16 backbone12
398Field-gating Seq2seq + dual attentionUnknownUnknownUnknown12
399Field-gating Seq2seq + dual attention + beam searchUnknownUnknownUnknown12
400Florence-2-LargeMicrosoft——12