Codesota · Models · Qwen2.5-3BQwen10 results · 1 benchmarks
Model card

Qwen2.5-3B.

Qwenopen-source
§ 02 · Benchmarks

Every benchmark Qwen2.5-3B has a recorded score for.

#BenchmarkArea · TaskMetricValueRankDateSource
01Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalbelebele78.3%#155/490—source ↗
02Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalklej-ner-generative45.7%#156/489—source ↗
03Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalppc73.3%#156/490—source ↗
04Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalaverage44.6%#161/491—source ↗
05Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalpoquad-open-book56.7%#224/337—source ↗
06Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generaldyk46.5%#241/489—source ↗
07Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalklej-ner-mc39.9%#252/490—source ↗
08Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalcbd20.0%#327/490—source ↗
09Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalpolqa-open-book75.7%#348/489—source ↗
10Open PL LLM LeaderboardNatural Language Processing · Polish LLM Generalpolemo2-in67.7%#396/490—source ↗
Rank column shows this model’s position vs all other models scored on the same benchmark + metric (competitors after the slash). #1 in red means current SOTA. Sorted by rank, then newest result.
§ 03 · Strengths by area

Where Qwen2.5-3B actually performs.

Natural Language Processing
1
benchmark
avg rank #241.6
§ 05 · Related models

Other Qwen models scored on Codesota.

Qwen/Qwen1.5-72B-Chat
72.3B params · 17 results
Qwen/Qwen2.5-14B-Instruct
14.8B params · 17 results
Qwen/Qwen2.5-1.5B-Instruct
1.54B params · 17 results
Qwen/Qwen2.5-32B-Instruct
32.8B params · 17 results
Qwen/Qwen2.5-3B-Instruct
3.09B params · 17 results
Qwen/Qwen2.5-72B-Instruct
72.7B params · 17 results
Qwen/Qwen2.5-7B-Instruct
7.62B params · 17 results
Qwen/Qwen2-72B-Instruct
72.7B params · 17 results
§ 06 · Sources & freshness

Where these numbers come from.

speakleash/open_pl_llm_leaderboard
10
results
10 of 10 rows marked verified.