ModelVerdict

Nezávislé měření AI modelů na firemní práci

Který model zvládne vaši práci v češtině a kolik vás to bude stát?

Každý týden necháme komerční i otevřené modely řešit stejné firemní úlohy: faktury, e-maily od zákazníků, osobní údaje a smlouvy, dále shrnutí a otázky nad dokumenty. Každé číslo vede ke skutečnému výstupu modelu a k tomu, kolik doopravdy stojí, včetně oprav jeho chyb.

Poslední běh 28. září 2026 · 10 modelů · dokumenty: čeština, angličtina (USA), němčina

Žebříčky podle úlohy

Seřazeno podle přesnosti. Cena už zahrnuje jazykovou daň na tokeny. Laťka: 95 %.

#ModelPřesnostZa 1000 ksJazyková daňData v EU
1Claude Sonnet 5
Anthropic
100,0 %splní laťku
216,47 Kč×1,52Ano
2Gemini 3.8 Flash
Google
100,0 %splní laťku
97,96 Kč×1,64Ne
3DeepSeek V4.1 Flash
DeepSeek · otevřené váhy
99,9 %splní laťku
11,41 Kč×1,85Jen self-host
4GPT-6 Sol
OpenAI
99,9 %splní laťku
232,70 Kč×1,71Ano
5Gemini 3.5 Flash Lite
Google
99,5 %splní laťku
23,72 Kč×1,64Ano
6GPT-6 Luna
OpenAI
99,3 %splní laťku
11,62 Kč×1,71Ano
7Gemma 4 31B
Google · otevřené váhy
96,1 %splní laťku
4,87 Kč×1,64Jen self-host
8Mistral Small 4
Mistral · otevřené váhy
93,6 %pod laťkou
10,06 Kč—Ano
9Mistral Medium 3.5
Mistral
93,5 %pod laťkou
107,82 Kč×1,73Ano
10Qwen3.8 Flash
Qwen
91,8 %pod laťkou
23,43 Kč×1,66Ne

Celý žebříček a filtry →