ModelVerdict

Benchmarks indépendants des modèles d'IA sur des tâches d'entreprise

Quel modèle traite vos documents, dans votre langue, et combien cela coûte-t-il vraiment ?

Chaque semaine, nous soumettons des modèles commerciaux et ouverts aux mêmes tâches d'entreprise : factures, e-mails clients, données personnelles et contrats, puis résumés et questions sur des documents. Chaque chiffre renvoie à la sortie réelle du modèle et à son coût réel, correction de ses erreurs comprise.

Dernière exécution 28 septembre 2026 · 10 modèles · documents : Anglais (US), Tchèque, Allemand

Classements par tâche

Trié par précision. Les coûts intègrent déjà la taxe linguistique sur les tokens. Seuil : 95 %.

#ModèlePrécisionPour 1 000Taxe linguistiqueDonnées dans l'UE
1GPT-6 Sol
OpenAI
99,9 %atteint le seuil
8,88 €×1,00Oui
2Claude Sonnet 5
Anthropic
99,8 %atteint le seuil
8,13 €×1,00Oui
3Gemini 3.8 Flash
Google
99,8 %atteint le seuil
3,53 €×1,00Non
4GPT-6 Luna
OpenAI
99,7 %atteint le seuil
0,47 €×1,00Oui
5DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,4 %atteint le seuil
0,48 €×1,00Auto-hébergement uniquement
6Gemini 3.5 Flash Lite
Google
99,2 %atteint le seuil
0,80 €×1,00Oui
7Mistral Medium 3.5
Mistral
97,8 %atteint le seuil
4,02 €×1,00Oui
8Gemma 4 31B
Google · poids ouverts
97,6 %atteint le seuil
0,15 €×1,00Auto-hébergement uniquement
9Mistral Small 4
Mistral · poids ouverts
95,6 %atteint le seuil
0,37 €—Oui
10Qwen3.8 Flash
Qwen
82,4 %sous le seuil
1,06 €×1,00Non

Classement complet et filtres →