ModelVerdict

Classement

Qui réalise le mieux votre tâche

Trié par part de champs corrects. Le coût correspond à la consommation réelle de tokens, ramenée à 1 000 documents. Seuil : 95 % de champs corrects ; en dessous, les corrections manuelles coûtent plus cher que ce qu'un modèle moins cher permet d'économiser.

Comparer deux modèles côte à côte →

Extraction de factures · Tchèque · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %8,66 €03,6 s100,0 %atteint le seuil—
2Gemini 3.8 Flash
Google
100,0 %99 %3,92 €73,5 s100,0 %atteint le seuilvaleur erronée
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,9 %99 %0,46 €135,0 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Sol
OpenAI
99,9 %99 %9,31 €133,9 s100,0 %atteint le seuilvaleur erronée
5Gemini 3.5 Flash Lite
Google
99,5 %93 %0,95 €671,8 s100,0 %atteint le seuilvaleur inventée
6GPT-6 Luna
OpenAI
99,3 %93 %0,46 €673,2 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
96,1 %67 %0,19 €33310,4 s100,0 %atteint le seuilvaleur erronée
8Mistral Small 4
Mistral · poids ouverts
93,6 %56 %0,40 €4402,0 s100,0 %sous le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
93,5 %63 %4,31 €3672,6 s100,0 %sous le seuilvaleur erronée
10Qwen3.8 Flash
Qwen
91,8 %77 %0,94 €23317,0 s96,7 %sous le seuilJSON invalide

Extraction de factures · Tchèque · Texte PDF (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %4,48 €02,7 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,46 €06,0 s100,0 %atteint le seuil—
3Gemini 3.5 Flash Lite
Google
100,0 %100 %0,84 €01,1 s100,0 %atteint le seuil—
4Gemini 3.8 Flash
Google
100,0 %100 %3,18 €02,8 s100,0 %atteint le seuil—
5GPT-6 Luna
OpenAI
100,0 %100 %0,19 €02,6 s100,0 %atteint le seuil—
6GPT-6 Sol
OpenAI
100,0 %100 %3,69 €02,8 s100,0 %atteint le seuil—
7Mistral Medium 3.5
Mistral
99,8 %98 %2,73 €221,5 s100,0 %atteint le seuilchamp manquant
8Gemma 4 31B
Google · poids ouverts
99,5 %93 %0,22 €679,0 s100,0 %atteint le seuilchamp manquant
9Mistral Small 4
Mistral · poids ouverts
96,8 %76 %0,23 €2441,4 s100,0 %atteint le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
92,0 %53 %0,68 €46719,9 s100,0 %sous le seuilvaleur erronée

Extraction de factures · Tchèque · Image nette (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %12,14 €03,8 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,45 €04,4 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
100,0 %100 %4,24 €04,0 s100,0 %atteint le seuil—
4GPT-6 Sol
OpenAI
100,0 %100 %13,40 €03,9 s100,0 %atteint le seuil—
5GPT-6 Luna
OpenAI
99,7 %96 %0,67 €443,6 s100,0 %atteint le seuilvaleur erronée
6Gemini 3.5 Flash Lite
Google
99,5 %93 %0,99 €672,0 s100,0 %atteint le seuilvaleur inventée
7Gemma 4 31B
Google · poids ouverts
95,4 %62 %0,18 €37811,0 s100,0 %atteint le seuilvaleur erronée
8Qwen3.8 Flash
Qwen
92,7 %84 %1,02 €15615,9 s95,6 %sous le seuilJSON invalide
9Mistral Small 4
Mistral · poids ouverts
92,3 %44 %0,47 €5561,9 s100,0 %sous le seuilvaleur inventée
10Mistral Medium 3.5
Mistral
92,1 %60 %4,94 €4002,5 s100,0 %sous le seuilvaleur erronée

Extraction de factures · Tchèque · Scan (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %9,65 €03,7 s100,0 %atteint le seuil—
2Gemini 3.8 Flash
Google
99,8 %98 %4,24 €223,5 s100,0 %atteint le seuilvaleur erronée
3GPT-6 Sol
OpenAI
99,8 %98 %10,94 €224,2 s100,0 %atteint le seuilvaleur erronée
4DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,7 %96 %0,45 €444,8 s100,0 %atteint le seuilvaleur erronée
5Gemini 3.5 Flash Lite
Google
99,0 %87 %0,99 €1331,8 s100,0 %atteint le seuilvaleur erronée
6GPT-6 Luna
OpenAI
98,3 %87 %0,54 €1333,4 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
94,9 %56 %0,18 €44411,9 s100,0 %sous le seuilvaleur erronée
8Mistral Small 4
Mistral · poids ouverts
92,1 %47 %0,47 €5332,6 s100,0 %sous le seuilvaleur erronée
9Qwen3.8 Flash
Qwen
90,9 %89 %1,08 €11115,4 s93,3 %sous le seuilJSON invalide
10Mistral Medium 3.5
Mistral
89,1 %36 %4,97 €6442,9 s100,0 %sous le seuilvaleur erronée

Extraction de factures · Tchèque · Photo (15 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %7,77 €03,9 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,49 €05,4 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
100,0 %100 %4,16 €03,4 s100,0 %atteint le seuil—
4Gemini 3.5 Flash Lite
Google
99,5 %93 %1,03 €671,8 s100,0 %atteint le seuilvaleur inventée
5GPT-6 Sol
OpenAI
99,5 %93 %8,98 €674,9 s100,0 %atteint le seuilvaleur erronée
6GPT-6 Luna
OpenAI
99,0 %87 %0,43 €1333,3 s100,0 %atteint le seuilvaleur erronée
7Mistral Small 4
Mistral · poids ouverts
92,8 %60 %0,49 €4002,9 s100,0 %sous le seuilvaleur erronée
8Gemma 4 31B
Google · poids ouverts
91,8 %33 %0,19 €66711,0 s100,0 %sous le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
91,8 %53 %5,19 €4673,0 s100,0 %sous le seuilvaleur erronée
10Qwen3.8 Flash
Qwen
91,3 %87 %1,02 €13315,4 s100,0 %sous le seuilchamp manquant

Extraction de factures · Allemand · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.5 Flash Lite
Google
100,0 %100 %0,95 €01,5 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %99 %9,80 €74,9 s100,0 %atteint le seuilvaleur erronée
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,5 %94 %0,52 €606,4 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Luna
OpenAI
99,2 %91 %0,50 €873,7 s100,0 %atteint le seuilvaleur erronée
5Claude Sonnet 5
Anthropic
99,0 %87 %9,58 €1333,8 s100,0 %atteint le seuilchamp manquant
6Mistral Medium 3.5
Mistral
97,4 %75 %4,34 €2532,5 s100,0 %atteint le seuilvaleur inventée
7Gemini 3.8 Flash
Google
97,2 %96 %6,58 €404,7 s97,3 %atteint le seuilJSON invalide
8Gemma 4 31B
Google · poids ouverts
94,9 %64 %0,18 €3607,7 s100,0 %sous le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
94,5 %49 %0,40 €5082,0 s100,0 %sous le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
93,5 %87 %1,03 €12719,0 s94,0 %sous le seuilJSON invalide

Extraction de factures · Allemand · Texte PDF (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,45 €06,7 s100,0 %atteint le seuil—
2Gemini 3.5 Flash Lite
Google
100,0 %100 %0,84 €01,1 s100,0 %atteint le seuil—
3GPT-6 Luna
OpenAI
100,0 %100 %0,20 €03,0 s100,0 %atteint le seuil—
4GPT-6 Sol
OpenAI
100,0 %100 %3,54 €03,1 s100,0 %atteint le seuil—
5Qwen3.8 Flash
Qwen
100,0 %100 %0,91 €027,8 s100,0 %atteint le seuil—
6Gemma 4 31B
Google · poids ouverts
99,5 %93 %0,21 €677,0 s100,0 %atteint le seuilchamp manquant
7Mistral Medium 3.5
Mistral
99,5 %93 %2,72 €671,4 s100,0 %atteint le seuilchamp manquant
8Claude Sonnet 5
Anthropic
99,3 %91 %5,42 €893,3 s100,0 %atteint le seuilchamp manquant
9Mistral Small 4
Mistral · poids ouverts
97,9 %80 %0,23 €2001,3 s100,0 %atteint le seuilvaleur inventée
10Gemini 3.8 Flash
Google
97,8 %98 %5,74 €223,9 s97,8 %atteint le seuilJSON invalide

Extraction de factures · Allemand · Image nette (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.5 Flash Lite
Google
100,0 %100 %0,99 €01,7 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %100 %14,04 €05,6 s100,0 %atteint le seuil—
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,7 %96 %0,51 €445,7 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Luna
OpenAI
99,7 %96 %0,71 €444,1 s100,0 %atteint le seuilvaleur erronée
5Claude Sonnet 5
Anthropic
99,0 %87 %12,21 €1333,8 s100,0 %atteint le seuilchamp manquant
6Mistral Medium 3.5
Mistral
96,6 %69 %5,00 €3112,5 s100,0 %atteint le seuilvaleur inventée
7Gemini 3.8 Flash
Google
95,2 %91 %8,10 €895,1 s95,6 %atteint le seuilJSON invalide
8Gemma 4 31B
Google · poids ouverts
93,9 %51 %0,17 €4897,4 s100,0 %sous le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
93,4 %36 %0,47 €6431,8 s100,0 %sous le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
88,4 %82 %1,16 €17816,7 s88,9 %sous le seuilJSON invalide

Extraction de factures · Allemand · Scan (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.5 Flash Lite
Google
100,0 %100 %0,99 €01,6 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
99,8 %98 %12,10 €225,1 s100,0 %atteint le seuilvaleur erronée
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,0 %87 %0,56 €1337,2 s100,0 %atteint le seuilvaleur erronée
4Claude Sonnet 5
Anthropic
98,6 %82 %10,93 €1783,8 s100,0 %atteint le seuilchamp manquant
5GPT-6 Luna
OpenAI
98,3 %82 %0,61 €1784,1 s100,0 %atteint le seuilvaleur erronée
6Gemini 3.8 Flash
Google
97,8 %98 %6,12 €225,0 s97,8 %atteint le seuilJSON invalide
7Mistral Medium 3.5
Mistral
96,9 %67 %5,02 €3332,8 s100,0 %atteint le seuilvaleur inventée
8Qwen3.8 Flash
Qwen
96,9 %87 %1,06 €13316,6 s97,8 %atteint le seuilJSON invalide
9Mistral Small 4
Mistral · poids ouverts
92,5 %33 %0,47 €6672,4 s100,0 %sous le seuilvaleur inventée
10Gemma 4 31B
Google · poids ouverts
91,8 %51 %0,17 €4898,7 s100,0 %sous le seuilvaleur erronée

Extraction de factures · Allemand · Photo (15 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.5 Flash Lite
Google
100,0 %100 %1,02 €01,6 s100,0 %atteint le seuil—
2Gemini 3.8 Flash
Google
100,0 %100 %5,93 €04,8 s100,0 %atteint le seuil—
3GPT-6 Sol
OpenAI
100,0 %100 %8,95 €05,4 s100,0 %atteint le seuil—
4DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,5 %93 %0,64 €676,4 s100,0 %atteint le seuildates inversées
5Claude Sonnet 5
Anthropic
99,0 %87 %10,17 €1333,8 s100,0 %atteint le seuilvaleur erronée
6GPT-6 Luna
OpenAI
98,5 %80 %0,46 €2003,5 s100,0 %atteint le seuilvaleur erronée
7Mistral Medium 3.5
Mistral
94,9 %60 %5,22 €4002,7 s100,0 %sous le seuilvaleur erronée
8Mistral Small 4
Mistral · poids ouverts
93,5 %46 %0,49 €5392,5 s100,0 %sous le seuilvaleur inventée
9Gemma 4 31B
Google · poids ouverts
93,3 %53 %0,17 €4679,1 s100,0 %sous le seuilvaleur erronée
10Qwen3.8 Flash
Qwen
79,0 %67 %0,91 €33315,6 s80,0 %sous le seuilJSON invalide

Extraction de factures · Anglais (US) · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1GPT-6 Sol
OpenAI
99,9 %99 %8,88 €74,1 s100,0 %atteint le seuilvaleur erronée
2Claude Sonnet 5
Anthropic
99,8 %99 %8,13 €133,2 s100,0 %atteint le seuilvaleur erronée
3Gemini 3.8 Flash
Google
99,8 %98 %3,53 €203,2 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Luna
OpenAI
99,7 %97 %0,47 €333,4 s100,0 %atteint le seuilvaleur inventée
5DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,4 %93 %0,48 €675,7 s100,0 %atteint le seuilvaleur erronée
6Gemini 3.5 Flash Lite
Google
99,2 %92 %0,80 €801,7 s100,0 %atteint le seuilvaleur erronée
7Mistral Medium 3.5
Mistral
97,8 %79 %4,02 €2072,3 s100,0 %atteint le seuilvaleur erronée
8Gemma 4 31B
Google · poids ouverts
97,6 %81 %0,15 €1878,9 s100,0 %atteint le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
95,6 %58 %0,37 €4201,8 s100,0 %atteint le seuilmauvais taux
10Qwen3.8 Flash
Qwen
82,4 %57 %1,06 €42717,4 s90,7 %sous le seuilJSON invalide

Extraction de factures · Anglais (US) · Texte PDF (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,47 €07,4 s100,0 %atteint le seuil—
2Gemini 3.8 Flash
Google
100,0 %100 %2,69 €02,3 s100,0 %atteint le seuil—
3Gemma 4 31B
Google · poids ouverts
100,0 %100 %0,17 €07,4 s100,0 %atteint le seuil—
4GPT-6 Luna
OpenAI
100,0 %100 %0,17 €02,7 s100,0 %atteint le seuil—
5GPT-6 Sol
OpenAI
100,0 %100 %3,02 €03,2 s100,0 %atteint le seuil—
6Claude Sonnet 5
Anthropic
99,8 %98 %3,60 €222,4 s100,0 %atteint le seuilchamp manquant
7Mistral Medium 3.5
Mistral
99,8 %98 %2,06 €221,2 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
99,4 %96 %0,66 €441,0 s100,0 %atteint le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
98,4 %84 %0,17 €1561,2 s100,0 %atteint le seuilvaleur erronée
10Qwen3.8 Flash
Qwen
91,7 %49 %0,89 €51118,7 s100,0 %sous le seuilmauvais taux

Extraction de factures · Anglais (US) · Image nette (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %11,21 €03,3 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %100 %12,70 €04,2 s100,0 %atteint le seuil—
3Gemini 3.5 Flash Lite
Google
99,6 %96 %0,85 €441,8 s100,0 %atteint le seuilvaleur inventée
4Gemini 3.8 Flash
Google
99,6 %96 %3,80 €443,5 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
99,6 %96 %0,67 €443,8 s100,0 %atteint le seuilvaleur inventée
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,2 %91 %0,46 €894,6 s100,0 %atteint le seuilvaleur inventée
7Gemma 4 31B
Google · poids ouverts
98,2 %84 %0,15 €1569,2 s100,0 %atteint le seuilvaleur erronée
8Mistral Medium 3.5
Mistral
98,0 %82 %4,83 €1782,3 s100,0 %atteint le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
95,6 %56 %0,46 €4441,7 s100,0 %atteint le seuilmauvais taux
10Qwen3.8 Flash
Qwen
77,2 %60 %1,04 €40015,2 s86,7 %sous le seuilJSON invalide

Extraction de factures · Anglais (US) · Scan (45 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %9,80 €03,3 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %100 %11,08 €04,3 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
99,8 %98 %4,01 €223,2 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Luna
OpenAI
99,6 %96 %0,58 €443,7 s100,0 %atteint le seuilvaleur erronée
5DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,0 %89 %0,50 €1115,4 s100,0 %atteint le seuilvaleur erronée
6Gemini 3.5 Flash Lite
Google
98,8 %87 %0,86 €1331,8 s100,0 %atteint le seuilvaleur inventée
7Gemma 4 31B
Google · poids ouverts
96,6 %73 %0,15 €2679,8 s100,0 %atteint le seuilvaleur erronée
8Mistral Medium 3.5
Mistral
96,0 %62 %4,85 €3782,8 s100,0 %atteint le seuilvaleur erronée
9Mistral Small 4
Mistral · poids ouverts
93,5 %38 %0,46 €6222,3 s100,0 %sous le seuilmauvais taux
10Qwen3.8 Flash
Qwen
81,4 %60 %1,24 €40017,4 s91,1 %sous le seuilJSON invalide

Extraction de factures · Anglais (US) · Photo (15 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.8 Flash
Google
100,0 %100 %3,80 €03,4 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,4 %93 %0,48 €675,3 s100,0 %atteint le seuilvaleur erronée
3GPT-6 Luna
OpenAI
99,4 %93 %0,44 €673,7 s100,0 %atteint le seuilvaleur erronée
4GPT-6 Sol
OpenAI
99,4 %93 %8,35 €674,9 s100,0 %atteint le seuilvaleur erronée
5Claude Sonnet 5
Anthropic
98,8 %93 %7,44 €673,2 s100,0 %atteint le seuilvaleur erronée
6Gemini 3.5 Flash Lite
Google
98,8 %87 %0,86 €1331,7 s100,0 %atteint le seuilvaleur erronée
7Mistral Medium 3.5
Mistral
96,4 %67 %5,00 €3332,8 s100,0 %atteint le seuilvaleur erronée
8Mistral Small 4
Mistral · poids ouverts
93,3 %47 %0,47 €5332,6 s100,0 %sous le seuilvaleur erronée
9Gemma 4 31B
Google · poids ouverts
92,1 %40 %0,15 €60010,4 s100,0 %sous le seuilvaleur erronée
10Qwen3.8 Flash
Qwen
72,7 %67 %1,10 €33319,6 s73,3 %sous le seuilJSON invalide

Tri des e-mails · Tchèque · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.8 Flash
Google
99,2 %93 %2,82 €732,6 s100,0 %atteint le seuilvaleur erronée
2GPT-6 Sol
OpenAI
99,0 %91 %2,94 €932,8 s100,0 %atteint le seuilvaleur erronée
3Qwen3.8 Flash
Qwen
98,5 %87 %0,41 €13313,0 s100,0 %atteint le seuilvaleur erronée
4Claude Sonnet 5
Anthropic
98,2 %83 %4,52 €1674,7 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,9 %81 %0,16 €1872,6 s100,0 %atteint le seuilvaleur erronée
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,4 %77 %0,27 €2274,2 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
97,1 %75 %0,15 €2532,5 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
95,8 %64 %0,47 €3600,7 s100,0 %atteint le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
94,5 %55 %1,79 €4470,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
87,7 %32 %0,11 €6850,8 s100,0 %sous le seuilvaleur erronée

Tri des e-mails · Tchèque · E-mail (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.8 Flash
Google
99,2 %93 %2,82 €732,6 s100,0 %atteint le seuilvaleur erronée
2GPT-6 Sol
OpenAI
99,0 %91 %2,94 €932,8 s100,0 %atteint le seuilvaleur erronée
3Qwen3.8 Flash
Qwen
98,5 %87 %0,41 €13313,0 s100,0 %atteint le seuilvaleur erronée
4Claude Sonnet 5
Anthropic
98,2 %83 %4,52 €1674,7 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,9 %81 %0,16 €1872,6 s100,0 %atteint le seuilvaleur erronée
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,4 %77 %0,27 €2274,2 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
97,1 %75 %0,15 €2532,5 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
95,8 %64 %0,47 €3600,7 s100,0 %atteint le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
94,5 %55 %1,79 €4470,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
87,7 %32 %0,11 €6850,8 s100,0 %sous le seuilvaleur erronée

Tri des e-mails · Allemand · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.8 Flash
Google
98,4 %85 %2,52 €1472,9 s100,0 %atteint le seuilvaleur erronée
2GPT-6 Sol
OpenAI
98,2 %84 %2,51 €1602,9 s100,0 %atteint le seuilvaleur erronée
3Claude Sonnet 5
Anthropic
97,9 %81 %4,70 €1874,3 s100,0 %atteint le seuilvaleur erronée
4Qwen3.8 Flash
Qwen
97,9 %81 %0,36 €18712,1 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,0 %73 %0,14 €2732,8 s100,0 %atteint le seuilvaleur erronée
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
96,3 %68 %0,28 €3244,2 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
95,1 %62 %0,14 €3803,6 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
94,7 %57 %0,44 €4330,8 s100,0 %sous le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
92,7 %48 %1,63 €5200,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
87,1 %29 %0,10 €7060,8 s100,0 %sous le seuilvaleur erronée

Tri des e-mails · Allemand · E-mail (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemini 3.8 Flash
Google
98,4 %85 %2,52 €1472,9 s100,0 %atteint le seuilvaleur erronée
2GPT-6 Sol
OpenAI
98,2 %84 %2,51 €1602,9 s100,0 %atteint le seuilvaleur erronée
3Claude Sonnet 5
Anthropic
97,9 %81 %4,70 €1874,3 s100,0 %atteint le seuilvaleur erronée
4Qwen3.8 Flash
Qwen
97,9 %81 %0,36 €18712,1 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,0 %73 %0,14 €2732,8 s100,0 %atteint le seuilvaleur erronée
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
96,3 %68 %0,28 €3244,2 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
95,1 %62 %0,14 €3803,6 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
94,7 %57 %0,44 €4330,8 s100,0 %sous le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
92,7 %48 %1,63 €5200,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
87,1 %29 %0,10 €7060,8 s100,0 %sous le seuilvaleur erronée

Tri des e-mails · Anglais (US) · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1GPT-6 Sol
OpenAI
99,0 %92 %2,24 €802,8 s100,0 %atteint le seuilvaleur erronée
2Gemini 3.8 Flash
Google
98,7 %89 %2,19 €1132,2 s100,0 %atteint le seuilvaleur erronée
3Claude Sonnet 5
Anthropic
98,2 %84 %3,69 €1603,8 s100,0 %atteint le seuilvaleur erronée
4DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,6 %79 %0,21 €2133,8 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,5 %77 %0,12 €2272,5 s100,0 %atteint le seuilvaleur erronée
6Qwen3.8 Flash
Qwen
97,5 %79 %0,28 €2138,9 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
96,5 %72 %0,11 €2802,2 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
96,3 %69 %0,39 €3130,7 s100,0 %atteint le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
94,9 %57 %1,36 €4270,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
89,7 %37 %0,09 €6270,8 s100,0 %sous le seuilvaleur erronée

Tri des e-mails · Anglais (US) · E-mail (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1GPT-6 Sol
OpenAI
99,0 %92 %2,24 €802,8 s100,0 %atteint le seuilvaleur erronée
2Gemini 3.8 Flash
Google
98,7 %89 %2,19 €1132,2 s100,0 %atteint le seuilvaleur erronée
3Claude Sonnet 5
Anthropic
98,2 %84 %3,69 €1603,8 s100,0 %atteint le seuilvaleur erronée
4DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,6 %79 %0,21 €2133,8 s100,0 %atteint le seuilvaleur erronée
5GPT-6 Luna
OpenAI
97,5 %77 %0,12 €2272,5 s100,0 %atteint le seuilvaleur erronée
6Qwen3.8 Flash
Qwen
97,5 %79 %0,28 €2138,9 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
96,5 %72 %0,11 €2802,2 s100,0 %atteint le seuilvaleur erronée
8Gemini 3.5 Flash Lite
Google
96,3 %69 %0,39 €3130,7 s100,0 %atteint le seuilvaleur erronée
9Mistral Medium 3.5
Mistral
94,9 %57 %1,36 €4270,8 s100,0 %sous le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
89,7 %37 %0,09 €6270,8 s100,0 %sous le seuilvaleur erronée

Clauses contractuelles · Tchèque · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %5,57 €03,6 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,39 €04,3 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
100,0 %100 %2,84 €02,2 s100,0 %atteint le seuil—
4Mistral Medium 3.5
Mistral
100,0 %100 %2,81 €01,2 s100,0 %atteint le seuil—
5GPT-6 Luna
OpenAI
100,0 %100 %0,25 €02,6 s100,0 %atteint le seuil—
6GPT-6 Sol
OpenAI
100,0 %100 %4,25 €02,0 s100,0 %atteint le seuil—
7Gemma 4 31B
Google · poids ouverts
100,0 %99 %0,23 €76,0 s100,0 %atteint le seuilvaleur erronée
8Qwen3.8 Flash
Qwen
99,9 %99 %0,58 €1313,6 s100,0 %atteint le seuilvaleur erronée
9Gemini 3.5 Flash Lite
Google
99,9 %98 %0,78 €200,9 s100,0 %atteint le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
99,0 %92 %0,21 €801,2 s100,0 %atteint le seuilvaleur erronée

Clauses contractuelles · Tchèque · Texte du contrat (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %5,57 €03,6 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,39 €04,3 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
100,0 %100 %2,84 €02,2 s100,0 %atteint le seuil—
4Mistral Medium 3.5
Mistral
100,0 %100 %2,81 €01,2 s100,0 %atteint le seuil—
5GPT-6 Luna
OpenAI
100,0 %100 %0,25 €02,6 s100,0 %atteint le seuil—
6GPT-6 Sol
OpenAI
100,0 %100 %4,25 €02,0 s100,0 %atteint le seuil—
7Gemma 4 31B
Google · poids ouverts
100,0 %99 %0,23 €76,0 s100,0 %atteint le seuilvaleur erronée
8Qwen3.8 Flash
Qwen
99,9 %99 %0,58 €1313,6 s100,0 %atteint le seuilvaleur erronée
9Gemini 3.5 Flash Lite
Google
99,9 %98 %0,78 €200,9 s100,0 %atteint le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
99,0 %92 %0,21 €801,2 s100,0 %atteint le seuilvaleur erronée

Clauses contractuelles · Allemand · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1GPT-6 Luna
OpenAI
100,0 %100 %0,24 €03,0 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %100 %4,01 €02,9 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
99,9 %99 %3,14 €72,6 s100,0 %atteint le seuilvaleur inventée
4Claude Sonnet 5
Anthropic
98,2 %87 %6,54 €1334,3 s100,0 %atteint le seuilvaleur inventée
5Gemini 3.5 Flash Lite
Google
98,0 %84 %0,73 €1601,0 s100,0 %atteint le seuilvaleur inventée
6Qwen3.8 Flash
Qwen
98,0 %87 %0,72 €12719,7 s99,3 %atteint le seuilvaleur inventée
7DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,2 %77 %0,47 €2284,6 s100,0 %atteint le seuilvaleur inventée
8Mistral Medium 3.5
Mistral
97,1 %75 %2,54 €2471,2 s100,0 %atteint le seuilvaleur inventée
9Gemma 4 31B
Google · poids ouverts
94,4 %27 %0,20 €7272,6 s100,0 %sous le seuilformat numérique
10Mistral Small 4
Mistral · poids ouverts
94,0 %45 %0,19 €5531,2 s100,0 %sous le seuilvaleur inventée

Clauses contractuelles · Allemand · Texte du contrat (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1GPT-6 Luna
OpenAI
100,0 %100 %0,24 €03,0 s100,0 %atteint le seuil—
2GPT-6 Sol
OpenAI
100,0 %100 %4,01 €02,9 s100,0 %atteint le seuil—
3Gemini 3.8 Flash
Google
99,9 %99 %3,14 €72,6 s100,0 %atteint le seuilvaleur inventée
4Claude Sonnet 5
Anthropic
98,2 %87 %6,54 €1334,3 s100,0 %atteint le seuilvaleur inventée
5Gemini 3.5 Flash Lite
Google
98,0 %84 %0,73 €1601,0 s100,0 %atteint le seuilvaleur inventée
6Qwen3.8 Flash
Qwen
98,0 %87 %0,72 €12719,7 s99,3 %atteint le seuilvaleur inventée
7DeepSeek V4.1 Flash
DeepSeek · poids ouverts
97,2 %77 %0,47 €2284,6 s100,0 %atteint le seuilvaleur inventée
8Mistral Medium 3.5
Mistral
97,1 %75 %2,54 €2471,2 s100,0 %atteint le seuilvaleur inventée
9Gemma 4 31B
Google · poids ouverts
94,4 %27 %0,20 €7272,6 s100,0 %sous le seuilformat numérique
10Mistral Small 4
Mistral · poids ouverts
94,0 %45 %0,19 €5531,2 s100,0 %sous le seuilvaleur inventée

Clauses contractuelles · Anglais (US) · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %4,64 €03,4 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,29 €03,9 s100,0 %atteint le seuil—
3GPT-6 Sol
OpenAI
100,0 %100 %3,06 €02,5 s100,0 %atteint le seuil—
4Gemini 3.5 Flash Lite
Google
100,0 %99 %0,64 €71,0 s100,0 %atteint le seuilvaleur erronée
5Gemini 3.8 Flash
Google
99,9 %99 %2,27 €72,0 s100,0 %atteint le seuilvaleur erronée
6GPT-6 Luna
OpenAI
99,8 %99 %0,18 €132,7 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
99,6 %97 %0,17 €272,5 s100,0 %atteint le seuilvaleur erronée
8Mistral Medium 3.5
Mistral
98,1 %87 %2,16 €1271,1 s100,0 %atteint le seuilvaleur erronée
9Qwen3.8 Flash
Qwen
95,1 %69 %0,57 €30714,1 s100,0 %atteint le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
91,5 %43 %0,16 €5671,1 s100,0 %sous le seuilvaleur erronée

Clauses contractuelles · Anglais (US) · Texte du contrat (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Claude Sonnet 5
Anthropic
100,0 %100 %4,64 €03,4 s100,0 %atteint le seuil—
2DeepSeek V4.1 Flash
DeepSeek · poids ouverts
100,0 %100 %0,29 €03,9 s100,0 %atteint le seuil—
3GPT-6 Sol
OpenAI
100,0 %100 %3,06 €02,5 s100,0 %atteint le seuil—
4Gemini 3.5 Flash Lite
Google
100,0 %99 %0,64 €71,0 s100,0 %atteint le seuilvaleur erronée
5Gemini 3.8 Flash
Google
99,9 %99 %2,27 €72,0 s100,0 %atteint le seuilvaleur erronée
6GPT-6 Luna
OpenAI
99,8 %99 %0,18 €132,7 s100,0 %atteint le seuilvaleur erronée
7Gemma 4 31B
Google · poids ouverts
99,6 %97 %0,17 €272,5 s100,0 %atteint le seuilvaleur erronée
8Mistral Medium 3.5
Mistral
98,1 %87 %2,16 €1271,1 s100,0 %atteint le seuilvaleur erronée
9Qwen3.8 Flash
Qwen
95,1 %69 %0,57 €30714,1 s100,0 %atteint le seuilvaleur erronée
10Mistral Small 4
Mistral · poids ouverts
91,5 %43 %0,16 €5671,1 s100,0 %sous le seuilvaleur erronée

Détection des données personnelles · Tchèque · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemma 4 31B
Google · poids ouverts
99,8 %99 %0,11 €132,9 s100,0 %atteint le seuilchamp manquant
2Mistral Medium 3.5
Mistral
99,8 %99 %1,29 €130,8 s100,0 %atteint le seuilvaleur inventée
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,7 %98 %0,29 €204,2 s100,0 %atteint le seuilchamp manquant
4GPT-6 Sol
OpenAI
99,7 %98 %2,04 €202,5 s100,0 %atteint le seuilchamp manquant
5GPT-6 Luna
OpenAI
99,6 %97 %0,11 €271,8 s100,0 %atteint le seuilchamp manquant
6Gemini 3.8 Flash
Google
99,5 %97 %2,01 €332,0 s100,0 %atteint le seuilchamp manquant
7Claude Sonnet 5
Anthropic
98,9 %92 %3,73 €803,2 s100,0 %atteint le seuilvaleur inventée
8Mistral Small 4
Mistral · poids ouverts
98,8 %92 %0,09 €810,9 s100,0 %atteint le seuilvaleur inventée
9Gemini 3.5 Flash Lite
Google
98,1 %88 %0,42 €1200,8 s100,0 %atteint le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
97,0 %89 %0,37 €1139,6 s99,3 %atteint le seuilvaleur erronée

Détection des données personnelles · Tchèque · Texte (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemma 4 31B
Google · poids ouverts
99,8 %99 %0,11 €132,9 s100,0 %atteint le seuilchamp manquant
2Mistral Medium 3.5
Mistral
99,8 %99 %1,29 €130,8 s100,0 %atteint le seuilvaleur inventée
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,7 %98 %0,29 €204,2 s100,0 %atteint le seuilchamp manquant
4GPT-6 Sol
OpenAI
99,7 %98 %2,04 €202,5 s100,0 %atteint le seuilchamp manquant
5GPT-6 Luna
OpenAI
99,6 %97 %0,11 €271,8 s100,0 %atteint le seuilchamp manquant
6Gemini 3.8 Flash
Google
99,5 %97 %2,01 €332,0 s100,0 %atteint le seuilchamp manquant
7Claude Sonnet 5
Anthropic
98,9 %92 %3,73 €803,2 s100,0 %atteint le seuilvaleur inventée
8Mistral Small 4
Mistral · poids ouverts
98,8 %92 %0,09 €810,9 s100,0 %atteint le seuilvaleur inventée
9Gemini 3.5 Flash Lite
Google
98,1 %88 %0,42 €1200,8 s100,0 %atteint le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
97,0 %89 %0,37 €1139,6 s99,3 %atteint le seuilvaleur erronée

Détection des données personnelles · Allemand · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Mistral Medium 3.5
Mistral
100,0 %100 %1,27 €00,9 s100,0 %atteint le seuil—
2Gemma 4 31B
Google · poids ouverts
99,9 %99 %0,09 €71,9 s100,0 %atteint le seuilchamp manquant
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,8 %99 %0,28 €133,7 s100,0 %atteint le seuilchamp manquant
4Claude Sonnet 5
Anthropic
99,7 %98 %4,05 €203,7 s100,0 %atteint le seuilvaleur inventée
5Gemini 3.8 Flash
Google
99,7 %98 %1,95 €202,3 s100,0 %atteint le seuilchamp manquant
6GPT-6 Sol
OpenAI
99,7 %98 %1,96 €202,6 s100,0 %atteint le seuilchamp manquant
7Gemini 3.5 Flash Lite
Google
99,6 %97 %0,42 €270,8 s100,0 %atteint le seuilvaleur inventée
8GPT-6 Luna
OpenAI
99,6 %97 %0,11 €272,2 s100,0 %atteint le seuilchamp manquant
9Qwen3.8 Flash
Qwen
99,6 %99 %0,33 €712,2 s100,0 %atteint le seuilchamp manquant
10Mistral Small 4
Mistral · poids ouverts
99,1 %94 %0,08 €650,9 s100,0 %atteint le seuilvaleur inventée

Détection des données personnelles · Allemand · Texte (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Mistral Medium 3.5
Mistral
100,0 %100 %1,27 €00,9 s100,0 %atteint le seuil—
2Gemma 4 31B
Google · poids ouverts
99,9 %99 %0,09 €71,9 s100,0 %atteint le seuilchamp manquant
3DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,8 %99 %0,28 €133,7 s100,0 %atteint le seuilchamp manquant
4Claude Sonnet 5
Anthropic
99,7 %98 %4,05 €203,7 s100,0 %atteint le seuilvaleur inventée
5Gemini 3.8 Flash
Google
99,7 %98 %1,95 €202,3 s100,0 %atteint le seuilchamp manquant
6GPT-6 Sol
OpenAI
99,7 %98 %1,96 €202,6 s100,0 %atteint le seuilchamp manquant
7Gemini 3.5 Flash Lite
Google
99,6 %97 %0,42 €270,8 s100,0 %atteint le seuilvaleur inventée
8GPT-6 Luna
OpenAI
99,6 %97 %0,11 €272,2 s100,0 %atteint le seuilchamp manquant
9Qwen3.8 Flash
Qwen
99,6 %99 %0,33 €712,2 s100,0 %atteint le seuilchamp manquant
10Mistral Small 4
Mistral · poids ouverts
99,1 %94 %0,08 €650,9 s100,0 %atteint le seuilvaleur inventée

Détection des données personnelles · Anglais (US) · Tous les niveaux (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemma 4 31B
Google · poids ouverts
99,9 %99 %0,08 €72,4 s100,0 %atteint le seuilchamp manquant
2Claude Sonnet 5
Anthropic
99,7 %98 %3,22 €202,5 s100,0 %atteint le seuilchamp manquant
3Gemini 3.8 Flash
Google
99,7 %98 %1,71 €201,9 s100,0 %atteint le seuilchamp manquant
4Mistral Medium 3.5
Mistral
99,7 %98 %1,06 €200,8 s100,0 %atteint le seuilchamp manquant
5GPT-6 Sol
OpenAI
99,7 %98 %1,92 €202,6 s100,0 %atteint le seuilchamp manquant
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,6 %97 %0,26 €273,8 s100,0 %atteint le seuilchamp manquant
7GPT-6 Luna
OpenAI
99,6 %97 %0,10 €271,8 s100,0 %atteint le seuilvaleur inventée
8Gemini 3.5 Flash Lite
Google
99,5 %97 %0,37 €270,8 s100,0 %atteint le seuilchamp manquant
9Mistral Small 4
Mistral · poids ouverts
99,4 %96 %0,07 €400,8 s100,0 %atteint le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
99,2 %99 %0,26 €137,5 s100,0 %atteint le seuilvaleur inventée

Détection des données personnelles · Anglais (US) · Texte (150 documents)

#ModèleChamps correctsDocuments sans erreurPour 1 000 documentsÀ corriger / 1 000Vitesse (médiane)Réponses validesSeuilErreur la plus fréquente
1Gemma 4 31B
Google · poids ouverts
99,9 %99 %0,08 €72,4 s100,0 %atteint le seuilchamp manquant
2Claude Sonnet 5
Anthropic
99,7 %98 %3,22 €202,5 s100,0 %atteint le seuilchamp manquant
3Gemini 3.8 Flash
Google
99,7 %98 %1,71 €201,9 s100,0 %atteint le seuilchamp manquant
4Mistral Medium 3.5
Mistral
99,7 %98 %1,06 €200,8 s100,0 %atteint le seuilchamp manquant
5GPT-6 Sol
OpenAI
99,7 %98 %1,92 €202,6 s100,0 %atteint le seuilchamp manquant
6DeepSeek V4.1 Flash
DeepSeek · poids ouverts
99,6 %97 %0,26 €273,8 s100,0 %atteint le seuilchamp manquant
7GPT-6 Luna
OpenAI
99,6 %97 %0,10 €271,8 s100,0 %atteint le seuilvaleur inventée
8Gemini 3.5 Flash Lite
Google
99,5 %97 %0,37 €270,8 s100,0 %atteint le seuilchamp manquant
9Mistral Small 4
Mistral · poids ouverts
99,4 %96 %0,07 €400,8 s100,0 %atteint le seuilvaleur inventée
10Qwen3.8 Flash
Qwen
99,2 %99 %0,26 €137,5 s100,0 %atteint le seuilvaleur inventée