ModelVerdict

Vergleich

Gemini 3.8 Flash vs. GPT-6 Sol

Dieselben Dokumente, derselbe Prompt: wo welches Modell richtig liegt, was es wirklich kostet und wie schnell es antwortet.

Auf einen Blick

Richtige Felder: Gemini 3.8 Flash / GPT-6 Sol; das bessere fett. Klicken Sie auf eine Zelle für Details.

Rechnungsextraktion · Deutsch (150 Dokumente)

GPT-6 Sol ist um 2,7 Pp. genauer. Gemini 3.8 Flash ist 1,5× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder97,2 %100,0 %
Fehlerfreie Dokumente96 %99 %
Pro 1.000 Dokumente6,58 €9,80 €
Zu korrigieren / 1.000407
Tempo (Median)4,7 Sek.4,9 Sek.
Gültige Antworten97,3 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Lieferant97,3 %100,0 %
Lieferanten-ID (EIN, IČO…)97,3 %100,0 %
USt-IdNr.96,7 %100,0 %
Rechnungsnummer97,3 %100,0 %
Zahlungsreferenz97,3 %100,0 %
Rechnungsdatum97,3 %100,0 %
Leistungsdatum97,3 %100,0 %
Fälligkeitsdatum97,3 %100,0 %
Netto nach Steuersatz96,7 %100,0 %
Steuer nach Steuersatz97,3 %100,0 %
Gesamtbetrag97,3 %100,0 %
Währung97,3 %100,0 %
Bankverbindung97,3 %99,3 %

Dokumente, bei denen sie sich unterscheiden

Rechnungsextraktion · Englisch (USA) (150 Dokumente)

GPT-6 Sol ist um 0,1 Pp. genauer. Gemini 3.8 Flash ist 2,5× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,8 %99,9 %
Fehlerfreie Dokumente98 %99 %
Pro 1.000 Dokumente3,53 €8,88 €
Zu korrigieren / 1.000207
Tempo (Median)3,2 Sek.4,1 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Lieferant100,0 %100,0 %
Lieferanten-ID (EIN, IČO…)100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Zahlungsreferenz100,0 %100,0 %
Rechnungsdatum100,0 %100,0 %
Fälligkeitsdatum100,0 %100,0 %
Netto nach Steuersatz100,0 %100,0 %
Steuer nach Steuersatz100,0 %100,0 %
Gesamtbetrag100,0 %100,0 %
Währung100,0 %100,0 %
Bankverbindung98,0 %99,3 %

Dokumente, bei denen sie sich unterscheiden

Rechnungsextraktion · Tschechisch (150 Dokumente)

Gemini 3.8 Flash ist um 0,1 Pp. genauer. Gemini 3.8 Flash ist 2,4× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder100,0 %99,9 %
Fehlerfreie Dokumente99 %99 %
Pro 1.000 Dokumente3,92 €9,31 €
Zu korrigieren / 1.000713
Tempo (Median)3,5 Sek.3,9 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Lieferant99,3 %99,3 %
Lieferanten-ID (EIN, IČO…)100,0 %100,0 %
USt-IdNr.100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Zahlungsreferenz100,0 %99,3 %
Rechnungsdatum100,0 %100,0 %
Leistungsdatum100,0 %100,0 %
Fälligkeitsdatum100,0 %100,0 %
Netto nach Steuersatz100,0 %100,0 %
Steuer nach Steuersatz100,0 %100,0 %
Gesamtbetrag100,0 %100,0 %
Währung100,0 %100,0 %
Bankverbindung100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Rechnungsextraktion · Spanisch (100 Dokumente)

GPT-6 Sol ist um 3,2 Pp. genauer. Gemini 3.8 Flash ist 1,4× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder95,9 %99,2 %
Fehlerfreie Dokumente95 %89 %
Pro 1.000 Dokumente7,23 €9,90 €
Zu korrigieren / 1.00050110
Tempo (Median)5,3 Sek.5,7 Sek.
Gültige Antworten96,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Lieferant95,0 %98,0 %
Lieferanten-ID (EIN, IČO…)96,0 %100,0 %
USt-IdNr.96,0 %100,0 %
Rechnungsnummer96,0 %100,0 %
Zahlungsreferenz96,0 %100,0 %
Rechnungsdatum96,0 %100,0 %
Leistungsdatum96,0 %100,0 %
Fälligkeitsdatum96,0 %100,0 %
Netto nach Steuersatz96,0 %92,0 %
Steuer nach Steuersatz96,0 %100,0 %
Gesamtbetrag96,0 %100,0 %
Währung96,0 %100,0 %
Bankverbindung96,0 %99,0 %

Dokumente, bei denen sie sich unterscheiden

Rechnungsextraktion · Französisch (100 Dokumente)

Beide sind gleich genau. Gemini 3.8 Flash ist 1,8× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,9 %99,9 %
Fehlerfreie Dokumente99 %99 %
Pro 1.000 Dokumente5,68 €10,17 €
Zu korrigieren / 1.0001010
Tempo (Median)5,2 Sek.5,9 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Lieferant100,0 %100,0 %
Lieferanten-ID (EIN, IČO…)100,0 %100,0 %
USt-IdNr.100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Zahlungsreferenz99,0 %99,0 %
Rechnungsdatum100,0 %100,0 %
Leistungsdatum100,0 %100,0 %
Fälligkeitsdatum100,0 %100,0 %
Netto nach Steuersatz100,0 %100,0 %
Steuer nach Steuersatz100,0 %100,0 %
Gesamtbetrag100,0 %100,0 %
Währung100,0 %100,0 %
Bankverbindung100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

E-Mail-Triage · Deutsch (150 Dokumente)

Gemini 3.8 Flash ist um 0,2 Pp. genauer.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder98,4 %98,2 %
Fehlerfreie Dokumente85 %84 %
Pro 1.000 Dokumente2,52 €2,51 €
Zu korrigieren / 1.000147160
Tempo (Median)2,9 Sek.2,9 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Kategorie100,0 %100,0 %
Priorität100,0 %97,3 %
Stimmung85,3 %86,7 %
Kundenname100,0 %100,0 %
Bestellnummer100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Betrag100,0 %100,0 %
Währung100,0 %100,0 %
Frist100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

E-Mail-Triage · Englisch (USA) (150 Dokumente)

GPT-6 Sol ist um 0,3 Pp. genauer.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder98,7 %99,0 %
Fehlerfreie Dokumente89 %92 %
Pro 1.000 Dokumente2,19 €2,24 €
Zu korrigieren / 1.00011380
Tempo (Median)2,2 Sek.2,8 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Kategorie100,0 %100,0 %
Priorität100,0 %98,0 %
Stimmung88,7 %93,3 %
Kundenname100,0 %100,0 %
Bestellnummer100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Betrag100,0 %100,0 %
Währung100,0 %100,0 %
Frist100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

E-Mail-Triage · Tschechisch (150 Dokumente)

Gemini 3.8 Flash ist um 0,2 Pp. genauer.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,2 %99,0 %
Fehlerfreie Dokumente93 %91 %
Pro 1.000 Dokumente2,82 €2,94 €
Zu korrigieren / 1.0007393
Tempo (Median)2,6 Sek.2,8 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Kategorie100,0 %100,0 %
Priorität99,3 %98,0 %
Stimmung93,3 %92,7 %
Kundenname100,0 %100,0 %
Bestellnummer100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Betrag100,0 %100,0 %
Währung100,0 %100,0 %
Frist100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

E-Mail-Triage · Spanisch (100 Dokumente)

Gemini 3.8 Flash ist um 0,5 Pp. genauer. GPT-6 Sol ist 1,2× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,1 %98,6 %
Fehlerfreie Dokumente92 %87 %
Pro 1.000 Dokumente3,06 €2,56 €
Zu korrigieren / 1.00080130
Tempo (Median)3,1 Sek.3,2 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Kategorie100,0 %100,0 %
Priorität98,0 %95,0 %
Stimmung94,0 %92,0 %
Kundenname100,0 %100,0 %
Bestellnummer100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Betrag100,0 %100,0 %
Währung100,0 %100,0 %
Frist100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

E-Mail-Triage · Französisch (98 Dokumente)

GPT-6 Sol ist um 0,1 Pp. genauer.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder98,9 %99,0 %
Fehlerfreie Dokumente90 %91 %
Pro 1.000 Dokumente2,48 €2,57 €
Zu korrigieren / 1.00010292
Tempo (Median)2,7 Sek.3,1 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Kategorie100,0 %100,0 %
Priorität99,0 %96,9 %
Stimmung90,8 %93,9 %
Kundenname100,0 %100,0 %
Bestellnummer100,0 %100,0 %
Rechnungsnummer100,0 %100,0 %
Betrag100,0 %100,0 %
Währung100,0 %100,0 %
Frist100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Erkennung personenbezogener Daten · Deutsch (150 Dokumente)

Beide sind gleich genau.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,7 %99,7 %
Fehlerfreie Dokumente98 %98 %
Pro 1.000 Dokumente1,95 €1,96 €
Zu korrigieren / 1.0002020
Tempo (Median)2,3 Sek.2,6 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Namen100,0 %100,0 %
E-Mail-Adressen100,0 %100,0 %
Telefonnummern100,0 %100,0 %
Adressen98,0 %98,0 %
Geburtsdaten100,0 %100,0 %
Identifikationsnummern100,0 %100,0 %
Bankkonten100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Erkennung personenbezogener Daten · Englisch (USA) (150 Dokumente)

Beide sind gleich genau. Gemini 3.8 Flash ist 1,1× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,7 %99,7 %
Fehlerfreie Dokumente98 %98 %
Pro 1.000 Dokumente1,71 €1,92 €
Zu korrigieren / 1.0002020
Tempo (Median)1,9 Sek.2,6 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Namen100,0 %100,0 %
E-Mail-Adressen100,0 %100,0 %
Telefonnummern100,0 %100,0 %
Adressen98,0 %98,0 %
Geburtsdaten100,0 %100,0 %
Identifikationsnummern100,0 %100,0 %
Bankkonten100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Erkennung personenbezogener Daten · Tschechisch (150 Dokumente)

GPT-6 Sol ist um 0,2 Pp. genauer.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,5 %99,7 %
Fehlerfreie Dokumente97 %98 %
Pro 1.000 Dokumente2,01 €2,04 €
Zu korrigieren / 1.0003320
Tempo (Median)2,0 Sek.2,5 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Namen98,7 %100,0 %
E-Mail-Adressen100,0 %100,0 %
Telefonnummern100,0 %100,0 %
Adressen98,0 %98,0 %
Geburtsdaten100,0 %100,0 %
Identifikationsnummern100,0 %100,0 %
Bankkonten100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Vertragsklauseln · Deutsch (150 Dokumente)

GPT-6 Sol ist um 0,1 Pp. genauer. Gemini 3.8 Flash ist 1,3× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,9 %100,0 %
Fehlerfreie Dokumente99 %100 %
Pro 1.000 Dokumente3,14 €4,01 €
Zu korrigieren / 1.00070
Tempo (Median)2,6 Sek.2,9 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Auftragnehmer100,0 %100,0 %
ID Auftragnehmer99,3 %100,0 %
Auftraggeber100,0 %100,0 %
ID Auftraggeber99,3 %100,0 %
Vertragsart100,0 %100,0 %
Preis (netto)100,0 %100,0 %
Währung100,0 %100,0 %
Abrechnungszeitraum100,0 %100,0 %
Wirksam ab100,0 %100,0 %
Vertragsende100,0 %100,0 %
Kündigungsfrist (Monate)100,0 %100,0 %
Verzugsstrafe (% pro Tag)100,0 %100,0 %
Anwendbares Recht100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.

Vertragsklauseln · Englisch (USA) (150 Dokumente)

GPT-6 Sol ist um 0,1 Pp. genauer. Gemini 3.8 Flash ist 1,4× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder99,9 %100,0 %
Fehlerfreie Dokumente99 %100 %
Pro 1.000 Dokumente2,27 €3,06 €
Zu korrigieren / 1.00070
Tempo (Median)2,0 Sek.2,5 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Auftragnehmer99,3 %100,0 %
ID Auftragnehmer100,0 %100,0 %
Auftraggeber99,3 %100,0 %
ID Auftraggeber100,0 %100,0 %
Vertragsart100,0 %100,0 %
Preis (netto)100,0 %100,0 %
Währung100,0 %100,0 %
Abrechnungszeitraum100,0 %100,0 %
Wirksam ab100,0 %100,0 %
Vertragsende100,0 %100,0 %
Kündigungsfrist (Monate)100,0 %100,0 %
Verzugsstrafe (% pro Tag)100,0 %100,0 %
Anwendbares Recht100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Vertragsklauseln · Tschechisch (150 Dokumente)

Beide sind gleich genau. Gemini 3.8 Flash ist 1,5× günstiger.

KennzahlGemini 3.8 FlashGPT-6 Sol
Richtige Felder100,0 %100,0 %
Fehlerfreie Dokumente100 %100 %
Pro 1.000 Dokumente2,84 €4,25 €
Zu korrigieren / 1.00000
Tempo (Median)2,2 Sek.2,0 Sek.
Gültige Antworten100,0 %100,0 %

Genauigkeit pro Feld

FeldGemini 3.8 FlashGPT-6 Sol
Auftragnehmer100,0 %100,0 %
ID Auftragnehmer100,0 %100,0 %
Auftraggeber100,0 %100,0 %
ID Auftraggeber100,0 %100,0 %
Vertragsart100,0 %100,0 %
Preis (netto)100,0 %100,0 %
Währung100,0 %100,0 %
Abrechnungszeitraum100,0 %100,0 %
Wirksam ab100,0 %100,0 %
Vertragsende100,0 %100,0 %
Kündigungsfrist (Monate)100,0 %100,0 %
Verzugsstrafe (% pro Tag)100,0 %100,0 %
Anwendbares Recht100,0 %100,0 %

Dokumente, bei denen sie sich unterscheiden

Beide Modelle hatten bei allen Beispieldokumenten gleich viele Felder richtig.