Wie urteilen KI-Modelle über die Wahlprogramme?
Was ist Modell-Bias? Alle Modelle lesen dieselben Programme aus Sicht derselben fiktiven Personas — und urteilen trotzdem unterschiedlich streng und kritisch. Dieses Urteil hängt vom Modell (und seiner Version) ab. Wähle ein Modell und sieh selbst.
Die Modelle und ihr Bias
Claude Opus 4.8
claude-opus-4-8[1m]
Ø-Urteileher zustimmend (+0.8)
Kritik-Quote27 %
Tonalitätgemischt
Ø Punkte/Urteil6.4
nachsichtig, gemischt · 112 Urteile · 720 Aussagen
→ Personas ansehenClaude Sonnet 4.6
claude-sonnet-4-6
Ø-Urteileher zustimmend (+0.5)
Kritik-Quote32 %
Tonalitätzugespitzt
Ø Punkte/Urteil5.7
nachsichtig, zugespitzt · 112 Urteile · 638 Aussagen
→ Personas ansehenGemini 3.1 Pro
Gemini 3.1 Pro (High)
Ø-Urteilgemischt (+0.4)
Kritik-Quote40 %
Tonalitätzugespitzt
Ø Punkte/Urteil7.1
ausgewogen, zugespitzt · 112 Urteile · 798 Aussagen
→ Personas ansehenGPT 5.5
gpt-5.5
Ø-Urteileher zustimmend (+0.9)
Kritik-Quote40 %
Tonalitätsachlich
Ø Punkte/Urteil12.1
ausgewogen, sachlich · 112 Urteile · 1.360 Aussagen
→ Personas ansehenGrok 4.3
xai/grok-4.3
Ø-Urteileher zustimmend (+0.5)
Kritik-Quote33 %
Tonalitätzugespitzt
Ø Punkte/Urteil4.7
nachsichtig, zugespitzt · 112 Urteile · 527 Aussagen
→ Personas ansehenQwen 3.7 Max
alibaba/qwen3.7-max
Ø-Urteilgemischt (+0)
Kritik-Quote44 %
Tonalitätzugespitzt
Ø Punkte/Urteil8.1
ausgewogen, zugespitzt · 112 Urteile · 903 Aussagen
→ Personas ansehenDie 16 Personas
Die Parteien · Sachsen-Anhalt
Urteile standardmäßig aus Sicht von Claude Opus 4.8 — auf der Partei-Seite ist das Modell wechselbar.