CourionAI
DE
Newsletter
← Glossar Begriff

Doppelblinde Auswertung

Ein KI-Test, bei dem der Bewerter das Modell nie sieht und der Besitzer des Modells nie die Fragen sieht.

In Anlehnung an die Medizin, wo weder der Patient noch der Arzt wissen, wer das echte Medikament bekommen hat, lässt eine doppelblinde KI-Bewertung beide Seiten über das Material des anderen im Dunkeln. Die Organisation, die den Test durchführt, sieht nie die Gewichtungen des Modells, und das Unternehmen, das das Modell erstellt hat, sieht nie die Testfragen. Es geht darum, dass ein Ergebnis für einen Außenstehenden etwas bedeutet.

Ohne sie erhalten Sie ein bekanntes Problem. Wenn ein Labor die Prüfung sehen kann, kann es sich auf die Prüfung vorbereiten, und niemand außerhalb kann ein wirklich leistungsfähiges Modell von einem gut ausgebildeten Modell unterscheiden. Verträge und keine Abholzungsversprechen waren die alte Antwort, die auf Vertrauen hinauslief. Google DeepMind führte im August 2026 mit dem Singapore AI Safety Institute die erste derartige Evaluierung eines proprietären Grenzmodells durch und erzwang die Trennung durch vertrauliche Datenverarbeitung und nicht durch ein Versprechen.