CourionAI
DE
Newsletter
← Alle News
privacy 3 Min. Lesezeit

Echte Menschen lesen echte ChatGPT-Gespräche und die meisten Benutzer haben keine Ahnung

404 Media erhielt interne Dokumente, die Project Lily beschreiben, das Programm von OpenAI, bei dem Hunderte von Auftragnehmern beauftragt werden, echte Benutzeraufforderungen zu lesen und die Antworten zu bewerten. Persönliche Daten passieren die Filter und die Einstellung, die sie steuert, ist standardmäßig aktiviert.

Ein Stapel versiegelter Umschläge, der obere offen und über dem Brief eine Lupe

404 Media veröffentlichte eine Untersuchung zu einem OpenAI-Programm, das intern „Project Lily“ heißt und auf durchgesickerten Dokumenten und echten Hinweisen basiert, wie dem Outlet gezeigt wurde. Die Kurzfassung: Hunderte von Auftragnehmern werden dafür bezahlt, echte Gespräche zwischen Menschen und ChatGPT zu lesen und die Antworten des Chatbots auf einer Skala von eins bis sieben zu bewerten. Keine anonymisierten Zusammenfassungen, keine synthetischen Testfragen. Echte Chats, darunter auch, wie OpenAI selbst zugibt, solche, die noch persönliche Daten enthalten.

Die Auftragnehmer werden von einer Firma namens Crossing Hurdles rekrutiert und über die Einstellungsplattform Mercor bezahlt, wobei ein Arbeiter über 50 Dollar pro Stunde angibt. Sie sehen keine Benutzernamen, und OpenAI sagt, dass es versucht, persönliche Informationen zu entfernen, bevor Eingabeaufforderungen einen Prüfer erreichen, aber das Unternehmen räumt ein, dass vertrauliche Daten trotzdem durchkommen. Das ist nicht verwunderlich, wenn man sich vorstellt, was die Leute tatsächlich tippen: die medizinische Sorge, die Nachricht an einen schwierigen Verwandten, den Vertrag, den sie eingefügt haben, um ihn erklären zu lassen. ChatGPT hat mehr als 900 Millionen Benutzer und bei Verbraucherplänen ist die Einstellung, die die Verwendung von Gesprächen zur Verbesserung des Modells ermöglicht, aktiviert, sofern Sie sie nicht deaktivieren. Fairerweise muss man sagen, dass dies keine OpenAI-Besonderheit ist. Anthropic und Google führen vergleichbare Programme zur menschlichen Überprüfung durch, und das gilt im Wesentlichen für jedes Unternehmen, das einem Modell beibringen musste, wie eine gute Antwort aussieht.

Was steckt dahinter

Modelle lernen den Geschmack nicht allein durch mehr Daten. Jemand muss sich zwei mögliche Antworten ansehen und sagen, welche besser ist und dass jemand bisher eine Person ist. Die Technik hat einen Namen: Reinforcement Learning aus menschlichem Feedback und ist einer der Gründe, warum sich moderne Chatbots hilfreich und nicht nur fließend anfühlen. Das Peinliche daran ist, dass echte Gespräche gerade deshalb das wertvollste Trainingsmaterial sind, weil sie real sind: chaotisch, spezifisch, manchmal verzweifelt. Ein Modell, das nur auf höfliche künstliche Fragen abgestimmt ist, ist bei höflichen künstlichen Fragen gut. Die Branche verwendet also das Original, legt es in der Datenschutzerklärung offen und verlässt sich darauf, dass fast niemand die Datenschutzerklärung liest.

Was das für Sie bedeutet: Gehen Sie davon aus, dass alles, was Sie in einen Allzweck-Chatbot eingeben, von einem Menschen gelesen werden kann, und entscheiden Sie auf dieser Grundlage, was Sie eingeben möchten. Das ist keine Paranoia, es ist nur das genaue mentale Modell. Wenn Sie es reduzieren möchten, ist die Kontrolle vorhanden: Öffnen Sie in ChatGPT „Einstellungen“, dann „Datenkontrollen“ und deaktivieren Sie die Option zur Verbesserung des Modells für alle, wodurch verhindert wird, dass Ihre zukünftigen Chats auf diese Weise verwendet werden. Ähnliche Schalter gibt es in Claude und Gemini, und Business- oder Enterprise-Pläne schließen Ihre Daten im Allgemeinen standardmäßig aus. Für wirklich sensible Dinge, Gesundheitsdaten, Kundendokumente und alles, was einer Geheimhaltungspflicht unterliegt, ist es besser, Namen und Nummern vor dem Einfügen zu entfernen oder ein Modell zu verwenden, das auf Ihrem eigenen Computer läuft. Und wenn Sie ein Unternehmen haben: Aus diesem Grund gehören kostenlose Chatbot-Konten und Kundendaten nicht in denselben Satz.

Quellen

Quellen: https://www.404media.co/inside-project-lily-the-humans-reading-your-chatgpt-chats/

Nächster Artikel

Nvidias neues Rack ist 10x, 30x oder 67x besser, je nachdem, wer zählt

Neue Zahlen für den Vera Rubin NVL72 sind diese Woche von Nvidia und SemiAnalysis eingetroffen, und die Multiplikatoren variieren stark. Die Verbreitung ist keine Unehrlichkeit, sondern eine Lektion darüber, wie Effizienzansprüche aufgebaut werden.

Drei Lineale unterschiedlicher Länge und Größe, die gegen denselben hohen Block gelehnt sind