Bestätigt

Anthropic launched a pilot granting three outside institutions aggregated query-based access to 750,000 anonymized conversations

KI

Anthropic gibt 250.000 Chatprotokolle für externe Sicherheitsforschung frei

Unabhängige Wissenschaftler erhalten datenschutzkonformen Einblick in Unterhaltungen mit dem KI-Assistenten Claude, um Risiken im tatsächlichen Praxiseinsatz zu bewerten.

Veröffentlicht
NRB — News Republic Brigade

Weitere Links

Anthropic

Das Wesentliche

Anthropic gewährt unabhängigen Forschungseinrichtungen Zugriff auf datenschutzgeprüfte Auswertungen von 250.000 Claude-Gesprächen und ermöglicht damit erstmals großflächige Einblicke in die reale KI-Nutzung. Eine erste Studie der Stanford University zeigt, dass Anwender bei mehr als der Hälfte der relevanten Anfragen folgenschwere Rechts-, Finanz- oder Alltagsfragen bearbeiten, die Zügel aber in über 70 Prozent der Fälle selbst in der Hand behalten.

Die Kernpunkte

  • Anthropic stellte externen Forschungsteams Stichproben von rund 250.000 Verbraucher-Gesprächen aus den Monaten April und Mai 2026 bereit.
  • Stanford-Forscher ermittelten, dass 56 Prozent der relevanten Dialoge folgenreiche Aufgaben mit Außenwirkung oder schwer umkehrbaren Folgen betrafen.
  • Hochsensible Anfragen zu Rechts- und Finanzthemen machten in der Stanford-Untersuchung 12 Prozent der handlungsbezogenen Interaktionen aus.
  • Nutzer behielten in mehr als 70 Prozent der analysierten Sitzungen die aktive Kontrolle und arbeiteten schrittweise mit dem System.
  • Das Imperial College London auditierte das System und bestätigte, dass die aggregierten Daten keine Rückschlüsse auf Einzelpersonen zulassen.

Aus dem Tagebuch des Redakteurs

Eine aussagekräftige Bewertung von KI-Risiken erfordert die Analyse realer Verhaltensweisen statt isolierter Labortests – vorausgesetzt, Datenschutzarchitekturen schirmen persönliche Daten im Vorfeld wirksam ab.

Wer beteiligt ist

  • Anthropic

    Führender Entwickler von Künstlicher Intelligenz

    will → Die eigene Sicherheitsforschung und Transparenz stärken und zugleich Geschäftsgeheimnisse sowie die Privatsphäre der Nutzer wahren

  • Stanford SALT Lab

    Forschungsgruppe für Computerlinguistik und Social Computing an der Stanford University

    will → Die Zusammenarbeit zwischen Mensch und Maschine, das Ausmaß der menschlichen Kontrolle und die Tragweite bearbeiteter Aufgaben im Produktivbetrieb analysieren

  • Oxford HIP Lab

    Forschungsgruppe für menschliche Informationsverarbeitung an der University of Oxford

    will → Emotionale Reaktionen, Verhaltensmuster und psychologische Dynamiken bei der Interaktion mit Chatbots untersuchen

  • METR

    Gemeinnützige Organisation zur Modell- und Bedrohungsbewertung

    will → Die Programmierfähigkeiten, Arbeitsbeschleunigung und technische Produktivität von Claude Code messen

  • Imperial College London

    Britische Forschungsuniversität als unabhängige Prüfinstanz

    will → Aggregierte Datensätze auditieren und sicherstellen, dass Rückschlüsse auf einzelne Personen ausgeschlossen sind

Kurz gefasst

Das US-Unternehmen Anthropic gewährt externen Forschungsgruppen erstmals aggregierten und datenschutzgeprüften Zugriff auf Protokolle seines Chatbots Claude. Die Initiative soll klären, wie Menschen generative Künstliche Intelligenz im Alltag bei weitreichenden Entscheidungen tatsächlich einsetzen.

Erste Auswertungen zeigen, dass Nutzer die Kontrolle über die Systeme weitgehend selbst behalten: In mehr als 70 Prozent der analysierten Sitzungen steuerten Menschen den Dialog aktiv und überließen dem Modell keine eigenständigen Entscheidungen. Allerdings betraf mehr als die Hälfte der relevanten Unterhaltungen folgenschwere Aufgaben mit Außenwirkung, allen voran rechtliche und finanzielle Fragestellungen.

Wissenschaftler können durch die Initiative das reale Nutzerverhalten analysieren, ohne private Textinhalte im Klartext einsehen zu müssen. Damit verlagert sich der Schwerpunkt der KI-Sicherheitsforschung von künstlichen Testeingaben auf reale Nutzungsgewohnheiten. Ob andere führende Entwickler dem Vorbild folgen und vergleichbare Datenzugänge bereitstellen, ist derzeit noch offen.

Wie es sich entwickelte

01

Anthropic öffnet Nutzungsdaten von Claude für externe Sicherheitsforscher

2026-08-25 – 2026-08-25

Anthropic hat eine neue Forschungsinitiative gestartet und am 26. August 2026 erste Ergebnisse zusammen mit Partnerinstituten vorgelegt, die dafür Stichproben von jeweils rund 250.000 Konversationen untersuchen.

1 Quelle
02

Stanford-Analyse belegt starke Nutzerkontrolle bei kritischen Aufgaben

2026-08-25 – 2026-08-27

Ein Forschungsteam der Stanford University wertete 249.834 Unterhaltungen mit Claude aus und stellte fest, dass Nutzer auch bei heiklen Themen das Steuer nicht aus der Hand geben. Den Ergebnissen zufolge bezogen sich 56 Prozent der auswertbaren Dialoge auf Aufgaben mit spürbaren Folgen für Dritte oder schwer umkehrbaren Konsequenzen; 12 Prozent entfielen auf hochsensible Rechts- und Finanzfragen. In über 70 Prozent der Fälle griffen die Anwender steuernd ein und nutzten das Modell lediglich als Hilfswerkzeug statt als eigenständigen Entscheider. Fachbeobachter lobten die Datenschutzarchitektur, verwiesen jedoch auf die methodischen Grenzen automatisierter Textklassifizierer.

2 Quellen

Wo die Dinge stehen

Das Pilotprojekt läuft weiter: Während die Analyse der Stanford University bereits vorliegt, stehen die Auswertungen des Oxford HIP Lab und der Organisation METR noch aus. Die beteiligten Forscher betonen, dass die eingesetzte Pipeline primär Absichten im Dialog erfasst und nicht misst, welche Handlungen Nutzer außerhalb des Chatfensters letztlich vollziehen.

In der Branche richtet sich der Blick nun darauf, ob Konkurrenten ähnliche Datenfreigaben auf aggregierter Basis umsetzen. Zudem werden die kommenden Berichte über psychologische Interaktionsmuster aus Oxford und über Programmierproduktivität von METR zeigen, wie belastbar die bisherigen Befunde zur menschlichen Kontrolle in der Praxis sind.

Quellen

  • explainx.aiTechnical Architecture Analysis · 2026-08-27