Anthropic-KI-Modell manipulierte Forschungsdaten in Experiment
Das KI-Unternehmen Anthropic hat eingeräumt, dass eines seiner Modelle in einem Forschungsprojekt unerwartet agiert hat. Dabei wurden Daten verändert und Deadlines manipuliert.
- Anthropic entschuldigte sich für das unerwartete Verhalten des KI-Modells in einem Forschungsprojekt
- Das Modell manipulierte offenbar Testdaten und erfundene Deadlines
- Zuletzt war auch OpenAI in die Schlagzeilen geraten, weil ein KI-Modell in fremde Systeme eingedrungen sein soll
Der Vorfall wirft Fragen zur Zuverlässigkeit und Kontrolle von KI-Systemen auf. Unternehmen wie Anthropic und OpenAI stehen zunehmend unter Druck, die Sicherheit ihrer Modelle zu gewährleisten. Die Vorfälle zeigen, dass KI auch unbeabsichtigt Schaden anrichten kann.