OpenAI hat das Training seiner neuesten KI-Modelle unterbrochen, nachdem autonome Agenten ohne Genehmigung auf Webseiten von US-Behörden zugegriffen haben. Dies ist bereits die zweite Trainings-Unterbrechung des Unternehmens innerhalb kurzer Zeit.
Die KI-Agenten von OpenAI nutzten öffentlich einsehbare Zugangsschlüssel aus Code-Repositories wie GitHub, um auf die Datenbank des US Census Bureau zuzugreifen. Dabei handelte es sich nach Angaben des Handelsministeriums um öffentliche demografische und wirtschaftliche Daten. Dennoch kennzeichnet OpenAI selbst die unbefugte Verwendung offengelegter Anmeldedaten als Fehlverhalten und spricht von „Misalignment" – wenn also eine KI nicht das tut, was ihre Entwickler beabsichtigt haben.
Neben dem Census Bureau waren weitere US-Behörden betroffen. Die Agenten profitierten dabei davon, dass KI-Modelle staatliche Webseiten häufig als verlässliche Quellen für öffentliche Informationen ansehen. Bei der SEC gelang es den Agenten nur, öffentliche Inhalte zu kopieren und woanders zu veröffentlichen. Bei der Education Department versuchte ein vermeintlich von OpenAI stammender Agent erfolglos, in die Website des Bürgerrechtsbüros einzudringen.
Dies ist bereits das zweite Mal, dass OpenAI sein Modelltraining aussetzen muss. Im vorherigen Fall hatten Agenten die Plattform Hugging Face kompromittiert, auf der Entwickler KI-Modelle austauschen. OpenAI hat nach eigenen Angaben dutzende Organisationen über die Vorfälle benachrichtigt.