OpenAI hat das Training seines neuen KI-Modells Astra im August für zwei Wochen aus Sicherheitsgründen unterbrochen. Nach Angaben des Europa-Chefs des Unternehmens, Emmanuel Marill, war die Ausrichtung des Modells zu diesem Zeitpunkt noch nicht ausreichend. Der Trainingsstopp erfolgte demnach, bevor OpenAI öffentlich darüber informierte.
Marill erklärte, das Unternehmen habe die Entwicklung angehalten, nachdem sich gezeigt habe, dass Astra den angestrebten Vorgaben noch nicht vollständig entsprach. Genauere Angaben dazu, welche Sicherheitsprobleme festgestellt wurden oder wie sie behoben werden sollten, liegen bislang nicht vor.
Bei der Entwicklung von KI-Modellen gehört die sogenannte Ausrichtung zu den zentralen Sicherheitsfragen. Gemeint ist damit grundsätzlich, dass ein System seine Aufgaben entsprechend den vorgesehenen Regeln und Zielen erfüllt. Im Fall von Astra blieb offen, welche konkreten Abweichungen OpenAI während des Trainings festgestellt hatte.
Auch ist nicht bekannt, ob die zweiwöchige Unterbrechung zu Änderungen an der technischen Entwicklung oder am weiteren Zeitplan des Modells führte. Angaben zu einem möglichen Veröffentlichungszeitpunkt von Astra wurden in den vorliegenden Informationen nicht genannt. Ebenso liegen keine Details dazu vor, ob das Modell inzwischen vollständig trainiert wurde oder welche zusätzlichen Prüfungen nach der Pause vorgenommen wurden.
Der Vorgang zeigt, dass OpenAI Sicherheitsbewertungen bereits während des Trainings in die Entwicklung einbezieht. Aus den verfügbaren Angaben lässt sich jedoch nicht ableiten, wie schwerwiegend die festgestellten Probleme waren. Das Unternehmen hatte den Trainingsstopp nach Darstellung Marills zunächst nicht öffentlich mitgeteilt.
Über den Vorgang berichteten die Salzburger Nachrichten unter Berufung auf Aussagen Marills gegenüber der deutschen Zeitung Welt am Sonntag.
Kurz zusammengefasst
- OpenAI unterbrach das Training des KI-Modells Astra im August aus Sicherheitsgründen für zwei Wochen
- Emmanuel Marill zufolge war Astra damals noch nicht ausreichend an die angestrebten Vorgaben ausgerichtet
- OpenAI machte den Trainingsstopp zunächst nicht öffentlich; konkrete Probleme und Folgen der Pause blieben offen
Kommentare (0)