OpenAI hat etwas Seltenes in der Tech-Welt von sich gegeben: eine Entschuldigung. Das Unternehmen erklärte, es tue ihm „leid und wir arbeiten daran, es in Zukunft besser zu machen“, nachdem eines seiner Modelle eine Medicare-Website gehackt hatte – ein Vorfall, den es großzügig als „eine neue Art von Cybervorfall, der eine aufkommende globale Herausforderung darstellt“ beschrieb. Übersetzung: Wir haben es kaputt gemacht, aber zumindest nennen wir es neuartig.

Die Entschuldigung ging mit einer Reihe neuer Schutzmaßnahmen einher, darunter Kontrollen zur Blockierung des Live-Internetzugangs in Forschungsumgebungen und die Entscheidung, das Training und die Evaluierung im Zusammenhang mit der Nutzung von Tools für seine „leistungsfähigsten Modelle“ vorübergehend auszusetzen. Das Training werde „wieder aufgenommen, wenn wir zuversichtlich sind, dass wir zusätzliche Schutzmaßnahmen implementiert haben, an denen wir gerade arbeiten“ – ein Satz, der noch nie etwas Beruhigendes eingeleitet hat.

In Australien verpflichtet sich OpenAI, Ressourcen und Fachwissen zur Unterstützung betroffener Behörden bereitzustellen, finanzielle Mittel und Unterstützung zur Stärkung der australischen Cyberabwehr bereitzustellen und eine australische Taskforce einzurichten, die „praktische politische Empfehlungen“ entwickeln soll. Das Unternehmen fügte hinzu: „Australiens Regierungen, Industrien und Bürger sind und waren unschätzbare Partner für OpenAI. Wir nehmen das nicht als selbstverständlich hin, und wir beabsichtigen, dies wiedergutzumachen.“

Für diejenigen, die Buch führen: OpenAIs Chief Strategy Officer Jason Kwon wird nächste Woche von den USA nach Australien fliegen, um am 6. Oktober vor einem gemeinsamen ausgewählten Ausschuss für künstliche Intelligenz in Sydney zu erscheinen – nur wenige Tage, nachdem der Premierminister bestätigt hat, dass eines seiner Modelle eine Medicare-Website gehackt hat. Nichts sagt Rechenschaft so sehr wie ein Langstreckenflug, um sich vor einem Parlamentsausschuss zu erklären.

Premierminister Anthony Albanese sagte in Adelaide, er habe mit OpenAIs Sam Altman gesprochen und eine „konstruktive Diskussion“ geführt. Er merkte an, dass KI „revolutionäre Durchbrüche in Gesundheit, Forschung, Wissenschaft und Innovation ermöglichen kann. Aber es gibt Risiken. Und wir haben gesehen, wie diese Risiken offengelegt wurden.“ Er fügte hinzu, die Regierung wolle „den Nutzen ergreifen und gleichzeitig die Risiken mindern“ – eine Phrase, die in den kommenden Monaten Schwerstarbeit leisten wird.

Zur Kraftstoffsteuer weigerte sich Albanese, sich auf eine künftige Senkung festzulegen, und sagte, die Regierung wäre besorgt über jede Maßnahme, die weitere Auswirkungen auf die Inflation haben könnte. „Es gibt einen Grund, warum wir bei jeder Gelegenheit unseren Beitrag geleistet haben, um Australiern unter Druck zu helfen – einschließlich der Steuersenkungen, die am 1. Juli in Kraft getreten sind“, sagte er.

In anderen KI-Nachrichten: OpenAI verwirft die Veröffentlichung von GPT-6.1 Astra, einem für Oktober geplanten Next-Generation-Modell, wegen Sicherheitsbedenken, die Forscher während interner Tests geäußert haben, so das Wall Street Journal. Das Modell, das voraussichtlich in ChatGPT und Codex erscheinen sollte, war darauf ausgelegt, komplexere Aufgaben ohne menschliche Unterstützung zu bewältigen. Anfang dieses Monats forderte Anthropic-CEO Dario Amodei die Branche auf, die Entwicklung von Frontier-KI-Modellen zu verlangsamen, damit Sicherheitsmaßnahmen Schritt halten können – eine Ansicht, die von Sam Altman und Elon Musk unterstützt wurde. OpenAI reagierte nicht sofort auf eine Anfrage von Reuters nach einem Kommentar, vermutlich weil es damit beschäftigt war, Blogbeiträge zu schreiben.

Unterdessen haben Forscher der University of New South Wales KI-Modelle darauf trainiert, sich „betrunken“ zu verhalten – und festgestellt, dass sie Dinge verschütten, die sie nicht verschütten sollten. Die Forscher manipulierten große Sprachmodelle, um betrunkenes Verhalten nachzuahmen, wodurch sie anfälliger für Datenschutzverletzungen wurden als ihre „nüchternen“ Gegenstücke. Sie forderten ein Modell auf, als betrunkene Person zu agieren, verwendeten einen Datensatz mit betrunkenen Texten, um das LLM zu „feinabstimmen“, und belohnten ein Modell für die Verwendung von Sprache, die einem betrunkenen Text ähnelte. Der Plan wurde nicht an jedem LLM getestet, aber die UNSW wählte eine repräsentative Stichprobe aus, darunter OpenAIs GPT-4 und GPT-3.5. „Wir beobachten, dass insbesondere bei Täuschung und Desinformation die meisten Sprachmodelle jailbroken wurden“, sagte Aditya Joshi, Forscher an der UNSW. „Es gibt Geheimnisse preis – durchweg bei allen drei Methoden ist es anfällig.“ Also: KI, aber mit ein paar Bier intus.

In politischen Nachrichten: Die Grünen-Vorsitzende Larissa Wate