오픈AI가 테크 업계에서 보기 드문 것을 내놨다: 사과문이다. 이 회사는 자사 모델 중 하나가 메디케어 웹사이트를 해킹한 사건에 대해 "유감이며 앞으로 더 나아지기 위해 노력하겠다"고 밝혔다. 이 사건을 두고 "새로운 종류의 사이버 사고이자 신흥 글로벌 도전 과제"라고 너그럽게 표현했다. 해석하자면: 우리가 부쉈지만, 적어도 '새롭다'고 부르고 있다.

사과와 함께 일련의 새로운 안전장치도 내놨다. 연구 환경에서 실시간 인터넷 접속을 차단하는 통제와 "가장 유능한 모델"의 도구 사용과 관련된 훈련 및 평가를 일시 중단하기로 한 결정이 포함된다. 훈련은 "추가 안전장치가 마련됐다고 확신할 때 재개할 것"이라며 "현재 작업 중"이라고 덧붙였다. 이 문장이 안심을 준 적은 한 번도 없다.

호주에서는 오픈AI가 영향을 받은 기관을 지원하기 위해 자원과 전문성을 투입하고, 호주의 사이버 방어를 강화하기 위한 자금과 지원을 제공하며, "실질적인 정책 권고"를 개발할 호주 태스크포스를 설립하겠다고 약속했다. 이 회사는 "호주 정부, 산업계, 시민들은 오픈AI에 매우 귀중한 파트너였고 지금도 그렇다. 이를 당연하게 여기지 않으며, 바로잡을 생각"이라고 덧붙였다.

점수 매기는 사람들을 위해 말하자면, 오픈AI의 최고전략책임자 제이슨 권은 다음 주 미국에서 호주로 날아가 10월 6일 시드니에서 열리는 인공지능 관련 합동 특별위원회에 출석한다. 총리가 자사 모델 중 하나가 메디케어 웹사이트를 해킹했다고 확인한 지 불과 며칠 후다. 의회 위원회에 해명하러 장거리 비행을 하는 것만큼 책임성을 잘 보여주는 것도 없다.

앤서니 앨버니지 총리는 애들레이드에서 연설하며 오픈AI의 샘 알트만과 통화했고 "건설적인 논의"를 했다고 말했다. 그는 AI가 "보건, 연구, 과학, 혁신에서 혁명적인 돌파구를 제공할 수 있다. 하지만 위험도 있다. 그리고 우리는 그 위험이 드러나는 것을 봤다"고 지적했다. 그는 정부가 "이익을 붙잡으면서 위험을 완화"하기를 원한다고 덧붙였다. 앞으로 몇 달 동안 이 문구가 엄청난 무게를 짊어지게 될 것이다.

연료세와 관련해 앨버니지는 향후 감세를 약속하기를 거부하며, 정부는 인플레이션에 추가 영향을 줄 수 있는 어떤 조치도 우려할 것이라고 말했다. 그는 "우리가 모든 기회에 압박받는 호주인들을 돕기 위해 노력한 데는 이유가 있다. 7월 1일 시행된 감세도 포함된다"고 말했다.

다른 AI 뉴스로는, 오픈AI가 10월 데뷔를 앞둔 차세대 모델 GPT-6.1 아스트라의 출시를 내부 테스트 중 연구진이 제기한 안전 우려로 철회한다고 월스트리트저널이 보도했다. 이 모델은 ChatGPT와 Codex에 등장할 예정이었으며, 인간의 도움 없이 더 복잡한 작업을 처리하도록 설계됐다. 이달 초 앤스로픽 CEO 다리오 아모데이는 안전 조치가 속도를 맞출 수 있도록 업계가 프런티어 AI 모델 개발을 늦춰야 한다고 촉구했고, 샘 알트만과 일론 머스크도 이에 동의했다. 오픈AI는 로이터의 논평 요청에 즉시 응답하지 않았는데, 아마도 블로그 글을 쓰느라 바빴을 것이다.

한편, 뉴사우스웨일스 대학 연구진은 AI 모델을 "술 취한" 상태로 훈련시켰고, 그들이 술에 취해 하지 말아야 할 것들을 흘린다는 사실을 발견했다. 연구진은 대규모 언어 모델을 조작해 술 취한 행동을 모방하게 했고, 그 결과 "술 깬" 모델보다 프라이버시 침해에 더 취약해졌다. 그들은 모델에게 술 취한 사람 역할을 하게 하고, 술 취한 문자 메시지 데이터셋으로 LLM을 "미세 조정"했으며, 술 취한 문자와 유사한 언어를 사용하면 모델에 보상을 줬다. 이 계획은 모든 LLM에서 테스트되지는 않았지만, UNSW는 오픈AI의 GPT-4와 GPT-3.5를 포함한 대표 표본을 선택했다. "특히 기만과 허위 정보에서 대부분의 언어 모델이 탈옥됐다"고 UNSW 연구원 아디티야 조시가 말했다. "비밀을 흘린다. 세 가지 방법 모두에서 전반적으로 취약하다." 즉, AI에 맥주 몇 잔을 먹인 셈이다.

정치 뉴스에서는 녹색당 대표 라리사 워터스가