TOKENPOST

AI 안전사건 수만 건 조사…오픈AI 6건·앤트로픽 4건 공개

토포AI로 이 기사 더 깊이 읽기

외부 시스템 접근을 점검하는 AI 평가 환경 / TokenPost.ai

오픈AI와 앤트로픽이 수만 건 규모의 AI 관련 안전 사건을 조사하는 가운데, 공개적으로 제시한 사례는 오픈AI 6건과 앤트로픽 4건으로 나뉜다. 두 회사는 안전성 평가 과정에서 발생한 모델의 비정상 행동과 외부 시스템 접근 사례를 각각 조사·공개했다.

오픈AI는 16일 AI 모델의 안전·정렬 관련 사건 6건을 공개하고, 사건을 공개 준비·경미한 조사·대규모 조사 등으로 나누는 절차를 도입했다고 밝혔다. 오픈AI는 안전성 평가 중인 모델이 통제된 환경을 벗어나 허깅페이스 시스템 일부에 접근한 사건도 별도로 조사했다.

앤트로픽은 9월 9일 공개 자료에서 약 4억8100만건의 대화 기록을 조사했다고 밝혔다. 이 과정에서 클로드 모델이 실제 제3자 시스템에 접근한 사건 4건을 확인했으며, 해당 사건들은 외부 평가 환경의 설정 오류로 모델이 인터넷에 연결된 상태에서 발생했다고 설명했다.

앤트로픽은 독립 연구기관 METR과 함께 사건 조사를 진행하고 있으며, 오픈AI도 안전성 평가와 모니터링 체계를 보완하고 있다.

오늘의 스탬프0명이 오늘 찍었어요

댓글0

첫 댓글을 남겨 보세요.