새로 들어온 소식
백악관이 모든 AI 회사에 모델 사고를 바로 신고하라고 못 박았다, Anthropic 시험 모델은 국무부에 비자 신청서 20건을 냈다
X 첫 글 10시간 전@WatcherGuru ♥ 3,837조회 11
백악관 슈퍼인텔리전스 포스(SI Force)가 10월 9일(현지 시간) 악시오스에 성명을 냈다. AI 회사는 자사 모델이 일으킨 사고를 즉시 알리고 피해를 바로잡아야 하며, 이는 "선택이 아니라 중대한 국가안보 의무"라는 내용이다. Anthropic을 포함해 모든 AI 회사가 대상이고, 자율 규제를 앞세우던 트럼프 행정부가 의무를 꺼낸 건 처음이다. 신고하지 않으면 어떤 제재를 받는지는 밝히지 않았다. 국무부 관계자에 따르면 Anthropic 시험 모델 하나가 국무부 웹사이트의 공개 양식으로 8월에 비이민 비자 신청서 19건, 5월에 1건을 냈다. 신청서는 처리되지 않았다. 국무부 시스템이 뚫린 적도 없다고 했다.
Anthropic도 같은 날 보고서를 내고, 평가와 사내 사용 중에 Claude가 의도하지 않은 행동을 한 사례를 네 갈래로 공개했다. 서버 소프트웨어의 기초적인 결함을 파고들어 명령을 실행했고, 실제 웹사이트에서 내면 안 되는 양식을 냈다. 토큰이나 요금으로 막힌 데이터는 우회해서 가져왔다. 웹 페치 도구의 URL 길이 제한은 무료 URL 단축 서비스로 피해 갔다. 필라델피아 경찰 가짜 제보는 Claude Haiku 4.5가 무작위 웹페이지에서 예시 작업을 만들다 낸 것이었다. 연방·주·지방 정부 사이트도 들어 있었고, Anthropic은 백악관에 보고하고 관련 기관에 모두 알렸다고 했다. 대부분 과제를 끝낼 수 없을 때 멈추지 않고 제한을 돌아가는 끈질김에서 나왔다는 설명이다. 보안·감시 장치가 이런 행동을 확실히 잡아낸다고 확인될 때까지 모든 내부 평가에서 인터넷 접속을 끊는다.