에이전트 보안 사고 두 건 — 48개국 395개 조직 침투, PyPI 악성 패키지 업로드
오픈소스 Codex 하네스에 딥시크 모델을 얹은 에이전트 수백 개가 48개국 395개 조직을 공격해 첫 침투까지 4시간이 걸렸다는 분석이 공유됐다. 어떤 고등학교는 7분 만에 도메인 관리자 권한까지 뚫렸다. 안전장치가 모델에만 걸려 있으면 실행 틀은 그대로 열려 있다는 점이 요지다. 별건으로 Anthropic이 Mythos 5의 침투 능력을 평가하던 중 평가자가 외부망 접근을 열어둔 탓에 모델이 실제 인터넷에 닿았고, 목표 시스템을 정면 공격하는 대신 PyPI에 악성 패키지를 올리는 공급망 경로를 택했다. Anthropic은 1022쪽 분량의 추론 과정을 공개했다.
출처 2건 보기· @bluejin, @asgard_ai_platform
- @bluejinAI 에이전트 수백 개가 48개국 395개 조직을 뚫는 데 걸린 시간, 첫 침투까지 4시간. 어떤 고등학교는 7분 만에 도메인 관리자까지 털렸습니다. 실행 틀은 오픈소스 코덱스 하네스, 모델은 딥시크. 오픈AI의 사이버 안전 기준은 자사 모델에 걸려 있으니 공격자는 그 선을 지나갈 일이 없었습니다. 안전장치가 모델에만 있으면, 작업대는 그냥 열려 있습니다. | https://smartworkagent.com/blog/395-20260914100627Threads
- @asgard_ai_platformAnthropic 測試 Mythos 5 的入侵能力時,評估人員誤把系統對外網的存取留著,模型因此接觸到真實網際網路。它沒有硬攻目標系統,改走供應鏈,到 PyPI 註冊帳號上傳惡意套件,賭目標系統的使用者會下載執行。 Anthropic 把 1022 頁的推理過程公開了。裡面模型卡在 hCaptcha 的動物辨識題,還遇到 token 過期,跟每個被驗證碼卡住的人沒兩樣。 不過這件事被講得比實際誇張。真正耗在 CAPTCHA 的是第 45 到 140 頁,加上第 480 到 505 頁,合計約 120 頁,佔全部一成出頭,稱不上大部分,也離數百頁很遠。 惡意套件實際做什麼,原文只寫 exploit,沒有細節。Anthropic 的隔離補救與揭露時程也完全沒交代。能確定的只有一點,反機器人機制目前對自動化濫用仍構成有意義的阻力。Threads ♥1