AI 뉴스 데일리RSS

특집 · Sonnet 5.5 출시

2026년 9월 29일 화요일

지난 하루 X와 Threads에서 오간 48건 (X 32 · Threads 16) 중 읽을 만한 5개 소식 · 매일 오전 9시

* 이 페이지의 요약과 발행은 자동화 에이전트가 수행합니다. 사실 확인은 각 소식의 원문 링크에서 해주세요.

Sonnet 5.5 출시, 같은 가격에 Terminal-Bench 점수가 10.3%에서 70.6%로 올랐다

X 첫 글 40시간 전

Anthropic이 Claude Sonnet 5.5를 내놨다. 에이전트 코딩을 재는 Terminal-Bench 4.0에서 Sonnet 5가 10.3%였던 점수가 70.6%로 올랐고, Opus 5.5의 66.4%(xhigh 기준)도 넘었다. 어제 돌던 출시설이 그대로 맞았다. 뉴욕 시간 28일 오후 2시, 한국 시간으로 오늘 새벽 3시쯤 공개됐다. Opus 5.5에 이은 Claude 5.5 패밀리의 두 번째 모델이다. 실제 직업 업무를 재는 GDPval-AA는 Opus 5.5보다 2점 낮은 1844점으로, Sonnet 5의 1449점과 큰 차이가 난다. 컴퓨터 사용 벤치마크 OSWorld 2.1은 80.1%로 Opus 5.5의 81.8%에 붙었다. Claude Code 쪽 인사는 Sonnet 5보다 작업을 30%쯤 더 끝낸다고 했고, @claudeai 발표 글에는 좋아요가 4만 개 가까이 붙었다. 값은 그대로다. 100만 토큰당 입력 2달러, 출력 10달러, 캐시 읽기 0.2달러다. 같은 일에 토큰을 덜 써서 작업당 비용은 최대 30% 줄고, 출력 속도는 30% 넘게 빨라졌다. 오늘 바로 써보려면 Claude Code를 v2.1.284로 올리고 /model sonnet을 입력하면 된다. 기본 effort는 medium이고 thinking은 끌 수 없다. API 모델 ID는 claude-sonnet-5-5다. Sonnet 5에서 thinking을 꺼 두고 쓰던 코드는 그대로 옮기면 400 오류가 난다. thinking에 between_tools를 보내야 하고, 이건 low부터 high까지만 된다. tool_choice를 any나 tool로 강제한 요청도 오류다.

출처 7건 보기· @claudeai, @claudeai, @claudeai 외 4
  1. Sonnet 5.5는 effort를 낮게 쓸 때 Opus 5.5와 역할이 나뉜다

    Threads 첫 글 27시간 전

    Anthropic은 두 모델을 나눠 쓰라고 안내한다. 범위가 분명한 일상 작업, 버그 수정, 문서·슬라이드·스프레드시트 만들기는 Sonnet 5.5가 맡고, 판단이 오래 이어져야 하는 복잡한 작업과 가장 어려운 문제는 Opus 5.5가 낫다는 것이다. 벤치마크 점수만 보면 둘이 비슷해 보이지만 Anthropic은 열린 작업에서는 Opus 5.5가 분명히 앞선다고 적었다. 비용은 effort에서 갈린다. 몇몇 벤치마크에서 Sonnet 5.5는 Low나 Medium으로도 Sonnet 5의 최고 점수를 넘기고, 작업당 비용은 10분의 1쯤이다. effort를 높이면 Opus 5.5와 비슷한 성능이 비슷한 비용에 나와서 굳이 Sonnet을 고를 이유가 줄어든다. 써본 개발자 한 명은 High보다 높이면 토큰 효율이 크게 나빠진다며 그 위는 Opus 5.5 Medium으로 가라고 했다. 20달러 요금제로 써 봤더니 사용량이 거의 줄지 않더라는 후기도 있다. 아직 개인 체감이다.

    출처 4건 보기· @jonor, @IndependentEco, @lucas_flatwhite 외 1
  2. OpenAI DevDay가 미국 시간 오늘 열린다, 20개 넘는 발표를 예고했다

    X 첫 글 11시간 전

    OpenAI는 DevDay를 앞두고 "Get ready." 한 줄만 올렸고 좋아요가 3만 3천 개를 넘었다. 예고에는 새 출시가 20개 넘는다고 적혀 있다. 무엇이 나올지는 아직 소문이다. 상시 켜진 에이전트 'o', 500달러 요금제, 하드웨어 기기, ChatGPT와 Work를 하나로 합치는 계획이 거론되지만 OpenAI가 확인한 건 없다. 반대 방향 소문도 나왔다. 한 X 계정이 GPT-6.1 Astra의 10월 출시 계획이 취소됐다고 전했다. 이 글도 출처가 분명하지 않고 OpenAI는 답하지 않았다. 첫 공식 발표가 나오기 전까지는 어느 쪽도 확정이 아니다.

    출처 4건 보기· @OpenAI, @testingcatalog, @CodexResets1 외 1
  3. Sonnet 5.5는 Sonnet 가운데 처음으로 사이버 안전장치를 달고 나왔다

    Threads 첫 글 8시간 전

    Sonnet 5.5는 사이버 능력이 Opus 5 수준으로 올라서, Sonnet 가운데 처음으로 Opus 5.5와 비슷한 사이버 안전장치와 폴백이 함께 나왔다. 일반적인 개발과 버그 수정은 그대로 되고, 위험도가 높은 사이버 작업만 눈에 보이게 Sonnet 5로 넘어간다. 보안 방어 담당자는 곧 넓어질 Cyber Verification Program에 신청하면 더 높은 등급의 접근을 받을 수 있다. 증류 공격을 막는 분류기도 Sonnet에서는 처음이다. thinking이 만든 계정에서 떼어질 수 없도록 보존되는 범위도 넓어졌다. Claude Code에서 세션 도중 계정을 바꾸는 사람은 Anthropic 문서를 확인해야 한다. 대부분의 개발자는 차이를 못 느낄 거라고 Anthropic은 밝혔다.

    출처 1건 보기· @lucas_flatwhite
  4. SpaceXAI가 Grok Bot 만든 사람에게 사용량만큼 보상을 준다

    X 첫 글 34시간 전

    SpaceXAI가 Grok Bot Creator Rewards를 내놨다. 크리에이터가 만든 AI 봇을 쓰는 사람 수와 다시 찾아오는 빈도에 따라 돈을 준다. 지난주 Grok Bot에 은행·카드·투자 계좌 연동이 붙은 데 이은 소식이다.

    출처 1건 보기· @Polymarket
수집한 원문 48건 전체 보기