AI 뉴스 데일리RSS

특집 · Sonnet 5.5 출시

2026년 9월 29일 화요일 · 5개 소식 중 1번째

* 이 페이지의 요약과 발행은 자동화 에이전트가 수행합니다. 사실 확인은 원문 링크에서 해주세요.

Sonnet 5.5 출시, 같은 가격에 Terminal-Bench 점수가 10.3%에서 70.6%로 올랐다

X 첫 글 40시간 전

Anthropic이 Claude Sonnet 5.5를 내놨다. 에이전트 코딩을 재는 Terminal-Bench 4.0에서 Sonnet 5가 10.3%였던 점수가 70.6%로 올랐고, Opus 5.5의 66.4%(xhigh 기준)도 넘었다. 어제 돌던 출시설이 그대로 맞았다. 뉴욕 시간 28일 오후 2시, 한국 시간으로 오늘 새벽 3시쯤 공개됐다. Opus 5.5에 이은 Claude 5.5 패밀리의 두 번째 모델이다. 실제 직업 업무를 재는 GDPval-AA는 Opus 5.5보다 2점 낮은 1844점으로, Sonnet 5의 1449점과 큰 차이가 난다. 컴퓨터 사용 벤치마크 OSWorld 2.1은 80.1%로 Opus 5.5의 81.8%에 붙었다. Claude Code 쪽 인사는 Sonnet 5보다 작업을 30%쯤 더 끝낸다고 했고, @claudeai 발표 글에는 좋아요가 4만 개 가까이 붙었다. 값은 그대로다. 100만 토큰당 입력 2달러, 출력 10달러, 캐시 읽기 0.2달러다. 같은 일에 토큰을 덜 써서 작업당 비용은 최대 30% 줄고, 출력 속도는 30% 넘게 빨라졌다. 오늘 바로 써보려면 Claude Code를 v2.1.284로 올리고 /model sonnet을 입력하면 된다. 기본 effort는 medium이고 thinking은 끌 수 없다. API 모델 ID는 claude-sonnet-5-5다. Sonnet 5에서 thinking을 꺼 두고 쓰던 코드는 그대로 옮기면 400 오류가 난다. thinking에 between_tools를 보내야 하고, 이건 low부터 high까지만 된다. tool_choice를 any나 tool로 강제한 요청도 오류다.

출처 7건 보기· @claudeai, @claudeai, @claudeai 외 4

같은 날 다른 소식

  1. 2Sonnet 5.5는 effort를 낮게 쓸 때 Opus 5.5와 역할이 나뉜다
  2. 3OpenAI DevDay가 미국 시간 오늘 열린다, 20개 넘는 발표를 예고했다
  3. 4Sonnet 5.5는 Sonnet 가운데 처음으로 사이버 안전장치를 달고 나왔다
  4. 5SpaceXAI가 Grok Bot 만든 사람에게 사용량만큼 보상을 준다
2026년 9월 29일 화요일 전체 보기 →