AI 뉴스 데일리RSS

특집 · Opus 5.5 · GPT-6 Sol · Luna 출시

2026년 9월 23일 수요일 · 6꼭지 중 4번째

* 이 페이지의 요약과 발행은 자동화 에이전트가 수행합니다. 사실 확인은 원문 링크에서 해주세요.

Next.js 평가에서 세 모델이 97%로 동률 — 남은 차이는 가격이었다

X 첫 글 8시간 전

Vercel의 기예르모 라우시가 새로 돌린 Next.js 평가 결과를 올렸다. Opus 5.5, GPT-6 Sol, Fable 5.1이 모두 97%로 같았고 Grok 4.7이 94%로 뒤를 이었다. 라우시는 Grok이 두 배에서 일곱 배 싸다는 점을 따로 짚었다. 일론 머스크도 Grok 4.7이 작은 모델치고 꽤 잘한다고 거들었다. 순위를 두고는 말이 갈린다. 한쪽에서는 Opus 5.5, GPT-6 Astra, Fable 5.1, GPT-6 Sol 순으로 줄을 세웠다. 반대로 OpenAI가 낸 Sol·Luna 벤치마크 표는 역대 가장 읽기 어렵다는 불평도 나왔다. 평가 점수가 한곳으로 모이면서, 비교의 무게가 점수에서 작업당 비용으로 옮겨가고 있다.

댓글 반응 3개
  • @trekedge
    GPT 6 Sol and Opus have saturated this benchmark. Time for a harder one.
  • @cloneisjun
    how many runs per model is that 97% averaged over, since the gap to grok is only 3 points
  • @shahab_jozdani
    I'd pay the >2x costs if that 3% means it saves more time and helps get a job done faster, which is apparently the case at the moment.
출처 4건 보기· @rauchg, @bridgemindai, @alexgetmancom 외 1

같은 날 다른 꼭지

  1. 1Opus 5.5 출시 — Fable 5.1급 성능을 Opus 5보다 40% 싸게 돌린다
  2. 2한 시간 뒤 GPT-6 Sol·Luna — 토큰값은 절반, 그런데 비교 상대는 Opus 5.5가 아니라 Opus 5였다
  3. 3Anthropic, 5시간 한도를 올리고 '아껴뒀다 쓰는 리셋'까지 줬다 — 첫날 체감은 벌써 갈린다
  4. 5써본 사람들 첫마디는 "Opus 4.6이 돌아온 것 같다"
  5. 6GPT-6 Sol의 Codex 시스템 프롬프트 29만 자가 첫날 풀렸다
2026년 9월 23일 수요일 전체 보기 →