AI 뉴스 데일리RSS

특집 · Opus 5.5 · GPT-6 Sol · Luna 출시

2026년 9월 23일 수요일

지난 하루 X와 Threads에서 오간 73건 (X 65 · Threads 8) 중 읽을 만한 6꼭지 · 매일 오전 9시

* 이 페이지의 요약과 발행은 자동화 에이전트가 수행합니다. 사실 확인은 각 꼭지의 원문 링크에서 해주세요.

Opus 5.5 출시 — Fable 5.1급 성능을 Opus 5보다 40% 싸게 돌린다

X 첫 글 8시간 전

Anthropic이 Claude 5.5 계열의 첫 모델 Opus 5.5를 냈다. 대부분의 작업에서 Fable 5.1 수준을 내면서, 돌리는 비용은 Opus 5보다 40% 적다는 게 공식 설명이다. 속도도 Opus 5보다 30% 넘게 빠르다. 독립 평가 기관 Artificial Analysis는 발표 직후 Opus 5.5를 자기 지능 지수 1위에 올렸다. 가격은 20% 내렸고 캐시 적중 할인 폭도 키웠다고 적었다. Terminal-Bench 4.0과 AutomationBench-AA에서는 GPT-6 Astra와 같은 수준까지 올라왔다. 공개된 표를 옮긴 글에 따르면 Terminal-Bench에서 Opus 5.5는 66.4%로 Astra의 57.9%를 넘었고, 과학 연구 항목은 Opus 5의 29%에서 58.7%로 두 배 가까이 뛰었다. 한국어 사용자 쪽에서는 안전장치가 눈에 띈다는 반응이 나왔다. 작업마다 분류기를 두어 사용자가 지시한 범위를 벗어나거나 위험한 행동을 거른다는 것이다. 같은 글은 그래도 GPT-6 Sol보다 두 배 비싸다고 짚었다.

댓글 반응 4개
  • @jayzhoupro
    a cache discount is the difference between an agent loop you leave running and one you babysit.
  • @ChristiexAI
    ff the early reactions hold up, the bigger win may be that it feels less exhausting to use. faster and cheaper is great, but people have been begging frontier models to stop replying like they swallowed a corporate handbook.
  • @ItsGoharr1
    the index everyone quotes only when they win
  • @marcgehring
    So the read is parity with GPT-6 Astra on the agentic evals, Terminal-Bench and AutomationBench included. The part an index like this rarely shows: does the score count recovery after a wrong step, or only reaching the goal on the first try
출처 5건 보기· @claudeai, @ArtificialAnlys, @DanDr1s 외 2
  1. 한 시간 뒤 GPT-6 Sol·Luna — 토큰값은 절반, 그런데 비교 상대는 Opus 5.5가 아니라 Opus 5였다

    X 첫 글 7시간 전

    Opus 5.5 발표 한 시간쯤 뒤 OpenAI가 GPT-6 Sol과 GPT-6 Luna를 내놨다. GPT-6 Astra의 성능을 더 빠르고 싼 모델로 옮긴 것이고, 캐싱과 추론 효율도 함께 끌어올렸다고 했다. 샘 올트먼은 두 모델이 5.6 계열보다 지능, 정렬, 작업 결과물, 코딩, 컴퓨터 사용에서 크게 나아졌고 토큰당 가격은 절반, 작업당 가격은 그보다 더 싸다고 했다. 이어서 "작업당 가격으로 비교하면 시장 어디에도 경쟁할 만한 게 없다고 본다"고 적었다. OpenAI 쪽 인사는 Sol이 Claude Opus 5를 비용의 9%로 앞선다고 소개했다. 비교 대상은 같은 날 나온 Opus 5.5가 아니라 이전 세대인 Opus 5다. Codex에도 곧바로 들어갔다. 국내 사용자 사이에서는 Sol이 GPT-5.6 Terra 정도 가격이라 간단한 대화는 Sol로 돌리면 되겠다는 계산이 나왔다. OpenAI DevDay에 GPT-6.1 Astra가 나온다는 루머도 벌써 돈다.

    댓글 반응 3개
    • @lorenzo_madeit
      Sol and Luna change the economics of trial and error: teams can run more parallel experiments, keep Astra for the hard cases, and ship with fewer compromises.
    • @venodeLabs
      Faster and cheaper models help work at scale — they don't define what "good enough to ship" means in a named workflow. The ops cut is still: which tasks can fail, who can stop a rollout, and whether evals mirror the live exception path.
    • @robertdomlewski1
      Sol and Luna under the Astra umbrella is a clean way to grow the 6 lineup.
    출처 8건 보기· @OpenAI, @sama, @sama 외 5
  2. Anthropic, 5시간 한도를 올리고 '아껴뒀다 쓰는 리셋'까지 줬다 — 첫날 체감은 벌써 갈린다

    X 첫 글 8시간 전

    Anthropic은 모델과 함께 요금제도 손봤다. Pro, Max, Team의 5시간 사용 한도를 올렸고, 구독자에게 한도 리셋을 한 번 준다. 받자마자 쓰지 않고 저장해뒀다가 원할 때 꺼내 쓸 수 있다. 사용자들은 Anthropic이 처음으로 '적립형 리셋'을 줬다며 반겼다. 써본 뒤 체감은 엇갈린다. 온종일 Opus 5.5를 세게 돌렸는데 한도가 거의 줄지 않았다는 후기가 있는 반면, 역대 가장 토큰을 많이 먹는 모델이라는 글도 올라왔다. Sonnet 5.5와 Haiku 5.5는 몇 주 안에 나온다. 두 모델 모두 Opus 5.5의 성능, 효율, 안전 개선 상당 부분을 이어받는다.

    출처 5건 보기· @claudeai, @argofowl, @theo 외 2
  3. Next.js 평가에서 세 모델이 97%로 동률 — 남은 차이는 가격이었다

    X 첫 글 6시간 전

    Vercel의 기예르모 라우시가 새로 돌린 Next.js 평가 결과를 올렸다. Opus 5.5, GPT-6 Sol, Fable 5.1이 모두 97%로 같았고 Grok 4.7이 94%로 뒤를 이었다. 라우시는 Grok이 두 배에서 일곱 배 싸다는 점을 따로 짚었다. 일론 머스크도 Grok 4.7이 작은 모델치고 꽤 잘한다고 거들었다. 순위를 두고는 말이 갈린다. 한쪽에서는 Opus 5.5, GPT-6 Astra, Fable 5.1, GPT-6 Sol 순으로 줄을 세웠다. 반대로 OpenAI가 낸 Sol·Luna 벤치마크 표는 역대 가장 읽기 어렵다는 불평도 나왔다. 평가 점수가 한곳으로 모이면서, 비교의 무게가 점수에서 작업당 비용으로 옮겨가고 있다.

    댓글 반응 3개
    • @trekedge
      GPT 6 Sol and Opus have saturated this benchmark. Time for a harder one.
    • @cloneisjun
      how many runs per model is that 97% averaged over, since the gap to grok is only 3 points
    • @shahab_jozdani
      I'd pay the >2x costs if that 3% means it saves more time and helps get a job done faster, which is apparently the case at the moment.
    출처 4건 보기· @rauchg, @bridgemindai, @alexgetmancom 외 1
  4. 써본 사람들 첫마디는 "Opus 4.6이 돌아온 것 같다"

    X 첫 글 9시간 전

    첫날 후기에서 가장 많이 나온 말은 속도와 말수였다. "훨씬 빠르고 훨씬 덜 장황하다, 아끼던 Opus 4.6이 더 좋아져서 5.5라는 이름으로 돌아온 것 같다"는 글과 "훨씬 똑똑해진 Opus 4.6과 대화하는 느낌"이라는 글이 나란히 올라왔다. 지금까지 써본 모델 중 시각 디자인이 가장 낫다는 평가도 있었다. 결과물 자랑도 쏟아졌다. 안티키티라 기계에서 영감을 받은 게임을 3MB짜리 HTML 파일 하나로 만들었고, 브라우저에서 도는 마인크래프트도 나왔다. 같은 프롬프트로 PS5 컨트롤러 SVG를 그리게 해 Sol과 나란히 놓은 비교도 돌았다. 갈아타겠다는 사람도 나왔다. Codex 구독을 해지하고 Claude로 돌아간다며 "Opus 5.5 하나로 충분했다"는 글이다. Sol을 두고는 "Opus 5.5에는 큰 모델 특유의 냄새가 나는데 Sol에는 없다"는 평이 붙었다. 출시 전에는 Vals의 PR에 'claude-wafer-eap'라는 이름으로 먼저 잡혔는데, 첫 도구 호출 전까지 한 턴에 10분 가까이 추론하는 모습이 보였다고 한다.

    출처 9건 보기· @kimmonismus, @mattshumer_, @other__reality 외 6
  5. GPT-6 Sol의 Codex 시스템 프롬프트 29만 자가 첫날 풀렸다

    X 첫 글 3시간 전

    탈옥으로 잘 알려진 elder_plinius가 GPT-6 Sol Codex의 시스템 프롬프트와 도구 정의 전체를 뽑아냈다며 링크를 올렸다. 추출한 텍스트는 29만 4천 자가 넘는다. 출시 당일 몇 시간 만이다.

    출처 1건 보기· @elder_plinius
수집한 원문 73건 전체 보기