AI 뉴스 데일리RSS

뉴스가 되기 전에, 타임라인에서 먼저

2026년 9월 16일 수요일

지난 하루 X와 Threads에서 오간 150건 (X 120 · Threads 30) 중 읽을 만한 14꼭지 · 매일 오전 9시

사내 코드 80%를 Claude가 쓰는 Anthropic — 대신 CI가 6개월 만에 25배로 늘었다

Anthropic이 자사 개발 현황을 공개했다. 사내 코드의 80%를 Claude가 작성하고 엔지니어 한 명당 분기 코드 출하량이 8배로 늘었다. 그 반동으로 테스트 양이 10배, CI 작업이 6개월 만에 25배로 폭증했다. 코드 생산 속도가 아니라 그 뒤의 검증 인프라가 병목이 된다는 얘기로, 무엇이 도움이 됐는지를 정리한 글을 함께 냈다. 같은 진단이 커뮤니티에서도 나왔다. Vibe Coding을 하다 보면 아이디어가 아니라 검증이 병목이 되고, 기능이 너무 빨리 늘어 하나씩 테스트할 틈이 없다는 것이다. Codex와 Claude Code 자신들도 잔버그가 자주 보이는데 AI로 개발 속도를 올린 대가로 보인다는 지적이다.

출처 3건 보기· @addyosmani, @HedgehogPython, @dotey
  1. GPT-5.5는 10월 14일 종료, GPT-6 Sol은 이번 주 나올 듯

    OpenAI가 10월 14일 ChatGPT·ChatGPT Work·Codex 전 플랜에서 GPT-5.5를 내린다고 공지했다. Codex에서 쓰던 사람은 GPT-5.6 Sol이나 GPT-6 Astra로 옮기라고 안내했다. 한편 GPT-6 Sol이 목요일 공개된다는 관측이 돌고, 일부 5.6 Sol 요청이 이미 내부적으로 GPT-6 Sol로 라우팅되고 있다는 제보도 나왔다. 가격은 5.6 Sol과 같은 선에서 유지될 것이라는 추측이 붙었다.

    출처 4건 보기· @ChatGPT, @Codexresets_, @AndrewCurran_ 외 1
  2. 지출에서 OpenAI가 Anthropic을 앞질렀다 — 개발자도, 기업도

    모델 중개 서비스 OpenRouter가 지난주 이용자들의 OpenAI 모델 지출이 Anthropic 모델 지출을 넘어섰다고 밝혔다. 2년 반 넘게 없던 역전이다. 기업 쪽도 같은 방향으로, Ramp 데이터 기준 이번 주 기업 AI 지출에서 Astra가 13%로 Fable(8%)을 앞섰다. Anthropic이 최전선 속도를 늦추자고 나선 사이 자사 최신 모델의 채택이 먼저 밀렸다는 해석이 붙었다. 개발자가 실제로 돈을 쓰는 곳을 보여주는 지표라 벤치마크 순위보다 체감에 가깝다.

    출처 2건 보기· @OpenRouter, @arakharazian
  3. Anthropic이 교사에게 Claude Pro를 1년 무료로 준다

    Anthropic이 교사 대상 Claude 프로그램으로 1년치 프로 기능을 결제 정보 없이 제공한다는 안내가 돌았다. 신청 페이지에서 인증을 마치면 Claude Code와 Cowork, 수업용 스킬과 커리큘럼 도구까지 함께 열린다. 학교나 학원 소속이면 확인해볼 만하다.

    출처 1건 보기· @pengsonal
  4. 서울대 ChatGPT 무제한, 1년치가 한 달 만에 동났다

    올해부터 교내에 ChatGPT를 무제한 제공한 서울대에서 1년 예산 분량이 한 달 만에 소진됐다는 이야기가 돌았다. 무제한에서 월 2만 크레딧으로, 다시 월 7천 크레딧으로 줄었고 현재 기준으로는 Sol 모델로 월 700번 대화하면 소진되는 수준이다. 대학이 AI 사용량을 어떻게 잡아야 하는지 감이 아직 없다는 걸 보여주는 사례다.

    출처 1건 보기· @admi_alts
  5. Opus 5.2 유출 정황이 늘었다 — Microsoft Foundry에 슬러그까지

    Anthropic이 Opus 5.1을 건너뛰고 5.2로 가는 것으로 보인다는 관측이 이어졌다. Claude Code 안에서 테스트 중이고 일부 트래픽이 이미 5.2로 라우팅되고 있다는 제보에 더해, Microsoft Foundry에 "claude-opus-5-2" 슬러그가 나타났다는 이야기가 더해졌다. Fable 5.1을 넘어선다는 주장도 있으나 모두 사용자 관측이고 공식 발표는 없다.

    출처 1건 보기· @Mr_Salio
  6. ChatGPT 공동 개발자가 2년 스텔스 끝에 새 모델 Jev 공개 — "20~200배 빠르다"

    ChatGPT를 함께 만든 연구자가 2년간 비공개로 개발한 학습 방식 RLCD와 그 위에서 만든 모델 Jev를 공개했다. 기존 대비 20~200배 빠르고 40~400배 저렴하며 출력 토큰은 무료라고 밝혔다. 초대형 채팅 모델이 왜 AGI로 이어지지 않았는가에서 출발했다는 설명이다. 벤치마크 검증은 아직 외부에서 이뤄지지 않았다.

    출처 1건 보기· @CompleteSkeptic
  7. Codex 한도 불만에 리셋 타이머 문제까지 — 기능 통합이 한도 축소로 번질까 우려

    Codex 사용량이 너무 빨리 닳는다는 불만이 이어지는 가운데 새 문제가 지목됐다. 리셋 후 다음 메시지를 보낼 때까지 7일 시계가 시작되지 않아, 사흘 쉬면 "주간" 리셋 사이가 10일이 된다는 것이다. Claude는 그렇지 않다는 비교가 함께 나왔다. 별개로 한 이용자가 Chat·Work·Codex가 나뉘어 있어 헷갈린다고 하자 OpenAI 쪽에서 고치겠다고 답했는데, 지금은 각각 별도 한도를 받는 구조라 "합쳐지면서 총량이 줄어드는 것 아니냐"는 반응이 번졌다. 월 200달러 20x 요금제 이용자도 한도에 막혀 계정 리셋을 부탁해야 하는 상황이 목격됐다는 글도 돌았다.

    출처 6건 보기· @buildwithrajath, @miu21590, @shownotover 외 3
  8. Gemini 3.8 Live 공개 — 도구를 쓰는 중에도 대화가 끊기지 않는 음성 모델

    구글 딥마인드가 Gemini 3.8 Live와 Live Extended Thinking을 냈다. 무전기처럼 번갈아 말하는 턴 방식이 아니라 full duplex로, 도구 호출이 백그라운드에서 도는 동안에도 대화를 이어갈 수 있다. Extended Thinking은 대화 중 백그라운드 추론까지 더한다. 같은 영역에서 OpenAI의 GPT-Live-1은 Artificial Analysis 음성 지수 81.5점으로 1위에 올랐는데, 추론과 도구 사용을 뒤쪽 텍스트 모델에 위임하면서 대화를 유지하는 방식이다.

    출처 4건 보기· @GoogleDeepMind, @Google, @ArtificialAnlys 외 1
  9. Claude Code 2.1.273에 세션 포킹 — 모바일에서 켠 세션을 로컬에서 이어받는다

    Claude Code 2.1.273에 세션 포킹이 들어갔다. 모바일이나 웹에서 시작한 세션을 로컬 머신에서 그대로 이어받는 흐름이 처음 열렸다. 이동 중에 방향만 잡아두고 실제 작업은 데스크톱에서 잇는 식이 가능해진다.

    출처 1건 보기· @think.5x
  10. Karpathy가 Anthropic 합류 후 첫 강연 — 주제는 하네스

    안드레이 카파시가 Anthropic에 합류한 뒤 첫 강연을 했다. 에이전트, 루프, 하네스, 자기개선 시스템 네 가지를 다뤘다. 같은 날 한국어권에서도 하네스 논의가 돌았는데, 훅·스킬·문서·툴로 에이전트가 움직일 수 있는 범위를 먼저 짜두고 그 안에서만 돌게 하는 설계이며 엣지 케이스 처리가 핵심이라는 정리다. 하네스는 루프와 상태·권한까지 쥐고, 프레임워크는 구성요소만 주고 제어권은 사용자에게 남기며, MCP는 프로토콜만 담당한다는 역할 구분도 함께 공유됐다.

    출처 3건 보기· @tspy, @data_richard, @eonsflow
  11. 실험실 데이터로 학습한 소형 모델이 대형 모델을 이겼다는 보고 두 건

    OpenAI 쪽 연구자가 멘로파크에 고속 실험 재료 연구소를 짓고 실험과 모델을 순환시키는 구조를 공개했다. H200 1,300장과 몇 달치 자체 실험 데이터만으로 오픈소스 모델을 중간학습·강화학습해 자사 평가에서 GPT-6 Astra를 넘겼다고 밝혔다. 초전도체 연구실 데이터로 조 단위 파라미터 모델을 학습시켜 Astra와 Fable보다 낫다는 별도 보고도 나왔다. 둘 다 자체 평가 기준이라는 점은 감안해야 한다.

    출처 2건 보기· @LiamFedus, @khoomeik
  12. AI 에이전트 인증 표준이 보험을 끌어들이기 시작했다

    AI 인수심사 회사 AIUC가 9월 15일 4천만 달러 시리즈 A를 발표하며 AIUC-1 인증 표준을 내세웠다. 에이전트가 인증을 받으려면 레드팀 테스트를 보통 1,000~5,000개 시나리오로 돌린다. 에이전트를 실제 업무에 붙이려는 기업이 늘면서 "이 에이전트가 사고를 내면 누가 책임지나"를 보험과 인증으로 다루려는 움직임이 나오고 있다.

    출처 1건 보기· @thearchv.ai
  13. Anthropic 규제 포획 의혹, 중국의 거부와 기사 삭제까지 번짐

    한 이용자가 Anthropic의 재무를 자체 감사했다며 "구조적으로 규제 포획을 멈출 수 없는 회사"라고 주장하고 의회 조사를 요구했다. 개인의 주장이고 검증된 감사는 아니지만 3만 회 넘는 반응이 붙었다. 여기에 Anthropic이 AI를 감독할 제3자로 내세운 기관이 실은 Anthropic의 자금 지원을 받는다는 지적, 마이클 버리의 "감속 요구는 선두 주자에게만 이롭다"는 비판이 겹쳤다. 감속을 말한 지 두 달 만에 양사가 신모델을 냈다는 비꼼도 돈다. 트럼프는 AI 우려를 "병적인 음모"로 일축하며 아모데이를 다시 지목했다. 국제 쪽으로도 번졌다. 중국은 Anthropic이 제안한 독립 AI 안전 감시 기구를 거부하고 국가 주도 보안 평가와 외부 테스트를 택하겠다고 밝혔다. 한편 Anthropic이 중국 대형 모델들이 중국 사용자 데이터를 자사 모델 증류 학습에 유출했다고 주장한 차이신 9월 12일자 기사가 9월 15일 접속 불가가 되고 원래 링크가 404로 바뀌었다는 관측도 나왔다.

    출처 8건 보기· @kevinnbass, @profstonge, @Polymarket 외 5
수집한 원문 150건 전체 보기

슬랙으로 받기

받고 싶은 채널에서 아래를 입력하면 매일 아침 한 건으로 옵니다. 해지는 같은 자리에서 /feed list.

/feed subscribe https://ailetter.ai.kr/daily.xml

RSS 리더를 쓴다면 /feed.xml이 꼭지별로 나뉘어 있어 더 편합니다.

9월 16일 AI 소식 — 사내 코드 80%를 Claude가 쓰는 Anthropic — 대신 CI가 6개월 만에 25배로 늘었다