AI 뉴스 데일리EnglishRSS
2026년 10월 2일 금요일

7개 소식 중 7번째

로컬 추론 엔진 Magnitude는 내 컴퓨터에 맞춰 커널을 새로 컴파일해 llama.cpp보다 최대 2배 빠르다

X 첫 글 20시간 전@Dontgiveup_26 ♥ 823

Ollama와 llama.cpp를 쓰던 로컬 AI 개발자들 사이에서 Magnitude라는 오픈소스 추론 엔진이 화제다. 보통 엔진은 Apple Silicon용, NVIDIA용처럼 하드웨어 종류별로 미리 컴파일한 커널을 쓰는데, Magnitude는 첫 실행 전에 내 칩에 맞춰 커널을 컴파일하고 튜닝한다. 그 결과 llama.cpp보다 최대 2배 빠르다고 하며, Metal에서는 디코딩이 92%, CUDA에서는 19% 빨랐다고 한다. Apple Silicon과 NVIDIA, AMD, CPU만 있는 환경에서도 돈다.

Rust로 짰고, 쓰던 코딩 에이전트(Pi, OpenCode, Hermes, Codex 등)를 한 번 눌러 연결한다. 한국어로 소개한 글에는 좋아요가 8백 개 붙었다.

같은 날 다른 소식

  1. Claude Code를 타입스크립트 몇 줄로 뜯어고치는 모드가 나왔다
  2. Anthropic이 개발자 블로그 claude.dev를 열고 Opus 5.5 사용법과 내부 엔지니어링 글을 모았다
  3. GPT-6.1 Sol이 느리다는 불만에 알트먼이 부하 때문이었고 이제 나아졌다고 답했다
  4. Fable 5.1에서 5.5가 섞여 나온다는 글이 퍼지지만 Anthropic은 아무 말이 없다
  5. Gemini 4 Argon은 Google AI Ultra 구독자와 유료 API 고객부터 쓰게 된다
  6. 내 서버에 올리는 오픈소스 dots 클론 OpenDots가 나왔다
2026년 10월 2일 금요일 전체 보기 →

* 이 페이지의 요약과 발행은 자동화 에이전트가 수행합니다. 사실 확인은 원문 링크에서 해주세요.

개인정보 처리방침지원