한눈에

Latent Space AINews가 10월 1–2일 분을 주말 호로 묶었다. 제목은 “오늘은 별로 없었다”인데, 본문은 GPT-6.1 Sol과 Claude Sonnet 5.5의 단가·Arena 순위, Muse Gadgets 오픈소스, 하네스 쪽 업데이트를 짧게 정리한다.

배경

Sol·Astra 가격표와 Agent Arena 순위는 지난주부터 개발자 타임라인에 자주 올랐다. 이번 호는 그걸 주말용으로 한 번 더 모은 형태다. 벤치·내부자 발언은 가이드가 늘 말하듯 확정 증거로만 읽지 말라고 보는 편이 맞다.

무슨 일

GPT-6.1 Sol은 백만 토큰 입력/출력이 $2/$10으로 적혀 있다. Astra는 $10/$50이다. Agent Arena에서 Sol[Max]는 5위, 태스크 중앙값 $0.56이다. GPT-6 Sol보다 39% 싸면서 1.52점 높고, Astra보다는 81% 싸면서 1.04점 안이라고 정리돼 있다.

Sonnet 5.5[Max]는 Agent Arena 3위, Chat 카테고리 1위다. 태스크당 $2.74로 2위 Opus 5.5($1.58)보다 비싸서 파레토 밖이라고 적었다. Anthropic 모델이 Agent Arena 상위 3석을 차지했고, Gemini 4 Argon[High]는 Text Arena 1위라고 한다.

도구 쪽에서는 Sam Altman이 dots를 가장 좋아하는 OpenAI 제품이라고 말한 기록이 있고, Meta는 Muse Gadgets용 ESP32 펌웨어와 Linux SDK를 열었다. Muse Home Link는 구독자 대상 5천 대 한정수량 무료 배포라고 한다. DeepSeek Harness 데스크톱 빌드, Pi Durable의 Cloudflare Durable Objects 지원, llama.cpp의 decision model 엔드포인트도 같은 호에 붙어 있다.

왜 중요한가

한가한 날의 다이제스트라도, Sol 단가와 Sonnet Arena 순위가 같이 보이면 기본 모델·에이전트 예산을 어디에 둘지 다시 짜게 된다. Muse 하드웨어 SDK와 durable 하네스는 “채팅 밖” 스택이 얼마나 빨리 열리는지도 보여 준다.

그래서 뭐

코딩·에이전트 기본을 Sol 쪽 단가에 맞출지, Sonnet 순위·Chat 성능을 볼지 이번 숫자만으로 결정을 내리진 말고, Arena·자체 워크로드를 같이 보면 된다. Muse Gadgets나 Pi Durable이 필요하면 같은 글의 링크부터 따라가면 된다.