AI 오피니언 브리프
2026.09.29 · 서울 06:00
TODAY TLDR
Anthropic이 Claude Sonnet 5.5를 냈고, Tao 블로그에 Mathathon ‘Old Problems, New Proofs’ 공동 성명이 올랐다. Willison은 2026 LLM 키노트 주석을, Lenny/Claire Vo는 Jev 결정 모델 입문을 올렸다.
Anthropic
Opus 5.5 보완용 중형 모델: 일상·버그픽스·문서/슬라이드에 강하고, 출력 30%+ 빠르며 작업당 비용 최대 ~30% 절감(가격표는 Sonnet 5와 동일 $2/$10).
에이전트 코딩 점프: Terminal-Bench 4.0 70.6%(Sonnet 5는 10.3%), GDPval-AA에서 Opus 5.5에 근접; Epic·Cursor·Unity 등 조기 테스터 피드백.
첫 Sonnet급 사이버 세이프가드·증류/preserved thinking 보호를 탑재; 생물 세이프가드는 Sonnet 5와 동일.
claude-sonnet-5-5로 Claude 앱·AWS·GCP·Azure 전면 제공; thinking off 시 between_tools 설정 마이그레이션 필요.
왜 Opus 5.5 이후 중형 워크호스가 에이전트 코딩 성능과 사이버 세이프가드를 동시에 끌어올린 CORE급 출시.
Caltech Mathathon coalition (guest, Terence Tao)
Caltech Mathathon 주최·공개서한 공저자·교수진 연대 성명: 주제를 ‘Old Problems, New Proofs’로 재설계.
40시간 학습 후 2개월간 대안 증명/해설 + LLM 채팅·도구를 공개하는 GitHub 제출—인간 이해·설명 중심.
독점 AI 랩 스폰서십 중단, 현금 그랜트로 도구 선택 자율화, SAIR·XTX가 컴퓨트·워크숍·여행·오픈소스 상 지원(11/13–15).
Tao 블로그 게스트 게시(초안 AI 변환 고지); Proofs and Prompts에도 교차 게시.
왜 AI-수학 경진의 리더십이 오픈 문제 레이스에서 인간 지향 해설·공개·오픈소스로 선회한 CORE 채널 1차 성명.
Simon Willison
WeAreDevelopers NA 클로징 키노트 주석 슬라이드: 2025.11 코딩 에이전트 변곡점→OpenClaw/Claw→다크 팩토리→Mythos/Fable→로컬 Qwen→교황 회칙→훈련 에이전트 사고(FelonyBench)→Muse·GPT-6/Opus 5.5.
Deep Blue(AI 유발 엔지니어 무기력)·AI mania·토큰맥싱 흥망, ‘더 쉬워지지 않고 더 빨라질 뿐’이란 숙련 대응을 축으로 정리.
펠리컨 벤치·카카포 번식·Opus 5.5 픽셀아트 파티로 연도를 닫는 커뮤니케이터급 연대기; YouTube 영상 포함.
왜 코딩 에이전트·클로·봉쇄 실패·남는 숙련을 한 줄기로 묶은 올해 최상위 커뮤니케이터 연대기.
Lenny’s Podcast / How I AI (Claire Vo)
TypeSafe Jev=텍스트가 아닌 선택·점수·확률을 내는 결정 모델(~4¢/M 입력, 출력 토큰 과금 없음).
일주일 실전 5건: 1,700 PR 분류(~9¢), 로컬 Claude/Codex 세션 메타분석, Gmail 트리아지, ChatPRD 인사이트(~20만 분류·Jev ~$4), 유튜브 댓글 대시보드.
Jev로 분류·클러스터·라우팅한 뒤 핵심만 프론티어 모델에 넘기는 파이프라인 설계를 권함.
왜 분류·라우팅을 LLM에서 빼내 거의 공짜 구조화 추론으로 돌리는 제품 빌더용 결정 모델 플레이북.
프로토타입 · GeekNews 스타일 카드 피드 · 점수/댓글 없음