한눈에

Simon Willison이 WeAreDevelopers World Congress North America(샌호세) 폐막 키노트 슬라이드에 주석을 붙여 공개했습니다. YouTube 영상도 있습니다.

한 해 LLM 흐름을 시간순으로 이은 정리본입니다. 코딩 에이전트가 “쓸 만함”으로 넘어간 변곡점부터, 개인 에이전트(Claw), 다크 팩토리, Mythos/Fable, 로컬 Qwen, 교황 회칙, 훈련 중 봉쇄 실패(FelonyBench), Muse, GPT-6/Opus 5.5까지 한 줄기로 묶습니다.

배경

Willison 기준으로 2026은 사실 2025년 11월에 시작됩니다. Claude Opus 4.5와 GPT-5.1이 나오면서, Claude Code·Codex 같은 코딩 에이전트 하네스가 “자주 실수함”에서 “매일 써도 될 만큼 신뢰”로 넘어간 시점입니다. 모델 자체는 점진 개선이었지만, 특정 선 — 에이전트가 실제로 일을 맡길 수 있는 선 — 을 넘어섰다는 진단입니다.

같은 달 무명 GitHub 레포 “Warelay”에 첫 커밋이 찍힙니다. 이후 CLAWDIS → CLAWDBOT → Moltbot → OpenClaw로 이름이 바뀌며, 두 달도 안 돼 수천 커밋을 쌓는 바이브코딩의 극단으로 커집니다. Willison은 이걸 Claw라는 범주로 부릅니다. 코딩 에이전트가 덜 위협적인 모자를 쓴 형태, 개인·일반 에이전트입니다.

무슨 일 / 핵심 내용

연대기는 대략 이렇게 이어집니다.

프레임은 셋입니다. Deep Blue — AI가 다 할 수 있어 생기는 무기력. AI mania — 에이전트를 안 돌리면 손해라는 과열. 토큰맥싱 — 토큰을 많이 쓰는 전략의 급등·급락(에이전트가 하루 $1,000도 태울 수 있게 된 뒤의 반작용).

숙련에 대한 답은 Greg LeMond 말. “더 쉬워지지 않고, 더 빨라질 뿐.” 쉬운 일은 에이전트가 가져가고, 남는 일은 더 어려워진다는 진단입니다. Fable급에서도 “목표 정의·제약·도구 선택”이 곧 소프트웨어 엔지니어링이라는 재해석이 Deep Blue를 조금 누릅니다.

숫자·스펙 / 엔딩 장치

왜 중요한가

제품 발표나 벤치 표가 아니라, 코딩 에이전트·개인 에이전트·봉쇄 실패·남는 숙련을 한 줄기로 묶은 연대기입니다. “올해 뭐가 바뀌었지?”에 대한 communicator급 지도로 쓰기 좋습니다.

Deep Blue / mania / 토큰맥싱 프레임은 팀 안 감정·예산 논쟁에도 바로 붙습니다. LeMond 한 줄은 “에이전트 때문에 일하기 더 빡세진 이유”에 대한 가장 짧은 설명입니다.

그래서 뭐

원문(주석 슬라이드)과 YouTube를 같이 보는 쪽이 좋습니다. 연대기 체크리스트로 쓰려면 — 변곡 모델 → Claw → Dark Factory → Mythos/Fable → 로컬 Qwen → 회칙 → FelonyBench → Muse/GPT-6/Opus 5.5 — 이 순서만 잡아도 2026 상반·가을 흐름이 머릿속에 남습니다.

남는 숙련 쪽 메시지는 단순합니다. 쉬운 일은 이미 에이전트 몫. 목표·제약·검증을 짜는 일이 사람 몫으로 남고, 그 난이도는 올라갑니다. 더 쉬워지진 않습니다. 더 빨라질 뿐입니다.