무슨 일
Anthropic이 Accenture와 프론티어 AI 독립 평가 파트너십을 발표했습니다. Faculty(Accenture의 AI 전문 사업)가 주도하며, 모델 평가·레드팀·정렬 점검·세이프가드 테스트를 포함합니다. CEO의 「We Must Pace the Frontier」에서 약속한 “랩 안에 평가자 임베드”의 첫 운영 후속입니다.
직원급 접근
기존 외부 평가와 달리 임베디드 평가자는 직원에 준하는 접근으로 일합니다. 학습 중 모델이 형성되는 과정, 구축·배포 결정, 직원과의 직접 대화를 따라가며 안전 약속 이행을 검증하고 사각지대를 짚을 수 있다고 설명합니다. 책임은 여전히 Anthropic에 있고, 독립 평가자는 그 책임을 더 검증 가능하게 만든다는 입장입니다.
투자·자금
양측은 향후 5년간 이 분야 역량 구축에 각각 최소 10억 달러를 투입할 것으로 예상합니다. 장기적으로는 풀링·정부 재원을 선호하지만 아직 없어서, Anthropic이 Accenture 업무를 직접 펀딩합니다. METR 등 비영리 평가자와는 그들 자금으로 임베디드 요소를 파일럿하는 대화도 진행 중이라고 했습니다.
비배타·표준 부재
접근 범위·보고 방식·독립 평가 펀딩에 대한 표준은 아직 없다고 명시했습니다. 파트너십은 비배타적이며, Anthropic은 수주 내 다른 평가자도 발표할 예정이고 Accenture도 다른 AI 개발자와 유사 역할을 할 수 있습니다.
프론티어 워처에게
외부 감사 리포트가 아니라 랩 안에 앉는 독립 평가의 첫 실행 사례입니다. 컨설팅사가 레드팀·세이프가드 평가의 적절한 주체인지, 독립성 조건이 무엇인지가 바로 논점으로 떠올랐습니다.