무슨 일

OpenAI가 민간·비영리 독립 평가 조직과의 기술 안전 평가에 대한 우선순위와 원칙을 공개했습니다. “프론티어 페이싱” 노력의 일부로, 학습·평가·배포 전 구간에 깊은 접근을 열어 평가자가 안전 주장(safety claim)을 검증하고 가정의 구멍을 찾게 하겠다고 합니다.

안전 주장 vs 안전 케이스

안전 주장은 능력·행동·세이프가드에 대한 구체적·검증 가능한 진술이고, 안전 케이스는 위험이 적절히 관리된다는 구조화된 논증+증거입니다. 우선 질문은 “증거가 랩의 안전 케이스를 뒷받침하는가”, “평가가 의도한 위험을 측정하는가”, “세이프가드가 현실 조건에서 작동하는가”입니다.

형태

주 단위부터 수개월까지, 여러 평가를 병행할 수 있다고 합니다. 사전 배포 게이트만이 아니라 출시와 무관한 장기 검증을 염두에 둔 프레임입니다. 정부 대상 테스트와는 별도로, 민간 독립 평가에 초점을 맞춥니다.

왜 지금

같은 날 Sol·Luna 제품 발표와 함께 나온 거버넌스 문서입니다. Anthropic의 페이싱·임베디드 평가 흐름과 맞물려, 랩이 말하는 “독립 검증”이 실제로 어떤 접근·원칙을 약속하는지를 글로 고정합니다.