Anthropic, Mythos 5 초과 내부 모델 'Model 2' 최초 공개 — 안전 평가 미완료로 출시 보류
Anthropic discloses unreleased internal 'Model 2' surpassing Mythos 5 in August 2026 AI risk assessment update
Anthropic이 8월 AI 위험 평가 업데이트에서 현재 최강 공개 모델 Mythos 5를 능가하는 내부 미출시 모델 'Model 2'를 처음으로 공개했다.
Anthropic에 따르면 Model 2는 사전 배포 안전 평가를 완료하지 못해 외부 출시 계획이 없으며, 동시에 재앙적 오정렬 위험 등급이 'very low'에서 'low'로 상향됐다. 이 정보는 2026년 8월 18일 Anthropic의 월간 위험 평가 업데이트에서 공개됐다.
OpenAI가 Astra 개발을 전면 중단한 것과 동일한 '임계 위험 기준' 논리가 Anthropic에서도 적용되며, 주요 AI 연구소가 자체 안전 임계치를 진지하게 집행하는 전례를 굳혀가는 흐름의 중요한 증거다.