오픈웨이트 AI, 프런티어 수렴 — 안전 격차는 오히려 확대
Open-Weight AI Models Are Catching Up to the Frontier — The Safety Gap Remains
최신 오픈웨이트 모델이 성능 지표에서 클로즈드 프런티어에 근접했지만, 안전성·정렬 연구는 여전히 심각하게 뒤처진다는 분석이 나왔다.
TechCrunch의 심층 분석에 따르면 Llama 4, Mistral Large, DeepSeek V4 등 오픈웨이트 모델은 코딩·추론·멀티모달 벤치마크에서 GPT-5·Claude Fable 5에 근접하는 수준을 달성했다. 그러나 안전 평가, 레드팀 테스트, RLHF 적용 깊이 측면에서 격차는 오히려 벌어지고 있다는 것이 전문가들의 공통된 평가다.
오픈웨이트 모델의 성능 도약이 안전 투자 없이 이뤄지고 있어, 이를 엔터프라이즈·고위험 도메인에 배포하는 기업의 리스크가 높아지는 구조적 문제가 수면 위로 부상하고 있다.