Models
★★★
DeepSeek V4-Flash-0731 Generally Available — Beats V4 Pro on 9 Agentic Benchmarks
DeepSeek V4-Flash-0731이 프리뷰를 종료하고 GA 출시, Terminal-Bench 에이전트 벤치마크 82.7%로 자사 1.6T 파라미터 Pro 플래그십 모델 대부분을 추월했다.
정식 가격은 입력 $0.14/M·출력 $0.28/M으로 확정됐으며, 9개 에이전트 벤치마크 중 대부분에서 훨씬 큰 DeepSeek-V4 Pro를 앞섰다. 2026년 8월 3일부로 프리뷰 종료 후 공개 API 전면 개방.
1.6조 파라미터 풀 MoE 플래그십을 5.1B 활성화 파라미터 경량 변형이 에이전트 태스크에서 제치는 결과는 API 비용을 10~15배 낮추면서 성능을 유지하는 방향으로 경쟁이 전개됨을 보여주며, Anthropic·OpenAI 대비 DeepSeek의 가격 경쟁력이 더욱 강화됨을 의미한다.
★★
SpaceX/xAI Launches Grok Voice Think Fast 2.0 with Major Accuracy Gains
xAI가 Grok Voice Think Fast 2.0을 출시하며 24개 언어에서 전사 정확도를 1.5~2배 개선하고, 첫 오디오 응답 지연을 1.25초에서 0.70초로 절반 가까이 단축했다.
가격은 분당 $0.08로 이전 버전 대비 인상됐고, 소음 환경에서는 기존 음성 모델 대비 최대 10배 우수한 전사 정확도를 보인다. 8월 5일부터 grok-voice-latest API 엔드포인트가 자동으로 2.0으로 전환된다.
추론과 발화를 병렬 처리해 지연 없이 지능을 높이는 Grok Voice의 접근법은 OpenAI Realtime API·Google Gemini Live와의 실시간 음성 에이전트 경쟁에서 새로운 성능 기준을 제시한다.
★★
Ant Group Unveils Ling-3.0-Flash: Delivering Top-Tier-Performance at a Fraction of the Parameter Scale
Ant Group의 에이전트 특화 MoE 모델 Ling-3.0-Flash가 OpenRouter 무료 API 기간을 마치고 오픈소스 가중치 공개를 예고, 124B 파라미터로 자사 1T 플래그십을 다수 벤치마크에서 능가한다.
토큰당 활성화 파라미터는 5.1B이며, 계층형 캐싱으로 장문 입력의 TTFT를 60~80% 절감한다. 256K 컨텍스트 윈도우를 네이티브 지원하며, OpenRouter·Vercel AI Gateway에서 API 이용 가능.
알리바바 Qwen·DeepSeek에 이어 Ant Group도 소형 활성화·대형 총 파라미터 설계로 자사 최대 모델을 능가하는 패턴을 반복 검증하면서, 중국 MoE 모델의 효율성 우위가 연구 트렌드가 아닌 양산 현실로 자리잡고 있다.
Industry
★★
Ai4 2026 Announces Dynamic Keynote Lineup Featuring Hinton, Li, Ng on Same Stage for First Time
미국 최대 AI 컨퍼런스 Ai4 2026이 8월 4~6일 라스베이거스 The Venetian에서 개막하며 Geoffrey Hinton·Fei-Fei Li·Andrew Ng가 사상 최초로 한 무대에 올랐다.
1만 2천 명 이상의 참가자와 400개 이상의 전시사가 모인 이번 행사에서 핵심 세션은 AI 실존 위험에 대해 상반된 입장을 가진 힌턴(경종 파)과 응(낙관 파)의 공개 토론이다. 2026년 AI 거버넌스 논쟁이 최고조에 달한 시점에 열린다.
EU AI Act 시행·미국 연방 임계값 협상·UN 패널 보고서가 동시에 논의되는 시점에, 힌턴-응의 공개 충돌은 '안전 vs. 혁신' 프레임이 업계 표준 담론으로 굳어지는 계기가 될 수 있다.
★★
Chinese AI Models Accelerating Enterprise Adoption as US Frontier Model Costs Surge
DeepSeek V4-Flash GA·Alibaba 신규 모델 공개가 맞물리며 중국 AI 모델의 미국 기업 API 점유율이 빠르게 확대되고 있다.
Vercel AI Gateway 기준 DeepSeek의 토큰 점유율이 5~6월 연속 상승했으며, 중국 AI 모델 가격이 미국 프런티어 모델 대비 10~15배 저렴한 사례가 증가하고 있다. Alibaba도 신형 모델을 공개하며 DeepSeek의 미국 침투 전략에 가세했다.
OpenAI·Anthropic 가격 급등과 미국의 중국 AI 도구 수출입 모호성이 겹치면서, 국내외 기업들이 중국 모델 도입 리스크를 수용하고 비용 절감을 우선하는 구도로 시장이 재편되고 있다.
Regulation
★★
OpenAI and Anthropic Are Writing the Threshold Their Rivals Must Clear to Launch
OpenAI와 Anthropic이 미국 정부와의 협의에서 경쟁사 AI 모델이 출시 전 통과해야 할 연방 안전 심사 기준의 초안을 직접 제안하는 역할을 맡고 있다.
두 회사는 어떤 모델이 30일 국가안보 검토 대상인지를 결정하는 '프런티어 모델' 정의 기준을 제시하고 있으며, 이는 자사보다 낮은 역량의 모델에 높은 진입 장벽을 설정할 수 있다는 우려를 낳는다. 6~7월 자사 모델이 정부 개입을 받은 직후 이 협의가 진행됐다.
규제 프레임 설정을 규제 대상 기업이 주도하는 구조는 미국 AI 규제의 독립성 훼손 우려를 낳으며, EU AI Act의 독립적 규제 프로세스와 대비되어 국제 AI 거버넌스 표준 경쟁의 핵심 쟁점이 되고 있다.
★
State of AI Governance Regulations in the United States 2026
캘리포니아 AI 투명성법이 2026년 8월 발효되어 소비자 대면 챗봇과 AI 생성 콘텐츠에 AI 식별 표시를 의무화했다.
EU AI Act 투명성 조항(8월 2일 시행)과 동시에 발효된 이 주(州)법은 미국 내 가장 영향력 있는 AI 표시 규제로, 캘리포니아에서 서비스하는 전 세계 기업에 적용된다.
EU AI Act·캘리포니아 독자 주법·연방 규정 검토 등 AI 투명성 의무가 동시에 확산되면서 미국 기업들은 파편화된 다층 규정 준수 비용을 부담하게 됐다.