Models
★★★
Anthropic launches Claude Sonnet 5 as a cheaper way to run agents
Anthropic의 Claude Sonnet 5가 에이전트 코딩 워크플로에서 GPT-5.6 Sol과 동등하거나 우수한 성능을 내면서 API 비용은 6분의 1 수준임이 확인됐다.
$2/M 입력·$10/M 출력 토큰의 소개 가격(8월 31일 종료)으로 Opus 4.8급 성능을 제공하며, 자율 계획·도구 사용·코딩 등 에이전트 핵심 능력이 Sonnet 4.6 대비 전 항목에서 우수하다. Claude Code 기반 에이전트 파이프라인 배포 시 추론 비용이 60~80% 절감됐다는 기업 실사용 보고가 잇따른다.
프런티어 성능과 미드-티어 가격이 처음으로 결합됨으로써 AI 에이전트 채택의 ROI 임계선이 크게 낮아졌으며, 이는 2026년 하반기 기업 AI 도입의 가장 큰 촉매제가 될 수 있다.
★★★
OpenAI launches its new family of models with GPT-5.6
OpenAI가 GPT-5.6 모델 패밀리(Sol·Terra·Luna)를 전면 공개했다. 플래그십 Sol은 에이전트 코딩 작업에서 토큰 효율이 54% 향상됐으며, 미국 정부의 단계적 검토 절차를 거쳐 ChatGPT·Codex·API에서 일제히 이용 가능하다.
Sol($5/M in · $30/M out)은 복잡한 추론·코딩·에이전트 워크플로 특화, Terra($2.5/M · $15/M)는 범용 균형형, Luna($1/M · $6/M)는 속도·저비용에 최적화됐다. Sol은 Cerebras와 협업으로 750 t/s 추론 속도를 달성해 프런티어 성능을 실시간에 가깝게 제공한다.
Sol이 주요 벤치마크에서 최고 수준을 기록하고 Cerebras 협력으로 초고속 추론까지 갖추면서 Claude Sonnet 5와 AI 코딩·에이전트 워크플로 시장의 양강 구도가 형성됐으며 가격 경쟁이 가속될 전망이다.
Products
★★★
Claude Fable 5 Ends Subscription Limbo: Permanent for Max, Credits-Only for Pro
Anthropic이 7월 20일부터 Claude Fable 5를 Max 및 Team Premium 요금제에 영구 포함했다. 주간 사용 한도의 50%까지 무료 이용 가능하며, Pro·Team Standard는 사용 크레딧을 통한 접근으로 전환됐다.
7월 1~7일 무료 체험 후 크레딧 전환 기간을 거쳐 Max(월 $100)·Team Premium 구독자는 7월 20일부터 별도 과금 없이 Fable 5를 이용할 수 있다. Pro 구독자는 $100 일회성 크레딧을 지급받았으며, API 접근 시 입력 $10/M·출력 $50/M의 크레딧 요금이 적용된다.
Fable 5의 영구 플랜 통합은 Anthropic이 최고 모델 접근성을 구독 경쟁력의 핵심 레버로 삼기 시작했음을 의미하며, 최상위 모델을 구독에 포함하는 방식으로 OpenAI ChatGPT Pro와의 구독 경쟁이 본격화됐다.
★★
Google's AI Mode now lets you link and interact with select apps
구글이 AI 모드에 외부 앱 연동 기능 'Connected Apps'를 출시했다. 7월 16일부터 미국 영어 사용자를 대상으로 Instacart(장보기), Canva(디자인), YouTube(플레이리스트)와 대화 중 직접 연동이 가능해졌다.
Instacart 연동 시 대화 내에서 장보기 목록을 작성하고 장바구니에 바로 추가할 수 있으며, Canva 연동 시 디자인 템플릿 제안과 생성이 인라인으로 처리된다. 구글 AI 모드는 출시 1년 만에 월간 사용자 10억 명을 돌파하며 분기마다 이용량이 2배씩 증가하고 있다.
검색을 '정보 획득'에서 '작업 완료'로 전환하는 앱 연동이 상용화되면 구글이 AI 에이전트 플랫폼으로 진화할 수 있으며, 소매·커머스·미디어 생태계에 대한 파급 효과가 기존 검색 광고 모델의 근본적 혼란을 예고한다.
★★
Anthropic launches Claude for Teachers in AI race to influence America's classrooms
Anthropic이 7월 14일 미국 K-12 인증 교사를 대상으로 'Claude for Teachers'를 출시했다. 프리미엄 Claude 기능과 교육 스킬 라이브러리를 1년간 무료로 제공하며, 50개 주 교육과정 기준에 맞춘 수업 자료를 자동 생성한다.
교사는 주 교육과정에 맞는 수업 계획서·학생용 자료를 즉시 작성할 수 있으며, 수준별 수업 설계(differentiation)와 ASSISTments·Brisk Teaching 등 교육 플랫폼과의 연동을 지원한다. 학생 데이터는 AI 학습에 사용되지 않으며, FERPA 준수 K-12 데이터 처리 협약으로 프라이버시가 보호된다.
OpenAI·구글·Khan Academy와의 교실 AI 경쟁에서 Anthropic이 교사를 주요 타겟으로 삼은 것은 AI 교육 시장 초기 선점 전략으로, 교사 채택이 학생 사용으로 이어지는 장기 플랫폼 잠금 효과를 노린 포석이다.
★★
NAVER Expands AI Infrastructure With NVIDIA to Serve Surging Global AI Demand
네이버가 NVIDIA DSX 플랫폼을 기반으로 GAK 세종 데이터센터에 55MW 규모의 주권 AI 인프라를 구축하고 GW급으로 확장하는 파트너십을 발표했다. 차세대 HyperCLOVA X와 2026년 하반기 AI 에이전트 플랫폼 운용이 목표다.
과기부가 NVIDIA 최신 GPU 5만 개 이상을 국가AI컴퓨팅센터와 NHN클라우드·카카오·네이버클라우드에 배포하는 한국 주권 AI 인프라 투자와 병행 추진된다. 네이버는 이 인프라로 한국 기업·제조업·공공기관 대상 AI 팩토리 서비스를 글로벌 AI 클라우드 고객에게도 제공할 예정이다.
한국 빅테크의 NVIDIA 풀스택 AI 팩토리 구축은 국내 AI 주권 인프라 경쟁을 가속시키고, 네이버·카카오가 글로벌 AI 클라우드 시장에 진출할 기반을 마련한다는 점에서 한국 AI 산업의 방향을 결정짓는 중대 선택이다.
Research
★★
Researchers trained an open source AI search agent, Harness-1, that outperforms GPT-5.4 on recalling relevant information
연구팀이 상태 외부화 하네스(state-externalizing harness)와 강화학습으로 훈련된 오픈소스 검색 에이전트 Harness-1을 공개했다. 8개 복합 검색 벤치마크에서 평균 리콜 0.730을 달성해 최강 오픈 검색 에이전트 대비 +11.4포인트 앞섰다.
Harness-1은 정책(모델) 내부 상태를 환경이 외부적으로 관리하도록 아키텍처를 분리해 모델이 순수 추론에만 집중하게 했다. 평가 범위는 오픈 웹 검색·SEC 재무공시·USPTO 특허 데이터베이스·멀티홉 QA를 포함하며, 훈련 외 전이 벤치마크에서도 강한 일반화 성능을 보였다.
검색 에이전트 성능이 모델 파라미터 확장이 아닌 하네스 설계에 의해 결정된다는 사실이 입증됨으로써, 소형 오픈소스 모델로 클로즈드 대형 모델을 추월할 수 있는 에이전트 공학 패러다임의 가능성을 보여준다.
★★
LLM Leaderboard & AI Model Benchmarks — July 2026 | 285 Models Compared
BenchLM이 7월 2026 LLM 종합 리더보드를 업데이트했다. 285개 모델·321개 벤치마크 평가 결과 Claude Mythos 5(83.9)가 1위, Fable 5(83.7) 2위, GPT-5.6 Sol(82) 3위를 기록했다.
카테고리별로는 코딩에서 Mythos 5(80.8)·Fable 5(80.5)·Sol(78.9) 순이며, 추론 1위는 Gemini 3.1 Pro(95.8), 지식 1위는 GPT-5.4(96.8)다. 종합 점수는 에이전트(22%)·코딩(20%)·추론(17%)·지식(12%)·멀티모달(12%) 등 8개 카테고리 가중 평균으로 산출된다.
Mythos 5와 GPT-5.6 Sol의 격차가 1.9점에 불과해 양강 구도가 확인됐으며, 코딩 특화 에이전트 시장에서는 Anthropic 모델들이 OpenAI 대비 우위를 유지하는 경향이 뚜렷해 AI 코딩 플랫폼 경쟁에 직접적 영향을 미친다.
★★
AI Research Breakthroughs in July 2026: What Happened
ICML 2026에서 발표된 선택적 활성화 희소성(selective activation sparsity) 연구가 주목받고 있다. 이 기법으로 훈련된 모델은 3배 큰 모델과 동등한 추론 벤치마크 성능을 달성하면서 훈련·추론 비용을 대폭 절감한다.
각 작업에 가장 관련 있는 파라미터만 활성화하도록 훈련하는 방식으로, 스케일링이 아닌 효율성을 통해 프런티어급 능력을 구현한다. 이 접근이 확인되면 모바일·엣지 기기에서 고성능 AI 실행이 가능해져 온디바이스 AI의 근본 한계를 극복하는 경로가 열린다.
추론 성능 향상이 모델 크기 확장이 아닌 효율적 파라미터 활용으로 달성 가능하다는 실증은 연산 집약적 AI 개발 패러다임에 근본적 의문을 제기하며, AI 칩·인프라 투자 전략에 재검토를 요구한다.
Industry
★★
Multi-Agent Orchestration Challenges Enterprises Must Solve in 2026
기업들이 AI 에이전트를 파일럿에서 프로덕션으로 전환하는 과정에서 중앙 오케스트레이터 병목·역할 충돌·옵저버빌리티 부재 등 멀티에이전트 특유의 운영 과제가 2026년 최대 AI 배포 장벽으로 부상하고 있다.
수십 개 에이전트가 동적으로 상호작용하는 환경에서 작업 분해·의존성 관리·역할 충돌 해소를 동시에 처리하는 오케스트레이션 레이어 부재가 핵심 문제다. MCP(Model Context Protocol)·A2A(Agent-to-Agent) 프로토콜 표준화가 진행 중이나, 엔터프라이즈 수준의 옵저버빌리티 도구는 아직 초기 단계에 머물러 있다.
Gartner가 2026년 말까지 기업 앱 40%에 에이전트가 내장될 것으로 전망하는 가운데, 오케스트레이션 인프라 없이는 에이전트 증가가 오히려 운영 위험으로 전환될 수 있어 AI 거버넌스·운영 플랫폼 투자가 시급하다.
★
The Build vs. Buy Shift: AI, Shadow IT, and the SaaS Replacement Era
Retool이 2026년 기업 소프트웨어 결정에 관한 보고서에서 기업 43%가 AI 코딩 에이전트를 활용해 SaaS 제품을 사내 개발로 대체하는 방안을 검토 중이라고 밝혔다.
오픈 가중치 모델 비용이 SaaS 대비 10~12배 저렴해지고 AI 코딩 하네스가 커스텀 개발 기간을 6~12개월에서 수 주로 단축하면서 빌드-바이 균형점이 이동하고 있다. 다만 AI 코드 소유 비용(확률적 동작·모델 업데이트·평가 하네스·거버넌스)이 기대보다 빠르게 증가하는 경향도 나타난다.