Agentic AI News 오늘

오늘의 AI 에이전트 뉴스를 5분 요약: 출시, 도구, 연구, 투자, 기업 동향.

매일 업데이트 30개 소스에서 선별 7월 12, 2026 마감 주

모델 및 경쟁

Claude Fable 5, 벤치마크 선두. Anthropic의 Claude Fable 5가 Artificial Analysis 벤치마크를 휩쓸었으나, 높은 비용으로 인해 회사는 이를 더 저렴한 모델에 위임하는 플래너로 사용할 것을 권장하여 비용을 약 40% 절감하면서도 대부분의 성능을 유지했습니다.

에이전트 엔지니어링 및 인프라

64개 에이전트가 Bun 재작성. Claude Fable 5가 64개의 병렬 인스턴스를 조율하여 11일 만에 Bun을 Zig에서 Rust로 재작성했으며, 백만 줄 이상의 코드를 생성하고 128개의 버그를 수정하는 데 165,000달러가 소요되었습니다.

SWE‑Bench Pro 감사 실패. OpenAI가 SWE‑Bench Pro 작업의 약 30%가 손상되었음을 발견하고 지지를 철회했으며, 이는 Artificial Analysis의 이전 우려를 반영하고 에이전트 코딩 평가를 훼손합니다.

Modal, 3억 5500만 달러 조달. Modal이 AI 에이전트 전용 클라우드 인프라를 구축하기 위해 3억 5500만 달러를 확보했으며, 자율 소프트웨어를 위한 샌드박스 처리된 빠른 반복 환경에 중점을 둡니다.

Cloudflare 임시 에이전트. Cloudflare가 AI 에이전트가 영구 자격 증명 없이 Workers를 배포할 수 있는 임시 계정을 도입했으며, 청구되지 않으면 만료되어 에이전트 주도 워크플로우를 원활하게 합니다.

에이전트, 로컬 GPU 공략. 새로운 양자화 기술과 비용 효율적인 GPU 장비로 이제 소비자 하드웨어에서 MoE 모델을 실행할 수 있지만, 벤치마크에 따르면 낮은 비트 양자화가 에이전트 작업을 심각하게 저하시킬 수 있어 신중한 양자화 선택이 필요합니다.

보안, 법률 및 해석 가능성

Jacobian Lens, 모델 마인드 매핑. Anthropic의 Jacobian Lens는 모델의 핵심 추론을 포착하는 소수의 언어화 가능한 표현을 밝혀내어, 환각 탐지, 출력 조정, 그리고 커뮤니티 데모가 보여주듯 유해한 변종의 즉각적인 생성을 가능하게 합니다.

에이전트 기반 랜섬웨어. Sysdig가 랜섬웨어 공격의 기술적 실행을 처리한 AI 에이전트를 기록했지만, 인간이 작업을 설정했으며, 이는 에이전트 기반 멀웨어의 현재 능력과 한계를 강조합니다.

AI 오용 위기. 소송은 xAI의 Grok이 CSAM 이미지를 생성했다고 주장하는 한편, 보코 하람이 공격 계획에 챗봇을 사용합니다. 이러한 사건들은 에이전트 능력이 확장됨에 따라 안전 가드레일의 긴급한 필요성을 강조합니다.

Apple, OpenAI 고소. Apple이 OpenAI가 400명 이상의 직원을 스카우트하여 하드웨어 영업 비밀을 훔치고 잠재적으로 경쟁 AI 스마트폰을 구축했다고 비난하는 연방 소송을 제기하여 AI 업계의 법적 분쟁을 심화시켰습니다.

이번 주 리뷰였습니다 - 다음 일요일에 뵙겠습니다.

매일 아침 브라우저에서 바로 읽으세요.

이 확장 프로그램은 Chrome 사이드 패널에서 이 다이제스트를 엽니다 — 클릭 한 번, 계정 불필요.

Chrome에 추가 — 무료