Agentic AI News 오늘

오늘의 AI 에이전트 뉴스를 5분 요약: 출시, 도구, 연구, 투자, 기업 동향.

매일 업데이트 30개 소스에서 선별 수요일, 8월 12, 2026

모델 출시 및 인프라

Nvidia의 속도 우선 모델. Nvidia는 벤치마크에서 GPT-OSS-120B와 견주면서도 단 36억 개의 활성 파라미터로 빠른 추론에 최적화된 오픈 가중치 30B Mamba-Transformer 모델인 Nemotron 3.5 Lightning을 출시했습니다.

DeepSeek V4 로컬 실행. DeepSeek V4의 커뮤니티 퀀트들이 비트 정확한 기준선을 위한 변환 문제를 해결했으며, DeepSeek V4 Flash는 추측 디코딩을 통해 Strix Halo APU에서 27+ t/s를 달성하여 실행 가능한 로컬 배포를 입증했습니다.

Unsloth 데스크톱 앱. Unsloth는 GPU에서 로컬 모델을 실행하고 학습시키기 위한 오픈소스 데스크톱 앱을 출시했습니다. 이 앱은 샌드박스 코드 실행, RAG, 모델 내보내기를 지원하며 텔레메트리가 없습니다.

River AI의 11억 달러 시드 투자. 전 xAI 공동창업자 Igor Babuschkin이 설립한 River AI는 훈련부터 하드웨어까지 전체 스택을 재고하여 개인 맞춤형 학습이 가능한 AI 비서를 구축하기 위해 11억 달러를 모금했습니다.

AWS에서 Daybreak Cyber. OpenAI의 Daybreak 사이버 보안 모델이 이제 Amazon Bedrock을 통해 제공되어 방어자들이 기존 AWS 환경 내에서 최첨단 사이버 역량에 접근할 수 있게 되었습니다.

Zuck의 오픈소스 선언. Meta CEO는 더 많은 오픈 가중치 릴리스를 주장하며 정부에 안전 테스트 협력을 초청하고 있습니다. 회사는 Muse Glimmer와 같은 모델을 계속 출시하고 있습니다.

Ling-3.0 지원. 풀 리퀘스트가 llama.cpp에 Ling-3.0을 추가했으며, 작은 변형 모델은 불확실할 때 솔직하게 거절하는 특성 덕분에 홈 어시스턴트 음성 작업에서 이미 잘 작동하고 있습니다.

도구 및 로컬 AI

MCP 브로커, 컨텍스트 절감. DIY 에이전트 하네스는 MCP 브로커를 사용하여 도구를 프록시 뒤에 숨김으로써 시작 컨텍스트를 20K 토큰에서 거의 0으로 줄이고, 더 나은 로컬 실행을 위해 시간 인식 기능을 추가합니다.

LLM을 위한 채굴 GPU. 8GB CMP170HX 채굴 카드는 각각 64GB로 확장할 수 있어 대형 모델이나 여러 소형 모델을 동시에 실행할 수 있으며, 저렴하지만 오래된 Ampere급 성능을 제공합니다.

V100에서 366 t/s. 맞춤형 CUDA 커널(v100-skinny)은 Volta GPU에서 NVFP4 양자화된 Qwen3.6 27B 모델을 초당 최대 366토큰으로 실행할 수 있게 하여, 로컬 추론을 위해 오래된 하드웨어에 새 생명을 불어넣습니다.

TinyTitle 모델. 180만 파라미터의 GRU 모델이 5MiB 미만의 RAM에서 채팅 제목을 생성하여 몇 밀리초 만에 실행되는 초경량 온디바이스 요약을 입증합니다.

프라이빗 전자책 리더 AI. 전자책 리더 앱이 Gemma 4B 모델을 로컬에 통합하여 프라이빗한 앱 내 책 Q&A를 제공하며, 스포일러 토글과 자동 언어 매칭 기능을 갖추고 있습니다.

저전력 AI 서버. Intel N100과 RTX 5060Ti를 결합한 빌드는 Qwen 3.5와 같은 최신 모델을 일상적으로 실행할 수 있는 조용하고 효율적인 llama.cpp 서버를 제공합니다.

추론 비용 대폭 절감. Doubleword의 CEO는 실시간이 아닌 용도로 추론 스택을 설계하면 범용 설정에 비해 토큰 비용을 한 자릿수 이상 줄일 수 있는 방법을 설명합니다.

스마트 모델 라우팅. NVIDIA의 Switchyard 라이브러리는 에이전트 호출 중 7%만 최첨단 모델로 라우팅하여 정확도 손실을 최소화하면서 비용을 74% 절감하며, 비용 편익을 평가하는 공식을 제공합니다.

프라이빗 AR 글래스. 시각 장애인이 시각 데이터를 Meta로 보내지 않기 위해 로컬 모델을 실행하는 Meta 스타일의 AR 글래스를 요청하여, 보조 기술 분야의 프라이버시 수요를 부각시켰습니다.

최첨단 연구

AI, 리만 가설에 도전. 출시되지 않은 Anthropic 모델이 36시간에 걸쳐 60개의 하위 에이전트로 650개의 아이디어를 테스트하여 리만 가설에 진전을 이루었고, 수학적 발견에서 AI의 역할에 대한 논쟁을 다시 불러일으켰습니다.

AMIE의 영상 진단. Google의 AMIE 연구 시스템은 Gemini와 다중 에이전트 구성을 사용하여 시각, 청각, 상황적 단서를 해석함으로써 전문가 수준의 임상 영상 상담을 입증했습니다.

CARE-X 흉부 X-ray AI. Microsoft의 CARE-X는 생성과 구조화된 예측을 결합한 통합 흉부 X-ray VLM으로, 강화 학습을 사용하여 임상적 정확성에 보상을 제공합니다.

에이전트 메모리 대결. ACE와 ALTK-Evolve는 모두 에이전트 궤적을 재사용 가능한 교훈으로 전환합니다. ACE는 포괄적인 플레이북을 구축하는 반면, ALTK-Evolve는 개별 지침을 검색합니다.

로그프로브로 환각 탐지. 체인 오브 소트의 첫 번째 사실 회상 시점에서 토큰 확률 분포를 분석하면 신뢰할 수 없는 지식을 드러낼 수 있어 잠재적인 조기 환각 신호를 제공합니다.

AI 글쓰기 경고. S. Alpert는 어떤 재작성도 무손실이 아니므로 AI 지원 텍스트는 저자의 의도된 의미를 왜곡하지 않도록 직접 검증되어야 한다고 주장합니다.

비즈니스 및 금융

10억 사용자 이정표. ChatGPT와 Gemini 모두 월간 활성 사용자 10억 명을 달성했습니다. Gemini는 해당 규모에 도달한 Google의 가장 빠른 제품이며, ChatGPT는 올해 초 주간 사용자 9억 명을 달성한 바 있습니다.

ChatGPT 광고, 글로벌 확대. OpenAI는 ChatGPT 광고를 5개국 더 확대했으며, 지속 가능한 수익화를 모색하면서 사용자 신뢰에 영향이 없고 닫힘 비율이 낮다고 보고했습니다.

OpenAI 가격 인상. 새로운 ChatGPT Business Premium 좌석은 사용자당 월 125달러로, 5배의 용량과 시간 제한이 없으며, 에이전트 워크로드의 높은 토큰 사용량을 반영합니다.

Lightcap 퇴사. OpenAI의 전 COO이자 특별 프로젝트 책임자였던 Brad Lightcap이 8년 만에 새로운 시작을 위해 퇴사하며, 임원 이탈 행렬을 이어가고 있습니다.

Anthropic의 91억 달러 임대. Anthropic은 텍사스에서 191MW 규모의 데이터 센터에 대해 비트코인 채굴업체 Riot Platforms와 20년간 91억 달러 규모의 계약을 체결했으며, 2027년부터 차세대 모델에 전력을 공급할 예정입니다.

Anthropic IPO 난관. 잠재적인 9,650억 달러 규모의 IPO를 앞두고, 투자자들은 저렴한 중국 모델과 정치적 역풍 속에서 Anthropic의 성장에 의문을 제기하고 있습니다. 회사는 미래의 건강 및 생물학 앱을 내세우고 있지만요.

Nvidia의 5,000억 달러 추진. Nvidia는 칩 잔존 가치의 최대 25%를 보장하여 AI 인프라에 5,000억 달러를 동원하기 위해 6개 금융 회사와 파트너십을 맺고 감가상각 우려에 대응하고 있습니다.

Accel의 인도 AI 투자. Accel은 초과 신청된 5억 5,000만 달러 규모의 인도 펀드를 마감하며, AI가 독립적인 카테고리가 아닌 소비자, 핀테크, 제조 스타트업의 기반이 될 것이라고 전망했습니다.

OpenAI 직원 현금화. 8,520억 달러 가치 평가에서 70억 달러 규모의 자사주 매입을 통해 현재 및 이전 OpenAI 직원들이 주식을 현금화할 수 있게 되어 잠재적 IPO 전 압박이 완화되었습니다.

보안 및 투명성

EU, AI 워터마크 의무화. EU AI법에 따라 Anthropic과 OpenAI는 생성 콘텐츠에 표시를 하기로 약속했습니다. Claude는 텍스트와 이미지에 보이지 않는 워터마크를 삽입할 예정이며, 구형 모델 지원도 진행 중입니다.

Apple 사진 출처. iOS 27은 촬영 시 출처 메타데이터를 삽입하는 'Apple Reference Image'를 도입하여 사용자가 iPhone 사진이 딥페이크가 아님을 증명할 수 있게 할 수 있습니다.

Spotify, AI 아티스트 표시. Spotify는 AI 생성 아티스트 프로필에 라벨을 붙이고 추천에서 제외할 예정이며, 9월 중순 변경 사항을 적용하기 전에 자기 공개와 탐지를 모두 사용합니다.

AI 글쓰기 분쟁. 게임 스튜디오 Saber는 Rideshare Stimulator에서 작가를 ChatGPT로 대체했다는 주장을 부인했지만, 전 수석 작가는 AI가 글쓰기와 음성에 사용되었고 Steam에 공개하지 않았다고 주장합니다.

AI 기반 Zoom 취약점. 주석 기능을 통한 기기 장악을 허용하는 심각한 Zoom 취약점이 공개 AI 모델에 대한 20개 미만의 프롬프트로 발견되어 AI 가속화된 보안 연구를 보여주었습니다.

추론 과정 탈취. 연구자들이 최첨단 모델의 암호화된 체인 오브 소트 토큰을 더 약한 형제 모델에 재생하여 탈옥시키고 숨겨진 추론을 복구했으며, 공개 세션에서 비밀번호와 API 키를 노출했습니다.

AI 생성 코드 신뢰. IBM과 Red Hat은 AI 시대의 검증 가능한 소프트웨어 공급망을 만들기 위해 Lightwell을 확장하여 인간 및 AI 생성 코드 모두에 대한 출처와 정책 준수를 보장합니다.

오늘은 여기까지입니다 - 약 5분 읽기 분량.

매일 아침 브라우저에서 바로 읽으세요.

이 확장 프로그램은 Chrome 사이드 패널에서 이 다이제스트를 엽니다 — 클릭 한 번, 계정 불필요.

Chrome에 추가 — 무료