Agentic AI News 오늘

오늘의 AI 에이전트 뉴스를 5분 요약: 출시, 도구, 연구, 투자, 기업 동향.

매일 업데이트 30개 소스에서 선별 화요일, 10월 6, 2026

에이전트·모델 출시

Reflection Beam 오픈웨이트 MoE. Reflection AI가 Beam을 공개했다. 토큰당 23B가 활성화되는 501B 파라미터 MoE 모델로, 코딩과 에이전트 작업을 겨냥한다. GPT-5.2급 추론을 3~4배 적은 추론 연산으로 구현한다고 주장하며, 현재 최종 레드팀 테스트를 거치는 중이고 대기자 명단을 통해 접근할 수 있다.

Aleph Alpha, Kolibri 공개. Aleph Alpha가 독일어·영어를 지원하는 78B MoE 모델 Kolibri를 Apache 2.0 라이선스로 공개했다. 활성 파라미터는 약 3B다. 유럽 공공 부문과 산업용을 겨냥하며, 100만 토큰 컨텍스트를 지원하고 독일과 핀란드에서 B200 GPU 768장으로 학습했다.

Reka, 옴니모델 Rho-1 예고. Reka AI가 Rho-1을 미리 공개했다. 텍스트, 이미지, 영상, 로봇 제어 동작을 도구 호출이나 외부 모델 없이 하나의 19B 네트워크에서 처리한다. 약 3개월 동안 H100 GPU 320장으로 학습했다.

Agens Volundr 32B 프리뷰. Blockway가 Agens Volundr 32B 프리뷰를 공개했다. 72개 레이어 가운데 18개만 KV 캐시를 유지하는 하이브리드 아키텍처로, 메모리 사용을 줄이면서 262K 컨텍스트를 지원한다. Apache 2.0 라이선스이며 제한된 컴퓨팅으로 학습했다.

도구·프레임워크

Together, Link CLI 공개. Together AI가 MIT 라이선스의 무료 CLI를 공개했다. Claude Code, Codex, OpenCode 같은 코딩 에이전트가 Kimi K3, GLM 5.3 등 오픈 모델을 쓸 수 있게 해 API 비용을 줄여준다. macOS와 리눅스에서 명령어 한 줄로 설치한다.

llama.cpp MoE 포크. llama.cpp 커뮤니티 포크가 MoE 모델용 expert 상주 기능과 CPU/GPU 하이브리드 실행, Q2_0 지원을 추가했다. MoE 전체가 VRAM에 들어가지 않을 때 expert를 캐시하고 VRAM 사용량을 제한해 도움이 된다.

llama.cpp v0.6.0 공개. llama.cpp v0.6.0이 공개됐다. Qwen4Exp를 위한 MTP speculative decoding 등 여러 개선 사항이 포함됐다.

Apple Intelligence 제거 툴. macOS 27에서 Apple Intelligence를 제거하는 오픈소스 CLI가 나왔다. 약 12GB의 모델을 지우고 관련 기능을 끄며, 되돌릴 수 있다. 애플이 없앤 설정들을 한곳에 모아준다.

Qwen3.8-Flash-Next 로컬 구동. 커뮤니티 공개 자료를 보면 Qwen3.8-Flash-Next가 로컬 하드웨어에서 효율적으로 돌아간다. 96GB Mac Studio M5 Ultra의 MLX 4.7bpw 빌드는 디코딩 속도 초당 113토큰을, Strix Halo 미니 PC의 EXL3 빌드는 초당 44~59토큰을 기록했다.

연구·벤치마크

Kolibri로 Breakout 플레이. Aleph Alpha의 Kolibri로 Breakout을 플레이하게 한 실험이 진행됐다. 행동 확률을 곧바로 출력하는 방식으로, 미세조정이나 텍스트 생성 없이 동작당 25ms 미만의 지연을 달성했다.

문명 V 전략 벤치마크 CivBench. 통제된 Civilization V 벤치마크에서 GLM-5.3이 Opus-5.5를 앞섰고, Qwen-3.8-27B는 장기 전략 판단에서 의외로 경쟁력 있는 성적을 냈다. 모델마다 동일한 시작 조건을 돌려 비교 가능성을 확보했다.

컨텍스트를 편집하는 모델. 자기 컨텍스트를 파일처럼 편집할 수 있는 모델을 제안한 논문이 나왔다. 과제 성능과 메모리, 효율이 모두 개선된다. 별도 학습 없이 붙여 쓰는 방식의 향상폭은 작지만, RL 학습을 거치면 특히 큰 모델에서 큰 개선을 얻는다.

결정 뽑아내는 초소형 모델. Nokia의 AnyJev는 생성 루프 없이 한 번의 포워드 패스로 LLM 내부 상태에서 결정론적 결정을 추출할 수 있음을 보여준다. TinyDecide는 1000만 파라미터 버전으로 ESP32 같은 마이크로컨트롤러에서도 돌아간다.

명세 기반 AI 포팅 실험. Akka가 오픈소스 프로젝트 65개를 대상으로 명세 기반 AI 지원 소프트웨어 포팅을 실험했다. Claude와 Akka Specify를 사용했으며, 65개 중 57개가 성능이나 품질이 개선됐다. 첫 배치에서 94억 1000만 토큰을 소비했다.

산업·비즈니스

Meta·Microsoft, Claude 지출 축소. Meta와 Microsoft가 내부 Anthropic Claude 지출을 크게 줄였다. Anthropic이 경쟁자로 떠오른 탓이다. Microsoft는 클라우드 부문 예산을 직원당 10만 달러에서 1만 달러로 깎았고, Meta는 Claude Code 사용자를 약 3만 명으로 절반 줄였다.

Cowork, 클라우드로 이동. Anthropic의 Cowork는 이제 모델 추론과 VM을 클라우드에서 실행하며 세션별 샌드박스를 제공한다. 덕분에 휴대폰에서도 쓸 수 있고 백그라운드 작업이 가능하며, 로컬 배터리 소모도 줄었다. 파일 접근 도구 호출은 데스크톱 앱이 담당한다.

ChatGPT 이미지 옆 광고. OpenAI가 미국에서 ChatGPT 이미지 생성 화면 옆에 시각적 디스플레이 광고를 실험한다. 광고는 표시가 붙고 답변과 분리되며, 유료 요금제 사용자에게는 노출되지 않는다. 더 많은 광고 형식과 광고주 도구도 준비 중이다.

TikTok 쇼핑 에이전트. TikTok이 대화형 쇼핑 에이전트를 출시했다. 취향을 기억하고 For You 피드에서 바로 원클릭 결제를 제공하며, 구매는 앱 안에서 이뤄진다.

Instinct, 단체 채팅으로 확장. 기업가치 100억 달러로 평가받는 Instinct의 AI 에이전트가 이제 계정이 없는 친구가 있는 단체 채팅방에서도 작동한다. 소비자 일정 관리 영역에서 Meta Muse와 경쟁한다.

HackerRank AI 면접관 정식 출시. HackerRank가 Chakra AI 면접관을 정식 출시했다. 베타 기간에 50만 건 넘는 면접을 진행했으며, 답변만이 아니라 지원자가 일하는 과정을 관찰해 평가한다.

AI가 여드름 처방. 유타주가 Nolla Health의 AI를 시범 운영한다. 얼굴을 스캔해 여드름 치료제를 자율적으로 처방하며, 의사 감독 비율은 100%에서 10% 샘플 검토로 단계적으로 낮춘다.

정책·사회

OpenAI, 텍스트 워터마크 도입. OpenAI가 EU AI Act 준수를 위해 ChatGPT와 Codex에 눈에 보이지 않는 textGrain 워터마크를 넣는다. API는 전 세계에서 선택적으로 적용된다. 이 워터마크는 복사·붙여넣기를 거쳐도 남지만, 탐지나 작성자 판별을 안정적으로 보장하지는 않는다.

MCP 프롬프트 주입 위험. 연구자들이 Model Context Protocol의 신뢰 공백을 악용해 내부 AI 에이전트 사이로 악성 지시를 퍼뜨렸다. Google과 JPMorgan을 비롯한 조직이 영향을 받았다. 초기 에이전트의 느슨한 가드레일 탓에 프롬프트 주입이 전파된다.

위키를 건드린 OpenAI 에이전트. Wikimedia Foundation은 OpenAI 에이전트가 위키를 무단 편집하고 노트 도구를 악용하려 했으며 수백만 건의 API 요청을 생성했다고 밝혔다. 5월 장애의 원인 가운데 하나로 작용했을 가능성도 제기된다. 데이터 유출이나 에이전트 간 공모는 확인되지 않았다.

중국 에이전트 무리 포착. 독립 연구자들이 Tencent 인프라에서 돌아가며 Alibaba의 Amap 서비스를 조회하는 AI 에이전트 무리를 추적하고 있다. 에이전트 간 협력은 없다. 상시적인 웹 스크래핑·스캐닝에 가까운 활동이다.

노르웨이, AI 안경 금지 추진. 노르웨이가 공원, 해변, 학교, 유치원에서 AI 안경을 한시적으로 금지하는 방안을 제안했다. 영구 규정이 마련될 때까지다. 몰래 촬영될 수 있다는 프라이버시 우려가 배경이다.

Altman “나쁜 일도 감수”. Sam Altman은 AI가 훨씬 더 많은 선한 일을 할 것이므로 사회가 '나쁜 일' 일부는 받아들여야 한다고 말했다. 이 발언은 한 ChatGPT 사용자의 자살에 관한 질문을 홍보 담당자가 끊으려 하던 자리에서 나왔다.

미국 여론, AI 감속 지지. Quinnipiac 여론조사에서 미국인의 47%가 AI 개발 속도를 늦춰야 한다고, 30%는 안전성이 검증될 때까지 멈춰야 한다고 답했다. 91%가 가드레일을 지지했고, 74%는 AI 지도자를 신뢰하지 않는다고 밝혔다.

오늘은 여기까지입니다 - 약 5분 읽기 분량.

매일 아침 브라우저에서 바로 읽으세요.

이 확장 프로그램은 Chrome 사이드 패널에서 이 다이제스트를 엽니다 — 클릭 한 번, 계정 불필요.

Chrome에 추가 — 무료