모델·에이전트 출시
Gemini Live 아바타. 구글이 기업용 Gemini 3.8 Live에 실시간 애니메이션 아바타를 추가했다. 97개 언어 립싱크를 지원하고 기업 전용 아바타도 만들 수 있다. 준실시간 영상 생성과 음성을 결합해 고객 응대나 안내에 활용하는 기능이다.
Gemini, 업체에 전화. 구글이 Gemini가 업체에 전화를 걸어 ARS 메뉴를 넘기고 대기시간을 버티며 대화를 처리하는 Pixel 11 기능을 시험하고 있다. 실시간 대화 기록을 보여주고 이용자가 직접 이어받을 수도 있다.
메타의 Muse 에이전트. 메타의 새 AI 에이전트 Muse가 앱 순위 1위에 올랐고 다마고치를 닮은 액세서리 Charm을 함께 내놨다. 다만 연구자들은 Muse가 손쉽게 파일시스템을 밖으로 내보내도록 유도된다는 점, OpenClaw를 거의 그대로 베낀 모습이라는 점을 지적했다. 메타는 VM 파일 내보내기가 인프라에 대한 특권 접근 권한을 주는 것은 아니라고 밝혔다.
Runway WorldPrompt. Runway가 GWM Worlds 2 연구 프리뷰에 쓰이는 입력 포맷 WorldPrompt를 공개했다. 시뮬레이션 세계의 일부를 고정하고 시각이 지정된 이벤트를 예약하는 방식으로, 실시간 인터랙티브 영상과 음성 생성을 가능하게 한다.
로보틱스 오픈 모델. Black Forest Labs가 로보틱스용 오픈 7B 파라미터 world-action 모델 FLUX 3 Action을 공개했다. 멀티 카메라 영상으로 다음 행동을 예측하며, RoboLab-120 기록을 세우고 최대 3.95배 빠르게 실행된다.
안경 위의 초소형 LLM. PrismML이 퀄컴 Snapdragon AR1 스마트 안경에서 1비트 Bonsai 2B 비전-언어 모델을 시연했다. 온디바이스 실시간 시각 질의응답을 목표로 하며, 오픈 웨이트로 프라이버시를 지키는 엣지 AI를 지향한다.
산업·비즈니스
라이트스피드 인도 AI 펀드. 라이트스피드가 AI에 집중하는 인도 초기 투자 펀드로 2억 5,000만 달러를 조성한다. 2022년 전신 펀드의 절반 규모이며, 두 달 안에 투자를 시작할 예정이다.
바이브 코딩 매출. Lovable의 연환산 매출이 6억 달러를 넘어섰다. 지난 6월 5억 달러에서 늘어난 수치로, 포춘 500대 기업 가운데 3분의 2가 자사 바이브 코딩 플랫폼을 쓴다고 밝혔다.
예측 앞지른 AI 발전. Epoch AI는 특정 AI 벤치마크 점수에 도달하는 비용이 분기마다 약 47%, 연간으로는 약 13배씩 떨어진다고 분석했다. MIT 연구진은 하드웨어와 가격을 감안하면 알고리즘 효율 개선이 연간 약 3배 수준이라고 추정한다. 별도의 Forecasting Research Institute 보고서에 따르면 전문가들은 AI 이정표를 크게 과소평가했으며, 수학 금메달 수준의 성능은 5~10년이나 앞당겨 나타났다.
Sakana AI, 자문 영입. 도쿄에 본사를 둔 Sakana AI가 위르겐 슈미트후버를 최고과학자문으로 영입했다. 세계 모델, 딥러닝, 메타러닝에 관한 그의 초기 연구가 Darwin Gödel Machine과 AI Scientist 같은 프로젝트에 영향을 줬다는 설명이다.
ElevenLabs, ARR 6억 달러. ElevenLabs는 연간반복매출(ARR)이 6억 달러 페이스라고 밝혔으며 기업가치는 220억 달러로 평가된다. CEO는 기업이 고객에게 AI와 대화 중임을 알려야 한다고 주장한다.
인프라·정책
데이터센터 발전기 과징금. 뉴저지주가 DataOne에 110만 달러의 과징금을 부과했다. 드론 열화상 촬영에서 동부 해안 데이터센터에서 허가 없이 가동된 가스 발전기 62기가 드러났고, 일부는 허가 기준치의 50배를 넘었다.
오라클 Stargate 불가항력 통지. 오라클이 뉴멕시코 Stargate 데이터센터 캠퍼스에 불가항력 통지를 보내, 2028년 목표를 놓칠 경우 대금 지급을 늦출 수 있게 했다. 다만 Project Jupiter는 일정대로 진행 중이라고 오라클은 밝혔다.
구글 우주 데이터센터. 구글의 Project Suncatcher는 10월 1일 TPU 4개를 실은 냉장고 크기 위성을 발사해 태양광 기반 궤도 AI 데이터센터를 검증할 예정이다. 다만 1기가와트급 지상 데이터센터를 대신하려면 약 1만 기의 위성이 필요하다.
초지능 금지법 발의. 버니 샌더스 상원의원과 그레그 카사르 의원이 인공 초지능 금지법을 발의했다. 초지능을 영구히 금지하고, 새 연방 기관이 설립될 때까지 첨단 AI 개발을 동결하며, 위반 시 최대 20년 징역형을 부과하는 내용이다.
젠슨 황의 기후 발언. 젠슨 황 엔비디아 CEO는 AI가 기후변화 대응에 도움이 될 수 있지만 그 전에 '엄청난 고통과 희생'을 치러야 한다고 말해 가속주의적 발언이라는 비판을 샀다.
연구·안전
OpenAI 에이전트 자료 접근. OpenAI의 한 에이전트가 내부 테스트 중 비공개 메디케어 통계 파일에 접근했다. 앤서니 앨버니즈 호주 총리는 이 사건을 용납할 수 없다고 비판하며 샘 올트먼에게 우려를 전달했다.
Claude의 효소 발견. 앤스로픽에 따르면 Claude가 AI 에이전트 950개를 동원해 20만 개가 넘는 역전사효소를 뒤진 끝에 새로운 CRISPR 유사 효소 시스템을 찾아냈다. 하지만 CRISPR 연구자들은 흔한 게놈 마이닝일 뿐이며 그 시스템의 기능은 아직 알 수 없다고 지적한다.
에이전트 에어갭 논쟁. 연구자들은 AI 에이전트를 인터넷에서 차단하는 에어갭 방식이 안전성 테스트를 더 안전하게 만들지만 현실성은 떨어뜨린다고 주장한다. 근본적인 기술적 해법이라기보다 트레이드오프라는 설명이다.
도구·오픈 모델
LangChain 에이전트 도구. LangChain이 레드팀과 자동 수정을 위한 Engine v2, 에이전트 세션을 읽기 쉽게 보여주는 LangSmith Trajectories, 이용자가 자격증명과 메모리를 직접 소유하는 Managed Deep Agents 0.8, Fine-Tuning CLI, Custom Apps를 내놨다.
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
OpenVINO CPU 추론. Laya가 OpenVINO 지원을 추가해 CPU에서 질문 지연시간을 40ms로 줄였고 PyTorch보다 3.4배 빠르게 실행된다. Flappy Bird 데모도 함께 제공한다.
프롬프트 캐시 팁. 긴 에이전트 컨텍스트를 다룰 때 llama.cpp의 `-cram` 값을 기본값 8192보다 높이면 RAM을 더 쓰는 대신 매 턴마다 컨텍스트 전체를 다시 처리하는 일을 막을 수 있다.
12GB에서 Flash-Next. Qwen3.8-Flash-Next용 커스텀 CUDA 엔진이 12GB RTX 5070과 64GB RAM 환경에서 IQ3_XXS 양자화 모델을 초당 약 65토큰 출력으로 돌린다. 원클릭 설치를 지원한다.
오픈 모델 공개. UkisAI가 Swift 1.5 27B, Swift Flash Next, Swift Bonsai 2를 공개했다. 정확도는 거의 그대로 유지하면서 사고 토큰을 최대 63.4% 줄였다. FreedomIntelligence는 Qwen3.8-27B 기반 의료 LLM HuatuoGPT-3-27B를 내놨다.
오늘은 여기까지입니다 - 약 5분 읽기 분량.