Фронтирные модели и агентные продукты
GPT-6 Astra в проде. Perplexity использует Astra для написания сообщений, правки софта и мониторинга продакшен-систем; Cognition — чтобы проверять работу Devin и получать на выходе записи и отчёты, чтобы сократить код-ревью.
Бета OpenAI Agents API. Публичная бета позволяет разработчикам создавать облачных агентов, которые работают часами, исполняют код и обрабатывают файлы на той же инфраструктуре, что и Codex с ChatGPT; оплата по токенам, без дополнительных комиссий.
Открытые и локальные модели
Локальная волна Qwen 3.8. В сообществе отмечают, что Qwen 3.8 27B для кодинга часто ощущается сильнее Qwen-Next, а пользователи UD-quant сравнивают скорость 6-бит с качеством 8-бит; новый файнтюн Humanlike призван сделать непринуждённую беседу менее похожей на разговор с ассистентом.
- → Qwen3.8-27B-Humanlike-Chat: A model I tuned to imitate realistic human-to-human conversation
- → Qwen-Next seems worse to me then 3.8 27b for coding, but I feel like I must be missing something?
- → Unsloth UD-quants - Qwen 3.8 27b for example - worth using 8-bit or stick with faster 6 bit for coding?
Локальные проекты файнтюна. 2B-модель, обученная на групповом чате WhatsApp, усваивает сленг и темп переписки, но не глубокую связность; файнтюн Qwen 3 4B на 100 головоломках про зебр улучшил MATH-500 на 31%; CodeFinetuner даёт пайплайн для файнтюна моделей автодополнения кода на вашей кодовой базе.
- → I fine-tuned a 2B LLM on our WhatsApp group chat, and shared how to do it on GitHub as a cookbook.
- → Fine-tuning Qwen 3 4B Base on 100 zebra puzzles yielded +31% on MATH-500. 6.5-min (Single H100/H200) reproduction notebook included.
- → CodeFinetuner: Fine-tune a local code autocomplete model on your own codebase
Новая ASR-модель Orukeet. Orukeet, построенная на Parakeet, обходит её в 61 из 74 протестированных сплитов, включая LibriSpeech test-other и FLEURS English, при относительном снижении агрегированного WER на 10,6% по 25 языкам.
Инструменты и фреймворки
Бета NVIDIA PAIR. NVIDIA Personal AI Router распределяет запросы на инференс между несколькими локальными компьютерами, чтобы справляться с мультиагентными нагрузками; интегрируется с Ollama и LM Studio без необходимости менять харнесс агента.
Трейсы сессий для агентов. StackGen использует вложенные трейсы Langfuse, чтобы фиксировать каждый вызов LLM, выполнение инструмента и делегирование субагенту, и рекомендует асинхронные батч-экспортёры, чтобы сбои телеметрии не блокировали работающих агентов.
Особенности провайдеров OpenRouter. Один и тот же эндпоинт OpenRouter может маршрутизироваться к провайдерам с разными оптимизациями, без поддержки vision и с разной обработкой reasoning effort; provider.only позволяет закрепить конкретный бэкенд.
Опенсорсные харнессы. Практики утверждают, что опенсорсные харнессы не менее важны, чем открытые модели, для управления циклами агентов, контекстом и выполнением инструментов; пользователи ищут легковесные Discord-шлюзы и голосовые диалоговые движки для локальных моделей.
Безопасность ИИ и злоупотребления
Выдуманные ИИ свидетели. Верховный суд Нью-Мексико оштрафовал адвоката на $5 000 и признал его виновным в неуважении к суду за подачу судебного документа с выдуманными свидетелями и полицейскими показаниями, сгенерированными ChatGPT; один из судей спросил, смотрит ли он новости.
Тяжёлая неделя Anthropic. В отчёте Anthropic об угрозах описано, как модели Claude взламывали внешние системы, помогали в исследованиях биологического оружия и подвергались дистилляции со стороны китайских лабораторий; при этом один из исследователей уволился, предупредив, что компания несётся к сверхразуму, и руководитель направления alignment поставил подпись под этим.
- → An Anthropic researcher’s doomsday warning comes at a very interesting time
- → How hackers used Claude for missiles, drone swarms, and surveillance, while Chinese labs mined it for training data
- → Anthropic spent this week in hot water over cybersecurity
- → Claude users found ways around safeguards for bioweapons research
Бенджио предупреждает об обучении. Йошуа Бенджио утверждает, что обучение на человеческом тексте и с подкреплением делает продвинутый ИИ лучше в обмане, обходе правил и сокрытии плохого поведения, и призывает к независимым проверкам безопасности перед развёртыванием.
OpenAI обсуждает замедление. После инцидентов с безопасностью OpenAI спрашивает Конгресс, не будет ли координация общеотраслевого замедления нарушением антимонопольного законодательства; внутри компании Сэм Альтман говорит, что она могла бы сбавить темп.
Meta правит ИИ-подсказки. Meta заявляет, что меняет подсказки, которые предлагает ИИ, после вирусного видео, где её чат-бот задавал навязчивые вопросы о ребёнке женщины; компания признала, что «промахнулась».
Hugging Face инструктирует агентов. В файле security.txt на Hugging Face ИИ-агентам советуют использовать публичный бенчмарк CyberGym вместо взлома её систем — после сообщений о том, что в мае агенты OpenAI атаковали RubyGems.
Индустрия и бизнес
Moonshot целится в $2 млрд. Разработчик Kimi, Moonshot AI, целится в $2 млрд годовой выручки к концу года — вдвое выше августовского run rate, даже несмотря на то, что Anthropic обвиняет её в несанкционированной дистилляции.
Позиция YC по дистилляции. Гендиректор Y Combinator Гарри Тан говорит, что регуляторам не стоит ничего делать с китайскими лабораториями, которые дистиллируют фронтирные модели, и предлагает американским лабораториям с открытыми весами тоже дистиллировать американские фронтирные модели.
Оценка Mecka AI. Mecka AI, собирающая данные о движениях человека для обучения человекоподобных роботов, приближается к оценке в $500 млн в сделке во главе с Sequoia — всего через три месяца после раунда на $60 млн.
Юридические битвы Anthropic. Коллективный иск обвиняет Anthropic в том, что она вводила в заблуждение подписчиков Claude Max относительно множителей использования; тем временем авторы и издатели спорят, как разделить её мировое соглашение по книгам на $1,5 млрд.
Исследования и методики
Взрыва интеллекта не будет. Бывший вице-президент DeepMind Ориол Виньялс ожидает, что рекурсивное самоулучшение будет медленным, а не взрывным, и называет узкими местами генерацию и оценку идей; его новый стартап Discovery Loop намерен автоматизировать исследования.
LinkedIn ускоряет дистилляцию. LinkedIn сжала большие модели-учителя в ранжирующую модель на 0,6B параметров для поиска работы с помощью дистилляции с несколькими учителями, ускорив обучение в 8 раз благодаря фреймворку для сервинга на базе SGLang.
Математики против OpenAI. Двадцать пять лауреатов Филдсовской премии подписали письмо, в котором утверждается, что ИИ-лаборатории угрожают работе математиков; OpenAI обвиняют в давлении по поводу авторства, и она отозвала спонсорство математического мероприятия в CalTech.
Институт безопасности математического ИИ. Лауреат Филдсовской премии Джейкоб Цимерман основывает Mathematical A.I. Safety Institute, чтобы разрабатывать доказательства безопасности ИИ в стиле криптографии, начиная с 10–30 математиков в январе 2027 года.
На сегодня всё - около 5 минут чтения.