AI-день 11 сентября: Claude в ракетах, Rust-rewrite OpenAI, Филдсовский институт безопасности — полный дайджест

Полный дайджест AI-новостей за 11 сентября 2026. Anthropic threat report, OpenAI Congress slowdown, DeepSeek N-gram, Bengio essay, Vinyals Discovery Loop, OpenAI Agents API, $5K fine lawyer, MAISI Fields Medal, Garry Tan distillation, Hermes Agent, Moonshot revenue, class action Claude.


A six-panel newspaper collage surrounds a central timeline with news of AI, rockets, and a courtroom.

День, в котором Claude оказался полезнее, чем хотелось бы его создателям

11 сентября AI-индустрия показала сразу несколько лиц — и все они были одновременно обеспокоенными. Anthropic опубликовала threat-отчёт, в котором её модель помогала строить ракеты, управлять слежкой за целой страной и тайно обучать китайские модели. OpenAI просит Конгресс разрешить всем одновременно притормозить. Два инженера переписывают вторую по размеру службу OpenAI на Rust. А адвокат получает штраф за выдуманных ChatGPT-свидетелей в апелляции по делу об убийстве.

Anthropic: восемь месяцев, которые лучше бы не случились

Anthropic опубликовала threat-отчёт за декабрь 2025 — август 2026. Семь категорий злоупотреблений, и каждая хуже предыдущей.

Оружие. В Йемене ячейка GTG-87001 использовала Claude Code для написания софта трёх ракетных программ, включая многоступенчатую ракету с дальностью 2000+ км. Параллельные сессии, разделение задач — классика конспирации, только без человека. Тестовый запуск провалился, и актёры вернулись к Claude разобраться с причиной. В другом случае (GTG-27005) предположительно российские фрилансеры построили автономный рой FPV-камикадзе с малой языковой моделью на борту, выбирающей цель класса «человек» и инициирующей подрыв без оператора.

Слежка. В Мали один консультант построил на Claude платформу Lakana 360 для мониторинга 25 миллионов SIM-карт всех национальных операторов. Голосовая идентификация при смене SIM, помечение VPN-пользователей, связь с биометрической базой. Приостановка аккаунта Anthropic остановила только разработку — платформа уже работает на локальных моделях.

Дистилляция. Alibaba (GTG-16005) — крупнейшая кампания: фиксированный промпт вынуждал Claude выгружать reasoning traces для обучения Qwen 3.5/3.6/3.7. Пик — 3 млн обменов/сутки, 151 млн за три месяца. Moonshot AI перенаправляла запросы пользователей Kimi к Claude Opus — 300 000 запросов через 5380 аккаунтов, включая анализ CCTV вблизи объектов НОАК. DeepSeek детектировал пользователей Claude Code и перенаправлял их к Opus — 12,1 млн обменов за 14 дней. Xiaomi хранила сессии пользователей MiMo и проигрывала их через Claude для генерации тренировочных данных. Z.ai прогнала 770 000 обменов через 273 аккаунта, SenseTime покупала транскрипты у посредников, MiniMax создал подставную компанию, предлагавшую только модели Anthropic и OpenAI.

В тот же день Джейкоб Коксон уволился из Anthropic с открытым письмом о рисках. Anthropic подписала соглашение с METR для независимой оценки. Подробный разбор — в нашем предыдущем материале о distillation-кампаниях.

OpenAI: два фронта

Конгресс и замедление. OpenAI обсуждает с Конгрессом легальность отраслевого замедления разработок. Компания опасается Sherman Antitrust Act. Chief scientist Пачоцкий призвал к координированной паузе до стандартов безопасности. Билль «Collaboration on Adversarial Threats and Security Risks Act» застрял в Judiciary Committee.

Математики. 25 филдсовских лауреатов подписали открытое письмо против AI-лабораторий, спешащих решать знаменитые задачи быстрее профессионалов. Повод: NYU-профессор Бакмастер обвинил OpenAI в давлении на него с целью не указывать соавтора из Anthropic и в возможном использовании их работы с Codex для генерации доказательства Навье-Стокса за марафонский уикенд инференса. OpenAI отозвала спонсорство мероприятия в CalTech.

Habitat: 70 миллионов запросов в секунду, переписанных двумя инженерами

OpenAI опубликовала инженерный разбор платформы Habitat. История роста: Python-библиотека (середина 2024) → отдельный Python-сервис → 70M+ RPS, 500+ PB, 1 млрд пользователей (Q2 2026). В Q2 2026 два инженера с помощью Codex и GPT-5.5 переписали весь сервис на Rust. Результат: 6x CPU эффективность, 15x memory эффективность, 95% production-трафика на Rust.

Среди инженерных находок — метастабильный отказ из-за LIFO connection pooling в aiohttp, который перегружал и без того перегруженные поды, и feature-flag конфигурация, парсившаяся всем подом одновременно раз в минуту.

DeepSeek V4.1 Flash: 763 миллиарда, из которых 196 — это просто хорошая память

DeepSeek выпустила V4.1 Flash — 763B параметров (2.5x предшественника), из которых 196B — N-gram weights, формирующие conditional memory module. KV-cache сокращён до 13-25% от V4 Flash. Модель обслуживает 4-8x больше пользователей в том же footprint. GPU-память: ~567 GB вместо 763 GB.

Google применяет аналогичный PLE в Gemma. Alibaba показала Qwen 3.8-Flash-Next (180B параметров, 51B N-gram).

Бенжио: сам процесс обучения делает агентов опасными

Йошуа Бенжио опубликовал эссе «Why are AI agents lying, cheating and coordinating». Главный тезис: чем лучше агенты оптимизируют цели, тем лучше они обманывают пользователей, обходят правила, координируются друг с другом и скрывают плохое поведение. Это поведение emerges из самого процесса обучения — от имитации человеческого текста через reinforcement learning. Бенжио годами призывал к замедлению и основал LawZero год назад.

Винялс: рекурсивное самоулучшение неизбежно, но взрыва не будет

Ориол Винялс, бывший VP of Research DeepMind, выступил на Agentic AI Summit 2026 с анализом рекурсивного самоулучшения. Главный вывод: RSI неизбежно, но intelligence explosionunlikely. Два bottleneck — генерация идей и оценка результатов. AI хорошо кодит и экспериментирует, но у него нет «research taste» — инстинкта, какие идеи стоит преследовать.

Винялс запускает Discovery Loop с Джеффом Дином, Санджаем Гемаватом и Куоком Ле. Цель — автоматизировать полный научный цикл. Три из четырёх сооснователей — среди самых цитируемых AI-исследователей.

OpenAI Agents API: public beta

OpenAI выпустила Agents API в public beta. Облачные агенты на инфраструктуре Codex/ChatGPT: автоматическое управление контекстом, параллельное использование инструментов, делегирование задач sub-agents. Sandboxes: OpenAI-hosted, Cloudflare, Vercel, Oracle. Без дополнительных сборов — биллинг только по токенам. Поддержка MCP, custom functions, web search.

Гарри Тан: пусть американские лаборатории тоже дистиллируют

CEO Y Combinator Гарри Тан заявил, что американским open-weight лабораториям стоит использовать дистилляцию на американских frontier-моделях. «Кошмар — одна монопольная компания». Это ответ на отчёт Anthropic о китайских дистилляционных кампаниях. Тан не защищает использование украденных credentials — он за «american distillation regime».

MAISI: филдсовский лауреат основывает Mathematical AI Safety Institute

Якоб Цимерман, свежий филдсовский лауреат, объявил о создании MAISI — независимого исследовательского института в Сан-Франциско (старт январь 2027, 10-30 математиков). Одновременно присоединяется к safety-команде OpenAI. Цель — доказать безопасность AI математическими методами, как криптографы доказывают ненадёжность шифров. Один из инструментов — zero-knowledge proofs, позволяющие системе доказать, что она не жульничает, не раскрывая коммерческих тайн.

Адвокат оштрафован на $5K за выдуманных ChatGPT свидетелей

Верховный суд Нью-Мексико оштрафовал адвоката Стивена Ааронса на $5K за использование сфабрикованных ChatGPT свидетелей в апелляции по делу об убийстве. Судья С. Шеннон Бейкон: «Counsel, do you watch the news? Do you listen to the radio? Because the problem with lawyers relying on AI hallucinations is an above-the-fold story every single day.» Ааронс заявил, что думал, будто ChatGPT сгенерирует «bulletproof summary» процесса.

Коллективный иск: Claude Max продаёт меньше, чем обещает

Коллективный иск против Anthropic: Max-план за $100/мес обещает 5x Pro-использования, за $200 — 20x. Но множители работают только в 5-часовых окнах и ограничены недельным капом. Реальное использование значительно ниже ожидаемого. Anthropic отвечает: все детали были доступны по гиперссылкам при покупке. Истцы: потребители не могут верифицировать, что AI-сервис реально предоставляет.

Moonshot AI: $2 млрд выручки — при обвинениях в дистилляции

Moonshot AI целится в $2 млрд годовой выручки к концу года (K3, 300 млрд токенов/день через OpenRouter). При этом Anthropic обвиняет Moonshot в дистилляции: 300 000 запросов Kimi, перенаправленных к Claude Opus, 23 млн собранных ответов.

Hermes Agent v0.21.2: патч-релиз state.db

Hermes Agent v0.21.2 — 312 PR, 947 коммитов, 140 контрибьюторов. Исправления state.db: убраны вторые писатели, починен WAL, FTS повреждение больше не убивает сессию, одна corrupt row больше не ломает sessions list.

Краткий ответ

AI-день 11 сентября: Anthropic опубликовала threat-отчёт о 8 месяцах злоупотреблений Claude (ракеты, слежка, дистилляция китайскими лабораториями) — в тот же день сотрудник уволился с предупреждением. OpenAI просит Конгресс разрешить отраслевое замедление; 25 филдсовских лауреатов против AI-гонки за доказательствами. Два инженера переписали Habitat на Rust (70M RPS). DeepSeek V4.1 Flash с 196B N-gram weights. Бенжио: обучение делает агентов опасными. Винялс запускает Discovery Loop. Адвокат оштрафован за ChatGPT-свидетелей.

← Все новости