Дайджест: Claude перестал забывать, IBM Granite 4.2, 4-bit побеждает 16-bit, хакеры водоканалов

Ежедневный дайджест AI-новостей: Anthropic объединила память Claude и Cowork, IBM Granite 4.2 с reasoning и agentic RL, QAH сжимает модель и делает её лучше, OpenClaw закрыла утечки секретов, AI снижает порог для атак на критическую инфраструктуру.


AI assistant merges screens while a scientist holds a reasoning stone and a hacker attacks a power plant.

Anthropic: Claude теперь помнит всё. И показывает, что запомнил

Anthropic объявила о слиянии двух систем памяти Claude: памяти чата и памяти Cowork. Теперь то, что модель узнала в одном режиме, доступно в другом. Пользователь может читать, редактировать и удалять любую информацию, которую Claude сохранил. Чувствительные темы — здоровье, религия, политика — по умолчанию не сохраняются, но можно включить opt-in. Government ID и Social Security numbers — никогда.

Это решает одну из самых раздражающих проблем работы с агентами: необходимость заново объяснять контекст каждый раз, когда переключаешься между режимами.

В тот же день Anthropic запустила грантовую программу на $5 миллионов для независимых исследований влияния AI на wellbeing пользователей. Гранты пойдут на создание open-source оценок, которые помогут индустрии измерять, как модели влияют на тех, кто их использует. Дедлайн заявок — 21 сентября.

IBM Granite 4.2: reasoning-модели, которые ходят в терминал

IBM Granite Team выпустила Granite 4.2 — семейство reasoning-моделей на 3B, 8B и 30B параметров. Все обучены с нуля на ~15 триллионах токенов с пятифазной стратегией, контекстное окно — 512K. Apache 2.0.

Главное — post-training. Модели 8B и 30B проходят через multi-stage RL-пайплайн с agentic RL: модель учится действовать в реальных средах — редактировать код в sandbox, работать с терминалом через Harbor/Terminus-2 (до 64 environment turns на rollout), делать multi-hop web search. 3B получает только foundational RL + RLHF.

Весь пайплайн работает на NeMo-RL и NeMo-Gym. Использованные harnesses для agentic corpus (31.6% от SFT-данных): OpenHands, OpenCode, Terminus-2, SWE-agent, OpenResearcher, MiniSWE, OpenSeeker, EnvScaler, Gemini CLI, Hermes, Codex, Goose.

4-bit побеждает 16-bit: Multiverse Computing вывернула компрессию наизнанку

Multiverse Computing представила Quantization-Aware Healing (QAH). Идея: вместо того чтобы восстанавливать сжатую модель из её же bfloat16-версии (что ограничивает ceiling), QAH дистиллирует из оригинальной, до-компрессии модели. Teacher — 120B full-precision. Student — 60B MXFP4. Разные архитектуры, но KL-divergence на логитах работает независимо от размера.

Результат: 60B MXFP4 превосходит собственный bfloat16 на 7 из 9 бенчмарков. Самые большие gains — на long-context reasoning (+7.4 на AA-LCR) и математике (+5.6 на AIME 2025). На двух бенчмарках (MMLU-Pro, SciCode) отстаёт менее чем на 1.5 пункта.

Это инвертирует обычное отношение: 4-bit модель меньше, дешевле в запуске и точнее, чем чекпоинт, из которого она была квантизована.

OpenClaw: три патча за день, все про секреты

OpenClaw закрыла три уязвимости за 24–25 августа. Все — про утечки секретов в failure paths.

Ollama loopback: плагин классифицировал только 127.0.0.1 как «локальный», а 127.0.0.2 и 127.1.2.3 (тоже loopback) — как «remote». Ambient Ollama Cloud credential уходила на то, что отвечало по этому адресу. PR #129168 исправил на full-/8 IPv4 loopback detector.

Reflected credentials: ошибки от Ollama и LM Studio могли содержать API-ключи, которые модель возвращала в error body. Старые билды копировали этот текст прямо в operator-visible errors. PR #119537 и #128561 теперь удаляют все формы секрета (raw, JSON-string, URI-encoded, form-encoded, mixed-case percent-escape).

ngrok authtoken в argv: Voice Call передавал ngrok-токен через child-process arguments, которые world-readable через /proc/pid/cmdline. PR #129330 перенёс токен на NGROK_AUTHTOKEN environment variable.

Multi-agent amnesia: Salesforce показал цифры

Блог Empirical (вендор shared-memory инструментов, но с самостоятельным анализом) поднял проблему, о которой все знают, но мало кто формулирует: мульти-агентные пайплайны страдают от «амнезии». Salesforce протестировал CRMArena-Pro на 4,280 бизнес-задачах: single-turn success ~58%, multi-turn (где контекст должен переноситься через шаги) — ~35%.

Это не баг фреймворка. Это architectural isolation: каждый субагент работает в своём контекстном окне (Anthropic прямо называет это «преднамеренным — для предотвращения context pollution»). Но та же изоляция означает, что каждый handoff — lossy compression. Agent 3 никогда не знает, что agent 1 обнаружил, если agent 2 не передал это в явном виде.

Vercel Run SDK: песочница для агентов, которые пишут TypeScript

Vercel выпустил Run SDK — пакет для выполнения не доверенного JavaScript/TypeScript без доступа к приложению или системе. QuickJS context в worker thread, host functions как единственное API для внешнего мира, human-in-the-loop interruption для sensitive operations.

При прерывании run получает signed token для resume. Resuming replay-ит программу, но settled host function calls используют записанные результаты — работа до прерывания не повторяется.

Это тот же модуль, который powering code mode в AI SDK.

OpenAI Admin Plugin: IT-отдел, который работает в ChatGPT

OpenAI запустила Admin plugin для ChatGPT Work и Codex. Администраторы workspace могут анализировать adoption, управлять members/groups, permissions, usage limits и spending requests — всё через разговорную сессию. Плагин работает в рамках существующих прав, не расширяя доступ.

Внутри OpenAI IT-команда уже использует его: ChatGPT Work-агент в Slack обрабатывает employee IT-запросы, триажит тикеты, завершает поддерживаемые задачи и эскалирует исключения. На момент отчёта ~45% тикет-объёма решались автоматическими workflow.

Axios: AI снижает порог для атак на водоканалы и электростанции

Axios сообщает о волне кибератак на критическую инфраструктуру. Iran-backed хакеры проникли на британскую электростанцию (четырёхдневный shutdown). В США хакеры активно использовали AI-сгенерированный exploitation script для targeting programmable logic controllers в водных системах.

AI не меняет способ взлома. AI снижает время, стоимость и экспертизу, необходимые для эксплуатации существующих уязвимостей. Исторически хакерам нужно было получить сами устройства или изучать технические мануалы. Теперь достаточно описания.

EPA пыталась ввести обязательные cybersecurity measures для водоканалов во время администрации Байдена. Policy была отменена после legal challenges от штатов и индустриальных групп.

AIToolsRecap: SuperGrok Heavy теряет «near-unlimited»

AIToolsRecap зафиксировал: у SuperGrok Heavy исчезло «near-unlimited usage», цена — $300. Новый $100-тир SuperGrok Plus. 31 августа — двойной дедлайн: Sonnet 5 repricing + GPT-5.4 уходит из Codex. Grok 4.7 — pre-training завершён.

Keenable: экс-Yandex строит индекс для AI-агентов

Andrey Styskin (экс-руководитель поиска, AI и облака в Yandex) и Matthias Petri вышли из stealth с Keenable — $26M seed от Accel. Индекс более 100 миллиардов документов для AI-агентов. API уже используется в production у нескольких AI-лабораторий и inference-провайдеров во время training и runtime.

Партнёрство с voice AI-компанией Gradium для live information retrieval. Styskin: «Это создаёт новый flywheel, отличный от того, что Google выучил из человеческого поведения».

Краткий ответ

AI-день 25 августа 2026: Anthropic объединила память Claude и Cowork + запустила $5M гранты на wellbeing-оценки. IBM Granite 4.2 — reasoning-модели 3B/8B/30B с agentic RL (SWE, terminal, search) на Apache 2.0. Multiverse Computing QAH — 60B MXFP4 превосходит собственный bfloat16 на 7 из 9 бенчмарков. OpenClaw закрыла три credential-exposure уязвимости. Salesforce показал 58%→35% drop в multi-turn agent tasks. Vercel Run SDK — QuickJS sandbox для агентов с human-in-the-loop. OpenAI Admin plugin для ChatGPT Work. Axios: AI снижает порог атак на критическую инфраструктуру. SuperGrok Heavy теряет «near-unlimited usage». Keenable — $26M на индекс 100B документов для AI.

← Все новости