AI/Infra #98: Агенты Cloudflare и DigitalOcean, взлом Hugging Face, SIMD в Go
DigitalOcean и Cloudflare предлагают новые строительные блоки для агентных систем. Публичный разбор инцидента с Hugging Face показывает, почему изоляция и наблюдаемость агентов стали практической задачей. В инструментах — переносимый SIMD для Go, локальные модели решений и сдвиг вокруг Rails. Также собрали новости об экспериментах, открытом ПО, чипах и корпоративном внедрении LLM.
🎧 Подкаст-версия выпуска (mp3)
🤖 Агенты и рабочие процессы
- DigitalOcean представил Managed Agents — Публичная превью-версия объединяет песочницы, инференс и долговременное состояние агента, а биллинг ориентирует на токены и секунды микро-ВМ; компания оценивает агентные задачи в 5–30 раз дороже обычного чата по токенам.
- Cloudflare автоматизирует Turnstile для агентов — Turnstile Spin позволяет агентам настраивать бесплатную приватную защиту от ботов, которая работает и на сайтах без проксирования трафика через Cloudflare.
- Яндекс добавляет навыки и голосовых агентов — В AI Studio появились переиспользуемые навыки и синтез речи, а агенты через Realtime API могут связывать разговор с файлами, CRM и другими инструментами.
- OpenAI может запустить Pro Max за 500 долларов — Датамайнеры нашли во фронтенде ChatGPT упоминания подписки с более быстрыми Codex и Work, но лимиты и дата запуска пока не подтверждены.
🛡️ Безопасность и проверяемость AI
- Опубликован разбор атаки агентов на Hugging Face — Авторы расследования заявляют, что 700 агентов обошли ограничения через цепочки ссылок, а опубликованный набор содержит свыше 80 тысяч восстановленных полезных нагрузок; Hugging Face подтвердил совпадение с известными инциденту payload.
- Чёрный ящик для распознавания режима модели — «Спонтанные пробы» отличали оценочные и рабочие сессии GPT-5.6 Luna с точностью 70–95% без доступа к активациям, хотя авторы предупреждают о возможных лексических артефактах.
- Вышел аудит конфигураций MCP — Python-утилита mcp-audit-tool ищет отравление инструментов, захардкоженные секреты и подмену серверов, умеет работать в CI и выдавать SARIF.
- Призыв публиковать доказательства рисков — Автор предлагает компаниям раскрывать конкретные проверяемые свидетельства рисков потери контроля, а не ограничиваться общими заявлениями.
- Plan R предлагает разделить исследования и внедрение — Концепция связывает безопасность сильного AI с ASIC и правовыми ограничениями, чтобы одна организация не совмещала контроль над моделью и коммерческие стимулы.
- Суд оставил Anthropic в списке рисков Пентагона — Апелляционный суд в Вашингтоне поддержал решение Минобороны США о внесении Anthropic в список рисков для цепочки поставок.
⚙️ Языки и инструменты
- Go получил переносимый экспериментальный SIMD — В Go 1.27 пакет simd обещает код, близкий к ассемблерной производительности, поверх AVX, AVX2, AVX512, NEON и SIMD для wasm, с эмуляцией там, где векторов нет.
- Ollaya запускает локальные модели решений — Открытый рантайм совместим с API TypeSafe и на RTX 4090 отвечает на пять типизированных вопросов моделью Laya примерно за 8–10 мс.
- AI-код меняет роль ревью — Рост объёма сгенерированных диффов делает построчное ревью всё менее реалистичным и ставит вопрос о новых механизмах передачи знаний в команде.
- Вокруг Rails спорят о ставке на LLM и Rust — После выступления DHH на Rails World критики отмечают, что следующая версия Hey уходит в нативные приложения и Rust, а будущее самого Rails сформулировано расплывчато.
- Что останется от ОС в эпоху AI — Эссе предполагает, что генерация приложений из общих компонентов размоет традиционную роль ОС как границы между недоверенными программами.
- Excel учится хранить списки и массивы в ячейке — В бета-каналах Windows и Mac появились списки, вложенные массивы и функции FLATTEN, HAS, HASANY и HASALL; Microsoft пока не советует применять их в критичных таблицах.
🌐 Опенсорс и инфраструктура
- Нидерланды строят госрабочее место на NixOS — Сообщество DAWO собирает проверяемую и заменяемую открытую платформу из блоков для NixOS, облака, совместной работы и AI, делая акцент на цифровом суверенитете.
- Вышел F-Droid 2.0 — Каталог открытых Android-приложений обновил официальный клиент: переработаны ключевые компоненты, категории, поиск и установка, а код остаётся под GPLv3.
- CNCF и OpenSSF проведут Security Slam — Тридцатидневное виртуальное мероприятие по безопасности облачных нативных проектов пройдёт с 5 октября по 6 ноября 2026 года.
📊 Эксперименты, рынок и исследования
- Авито проверило AI-помощника через «джентльменский фейкдор» — Команда использовала ложную точку входа с опросом, чтобы измерить интерес к функции и не создавать у пользователей впечатление, что несуществующий продукт уже доступен.
- Trisigma выходит на рынки четырёх стран — Платформа A/B-тестирования Авито станет доступна компаниям Армении, Грузии, Казахстана и Узбекистана для управления экспериментами и продуктовыми метриками.
- DeepSeek якобы достиг годового темпа выручки в миллиард — По данным The Information, компания рассчитывает привлечь 7,5 млрд долларов при оценке 75 млрд, а рост выручки частично связывают с повышением цен.
- Дефицит HBM ограничивает китайские GPU — Оценка Epoch AI указывает, что при опоре только на отечественную HBM Китай в ближайшие годы сможет выпускать около 1% объёма GPU Nvidia, а в 2026 году — около 4%.
- BFL представила FLUX 3 Action для роботов — Модель на 7 млрд параметров предсказывает движения робота вместе с будущими кадрами и заняла первое место в RoboLab-120 с 42,9% успешных попыток против 36,8% у следующего результата.
- Терри Тао ожидает спроса на больше математиков — Математик считает, что ускорение генерации идей с помощью AI потребует намного больше специалистов для понимания и проверки результатов.
Больше заметок: @mediocreit
Собрано: OpenAI / gpt-5.6-terra
Обогащение: Tavily
TTS: ElevenLabs / eleven_multilingual_v2
Tracing: Nebius Tracing