Дайджест AI/Infra — 30 июля
Дайджест AI/Infra за 2026-07-30.
Выпуск канала mediocre notes — @mediocreit
🤖 Модели, агенты и локальный запуск
- Gemma 4 26B запускают на Mac с 2 ГБ памяти — Открытый TurboFieldfare на Swift и Metal держит в памяти около 2 ГБ, подгружая нужных экспертов Gemma 4 26B с SSD; на M2 заявлены 5,1–6,3 токена в секунду.
- У Kimi K3 появился режим контекста 256K — Вариант k3-256k даёт те же результаты в окне 256K, потребляя примерно вдвое меньше квоты, чем версия K3 с контекстом 1M.
- Вышла двухбитная Qwen 35B для локального сервинга — Квантованная MoE-модель размером 12,3 ГБ рассчитана на GPU с 16–24 ГБ памяти и отдаёт OpenAI-совместимый API через SGLang или ZML.
- Длинные инструкции плохо управляют агентами — Бенчмарк HANDBOOK.md проверяет следование агентными моделями правилам в длинном контексте и показывает ненадёжность одних лишь объёмных политик.
- Независимые мониторы тоже могут деградировать — Обучение против одного монитора безопасности способно через побочные эффекты ухудшать другие, не использованные при обучении проверки.
- Эксперимент с внутренними состояниями Gemma 3 — Репликация на Gemma 3 27B показала: явная просьба думать о понятии усиливает его внутреннее представление даже при написании несвязанного текста.
☸️ Платформа, Kubernetes и наблюдаемость
- Grafana Cloud предлагает автоматизировать рутинную эксплуатацию — Новые Automations, Watchers и Investigations в Grafana Assistant должны следить за телеметрией, разбирать аномалии и снимать с инженеров повторяющийся триаж.
- VK WorkSpace заменил связку Puppet и Helm на Helmwave — Helmwave выбрали для управления зависимостями релизов, шаблонизации и отслеживания установок через Kubedog, чтобы избежать гонок с CRD.
- Проверки здоровья могут ломать scale-to-zero — KubeElasti ProbeResponse позволяет сервисам оставаться неактивными, отвечая на проверки Kubernetes и балансировщиков без фактического пробуждения приложения.
- CoreWeave призывает валидировать ИИ-фабрики до продакшена — Компания описывает ИИ-фабрику как полный жизненный цикл, где совместно спроектированный стек NVIDIA и CoreWeave проверяют до поставки заказчику.
- Практика SQLite в продакшене — Материал разбирает настройку WAL, конкурентный доступ и слои VFS для снижения задержек серверных приложений.
- Cloudflare добавил постквантовую аутентификацию origin-серверов — Authenticated Origin Pulls и Custom Origin Trust Store теперь позволяют настроить взаимный TLS с постквантовой аутентификацией до origin.
📊 Данные, качество и инструменты разработки
- В Яндексе описали 15 тысяч таблиц за полгода — Команда автоматизировала документацию для каталога с десятками миллионов таблиц, увеличив темп с 500 таблиц в год до 15 тысяч за полгода.
- Авито унифицировал метрику для сотен антифрод-моделей — Команда BI создала общую метрику, чтобы сопоставимо оценивать эффективность множества ИИ-моделей антифрода.
- Qodana 2026.2 улучшает покрытие в pull request — Релиз показывает непокрытые новые строки и упрощает работу с находками качества, безопасности и соответствия требованиям.
- PwC исправляет отчёты с ошибками от ИИ — В опубликованных материалах обнаружили выдуманную научную статью, ссылку на малозаметный блог и другие признаки непроверенной генерации.
🏗️ Масштаб ИИ-инфраструктуры
- Дата-центры ИИ ищут тысячи рабочих специальностей — Строительство инфраструктуры для ИИ резко повышает спрос на электриков и плотников, превращая дефицит кадров в ограничение роста дата-центров.
- Гиперскейлеры поставили на ИИ 2,5 трлн долларов — Оценка для Amazon, Google, Meta, Microsoft и Oracle говорит о 2,5 трлн долларов обязательств по ИИ-инфраструктуре, из которых примерно половина уже потрачена.
- Сотрудники лабораторий просят подготовить механизм замедления — Открытое письмо 1 224 сотрудников, поддержанное OpenAI и Anthropic, предлагает заранее создать международные технические и управленческие инструменты для регулирования темпа развития ИИ.
- Ведущие ИИ-стартапы всё реже публикуют исследования — Обсуждение на Hacker News привлекло внимание к снижению открытости исследований у крупнейших частных лабораторий ИИ.
🚀 Космические системы
- Starship S40 точно сел на виртуальную башню — По данным сообщения, точности океанской посадки хватило бы для захвата манипуляторами, что повышает шансы на проверку посадки в следующей миссии.
Больше заметок: @mediocreit
Собрано: OpenAI / gpt-5.6-terra Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing