Дайджест AI/Infra — 24 июля
Дайджест AI/Infra за 2026-07-24.
Выпуск канала mediocre notes — @mediocreit
🧠 AI-модели и открытый код против закрытых
- OpenAI и Anthropic объединились против open-weight моделей — Две компании лоббируют в США ограничения на открытые весовые модели под предлогом «китайской угрозы», что вызвало волну критики со стороны стартап-сообщества.
- Стартап-основатели призвали правительство США не запрещать open-weight AI из Китая — 854 голоса на HN: 150+ основателей через инициативу Little Tech обратились к администрации Трампа, назвав запрет катастрофическим для инноваций.
- Аргументы против open-source AI — слабые — Разбор в блоге: аргументы о безопасности открытых моделей основаны на спекуляциях, а не на реальных инцидентах, и служат лишь защите бизнес-моделей крупных игроков.
- Будущее AI — за комьюнити и открытостью, заявляет CNCF — Согласно опросу CNCF, 66% организаций, использующих генеративный AI, управляют инференсом через Kubernetes; сообщество выступает за открытую AI-инфраструктуру.
- grug-9b: думать в 36 токенов вместо 570 — Модель на базе Ornith-1.0-9B с файнтюнингом на «grug-стиле»: стоимость инференса снижена на ~75%, скорость — в 3.3 раза быстрее, при падении HumanEval на 12.2 пункта.
- Black Forest Labs анонсировала FLUX 3 — единая модель для изображений, видео и аудио — Разработчики обещают качество, приближающееся к видеомоделям Google; релиз будет постепенным в ближайшие недели и месяцы.
- Математики в панике из-за наступления AI — Ведущие математики уходят в AI-лаборатории на фоне угрозы, которую AI представляет их карьере; сообщество требует срочных альтернатив.
💰 Экономика AI: траты и долги
- AI-компании скрывают ошеломляющий объём долгов за балансом — Расследование Futurism: AI-компании выводят миллиардные обязательства перед облачными провайдерами за баланс, маскируя реальную стоимость индустрии.
- Alphabet сжигает деньги — Big Tech наращивает AI-расходы — Reuters сообщает о рекордном cash burn Alphabet из-за гонки AI-инвестиций; аналитики бьют тревогу об устойчивости таких расходов среди техногигантов.
☸️ Kubernetes и AI-инфраструктура
- Kubeflow + Cilium: как 60% GPU простаивали из-за сетевых политик — Инженеры Adobe обнаружили, что CiliumNetworkPolicy блокировала трафик между координатором и GPU-воркерами в разных AZ, оставляя кластер бездействующим при зелёных индикаторах.
- Запуск AI Infra SIG в CNCF Japan Chapter — CNCF открывает специальную группу по AI-инфраструктуре в японском отделении; первый митап и приём докладов на KubeCon Japan 2026.
- Kubernetes к 2035 году: стандарт, невидимка или история? — Блог AvitoTech размышляет: станет ли Kubernetes невидимой инфраструктурой или устаревшим легаси, когда технология становится общепринятым стандартом.
🔧 Инференс-оптимизация и модельный роутинг
- Echo: результат уровня Fable за треть цены на open-weight моделях — Show HN: система динамически выбирает и комбинирует open-weight модели (GLM-5.2, Kimi K2.7 и др.) для каждой задачи, достигая качества Fable при ~1/3 стоимости инференса.
- Model Synthesis от DigitalOcean: обход Fable 5 за половину цены — Новый server-side инструмент на Inference Engine использует модель-синтезатор для выбора оптимального соотношения интеллекта и цены для каждого запроса.
- Не фиксируйте провайдера в OpenRouter — это может обнулить ваше исследование — Статья на LessWrong: случайная маршрутизация OpenRouter на провайдеров с разным качеством привела к опровержению результатов NeurIPS-статьи; выводы исследований могут быть недостоверны без фиксации провайдера.
📊 Наблюдаемость и мониторинг AI-агентов
- Мониторинг AI-агентов в продакшене: как «измерить радиацию» — Yandex Cloud разбирает особенности observability для AI-агентов: LLM, оркестратор, инструменты и данные требуют иного подхода к метрикам, чем классические микросервисы.
- OpenTelemetry: итоги 10-недельного менторского когорта с Bloomberg — 48 инженеров Bloomberg подали 118 PR (70 смержены) в 11 репозиториев OTel, включая multi-cloud credential rotation extension для Collector; OTel получил статус graduated в CNCF.
🦀 Rust и инструменты разработки
- RustRover 2026.2: нативная поддержка Axum — JetBrains добавили в IDE навигацию по роутам, понимание request flow и генерацию клиентских вызовов для Axum — фреймворка с >850K ежедневных загрузок и >25K звёзд на GitHub.
- Всем стоит знать SIMD — Митчелл Хашимото — Автор объясняет 5-шаговый паттерн векторизации циклов, дающий 4x–8x ускорение на больших данных; базовое знание SIMD должно быть у каждого разработчика.
⚙️ Распределённые системы и масштабирование
- Масштабирование Zeebe: от каскадных сбоев до 100 процессов/с — Т-Банк провёл нагрузочное тестирование Camunda 8.5/8.6, выявил узкие места в общем пуле потоков воркеров и дал практические рекомендации по тюнингу Zeebe для высоконагруженных сценариев.
- Cloudflare запускает Cache Response Rules — Новый тип правил срабатывает после ответа origin, но до кэширования — позволяет гибко управлять тем, что Cloudflare сохраняет в кэш.
🏗️ Dev-инструменты и практики
- Почему фабрики ПО проваливаются: harness engineering недостаточно — Разбор на GitHub: автоматизация генерации кода без понимания контекста и предметной области приводит к провалу концепции «фабрик программного обеспечения».
- Code Coverage: как измерять и улучшать тесты — гайд от JetBrains Qodana — Разбор метрик покрытия кода с практическими рекомендациями: как понять, что именно тесты не проверяют, и куда направить усилия.
- Как не нужно работать с выделенными серверами — Yandex Cloud собрал типичные ошибки при работе с bare-metal: от игнорирования мониторинга до неправильной настройки сети и хранения.
🤖 AI-агенты в действии
- AI-агенты CoreWeave обрабатывают радио F1 в реальном времени — Платформа транскрибирует 40 радиоканалов гонок Aston Martin Aramco, превращая переговоры в тактические решения за доли секунды.
- DARPA и ВВС США подняли в воздух F-16 под управлением AI — Автономный полёт истребителя под управлением AI успешно продемонстрирован; важный рубеж в применении AI для критически опасных систем.
💻 Железо, DIY и опенсорс
- Программный рендеринг в 500 строках чистого C++ — Образовательный проект: реализация софтверного рендерера с нуля, отрисовка треугольников и текстурирование без GPU — наглядное введение в компьютерную графику.
- Plex уходит в корпоративный контент — пора переезжать на Jellyfin — Plex смещает фокус на рекламный стриминг и ограничивает self-hosting фичи; Jellyfin остаётся полностью свободной альтернативой с настоящим контролем.
Больше заметок: @mediocreit
Собрано: Nebius Token Factory / deepseek-ai/DeepSeek-V4-Pro Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing