Дайджест AI/Infra — 17 июля
Дайджест AI/Infra за 2026-07-17.
Выпуск канала mediocre notes — @mediocreit
🧠 AI-модели и агенты
- Kimi K3: первая открытая модель класса 2.8T параметров — Moonshot выпустила Kimi K3 — Mixture-of-Experts на 2.8T параметров (896 экспертов, 16 активных) с контекстом 1M токенов; обгоняет Opus 4.8 по бенчмаркам, но уступает Claude Fable 5 и GPT 5.6 Sol, веса — до 27 июля.
- Kimi K3: $3/$15 за миллион токенов, автокэширование со скидкой 90% — Moonshot оценила Kimi K3 на уровне Sonnet: $3/$15 за млн токенов, стоимость за таск вдвое ниже Opus 4.8 благодаря автоматическому кэшированию.
- LM Studio Bionic: AI-агент для открытых моделей — LM Studio представила Bionic — настольного AI-агента для кодинга и работы с документами, с локальным запуском открытых моделей, офлайн-транскрипцией Voxtral от Mistral и опциональным облачным инференсом с Zero Data Retention.
- Hy3-GGUF: квантизация Hy3 для llama.cpp с MTP-декодингом — Опубликованы рецепты низкобитной квантизации модели Hy3 в формат GGUF с поддержкой MTP self-speculative decoding и конфигурациями для H20 (1–4 GPU), включая патчи для llama.cpp.
- NotebookLM переименован в Gemini Notebook — Google объединила NotebookLM с экосистемой Gemini: сервис теперь называется Gemini Notebook и глубже интегрирован с остальными AI-продуктами компании.
☸️ Kubernetes и облачная инфраструктура
- Modal: масштабирование до 1 млн параллельных песочниц за секунды — Modal перестроила платформу песочниц: убраны все центральные bottlenecks, контейнеры создаются напрямую на worker-нодах через слой load balancer’ов, достигнута скорость создания десятков тысяч песочниц в секунду.
- CNCF и Broadcom: платиновое партнёрство для AI-ready инфраструктуры — Broadcom повысила членство в CNCF до платинового уровня, углубляя инвестиции в открытую cloud-native инфраструктуру для AI-нагрузок.
- Self-hosted LLM в Kubernetes с vLLM и LINSTOR — CNCF опубликовала гайд по развёртыванию vLLM в Kubernetes с реплицированным хранилищем LINSTOR/DRBD для model weights; используется Llama-3.2-1B-Instruct через OpenAI-совместимый REST API.
🛠 Релизы IDE от JetBrains
- WebStorm 2026.2: TypeScript 7, GitHub Copilot и Agent Skills — WebStorm 2026.2 получил нативную интеграцию GitHub Copilot, менеджер Agent Skills и поддержку TypeScript 7 с компилятором на Go — загрузка Kibana ускорилась с ~12 до ~3 секунд.
- IntelliJ IDEA 2026.2: Java 27, Kotlin 2.4, Copilot и Logpoints — IntelliJ IDEA 2026.2: day-one поддержка Java 27 и Kotlin 2.4, нативный GitHub Copilot, Agent Skills, Logpoints, ранняя поддержка Gradle 10 и 1300+ багфиксов.
- IntelliJ IDEA 2026.2: 1300+ исправлений — Релиз закрывает более 1300 багов и 140 фризов/перформанс-проблем, собранных через reporting API.
- GoLand 2026.2: профилирование без доп. настройки, go fix и Copilot — GoLand 2026.2 вводит окно Go Optimization с pprof-профилированием обычных приложений (не только тестов), поддержкой Goroutine leak profile из Go 1.27, интеграцией go fix и нативным GitHub Copilot.
- DataGrip 2026.2: AI Agent Skills и MCP-инструменты для БД — DataGrip 2026.2 добавил три AI Agent Skills (database-tools, connection-management, text-to-sql), CLI-команды для управления data source’ами и улучшенный контроль сессий с согласием агента перед операциями.
- CLion 2026.2: отладочный скилл для AI-агентов и C++26 reflection — CLion 2026.2 даёт AI-агентам доступ к GDB/LLDB/DAP-отладчику через ACP, поддерживает C++26 reflection и STM32 Cube CLI для управления тулчейнами встраиваемой разработки.
- Scala Plugin 2026.2 и IntelliJ IDEA — Новый релиз Scala Plugin для IntelliJ IDEA приносит ряд исправлений и улучшений для Scala-разработчиков.
🐧 Инфраструктура и железо
- Регрессия Linux 7.0: падение производительности AMD ROCm в 42 раза — Инженеры Canonical обнаружили, что ядро 7.0.0-28.28 с драйвером amdgpu замедляет Stable Diffusion XL с 9 до 388 секунд — регрессия затрагивает Ubuntu 24.04 и 26.04.
💻 Языки, тулинг и devtools
- Как идёт миграция с Rust на Zig — Ричард Фельдман рассказал о ходе переписывания проекта с Rust на Zig: основные выгоды — упрощение билд-системы и ускорение компиляции, но не без trade-off’ов.
- Microsoft Comic Chat стал открытым исходным кодом — Microsoft открыла исходники Comic Chat — культового IRC-клиента 1996 года, представлявшего чат в виде комиксов.
- Decoy Font: обфускация текста через хитрый шрифт — Экспериментальный шрифт Decoy Font визуально скрывает содержимое от LLM-скраперов, сохраняя читаемость для человека — 491 очко на Hacker News.
📊 Мнения и аналитика
- Почему критики LLM правы — и почему автор всё равно их использует — Разработчик Теохарис признаёт обоснованность критики LLM (галлюцинации, качество), но объясняет, почему они остаются полезным инструментом в его повседневной работе.
- AI породит кризис техдолга и дефицит сеньоров — Автор прогнозирует, что AI-сгенерированный код создаст взрывной рост сложности и техдолга, что приведёт к острому дефициту senior-разработчиков и сделает их сверхвостребованными.
Больше заметок: @mediocreit
Собрано: Nebius Token Factory / deepseek-ai/DeepSeek-V4-Pro Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing