Дайджест AI/Infra — 19 июля
Дайджест AI/Infra за 2026-07-19.
Выпуск канала mediocre notes — @mediocreit
🧠 Гонка моделей: Kimi K3, Fable 5 и GPT-5.6
- Kimi K3 — открытая модель на 2.8 трлн параметров обходит Fable 5 и GPT-5.6 в ряде бенчмарков — Moonshot AI выпустила Kimi K3 — MoE-модель с 2.8 трлн параметров, 896 экспертами (16 активны), 1M-токенным контекстом и всегда включённым thinking-режимом; по AA Intelligence Index и фронтенд-арене модель впервые вывела открытый проект на первое место, а API стоит $3/$15 за миллион токенов.
- Практик тестирует Kimi K3 против Claude: паритет по качеству, радикальный разрыв в цене — Разработчик Stephen Bochinski неделями гонял Kimi K3 параллельно с Claude и не заметил разницы в задачах и расходе токенов, но подписка Kimi стоит $19–39/мес против жёстко лимитированных планов Anthropic.
- Скептический взгляд: почему бенчмарки Kimi K3 могут не повторить успех K2 Thinking — Аналитика по 16 пост-релизным бенчмаркам K2 Thinking показала, что модель уступила GPT-5 и Sonnet 4.5 на 13 из них; автор задаётся вопросом, повторится ли этот паттерн с K3.
- Anthropic оставляет Fable 5 в планах Max и Team Premium, но с урезанными лимитами — С 20 июля Fable 5 остаётся только на Max ($100–200/мес) и Team Premium ($125/мес) с доступом к 50% лимитов; Pro и Team получают разовый кредит в $100 — давление конкурентов вынудило Anthropic отказаться от полного удаления модели из подписок.
- Fable 5 vs GPT-5.6 Sol на NP-трудной задаче: Fable 5 — «абсолютный зверь», /goal не панацея — В тесте на задаче проектирования оптоволоконной сети (пространство поиска ~10^1223) Fable 5 показал лучшее решение и исключительную стабильность, тогда как /goal-режим иногда улучшал, а иногда ухудшал результат.
- GPT-5.6 закрыл 30-летний пробел в выпуклой оптимизации одним промптом, доказательство верифицировано в Lean — Reddit r/math обсуждает: GPT-5.6 по аналогии с CDC-пруфом OpenAI смог найти доказательство для давно открытой задачи выпуклой оптимизации, и результат был формально проверен в Lean.
🛠️ AI-кодинг: инструменты, скепсис и Stack Overflow
- График: как ИИ обрушил число новых вопросов на Stack Overflow — Запрос к SEDE показывает помесячную динамику: с ноября 2022 их количество резко пошло вниз, наглядно демонстрируя, что разработчики всё чаще получают ответы от ИИ, а не задают вопросы.
- Code Review не спасает: почему полагаться на ревью AI-кода — нерабочий аргумент — Thomas Depierre ссылается на научные данные: эффективное ревью покрывает лишь ~400 строк в час, что делает проверку быстрого AI-вывода слишком медленной и дорогой.
- AI Mania Is Eviscerating Global Decision-Making — массовый психоз вокруг ИИ в корпорациях — Автор утверждает, что за полтора года не видел ни одного реально успешного AI-внедрения: компании покупают лицензии и объявляют победу без фактического роста продуктивности.
- Пошаговый гайд: как настроить запасной Mac под полный контроль Claude Code — Практическое руководство по созданию изолированной среды на втором Mac с доступом Claude Code через SSH и мобильное приложение Claude, включая computer use для приложений вроде Unity.
- Codex Resets — трекинг сбросов лимитов OpenAI Codex — Сайт фиксирует 35 сбросов лимитов со средним интервалом 8.9 дней; информация поступает из объявлений @thsottiaux в X.
🚀 Релизы и экосистема
- Qwen3.6-35B-A3B-DFlash-GGUF — квантованная draft-модель для спекулятивного декодирования — Выложен GGUF-вариант diffusion-основанной draft-модели Qwen 3.6; поддерживается Transformers, llama-cpp-python, Ollama и LM Studio под Apache 2.0.
- Transcribe.cpp — высокопроизводительная транскрипция аудио на C++ — Новый open-source инструмент для преобразования речи в текст, написанный на C++ с упором на скорость и локальный запуск.
- Elixir-lang.org получил новый дизайн — Официальный сайт языка Elixir полностью обновил внешний вид и структуру.
- Gleam теперь доступен на Tangled — Функциональный язык Gleam, компилируемый в Erlang и JavaScript, добавлен на платформу Tangled для совместного редактирования кода.
🔧 Dev-инструменты
- GitRoot — self-hosted git-фордж без базы данных, где всё хранится в git — Новый минималистичный git-сервер: репозитории, issues и плагины управляются через ветки и права в самом git, без отдельной СУБД.
- Hardcore IndieWeb: свой сайт за $0.01/день со 100% независимостью — Метод: HTML на локальном диске, предпросмотр в браузере, загрузка на NearlyFreeSpeech.net — без подписок, полный контроль и лёгкая миграция.
📝 Мнения и практики
- Goodbye, and Thanks for All the Bikesheds — прощальная колонка в ACM Queue — Автор прощается с читателями, размышляя о культуре bikeshedding’а в инженерных обсуждениях.
- If You Build It, They Will Come — о построении аудитории для технических проектов — Ben Landau Taylor делится опытом: как создавать продукт и растить сообщество, не полагаясь на вирусный успех.
⚠️ Железо и софт
- Мониторы LG тайно устанавливают софт через Windows Update без согласия пользователя — Обнаружено, что драйверы мониторов LG через механизм Windows Update silently инсталлируют стороннее ПО — 1084 балла на HN.
Больше заметок: @mediocreit
Собрано: Nebius Token Factory / deepseek-ai/DeepSeek-V4-Pro Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing