Дайджест AI/Infra — 18 июля
Дайджест AI/Infra за 2026-07-18.
Выпуск канала mediocre notes — @mediocreit
🔍 AI-модели и поисковые агенты
- Т-Банк открыл T-Search — агента многошагового поиска — T-Search на базе Qwen3.6-35B-A3B обучен полностью на синтетических данных и отдаёт ранжированный список чанков, а не финальный ответ; вместе с моделью выложены бенчмарки TRuST и SynthComp.
- T-Search: MoE-модель с 3B активных параметров на одной GPU — По среднему Recall@10 T-Search обходит значительно более крупные открытые модели — Qwen3.5-397B, GLM-5.2 и Kimi-K2.6, что на порядок удешевляет инференс поисковой агентики.
- Moonshot AI представила Kimi K3 — 2.8-триллионную модель — Модель обходит Claude Opus 4.8 max и GPT-5.5 high на многих бенчмарках, занимает первое место на Arena.ai Frontend Code, а открытые веса обещаны к 27 июля; стоимость — $3/$15 за миллион токенов.
- Слив Suno: исходники подтвердили массовый скрейпинг музыки — Хакер ellie.191 опубликовал исходники Suno за 2023–2024 годы: модель обучали на миллионах треков с YouTube Music, Deezer, Genius и других сервисов, используя Bright Data для обхода защит.
- Доклад Mozilla: состояние открытого AI — паритет достигнут — Разрыв между открытыми и закрытыми моделями на Chatbot Arena сократился с 8% до 3.3%, стоимость инференса уровня GPT-4 упала с $20 до $0.40 за миллион токенов за 36 месяцев, а большинство продакшен-токенов идут через открытые веса.
🛠️ AI-инструменты и агентская разработка
- Tailscale: во что реально обходится $20-подписка на coding agent — Tailscale показал через Aperture, что токен-затраты на Claude Code могут достигать $3.29 за одну задачу — subscription-модель скрывает реальную стоимость AI-кодинга.
- Авито: как обеспечить качество при агентской разработке — Андрей Бровко из Авито Авто делится опытом: AI-агенты генерируют код за секунды, но без выстроенных процессов разработки они лишь быстрее доставляют некачественный продукт.
- Midnight Code Cup 2026: олимпиада, где разрешён AI — В Белграде прошёл финал 24-часового соревнования, где задачи усложнили так, чтобы они не решались одним промптом — дорешивание открыто на сайте.
☁️ Облака и инфраструктура
- AWS показал пользователям счета на миллиарды долларов из-за бага — Ошибка перепутала гигабайты с байтами в биллинге: пользователи с обычным чеком в $5 увидели счета до $627 млрд; AWS подтвердила проблему через Health Dashboard.
- Flipkart и LitmusChaos: хаос-инжиниринг в масштабах Big Billion Days — На KubeCon India Flipkart рассказал, как построил multi-tenant хаос-платформу на LitmusChaos: DaemonSet-based HA, hybrid VM chaos и Script Runner для динамического выбора целей.
- Cloudflare WAF закрыл две критические уязвимости WordPress — Новые правила WAF защищают от Unauthenticated RCE в REST API WordPress и связанной SQL-инъекции.
💻 DevTools и языки
- PhpStorm 2026.2: агенты, модели и улучшенный Git — Новый релиз позиционирует PhpStorm как платформу для любых coding-агентов и AI-подписок, плюс улучшения PHP, Laravel и Git.
- Kotlin исполнилось 15 лет — JetBrains празднует 15-летие языка: от мобильной разработки до серверной и multiplatform-экосистемы.
- Apple Game Porting Toolkit 4: +66% FPS в GTA V на M4 Pro — Новая бета GPTK значительно повышает производительность игр на Apple Silicon — GTA V прибавила 66% кадров, намекая, что «железо» больше не узкое место.
- Zilog Z80 исполнилось 50 лет — Процессор 1976 года, ставший основой домашних компьютеров и GameBoy, отмечает полувековой юбилей.
🧠 AI-безопасность и alignment
- Apple рассылает юристам письма десяткам сотрудников OpenAI — Apple начала legal action против сотрудников OpenAI — детали пока скудны, но Financial Times подтверждает факт рассылки.
- Inoculation Adapters: LoRA для подавления нежелательных черт модели — Метод использует LoRA-адаптер, который впитывает нежелательные паттерны во время обучения, улучшая suppression misalignment по сравнению с prompting.
- Kaggle-скандал: несостыковки в оценке победителей AGI-хакатона — Участники обнаружили несоответствия в процессе оценки Google DeepMind Measuring Progress Toward AGI Hackathon с призовым фондом $125 000.
- Corrigibility Research Fund: $200k на исследования управляемости AI — Lightcone Infrastructure запустила фонд грантов и призов за corrigibility research, дедлайн подачи — 23 августа.
🗄️ Базы данных
- Джулия Эванс: уроки запуска SQLite в продакшене — Главный инсайт: ANALYZE ускорил FTS5-запрос со 100×; DELETE-операции научили ценить многопоточную запись Postgres; бэкапы — через .clone().
🌍 За пределами кода
- Найдена атмосфера у землеподобной планеты в обитаемой зоне — Астрономы впервые обнаружили атмосферу у планеты земного типа в зоне обитаемости другой звезды.
- Медсёстры Kaiser: AI и слежка ухудшают уход за пациентами — Медперсонал Kaiser Permanente сообщает, что AI-мониторинг и surveillance на рабочих местах вредят и сотрудникам, и качеству лечения.
- EEG показала: мозг кодирует два речевых потока одновременно — Исследование PLOS Biology демонстрирует, что мозг способен параллельно отслеживать два независимых речевых сигнала.
Больше заметок: @mediocreit
Собрано: Nebius Token Factory / deepseek-ai/DeepSeek-V4-Pro Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing