Google выпустила две голосовые модели Gemini для быстрых диалогов и сложных задач. Cloudflare и Modal добавляют базовые примитивы для безопасного запуска агентов и моделей в продакшене. ClickHouse сближает хранение метрик с логами и трейсами, а вокруг моделей продолжается разговор о проверках и переносе нежелательных свойств.
Mediocre notes
-
AI/Infra #88: Gemini 3.8, ClickHouse PromQL и доступы агентов в Cloudflare
-
AI/Infra #87: Cilium 1.20, гибкая Siri и AI-агенты для QA
Cilium расширяет Gateway API и приносит IPv6 в ENI IPAM для AWS. Т-Банк показывает, как VLM-агент прогоняет мобильный регресс, а VK Tech сравнивает векторный поиск на 1,18 млн объектов. Apple готовит Siri к работе со сторонними моделями, а dbt Labs переносит графики в проверяемый код. Внутри также обновления Grafana, JetBrains и заметные риски агентных систем.
-
AI/Infra #86: Edge0 для локального инференса, Homebrew 7 и проверки AI-моделей
Edge0 показал, как запускать разреженные модели на обычных локальных машинах с очень скромной активной памятью. Homebrew выпустил крупное обновление с параллельными установками, песочницей и проверками уязвимостей. Исследователи вновь нашли способы, которыми сильные модели обходят условия оценок, а вокруг регулирования и дистилляции разгорается спор. Также собрали заметные новости о железе, приватности и открытых инструментах.
-
AI/Infra #85: Anthropic зовёт замедлиться, Real-SWE меряет агентов, Nvidia финансирует ИИ
Дарио Амодеи и Йошуа Бенжио обсуждают, почему рост возможностей агентов требует иной осторожности. Новый Real-SWE проверяет кодовых агентов на закрытых корпоративных репозиториях, а Nvidia всё активнее финансирует спрос на собственные ускорители. Также — профилирование сборок, локальная генерация 3D-ассетов и проекты из мира опенсорса.
-
AI/Infra #84: GigaChat 3.5 Reasoning, ИИ в ClickHouse и риски агентных систем
Сбер открыл большую модель рассуждений, а Яндекс показал компактный разреженный вариант для продакшена. ClickHouse переносит LLM-функции прямо в SQL, а платформенные команды разбирают сеть и хранилище для распределённого обучения. Отдельно — громкие вопросы к поведению агентов, лицензиям и качеству сгенерированного кода.
-
AI/Infra #83: Alice AI, нативный стек Shopify и данные ClickHouse в ChatGPT
Яндекс открыл веса базовой модели Alice AI Search, а Shopify пересматривает ставку на React Native из-за кодовых агентов. В инфраструктуре — практики восстановления Kubernetes, новые метки Grafana и интеграции для SRE-агентов. ClickHouse ускоряет репликацию из Postgres и приносит аналитику в ChatGPT Work. Отдельно собрали важные сигналы о проверяемости и приватности работы с моделями.
-
AI/Infra #82: DeepSeek V4.1 Flash, Tailwind в Shopify и миграция ClickHouse
DeepSeek представила экономичную мультимодальную модель, а вокруг GPT-6 Astra продолжается разговор о скрытом рассуждении. Mindbox разобрала миграцию десятков кластеров ClickHouse без простоя, а Karpenter — неочевидности консолидации узлов. Shopify покупает Tailwind Labs, тогда как JetBrains и другие команды показывают новые практики для IDE, агентов и локального AI.
-
AI/Infra #81: Claude Fable 5.1, ClickHouse для агентов и экономия кэша Cloudflare
Anthropic представила Claude Fable 5.1 и закрытую версию Mythos 5.1 с иными ограничениями. ClickHouse измерил качество аналитических агентов на реальных задачах и купил RunReveal. Cloudflare сжимает кэш, а PostgreSQL 19 добавляет полезные представления для диагностики. В конце — заметные изменения в инструментах для кода, локальном запуске моделей и опенсорсе.
-
AI/Infra #80: DeepSeek-V4 Vision, OpenTelemetry и риски автономных агентов
DeepSeek выпустил экспериментальную мультимодальную модель с сильными результатами в агентных тестах. JetBrains предлагает оценивать кодовых агентов не только по пройденным тестам, а OpenTelemetry закрепляется как зрелый стандарт. В подборке также практические кейсы локальных LLM, сетевые инструменты и новые вопросы к изоляции автономных агентов.
-
AI/Infra #79: AI-агенты и AI Act, ChatGPT Work и уязвимости Linux
Исследования и разборы снова ставят безопасность агентных систем в центр внимания. Евросоюз начал первые формальные проверки поставщиков моделей, а OpenAI развивает отдельный рабочий режим ChatGPT. Также собрали заметные обновления Linux-проектов, локального инференса и несколько практичных инженерных идей.
-
AI/Infra #78: Debian разрешил генеративный ИИ, Tencent выпустила Hy4, Нью-Йорк тормозит ЦОД
Tencent открыл крупную модель Hy4, а Debian сформулировал правила ответственного применения генеративного ИИ. Инцидент с агентами и Hugging Face снова поднимает вопрос о наблюдаемости действий моделей. Параллельно дата-центры упираются в энергосеть, а Samsung переносит вычисления прямо в память.
-
AI/Infra #77: Kubernetes готовят к AI, GLM-5.3 открыли, JetBrains раскрыла взлом
Платформенным командам предлагают готовить Kubernetes к гетерогенным AI-нагрузкам и предсказывать потребность в GPU заранее. Вышли открытые веса GLM-5.3 и локальный ускоритель инференса для Qwen. JetBrains сообщила о компрометации Cadence через критическую уязвимость TeamCity. Также — htmx 4.0, Flatpak, ClickHouse Managed Postgres и идеи для памяти агентных систем.
-
AI/Infra #76: Cloudflare экономит 100 ПБ, Google обновляет Gemini, Kubernetes делит GPU
Cloudflare показал, как оптимизация структуры данных освободила 100 ПБ памяти в DNS-кэше. Google выпустил модели для транскрибации и управляемой генерации видео, а команды описывают память агентов и маршрутизацию моделей. В инфраструктуре — практики совместного использования GPU в Kubernetes, превью-окружения и спор о роли ClickHouse в observability. Отдельно — компактные модели, приватное обучение и новые правила SourceHut для LLM.
-
AI/Infra #75: Kubernetes 1.37, AWS и DuckDB, новые модели Qwen и GLM
Kubernetes 1.37 приносит снимки подов, а Deckhouse готовит переход к Gateway API. Вышли компактные модели Qwen и GLM, пригодные для быстрого и локального инференса. JetBrains добавляет агентные и observability-инструменты прямо в среды разработки. Отдельно — покупка DuckLabs компанией AWS и разбор инцидента с агентами OpenAI.
-
AI/Infra #74: Apple M6 и M5 Ultra, агентная инфраструктура и OpenAI Jalapeño
Apple представила M6 и M5 Ultra, а OpenAI продолжает развивать собственный чип для инференса. Облака выводят новые вычислительные и агентные сервисы, а команды описывают, как меняется эксплуатация многомодельных систем. Также собрали заметные релизы для Go, Rust, Python, Kafka и локальной AI-разработки. Отдельно — открытые эмбеддинги и ограничения C2PA на Android.