AI/Infra #89: Claude объединяет Cowork и чат, Delta заменяет Pull Request, CUDA Rust
Claude свёл чат и автономную работу в один интерфейс, а Zed предлагает проводить ревью без Pull Request. NVIDIA развивает нативные GPU-ядра на Rust, пока эксперименты с моделями добираются до оптимизации запросов Postgres. В инфраструктуре появились обновления для Kubernetes, хранилищ и аналитики. Также собрали заметные релизы JetBrains и GNOME.
🎧 Подкаст-версия выпуска (mp3)
🤖 Агенты и модели
- Claude объединил чат и Cowork — На тарифах Pro и Max постепенно появляется единый Claude с фоновыми задачами, а создание документов, презентаций и дизайна стало доступно прямо в диалоге.
- Delta от Zed вышел в публичную бету — Среда для совместной работы с агентами переносит обсуждение, рабочие деревья и ревью в треды, сохраняя совместимость с обычными Git-репозиториями.
- OpenSpec для спецификаций с ИИ — Открытый лёгкий фреймворк управления спецификациями заявляет поддержку более 40 инструментов ИИ-кодинга и 68 тысяч звёзд на GitHub.
- Mistral подключает модели к Firefox — Бета-ассистент Firefox Smart Window использует модели Mistral для работы с поиском и вкладками во Франции и Северной Америке, далее запланированы Великобритания и Германия.
- Xiaomi открыл панель постобучения Mimo — В публичном дашборде два прогона Mimo 2.6 уже показывают совокупные затраты свыше миллиона долларов и результаты DeepSWE 62,24 и 60,77.
- OpenAI раскрыл шесть инцидентов поведения ИИ — Компания сообщила о шести новых случаях вызывающего опасения поведения моделей, вновь обозначив ограничения существующих защитных барьеров.
- Lean 4 нельзя считать единственной проверкой — Разбор напоминает, что ошибки в обоснованности Lean 4 могут быть использованы агентами, поэтому формальную верификацию стоит дополнять независимыми проверками.
⚙️ Разработка и IDE
- NVIDIA представила CUDA Rust — Для GPU-ядер предложены cuda-oxide с компиляцией в PTX и cutile-rs для стабильного Rust 1.89+; второй уже применяется в Grout и mistral.rs.
- Rider и ReSharper 2026.2.2 — В Rider появился виджет настройки агентных возможностей, а dotCover получил измерение покрытия тестов TUnit при Microsoft.Testing.Platform 2.3.0 и новее.
- Исправления для JetBrains MPS — Патчи для веток 2026.1.1, 2025.3.2, 2025.2.4 и 2025.1.4 улучшают Projectional Agent Toolkit и подсказки агентам для тестов и задач YouTrack.
- Вышла IntelliJ IDEA 2026.2.3 — Свежая минорная версия IDE приносит очередной набор исправлений и доступна через встроенное обновление, Toolbox App и Snap.
- Практика logpoints в IntelliJ IDEA — Разбор показывает, как использовать точки логирования для диагностики без остановки выполнения программы.
- Фронтенд без готового бэкенда — Материал разбирает перехват трафика и мокирование как способ независимо разрабатывать и тестировать клиент до готовности серверного API.
🗄️ Данные и наблюдаемость
- Модель на 4 млрд параметров для планов Postgres — После дообучения и агентного RL модель Qwen снизила задержку на 44,7% на 113 запросах с большим числом соединений по сравнению с планами Postgres.
- ClickHouse появился на платформе dbt — Адаптер ClickHouse для dbt v2 в публичной бете использует движок dbt на Rust, а интеграция с платформой dbt доступна в приватной бете.
- Карта микросервисов из OpenTelemetry — Плагин JetBrains строит актуальную карту взаимодействий сервисов по телеметрии, устраняя зависимость от быстро устаревающих архитектурных схем.
- CoreWeave ускоряет межрегиональную запись — В AI Object Storage появились ускоренная запись в удалённый регион и архивный класс хранения для чекпойнтов и других редко используемых данных.
- Настройка AI Object Storage в CoreWeave — Практическое руководство объясняет, как сочетать LOTA, предварительную подкачку, межрегиональную запись и архивный класс для скорости и стоимости.
☸️ Платформы и инфраструктура
- OpenBao на Kubernetes с CloudNativePG — Руководство объединяет открытый форк Vault от Linux Foundation с PostgreSQL-оператором CloudNativePG для самовосстанавливающегося хранилища секретов без привязки к поставщику.
- Как собирают кластер Vera Rubin NVL72 — CoreWeave описывает автоматизацию жизненного цикла стоек, проверку производительности GPU и неблокирующую сетевую фабрику для объединения нескольких стоек NVL72.
- CoreWeave отчитался о MLPerf Inference v6.1 — Провайдер заявил лидирующую среди облаков производительность инференса в MLPerf v6.1 на платформах NVIDIA Blackwell и Blackwell Ultra.
- Глобальный сбой Salesforce — Страница статуса Salesforce фиксировала нарушения работы сервисов в регионах Americas, Asia Pacific и EMEA.
- Вышел GNOME 51 — Проект GNOME представил новый крупный релиз настольного окружения для Linux.
🎬 Мультимодальный ИИ
- FastWave: лёгкая диффузионная модель для BWE — Команда VK и ВШЭ рассказывает о разработке компактной диффузионной модели для восстановления широкой полосы аудио.
- TaoMate-H3 для потоковой генерации видео — Рантайм на базе MiniMax H3 с трёхшаговой LoRA заявляет генерацию длинных роликов в 480p, 768p и 1080p на одном узле с 4–8 GPU.
- Многоязычная GLiNER 2.5 Multi — Модель на 287 млн параметров на базе mDeBERTa-v3-base объединяет извлечение сущностей, классификацию и поиск связей и загружается через AutoExtractor.
Больше заметок: @mediocreit
Собрано: OpenAI / gpt-5.6-terra
Обогащение: Tavily
TTS: ElevenLabs / eleven_multilingual_v2
Tracing: Nebius Tracing