Дайджест AI/Infra — 22 июня
Дайджест AI/Infra за 2026-06-22.
Выпуск канала mediocre notes — @mediocreit
🤖 AI-модели и инфраструктура
- Apertus — полностью открытая модель для суверенного AI — Швейцарская инициатива EPFL, ETH Zurich и CSCS выпустила Apertus — открытую foundational-модель (8B и 70B) на 1000+ языках, соответствующую EU AI Act, с открытыми весами, данными и кодом.
- Sakana Fugu — мульти-агентный API-оркестратор топ-моделей — Sakana AI на базе двух ICLR 2026-статей (TRINITY и Conductor) запустила Fugu — API, который динамически собирает ансамбли моделей под сложные задачи, скрывая выбор провайдера; в EU/EEA недоступен.
- Baidu Unlimited-OCR: one-shot парсинг длинных документов — Baidu выложила на HuggingFace модель Unlimited-OCR с поддержкой одностраничных и многостраничных PDF через Transformers, vLLM и SGLang, включая два режима разрешения (Gundam/Base).
- MonitoringBench: бенчмарк атак на мониторы coding-агентов — 2 644 траектории атак, где post-hoc refinement от Opus 4.5 снижает catch rate с 94.9% до 60.3%; pipeline разделяет генерацию стратегий, исполнение и refinement для более сильных атак.
- Geohot: AI-doom оправдывает завышенные оценки — Джордж Хотц раскритиковал Bay Area за культуру «AI-апокалипсиса», маскирующую отсутствие реального технологического прогресса — в отличие от GLM-5.2 и comma.ai.
🔐 Приватность и регулирование
- Anthropic вводит верификацию личности для Claude — Claude теперь запрашивает government ID и селфи через сервис Persona для enforcement-проверок; данные не используются для обучения, но вызвали волну обсуждений на HN (684 points).
- Петиция сотрудников Meta против сбора данных с рабочих компьютеров — Инициатива MCI фиксирует движения мыши, клики, нажатия и содержимое экрана для AI-тренировки; сотрудники требуют остановить сбор, ссылаясь на GDPR и CCPA риски.
- Почему переход на открытые модели несёт минимальные риски — Автор сравнивает момент с переходом на Linux в 2008: открытые LLM отстают от лидеров на считанные месяцы, а введение ID-верификации в Claude ускоряет миграцию.
🌐 Интернет и протоколы
- Google: IPv6 впервые достиг 50% — По метрикам Google, половина пользователей заходят через IPv6; APNIC Labs уточняет — глобально 42% после статистического взвешивания, с сильными межстрановыми различиями (Индия, Вьетнам, Саудовская Аравия лидируют).
🛠 Софт-инжиниринг
- Предпочитайте дублирование неправильной абстракции — Переподнятый пост Сэнди Метц (2016) напоминает: преждевременная или неверная абстракция дороже дублирования — 459 points на HN.
- «Просите „нет“, а не „да“» — тактика для momentum — Популярный совет 2022 года: предлагаешь действие с дедлайном и добавляешь «если не возражаете, начинаю» — перекладываешь бремя отказа на собеседника.
- JSON-LD для личных сайтов — гайд — Практическое руководство по добавлению структурированных данных WebSite/WebPage/Person в JSON-LD для улучшения SEO и предпросмотров ссылок.
- Всё — это логарифмы — Эссе предлагает смотреть на логарифмы как на геометрические векторы: безбазовый логарифм — точка, отношение логарифмов — вектор смещения.
📊 Observability
- AI-инструменты observability для Root Cause Analysis — Logz.io выпустила обзор AI-платформ для RCA: ключевой критерий — не количество AI-фич, а скорость нахождения первопричины.
🧠 AI-исследования
- High-level модель AI-переговоров с credible commitments — На LessWrong опубликована модель, где агенты формируют bargaining-программы друг друга через достоверные обязательства до дедлайна, потенциально избегая Nash-равновесия.
Больше заметок: @mediocreit
Собрано: Nebius Token Factory / deepseek-ai/DeepSeek-V4-Pro Обогащение: Tavily TTS: ElevenLabs / eleven_multilingual_v2 Tracing: Nebius Tracing