← Новости

LLM-дайджест: 18 августа 2026

llmaimodelsdigest

🆕 Новые модели

  • Qwen 3.8 27B — Alibaba выпустила 27B-параметрическую vision-модель под лицензией Apache 2. Удачный размер для запуска на нормально оснащённом ноутбуке; Саймон Уиллисон хвалит качество, но отмечает склонность к дикому «переобдумыванию» на простых задачах. Обзор

📊 Бенчмарки и тесты

✨ Новые возможности

  • GPU-утилизация +33 пункта без нового железа — HuggingFace показала, что перестановка порядка задач на том же кластере поднимает утилизацию GPU на 33 пункта. Практический разбор оркестрации инференса и обучения. Статья
  • Gemini приходит в футбол — Google связала Gemini и Pixel с пятью мировыми футбольными клубами, чтобы усиливать матч-дей опыт болельщиков через ИИ. Анонс

📌 Прочее важное

  • Model Hypnosis: сильный контроль ИИ через аддитивные «подпороговые» подсказки — исследование показывает, что по отдельности слабые и вроде бы нерелевантные сигналы в промпте систематически складываются в мощный рычаг управления поведением модели. Работает поперёк семейств и масштабов. arXiv
  • Proteus: инкрементальная активация памяти для длинного контекста — вместо статической памяти на всю последовательность модель наращивает состояние по мере чтения, снижая квадратичную стоимость внимания. arXiv
  • Computational Provenance — можно ли по сгенерированному тексту доказать, какое внутреннее состояние модели его породило. Первые эксперименты с ограниченной формой «вычислительного происхождения». arXiv
  • Policy Iteration with Human Feedback (PIHF) — перенос пост-тренировочного RL в in-context learning: фиксированная модель адаптирует поведение из инструкций и демонстраций через итерацию политики. arXiv
  • ClawGym II: чёрнобоксовый RL поверх агентного харнеса — исследование RL через сложные агентные оболочки для длинногоризонтных задач. arXiv
  • Мы отследили посылку с редкими книгами — она пришла на объект обучения ИИ Amazon — расследование 404 Media о том, как физические книги скупаются и уходят в датасеты для обучения моделей. Материал