LLM-дайджест: 27 августа 2026
🆕 Новые модели
- Qwen3.8-Flash-Next. Qwen представила открытую мультимодальную MoE-модель со 125 млрд параметров и 6 млрд активных параметров; её архитектура служит ранним превью Qwen4.
📊 Бенчмарки и тесты
- Trace Integrity для LLM-агентов данных. Авторы предлагают оценивать не только правильность ответа, но и достоверность вычислительной трассы: верный результат в задачах со структурированными данными может быть получен через некорректные шаги. Исследование
✨ Новые возможности
-
Gemini 3.5 Transcribe. Google DeepMind анонсировала новый режим Gemini для более интеллектуальной расшифровки речи в текст. Анонс
-
Обучение multi-vector embedding-моделей. Hugging Face опубликовала руководство по обучению и дообучению multi-vector encoder-моделей с помощью Sentence Transformers. Материал
-
Prefix Sliding для экономного test-time scaling. Метод сокращает стоимость долгих рассуждений, где хранение всей цепочки в полном attention делает сложные задачи чрезмерно дорогими. Исследование
-
PlanSightRAG для инженерных чертежей. Visual-first мультимодальный RAG автоматизирует ответы на вопросы и проверку соответствия строительных планов, сохраняя важные геометрию и компоновку, которые теряются при одном OCR. Исследование
-
Языковое рассуждение для роботов. В работе R³ исследуется обучение роботов естественно-языковому рассуждению с подкреплением для сложных задач манипуляции с длинным горизонтом. Исследование
-
Whisper для языка банива. Предварительное исследование проверяет дообучение Whisper для распознавания речи на малоресурсном коренном языке банива. Исследование
📌 Прочее важное
-
SwarmWorld: эволюция сообществ LLM-агентов. Авторы исследуют стигмергическую координацию, при которой агенты взаимодействуют через общую среду, а их локальные действия складываются в устойчивую социальную организацию. Исследование
-
Теория выбора ранга LoRA. Работа выводит зависящие от задачи границы ошибки аппроксимации для разных рангов LoRA в attention, предлагая теоретическую основу вместо чисто эмпирического подбора. Исследование