← Новости

LLM-дайджест: 13 августа 2026

llmaimodelsdigest

🆕 Новые модели

  • DeepSeek V4 Pro 0813 — вышла свежая Pro-версия DeepSeek, пока доступна только через API (без публичной страницы анонса; ссылка через OpenRouter). Подробнее
  • LFM2.5-VL-3B от Liquid AI — компактная vision-language модель на 3B для edge-устройств: лучше и быстрее обрабатывает изображения. Подробнее
  • OlmoEarth embeddings (AllenAI) — экспорт кастомных эмбеддингов из OlmoEarth Studio для дальнейшего анализа. Подробнее

📊 Бенчмарки и тесты

  • VICBench — новый мультиязычный бенчмарк для оценки детекции уязвимостей в коде на основе vulnerability-inducing commits. Подробнее

✨ Новые возможности

  • Google DeepMind SL2T — прорывная модель перевода жестового языка в текст (sign-language-to-text), которая ляжет в основу функций для глухих и слабослышащих пользователей. Подробнее

📌 Прочее важное

  • Кража reasoning-трейсов через API — статья показывает, что скрытые рассуждения проприетарных LLM (Anthropic, OpenAI, Google) можно частично восстановить из API-ответов. Подробнее
  • «Нет lossless-преобразований естественного текста» — Софи Альперт делится внутренней политикой допустимого использования ИИ-письма инженерами: любое переписывание текста моделью теряет часть смысла. Подробнее
  • Парадокс изобилия информации — длинноконтекстное обучение может подрывать параметрические знания модели, а не только обогащать её. Подробнее
  • Simulator Collapse в multi-agent RL — один «замороженный» LLM-симулятор пользователя приводит к коллапсу и не обобщается; для human-AI обучения этого недостаточно. Подробнее
  • AI4AI на этапе инференса — перенос способностей от сильной модели к слабой можно делать в test-time через «harness», без дообучения параметров. Подробнее