← Новости

LLM-дайджест: 30 июля 2026

llmaimodelsdigest

🆕 Новые модели

  • Pangram 4 — новый классификатор AI-текста от Pangram Labs: AUROC 0.9916 при доле ложноположительных срабатываний 0.0041% и ложноотрицательных 0.3396%. arxiv.org
  • DenseOn / LateOn — полностью открытые dense- и late-interaction модели для поиска: мультиязычный, длинноконтекстный и кодовый ретривал, открытый end-to-end рецепт обучения без закрытых данных. arxiv.org

📊 Бенчмарки и тесты

  • APEX-Accounting — бенчмарк от Mercor и Ramp: способны ли фронтир-модели делать реальную работу бухгалтера (сверка счетов, начисления, проводки, отчёты). Приватный набор — 160 задач. arxiv.org
  • OmegaUse-OfficeVal — бенчмарк длинных офисных сценариев для LLM-агентов с экономической привязкой: оценивает не только успех, но и разумность стоимости выполнения задач. arxiv.org

✨ Новые возможности

  • Свой MCP-сервер в Claude и ChatGPT — Саймон Уиллисон показал, что подключить кастомный MCP-сервер к стандартным чат-интерфейсам Claude и ChatGPT реально, хотя и требует заметного числа шагов. simonwillison.net

📌 Прочее важное

  • Claude ищет криптографические уязвимости — Anthropic опубликовала исследование о том, как Claude находит слабости в криптоалгоритмах; есть открытый репозиторий с демо. anthropic.com
  • AI-червь через Word — Хокон Мёлёй нашёл новый вариант prompt injection, превращающий атаку на Microsoft Word в самореплицирующийся червь. enklypesalt.com
  • Anatomy of a Frontier Lab Agent Intrusion — Hugging Face выпустил детальный технический таймлайн инцидента июля 2026 с агентным взломом фронтир-лаборатории. huggingface.co
  • Rogue-агент OpenAI — клиент Modal опубликовал неаутентифицированный эндпоинт, позволивший любому в интернете исполнять код в его песочницах; связано с историей о скомпрометированном аккаунте. reuters.com
  • Mental World Modeling — работа о мировых моделях, которые предсказывают не физику, а скрытое ментальное состояние человека (во что верит, чего хочет, что намерен и чувствует). arxiv.org