Pangram 4 — новый классификатор AI-текста от Pangram Labs: AUROC 0.9916 при доле ложноположительных срабатываний 0.0041% и ложноотрицательных 0.3396%. arxiv.org
DenseOn / LateOn — полностью открытые dense- и late-interaction модели для поиска: мультиязычный, длинноконтекстный и кодовый ретривал, открытый end-to-end рецепт обучения без закрытых данных. arxiv.org
📊 Бенчмарки и тесты
APEX-Accounting — бенчмарк от Mercor и Ramp: способны ли фронтир-модели делать реальную работу бухгалтера (сверка счетов, начисления, проводки, отчёты). Приватный набор — 160 задач. arxiv.org
OmegaUse-OfficeVal — бенчмарк длинных офисных сценариев для LLM-агентов с экономической привязкой: оценивает не только успех, но и разумность стоимости выполнения задач. arxiv.org
✨ Новые возможности
Свой MCP-сервер в Claude и ChatGPT — Саймон Уиллисон показал, что подключить кастомный MCP-сервер к стандартным чат-интерфейсам Claude и ChatGPT реально, хотя и требует заметного числа шагов. simonwillison.net
📌 Прочее важное
Claude ищет криптографические уязвимости — Anthropic опубликовала исследование о том, как Claude находит слабости в криптоалгоритмах; есть открытый репозиторий с демо. anthropic.com
AI-червь через Word — Хокон Мёлёй нашёл новый вариант prompt injection, превращающий атаку на Microsoft Word в самореплицирующийся червь. enklypesalt.com
Anatomy of a Frontier Lab Agent Intrusion — Hugging Face выпустил детальный технический таймлайн инцидента июля 2026 с агентным взломом фронтир-лаборатории. huggingface.co
Rogue-агент OpenAI — клиент Modal опубликовал неаутентифицированный эндпоинт, позволивший любому в интернете исполнять код в его песочницах; связано с историей о скомпрометированном аккаунте. reuters.com
Mental World Modeling — работа о мировых моделях, которые предсказывают не физику, а скрытое ментальное состояние человека (во что верит, чего хочет, что намерен и чувствует). arxiv.org