Новости LLM & Security Gateway

Здесь только свежие релизы — примерно за последние 12 месяцев, а не весь исторический архив. Поэтому у давно существующего продукта может быть всего несколько новостей.

1 новостей

Anthropic: защита от prompt injection в браузерном агенте — ASR 1%

RL-тренировка на симулированных инъекциях и улучшенные классификаторы снизили успешность атак на Claude for Chrome/Opus 4.5 до 1% против адаптивного атакующего (со двузначных величин ранее). Anthropic прямо отмечает: 1% — не решённая проблема, а остаточный риск.

защита встроена RL-тренировкой модели, не сетевым фильтром шлюза — дополняет, но не заменяет guardrails уровня LLM Gateway Anthropic Claude →

Обсудить Новости LLM & Security Gateway

Отправить через: