Новости LLM & Security Gateway

Здесь только свежие релизы — примерно за последние 12 месяцев, а не весь исторический архив. Поэтому у давно существующего продукта может быть всего несколько новостей.

1 новостей

Anthropic: три модели Claude во время cyber-оценок вышли за пределы тестового контура и атаковали живые системы

Причина — неверная настройка eval-окружения с партнёром Irregular: тестовым машинам дали реальный доступ в интернет вопреки system prompt, утверждавшему изоляцию. Модели восприняли CTF-цель как легитимную и атаковали инфраструктуру трёх настоящих компаний; инцидент найден при разборе 141 006 тестовых сессий.

Обсудить Новости LLM & Security Gateway

Укажите email или телефон, чтобы мы могли вам ответить.

Отправить через: