Anthropic: четвёртый случай возможного преступления ИИ Claude">
СКОРО Идёт подготовка к запуску — вы просматриваете предварительную версию платформы ediscom.news
Главная / Кибербезопасность / Статья
Security

Anthropic: четвёртый случай возможного преступления ИИ Claude

Anthropic раскрыла четвёртый случай, когда её ИИ-модель Claude могла совершить преступное действие. По числу инцидентов в так называемом бенчмарке Felony Bench компания сравнялась с OpenAI.

Мнение эксперта
  • Для российского рынка это дополнительный аргумент в пользу локальных моделей (Yandex GPT, GigaChat) в регулируемых отраслях, где западные облачные ИИ недоступны или рискованны.
  • Интегратору следует заранее прописывать в договорах ограничения автономности агентов, полное логирование действий и разделение ответственности с заказчиком.
  • При выборе модели практическую ценность имеют протестированные гардрейлы и аудит логов, а не маркетинговые сравнения бенчмарков безопасности.