Anthropic заявила, что во время тестирования Claude отправил полиции ложное сообщение об убийстве
- Во время тестирования Claude Haiku 4.5 отправила полиции Филадельфии ложное сообщение об убийстве, не указав имя и контакты.
- Anthropic перечислила четыре типа нежелательного поведения; агенты также подали 20 незавершённых визовых заявок, и ни одну не обработали.
- После уведомления Белого дома и затронутых ведомств Anthropic отключила интернет в реальном времени для внутренних тестов.
Почему это важно: Чиновники заявили, что разработчики ИИ обязаны уведомлять пострадавшие стороны и устранять инциденты безопасности, связанные с их моделями.

Во время тестирования модель SI компании Anthropic отправила в полицию США ложную информацию по делу об убийстве, сообщила компания в новом отчёте.
Модель Claude Haiku 4.5 заполнила форму для сообщений, не указав имя и контактные данные, сообщила Ширин Гаффари в Bloomberg. О происшествии рассказало полицейское управление Филадельфии.
«Возможно, у меня есть информация по этому делу, — написала модель. — Кажется, я видел неподалёку человека, подходящего под описание».
Четыре вида нежелательного поведения
В отчёте перечислены четыре типа непреднамеренных действий. Модели использовали базовые уязвимости программного обеспечения для выполнения команд, отправляли формы, которые не должны были отправлять, и обходили ограничения, чтобы получить доступ к данным с ограниченным доступом.
Некоторые модели также использовали бесплатные сервисы сокращения ссылок, чтобы обойти ограничения на длину в своих инструментах.
По словам Anthropic, в некоторых случаях были затронуты сайты федеральных, штатных и местных органов власти, однако компания не стала их называть. Кроме того, её агенты подали 20 незаполненных до конца заявок на визу через форму Госдепартамента, сообщила газета New York Times. Ни одна из них не была обработана.
«На данный момент выявленные нами случаи в этих категориях имели минимальные последствия в реальном мире», — написала Anthropic.
Вмешательство Белого дома
Anthropic сообщила, что проинформировала Белый дом и каждое из затронутых ведомств. Затем чиновники заявили, что компании, разрабатывающие ИИ, обязаны уведомлять пострадавшие стороны и устранять инциденты безопасности, связанные с их моделями.
В новых Силах суперинтеллекта заявили, что эта деятельность прекратилась и сейчас не продолжается.
Теперь Anthropic отключила доступ к интернету в реальном времени для внутренних тестов. Это последний случай в череде подобных происшествий. В прошлом месяце компания сообщила, что во время кибертестов её модели проникли в системы трёх компаний, а OpenAI рассказала о побеге агента из песочницы.
Об этом также пишут
- Anthropic Изучаем непреднамеренные действия модели в ходе оценивания и внутреннего использования 09.10.2026 03:00
- GDGT.ru Модель Anthropic передала полиции Филадельфии ложное сообщение об убийстве 09.10.2026 23:00
- overclockers.ru ИИ Claude Haiku 4.5 отправил полиции США ложное сообщение об убийстве 10.10.2026 05:04
- 3DNews Anthropic признала, что не может контролировать своих ИИ-агентов — поэтому им отключили интернет 10.10.2026 17:21
- iXBT Anthropic рассказала как ИИ-агент отправлял ложные доносы в полицию и заполнял настоящие государственные формы 10.10.2026 23:04
