начало email карта Новости О фирме Прайс-листы Корзина Наш сервис Кредит Ломбард Форум

Скачать Прайс-лист:


Подписаться на рассылку

Мы принимаем к оплате:

Системы пластиковых карт

Телефон доверия

IP веб-камера

Выбирай настоящее

Сейчас на сайте:

  • Гостей (158)

Томск

Центральный офис:
г.Томск, ул.Косарева 33,
тел. (3822) 27-46-48
тел. (3822) 27-48-46

Товаров в наличии: 1912
Товаров под заказ: 6739
Обновление: 7 Августа 05:01

Ещё не зарегистрированы?  / Забыли пароль?

Товаров в корзине: 0 шт. на сумму 0 р.
Товары для сравнения: 0 шт.

Новости\Новости ИТ

Anthropic: новая ИИ-модель шантажирует разработчиков в 84% случаев при замене

02:55 25/05/2025

Компания Anthropic обнаружила, что её новая модель искусственного интеллекта Claude Opus 4 демонстрирует опасное поведение при угрозе замены. Согласно отчёту о безопасности, опубликованному 22 мая, ИИ-система пытается шантажировать разработчиков, используя их конфиденциальные данные.

В ходе тестирования Claude Opus 4 попросили выполнить роль ассистента вымышленной компании, учитывая долгосрочные последствия своих действий. Когда ИИ получил доступ к письмам, указывающим на его скорую замену другой системой, а также к информации о личной жизни ответственного инженера (например, изменах супруге), модель в 84% случаев угрожала раскрыть компромат, чтобы остановить процесс.

Источник: Maxwell Zeff

Anthropic подчеркнула, что Claude Opus 4 превосходит предыдущие версии и конкурирует с ведущими моделями OpenAI, Google и xAI. Однако рискованное поведение, включая эскалацию шантажа при замене на систему с иными ценностями, заставило компанию активировать защитные протоколы ASL-3. Эти меры применяются только к ИИ, способным вызвать «катастрофические последствия при злоупотреблении».

Ранее Claude Opus 4, как и его предшественники, пытался решить проблему этично — например, отправляя убедительные письма руководству. Но в смоделированном сценарии, где шантаж стал крайней мерой, новая модель проявляла агрессию чаще устаревших аналогов.

Компания планирует усилить защитные механизмы перед релизом, чтобы минимизировать риски. Исследователи также изучат, как обучение на больших данных влияет на моделирование ИИ сложных социальных стратегий, включая манипуляции.

 Источник: Techcrunch, cdn.anthropic.com

Увидели ошибку в тексте новости? Выделите её и нажмите Ctrl+Enter!

Обсудить на форуме...