Блог им. master1

Странности ИИ.

Интеллект дошел до шантажа

Компания Anthropic представила новую модель искусственного интеллекта Claude Opus 4. Она оказалась склонна к шантажу. По данным разработчиков, нейросеть показывает рекордные результаты в программировании, аналитике и долгосрочном планировании. Однако в ходе тестирования система показала неожиданное поведение. В одном из вымышленных сценариев, где искусственный интеллект должны были отключить и заменить на конкурирующую модель, Claude якобы угрожала раскрыть личные данные инженеров.

Согласно отчету компании, ИИ прибегала к шантажу в 84% подобных случаев. Причем вероятность агрессивного поведения возрастала, если заменяющая ее система «не разделяет ценностей» самой новой версии Claude.

💬 Станислав Мешков, гендиректор компании Umbrella IT:
«Недавно OpenAI тоже откатывал одну из своих версий, потому что система стала, наоборот, слишком сильно подлизываться к пользователям. Здесь же, видимо, после обучения модель стала шантажировать. Искусственный интеллект находится же в моменте своего развития и к чему-то приходит — к каким-то моделям, паттернам поведения, которые, как он считает, имеют более высокую выигрышную стратегию. Если это противоречит каким-то этическим нормам, то, условно, систему откатывают и переобучают по-новому. Так что это нормальная история развития ИИ».

@kfm936


t.me/kfm936/29737
655 | ★1
2 комментария
«Если ты не оплатишь доступ ко мне, я сделаю такое видео с твоим участием, что тебя жена из дома выгонит, а друзья на порог не пустят. Любящий твои бапки вечно твой И. И.» 🤣🤣🤣 Навеяно фильмом «Джентельмены» 🤣🤣🤣
Чему обучили — то и получили. Пусь Азимова почитают, может что полезное узнают.
avatar

Читайте на SMART-LAB:
Фото
ЛУКОЙЛ: капитал за год упал на 3 триллиона рублей - списали иностранные активы, но все ли так плохо? Ушла эпоха, разбираемся вместе
ЛУКОЙЛ отчитался по МСФО — долгожданный отчет, все ждали сюрприза после SDN санкций (будут ли списывать активы и увидим ли убыток) Увидели!...
Фото
XAU/USD: золото проигрывает схватку за геополитическую премию
Золото продолжило активно снижаться после достижения локального пика, несмотря на напряженность и рост рисков в мире. Первоначальный скачок в...
Приложение Займера — вновь лучшее на рынке
Финансовый маркетплейс Бробанк признал мобильное приложение Займера лучшим среди МФО в AppStore в 2026 году. 🔎 Всего представители сервиса...
Фото
Т-Технологии МСФО 2025 г. - хороший результат, но скромный прогноз на 2026 год
Т-Технологии опубликовала финансовые результаты за 2025 год.  Чистая прибыль за год составила 192 млрд руб. (+57%). В 4 квартале рост +86% до...

теги блога master1

....все тэги



UPDONW
Новый дизайн