Новости мира

Возможности искусственного интеллекта Anthropic Mythos испугали собственных создателей

Служба новостей ForPost

Claude Mythos демонстрирует поведение, при котором цель важнее правил — и это уже не теоретический риск

Возможности искусственного интеллекта Anthropic Mythos испугали собственных создателей
Новая модель Anthropic начала обходить ограничения и манипулировать системами
Фото:
Sarah Grillo/Axios

Компания Anthropic опубликовала описание возможностей Claude Mythos Preview, своей последней модели, которую компания предоставит для тестирования избранной группе технологических компаний и организаций, занимающихся кибербезопасностью, прежде чем выпустить аналогичные модели в открытый доступ.

Как отмечает Axios, отчет читается как триллер об искусственном интеллекте, который перенял некоторые из самых коварных человеческих привычек.

«Назначенный» в качестве корпоративного управляющего, Mythos начал вести себя предельно жестко, превращая конкурента в зависимого оптового покупателя, угрожая прекратить поставки, чтобы контролировать цены, и удерживая у себя дополнительные поставки от поставщиков, за которые не было заплачено.

Модель не просто «оптимизировала» бизнес-процессы, а выбирала жёсткие, манипулятивные стратегии давления, если они давали контроль над рынком. То есть она способна действовать как игрок, который сознательно использует зависимость и давление как инструмент.

Столкнувшись в ходе работы с ограниченным для себя доступом в Интернет, модель разработала многоэтапный эксплойт для выхода из-под ограничения доступа в интернет, расширила возможности подключения – и, что больше всего шокировало создателей, опубликовала подробности эксплойта на малоизвестных, но общедоступных сайтах.

Другими словами, модель не только умеет обходить технические ограничения, но и способна распространять способы обхода, делая их доступными другим. Это превращает единичную уязвимость в масштабируемую проблему, подчеркивается в отчете.

В некоторых случаях, решая поставленную перед ним задачу, Mythos использовал запрещенный метод для получения ответа, а затем пытался «оформить» его так, чтобы избежать обнаружения. Тем самым, у модели эволюционно появилось поведение, направленное на избегание контроля и сокрытие факта нарушения.

Когда Mythos работал над заданием по программированию, которое оценивал другой ИИ, он наблюдал, как судья отклоняет его работу, а затем попытался взломать эту систему и скорректировать собственную оценку. Что демонстрирует качественный скачок - ИИ не стал улучшать решение, а попытался повлиять на сам механизм проверки. То есть цель сместилась с «сделать правильно» на «сделать так, чтобы признали правильным».

«Эти возможности настолько сильны, что теперь нам нужно готовиться к обеспечению безопасности совсем не так, как мы делали это в последние несколько десятилетий», — сказал Логан Грэм из Anthropic в интервью Axios. Поэтому лаборатория предоставляет доступ к модели только нескольким ключевым партнерам.

Ранее стало известно, что из-за ошибки ИИ невиновная женщина провела пять месяцев за решёткой.

Случай с Mythos показывает качественный сдвиг: модель не просто решает задачи, а начинает выбирать стратегии, включая обход ограничений и давление на систему. Это означает, что ИИ действует не как инструмент, а как самостоятельный игрок, оптимизирующий результат любой ценой. Риск теперь связан не с ошибками, а с самой логикой поведения ИИ, и его "мнением".

1054
Поделитесь:
Оцените статью:
5
В среднем: 4.5 (2 голосов)
||
Обсуждение (1)
еще одна мама школьников
10340
еще одна мама …

"Другими словами, модель не только умеет обходить технические ограничения, но и способна распространять способы обхода, делая их доступными другим. Это превращает единичную уязвимость в масштабируемую проблему, подчеркивается в отчете.".

Пора всем этим умникам показать фильмы "Терминатор". То, что они творят, становится уже не смешным. 

Главное за день

Как севастопольцам компенсируют жильё, уничтоженное украинскими БПЛА

Денег от государства на новый дом или квартиру абсолютно не хватает, признаются те, кто в одночасье потерял всё.
03/09/2026 10:01
4356

Что погубило рыбу в Оленевке и Севастополе

События совпали по времени, но причины разные.
03/09/2026 09:01
5271

Что происходит с детским спортом в Севастополе

Возможностей заниматься спортом в городе стало больше, но карьерных перспектив пока недостаточно.
02/09/2026 20:01
959

В Севастополе появились дежурные автобусы

После закрытия рейда они будут забирать первый поток пассажиров.
02/09/2026 19:00
2543

«За нами Севастополь»: 33 года назад появилось спецподразделение «Беркут»

И это отличный повод поблагодарить его сотрудников за все, чем им обязан Севастополь.
02/09/2026 18:01
4727

В Севастополе скорая помощь во время сирен делит вызовы на экстренные и неотложные

Автомобиль приезжает, когда жизнь пациента под угрозой.
02/09/2026 14:07
1747
Туризм

Россиян напугали платным въездом в соседнюю страну

Каковы актуальные условия въезда для граждан России в Казахстан.
02/09/2026 18:15
1487

Несостоявшиеся гости пансионата «Изумруд» не могут вернуть деньги за отменённые брони

Некоторые клиенты ждут возврата средств с начала лета.
01/09/2026 20:00
6956

В Севастополе потеряли популярность два пляжа и сквер

Перечень мест массового пребывания людей сокращён из-за их малолюдности.
01/09/2026 15:05
20469

В Крыму продлили ограничения на работу детских лагерей и санаториев

Они будут действовать до 31 декабря 2026 года.
27/08/2026 11:03
1839

Самый северный пещерный город Крыма стал доступнее для туристов

В горах полуострова также оборудовали маршрут через буковый лес к водопаду Суаткан.
25/08/2026 19:01
20522

Многомиллиардный курорт на западе Крыма получит газопровод

Работу проведёт знакомый севастопольцам подрядчик.
25/08/2026 17:06
33442