Anthropic Заблокировала Доступ к ИИ-моделям Fable 5 и Mythos 5
Блог Тихона Мануйленко

Anthropic Заблокировала Доступ к ИИ-моделям Fable 5 и Mythos 5


(Никто еще не голосовал)
Loading...

Компания Anthropic объявила о блокировке доступа своих клиентов к передовым моделям искусственного интеллекта Fable 5 и Mythos 5. Это решение было принято в ответ на распоряжение правительства США, полученное 12 июня, со ссылкой на вопросы национальной безопасности. Остальные модели компании и её чат-бот Claude остаются доступными без изменений.

Правительственное Предписание и Опасения Национальной Безопасности

Согласно заявлению Anthropic, американское правительство потребовало приостановить доступ ко всем недавно запущенным ИИ-моделям для иностранных граждан, независимо от их местонахождения и статуса (даже если это сотрудники компании), из-за опасений за национальную безопасность.

Хотя конкретные угрозы не были детализированы, в Anthropic полагают, что причиной стало обнаружение потенциального метода «джейлбрейка» – обхода встроенных ограничений или защитных механизмов – для модели Fable 5.

Модель Fable 5 была представлена публике 9 июня и призвана предоставить широкому кругу пользователей многие возможности Mythos – передовой кибербезопасной модели, доступной только партнерам по проекту Project Glasswing. По заявлениям компании, возможности Fable превосходят все предыдущие разработки Anthropic. Например, в ходе внутреннего тестирования модель успешно прошла игру Pokémon FireRed, тогда как более ранняя версия Claude не справилась с оригинальной Pokémon Red.

Меры Безопасности и Уязвимости

В своем заявлении Anthropic подробно описала меры, принятые для обеспечения безопасности Fable. Были внедрены строгие защитные механизмы, призванные «снизить вероятность неправомерного использования Fable в задачах, связанных с кибербезопасностью». Компания отметила, что эти меры настолько обширны, что некоторые пользователи жаловались на их чрезмерность.

Также было разъяснено, что ни один разработчик не может гарантировать полную неуязвимость к попыткам джейлбрейка, и любая модель уязвима для специально разработанных методов обхода. Стратегия защиты Anthropic направлена на то, чтобы сделать джейлбрейки либо узконаправленными (неуниверсальными), либо чрезвычайно затратными в производстве (универсальными), а также сочетать это с тщательным мониторингом для быстрого обнаружения и пресечения любых успешных атак.

Разногласия с Регулятором

По имеющейся информации, правительство предоставило компании устные свидетельства потенциального «узконаправленного, неуниверсального» джейлбрейка, которые были получены от неназванной стороны. Anthropic пообещала предоставить дополнительные детали в течение 24 часов, но при этом четко заявила о своем несогласии с тем, что потенциальный джейлбрейк должен служить причиной для отзыва коммерческой модели.

В компании, которая ранее активно высказывалась о необходимости усиленного надзора за ИИ, подчеркнули: «Мы убеждены, что правительство должно иметь возможность блокировать небезопасные развертывания в рамках законодательного процесса, который является прозрачным, справедливым, четким и основанным на технических фактах. Данное действие не соответствует этим принципам».



Подпишитесь на новости блога
Добавить в закладки
Поучаствуйте в опросе:
Из чего строить загородный дом?
Топ комментаторов:
adianon(44)
сергей(30)
Слава(27)
Стелла(23)
Nikiforov(17)
VITALY(14)