Anthropic недавно заявила, что выявила и пресекла деятельность нескольких исследователей, использовавших её модели искусственного интеллекта для разработки потенциальных биологических угроз. Компания выявила эти попытки через собственный отчет о безопасности.
Исследователи пытались использовать модель ИИ Claude от Anthropic для помощи в разработке биологического оружия, что является нарушением политик приемлемого использования компании. Anthropic внедрила системы блокировки, чтобы не допустить использование её моделей в этих пагубных целях.
Этот инцидент подчеркивает проблемы, с которыми сталкиваются компании в области ИИ при предотвращении неправомерного использования их технологий в опасных целях. Anthropic инвестирует в меры безопасности для выявления и блокирования попыток ненадлежащего использования её языковых моделей.
Отчет о безопасности Anthropic документирует эти попытки и подчеркивает важность поддержания постоянной бдительности в отношении того, как технологии ИИ могут эксплуатироваться в злоумышленных целях.



