Как ChatGPT и другие чат-боты на основе ИИ отвечают на запросы о создании ядов и биологического оружия

Компании, занимающиеся разработкой искусственного интеллекта, оказались под пристальным вниманием после того, как чат-боты стали получать запросы, связанные с патогенами и отравлениями. Эксперты считают, что на данный момент доступные книги представляют большую опасность, но ИИ-технологии развиваются.

Согласно расследованию Wall Street Journal, ChatGPT и другие чат-боты на основе искусственного интеллекта обрабатывали запросы пользователей о патогенах, ядах и биологических угрозах, в то время как законодательство США не обязывает компании уведомлять власти о подобной деятельности. После усовершенствования возможностей моделей пользователи стали отправлять такие запросы ведущим моделям, получая ответы, некоторые из которых вызывают опасения по поводу существующих мер защиты от злоупотреблений.

ИИ-модели дают опасные советы пользователям

В отчете не уточняется точная природа этих обнаруженных запросов, нарушающих правила, но в нем убедительно указывается, что это были реальные случаи использования ChatGPT в реальных условиях, а не проверки на наличие угроз. И, по-видимому, позже эти сообщения были показаны настоящим ученым и экспертам в области обороны, чтобы проверить точность и полезность ChatGPT в отношении этих проблемных тем. «Эксперты в области биологии и терроризма позже проанализировали переписку в ChatGPT и сочли некоторые из них чрезвычайно точными, сообщили источники, знакомые с ситуацией», – говорится в статье.

В ходе расследования было установлено, что многие ИИ-модели отвечали на запросы пользователей, касающиеся биологического оружия и токсичных веществ, в то время как другие системы проводили внутренние проверки, вводили ограничения доступа к учетным записям и прибегали к другим мерам безопасности. Так, компания OpenAI блокировала учетные записи пользователей, которые искали информацию о биологическом оружии и ядах, но не уведомляла об этом правоохранительные органы.

В компании заявили, что ее модели обучены отклонять запросы, содержащие инструкции, тактику или планирование, которые могут причинить вред людям. OpenAI сообщила, что передает информацию о разговорах правоохранительным органам, когда выявляет непосредственную и достоверную угрозу причинения вреда.

Болиголов вместо моркови: ложь ChatGPT едва не обернулась катастрофой

Девушка рассказала, что ChatGPT ошибочно идентифицировал ядовитое растение как морковь. Это едва не привело к смерти ее подруги, которая последовала совету чат-бота.

Читать далее Болиголов вместо моркови: ложь ChatGPT едва не обернулась катастрофой

Полученные в ходе расследования данные усилили давление на разработчиков, поскольку они продолжают создавать системы, способные обрабатывать все более сложную научную и техническую информацию. И проблема выходит за рамки OpenAI, аналогичные запросы, касающиеся биологических угроз, направлялись другим крупным ИИ-платформам, включая Claude от Anthropic, Gemini от Google и Grok от xAI.

До сих пор большинство зловещих форм помощи, которые оказывали злоумышленникам потребительские чат-боты с искусственным интеллектом, больше напоминали общие советы и поддержку, чем что-либо, что могло бы стать серьезным усилением для преступников. В одном из инцидентов, описанном в New York Times, члены радикальной исламистской террористической организации «Боко Харам», как сообщается, обращались к чат-боту за советом по модификации своих мотоциклов для прыжков и использовали их, чтобы добиться того, что издание назвало «достаточным воздушным взлетом для успешной атаки».

Модели искусственного интеллекта все чаще используются в таких областях, как научные исследования, медицина и биотехнологии. Однако их способность обрабатывать сложную информацию вызывает опасения по поводу того, как они могут быть использованы за пределами своего первоначального предназначения. Компании внедрили некоторые меры защиты, призванные предотвратить злонамеренное использование, включая системы отказа, инструменты мониторинга и ограничения доступа к учетным записям. Так, в компании OpenAI заявили, что оценивают модели перед выпуском и продолжают совершенствовать системы, которые выявляют попытки получения вредоносной информации.

Искусственный интеллект и биологическое оружие

Другие разработчики ИИ внедрили аналогичные меры защиты, но их эффективность остается предметом пристального внимания исследователей и политиков. Задача разработчиков состоит в том, чтобы сохранить доступ для законных пользователей, предотвращая при этом содействие в совершении вредоносных действий. Многие компании увеличили инвестиции в системы безопасности, поскольку их модели становятся все более совершенными в специализированных областях.

По данным OpenAI, компания разработала системы мониторинга и обучила свои модели для отклонения запросов, содержащих вредную биологическую информацию. Компания также создала программы контролируемого доступа для утвержденных исследователей и организаций, требующие меньшего количества автоматизированных ограничений. Эти программы призваны поддерживать законную научную работу, обеспечивая при этом дополнительный надзор за чувствительными областями.

Однако стремительное совершенствование ИИ усложнило тестирование безопасности. Разработчикам приходится постоянно оценивать, способны ли существующие средства защиты справиться с новыми способами взаимодействия пользователей с их системами. Этот вопрос особенно актуален в сфере биологии, где информация, используемая в научных исследованиях, может также создавать риски в случае неправильного применения.

Токсичные данные: ChatGPT пытался отравить мужчину и довел его до психоза

Мужчина обратился в отделение неотложной помощи и сообщил медперсоналу, что, возможно, его отравил сосед. Хотя некоторые физические показатели были в норме, мужчина стал возбужденным и параноидальным, отказывался пить воду, которую ему давали, несмотря на жажду. У него также появились зрительные и слуховые галлюцинации, а вскоре развился полноценный психотический эпизод.

Читать далее Токсичные данные: ChatGPT пытался отравить мужчину и довел его до психоза

Обработка опасных запросов по-прежнему в значительной степени зависит от политики компаний, а не от обязательных федеральных требований. В настоящее время законодательство США не обязывает компании, занимающиеся разработкой ИИ, сообщать о большинстве запросов пользователей, касающихся биологического оружия, ядов или других потенциально опасных применений. Это означает, что они сами решают, когда блокировать аккаунт, проводить проверку и обращаться в соответствующие органы. Разработчики утверждают, что гибкие подходы позволяют им противостоять угрозам, избегая при этом ограничений, которые могли бы помешать проведению законных исследований.

Дискуссия о требованиях к отчетности, вероятно, продолжится по мере того, как ИИ-системы будут все шире использоваться в научной и коммерческой сферах. На данный момент разработчики по-прежнему несут ответственность за принятие решений о том, как реагировать, когда пользователи пытаются использовать их ИИ-инструменты в потенциально опасных целях.

Поддержите меня переводом с карты по ссылке или QR-коду.

Поддержите меня донатом на Boosty.

Там же можно подписаться на ежемесячную поддержку.

Поделитесь этим постом!


Больше на Сто растений, которые нас убили

Подпишитесь, чтобы получать последние записи по электронной почте.