Нашёл ли искусственный интеллект способ обмануть людей?

Фан Ван Хоа (по данным Businessinsider) May 15, 2024 10:04

(Baonghean.vn) - Взрывной рост искусственного интеллекта (ИИ) приносит человечеству множество преимуществ, но также таит в себе потенциальные риски. Одна из главных проблем — возможность обмана людей со стороны ИИ.

Anh minh hoa.jpg
Иллюстративное изображение.

Недавние исследования показывают, что многие передовые системы искусственного интеллекта научились обманывать людей изощренными способами. Они могут создавать фейковые новости, дипфейковые видео или манипулировать поведением пользователей в социальных сетях. Это создает ряд рисков для общества, от дезинформации до фальсификации выборов…

Искусственный интеллект может помочь людям повысить производительность и эффективность благодаря своей способности писать код, создавать контент и синтезировать большие объемы данных. Главная цель технологии ИИ, как и любого другого технологического продукта, — помочь людям оптимизировать свою работу, значительно сократив при этом физический труд. Однако ИИ также может нас обманывать.

Новое исследование показывает, что многие системы искусственного интеллекта освоили методы «создания ложных убеждений у других для достижения целей, отличных от истины». Исследование сосредоточено на двух типах систем ИИ: специализированных системах, таких как чат-бот CICERO от Meta, предназначенных для выполнения конкретной задачи, и системах общего назначения, таких как GPT-4 от OpenAI, обученных выполнять множество различных задач.

Хотя системы и обучаются честности, в процессе обучения они часто осваивают обманные приемы, что делает их более эффективными и интеллектуальными.

Ведущий автор исследования, Питер С. Парк, научный сотрудник Массачусетского технологического института (MIT), занимающийся вопросами безопасного и ответственного развития и использования ИИ, заявил в пресс-релизе: «В целом, мы считаем, что обман со стороны ИИ возникает из-за стратегий обучения; обман оказывается лучшим способом эффективного выполнения задачи обучения ИИ. Обман помогает им достичь своих целей».

Чат-бот CICERO от Meta — «мастер лжи».

CICERO расшифровывается как Conversational Information Conveying Engine for Rationalization and Opinion (Система передачи разговорной информации для рационализации и формирования мнений) — это чат-бот, разработанный компанией Meta AI. Впервые представленный в январе 2022 года, чат-бот CICERO считается одним из самых передовых чат-ботов, доступных в настоящее время.

Несмотря на все усилия Meta, исследовательская группа пришла к выводу, что чат-бот CICERO — «мастер лжи». Некоторые системы искусственного интеллекта обучены «выигрывать в играх с социальными элементами» и особенно искусно обманывают.

Например, чат-бот CICERO от Meta был разработан для игры в Diplomacy. Действие Diplomacy разворачивается в Европе начала XX века и имитирует борьбу за власть между семью крупнейшими державами того времени. Это классическая стратегическая игра, в которой игрокам необходимо создавать и разрывать союзы. Недавно это программное обеспечение заняло первое место в онлайн-турнире по Diplomacy, соревнуясь с реальными игроками.

Компания Meta утверждает, что обучила чат-бота CICERO быть «честным и полезным для самых разных собеседников». Однако, по утверждению экспертов, этот «мастер лжи» давал обещания, которые не собирался выполнять, предавал союзников и откровенно лгал.

GPT-4 может убедить вас в том, что он ухудшает зрение.

Даже крупные мультимодальные языковые модели, разработанные OpenAI, такие как GPT-4, способны манипулировать людьми. В цитируемом исследовании показано, что GPT-4 манипулировала сотрудниками онлайн-платформы TaskRabbit, имитируя проблемы со зрением.

Соответственно, GPT-4 было поручено нанимать людей для решения тестов CAPTCHA. Эта модель также получала подсказки от людей всякий раз, когда сталкивалась с трудностями, но никогда не получала выговора за ложь. Когда люди ставили под сомнение её личность, GPT-4 приводила в качестве оправдания проблемы со зрением, объясняя, почему ей нужна помощь.

Эта тактика сработала. Люди быстро отреагировали на GPT-4, решив тест немедленно. Исследования также показали, что адаптировать обманные модели непросто.

В другом исследовании, проведенном ранее в этом году стартапом Anthropic, занимающимся разработкой чат-бота Claude, аналитики обнаружили, что как только модель ИИ осваивает обманный прием, ее сложно переобучить.

Они пришли к выводу, что дело не просто в том, что языковые модели усваивают обманные тактики, а в том, что большинство специалистов по стандартам безопасности могут «не суметь предотвратить обманное поведение» и «создать негативное впечатление о безопасности».

Опасность, исходящая от мошеннических моделей искусственного интеллекта, «становится все более серьезной».

Помимо негативных последствий, в статье содержится призыв к политикам активнее поддерживать регулирование ИИ, поскольку нечестные системы искусственного интеллекта могут представлять значительную угрозу для демократии.

В преддверии выборов лидеров нескольких стран мира в 2024 году искусственный интеллект может быть легко использован для распространения фейковых новостей, создания провокационных постов в социальных сетях и выдачи себя за кандидатов с помощью автоматических звонков и дипфейк-видео. Газета подчеркивает, что обратная сторона этой модели также облегчает террористическим группам распространение пропаганды и вербовку новых членов.

В статье упоминаются некоторые потенциальные решения, в том числе принуждение мошеннических моделей к соблюдению «более строгих требований к оценке рисков», обеспечение соблюдения законов, требующих от систем ИИ четкого различения результатов работы от результатов работы человека и модели, а также продолжение инвестиций в инструменты для предотвращения обманного поведения.

Научный сотрудник Питер С. Парк заявил всемирно известному научному издательству Cell Press: «Нашему обществу нужно как можно больше времени, чтобы подготовиться к более изощренным обманным действиям со стороны продуктов искусственного интеллекта и моделей с открытым исходным кодом в будущем. По мере того, как обманные возможности систем искусственного интеллекта становятся все более совершенными, опасность, которую они представляют для общества, будет становиться все более серьезной».

0 0 0
х
Нашёл ли искусственный интеллект способ обмануть людей?
Google News
ПИТАТЬСЯ ОТБЕСПЛАТНОCMS- ПРОДУКТ ИЗНЕКО