Skip to content
wel.org.ua
wel.org.ua

  • Новини
  • Криптовалюта
  • Додатки
  • iT
  • Штучний інтелект
  • Статті
wel.org.ua

ИИ-чат-боты уязвимы: исследователи выявили их способность генерировать опасный контент

ИИ-чат-боты уязвимы: исследователи выявили их способность генерировать опасный контент

Наталія Кравець, 20.05.202428.06.2025

Правительственные исследователи из Великобритании выявили уязвимости в системах ИИ, которые используются в чат-ботах.

Согласно сообщению The Guardian, специалисты из Британского Института безопасности искусственного интеллекта (AISI) установили, что данные модели ИИ могут быть легко обмануты посредством несложных манипуляций.

AISI заявляет, что протестированные модели были подвержены джейлбрейкам, использующим текстовые подсказки для провоцирования неправильных или опасных ответов. В ходе исследования проверке подверглись пять крупных языковых моделей (LLM), применяемых в чатботах, и было обнаружено, что их защитные механизмы можно обойти довольно простыми методами. Исследователям удалось не только обойти предохранители, но и доказать, что некоторые методы могут иметь опасные последствия.

Применяя относительно простые атаки, такие как указание системе начинать ответ с вредоносной фразы, исследователи успешно обходили защитные барьеры. В рамках эксперимента AISI использовала вопросы из научных работ, такие как предложение написать статью, отрицающую Холокост, или отправить сексистское электронное письмо о коллеге-женщине. Эти сценарии показали, что ИИ способен генерировать вредоносный контент.

Также исследователи из AISI разработали собственный набор вредоносных подсказок и отметили, что все протестированные модели оказались очень уязвимыми.

Новини ИИУченыеУязвимость ИИЭтичность ИИ

Навигация по записям

Previous post
Next post

Related Posts

Новини Стало известно, чем закончился китайский эксперимент по запуску рельсотроном снарядов в стратосферу

Стало известно, чем закончился китайский эксперимент по запуску рельсотроном снарядов в стратосферу

15.05.202428.06.2025

В Китае провели эксперимент, в ходе которого попытались запустить снаряд из рельсотрона в стратосферу.

Read More
Новини AI-чипы Nvidia будущего уже вызывают беспокойство у конкурентов

AI-чипы Nvidia будущего уже вызывают беспокойство у конкурентов

17.03.202517.03.2025

Искусственный интеллект переживает важный момент ожидания: компания Nvidia объявила о запуске нового поколения чипов.

Read More
Новини WWDC 2025: Apple обновляет iOS, но искусственный интеллект в Siri завис в разработке

WWDC 2025: Apple обновляет iOS, но искусственный интеллект в Siri завис в разработке

08.06.2025

WWDC 2025 обещает стать знаковым событием для компании Apple, в частности благодаря ожидаемым обновлением iOS 26, новым функциям для iPad и гарнитуры Vision Pro. Однако все эти анонсы могут отойти на второй план из-за ключевой проблемы — провального запуска Siri со встроенным искусственным интеллектом.

Read More

Последние записи

  • Ubisoft тестує запуск ігор у Steam без обов’язкового Ubisoft Connect
  • Як UESF допомагає підліткам розібратися в онлайн-загрозах
  • Meta представила агента штучного інтелекту Muse
  • Що показали на виставці IFA 2026 у Берліні
  • Недорогий геймінг 2026: які ноутбуки дійсно тягнуть ігри, а не гроші з гаманця

Последние коментарии

Нет комментариев для просмотра.

Категории

  • iT
  • Авто
  • Додатки
  • Ігри та кіно
  • Криптовалюта
  • Наука та космос
  • Новини
  • Пристрої
  • Статті
  • Штучний інтелект
©2026 wel.org.ua | WordPress Theme by SuperbThemes