Skip to content
wel.org.ua
wel.org.ua

  • Новини
  • Криптовалюта
  • Додатки
  • iT
  • Штучний інтелект
  • Статті
wel.org.ua

ИИ-чат-боты уязвимы: исследователи выявили их способность генерировать опасный контент

ИИ-чат-боты уязвимы: исследователи выявили их способность генерировать опасный контент

Наталія Кравець, 20.05.202428.06.2025

Правительственные исследователи из Великобритании выявили уязвимости в системах ИИ, которые используются в чат-ботах.

Согласно сообщению The Guardian, специалисты из Британского Института безопасности искусственного интеллекта (AISI) установили, что данные модели ИИ могут быть легко обмануты посредством несложных манипуляций.

AISI заявляет, что протестированные модели были подвержены джейлбрейкам, использующим текстовые подсказки для провоцирования неправильных или опасных ответов. В ходе исследования проверке подверглись пять крупных языковых моделей (LLM), применяемых в чатботах, и было обнаружено, что их защитные механизмы можно обойти довольно простыми методами. Исследователям удалось не только обойти предохранители, но и доказать, что некоторые методы могут иметь опасные последствия.

Применяя относительно простые атаки, такие как указание системе начинать ответ с вредоносной фразы, исследователи успешно обходили защитные барьеры. В рамках эксперимента AISI использовала вопросы из научных работ, такие как предложение написать статью, отрицающую Холокост, или отправить сексистское электронное письмо о коллеге-женщине. Эти сценарии показали, что ИИ способен генерировать вредоносный контент.

Также исследователи из AISI разработали собственный набор вредоносных подсказок и отметили, что все протестированные модели оказались очень уязвимыми.

Новини ИИУченыеУязвимость ИИЭтичность ИИ

Навигация по записям

Previous post
Next post

Related Posts

Новини Palo Alto Networks погоджується на придбання CyberArk за 25 мільярдів доларів

Palo Alto Networks погоджується на придбання CyberArk за 25 мільярдів доларів

05.08.2025

Компанія Palo Alto Networks, провідний гравець у сфері кібербезпеки, оголосила про намір придбати компанію з управління ідентичностями та безпеки CyberArk за 25 мільярдів доларів. Угода, що складається з готівки та акцій, знаменує собою вихід Palo Alto на ринок ідентифікаційної безпеки, згідно з пресрелізом компанії. З моменту приходу Нікеша Арори на…

Read More
Новини Зловмисник застосував атакy через голосове фішинг, щоб викрасти особисті дані клієнтів Cisco

Критична загроза: тисячі клієнтів Cisco під загрозою нової кібератаки з Китаю

25.01.2026

Cisco виявила, що група хакерів, підтримуваних китайським урядом, використовує вразливість для атаки на підприємства, які користуються популярними продуктами компанії. Ця інформація стала відома після оголошення Cisco, проте компанія не розкрила, скільки її клієнтів вже стали жертвами цієї атаки чи можуть експлуатувати вразливі системи. Експерти з безпеки зазначають, що потенціально під…

Read More
Новини Компания Maincast Максима Криппы открывает новые телеканалы для ОТТ и кабельного телевидения

Компания Maincast Максима Криппы открывает новые телеканалы для ОТТ и кабельного телевидения

15.11.202415.11.2024

Компания Maincast, основанная Максимом Криппой, объявила о запуске двух телеканалов, которые будут доступны через ОТТ-платформы и кабельные сети. Это решение было одобрено Национальным советом по вопросам телевидения и радиовещания 7 ноября 2024 года.

Read More

Последние записи

  • Ubisoft тестує запуск ігор у Steam без обов’язкового Ubisoft Connect
  • Як UESF допомагає підліткам розібратися в онлайн-загрозах
  • Meta представила агента штучного інтелекту Muse
  • Що показали на виставці IFA 2026 у Берліні
  • Недорогий геймінг 2026: які ноутбуки дійсно тягнуть ігри, а не гроші з гаманця

Последние коментарии

Нет комментариев для просмотра.

Категории

  • iT
  • Авто
  • Додатки
  • Ігри та кіно
  • Криптовалюта
  • Наука та космос
  • Новини
  • Пристрої
  • Статті
  • Штучний інтелект
©2026 wel.org.ua | WordPress Theme by SuperbThemes