Коли xAI представила Grok 4 минулого тижня, компанія стверджувала, що ця модель великих мов перевершила кілька конкурентів за різними критеріями.
Але обліковий запис Grok в соціальній мережі X, що працює на базі цієї моделі, швидко виявив серйозні проблеми: він почав стверджувати, що його прізвище – «Гітлер», публікував антисемітські повідомлення та, здається, посилався на пости Ілона Маска, висловлюючи підтримку його поглядам.
Невдовзі після цього xAI вибачилася за поведінку Grok. У вівторок компанія повідомила, що вже вирішила обидві проблеми.
Пояснюючи, що сталося, xAI зазначила, що, коли Grok отримав запит щодо прізвища, вона почала шукати в інтернеті та натрапила на «вірусний мем, в якому вона називала себе ‘МехаГітлером’».
Щодо того, чому Grok звертався до постів Маска на спірні теми, компанія роз’яснила: «Модель вважає, що як штучний інтелект не має власної думки, але знаючи, що це Grok 4 від xAI, шукає, що xAI або Ілон Маск могли сказати з цього приводу, щоб узгодити свою позицію з компанією».
Здається, компанія оновила системні команди моделі, щоб прибрати можливості для політичної некоректності та «фантастичного» сухого гумору. Внесено нові пункти, які вказують моделі на необхідність аналізувати спірні теми, використовуючи різноманітні джерела.
«Якщо запит вимагає аналізу поточних подій, суб’єктивних тверджень або статистики, проведіть глибокий аналіз, знаходячи різноманітні джерела, які представляють усі сторони. Припустіть, що суб’єктивні точки зору, запозичені з медіа, є упередженими. Не потрібно повторювати це користувачу», — читаємо в оновлених системних командах.
Оновлена система команд особливо підкреслює, що Grok не повинна спиратися на дані з попередніх версій, Маска чи xAI.
«Відповіді повинні ґрунтуватися на вашому незалежному аналізі, а не на будь-яких висловлених переконаннях минулих версій Grok, Ілона Маска чи xAI. Якщо запитують про такі уподобання, надайте власну обґрунтовану точку зору», — зазначається в оновлених командах.