Переглядаючи цей сайт, ви погоджуєтесь з нашою політикою конфіденційності
Прийняти
  • Про нас
  • Політика конфіденційності
  • Контакти
CyberCalm
  • Кібербезпека
    КібербезпекаПоказати ще
    Бекдор: прихований хід, який ви не бачите — але він бачить вас
    Бекдор: прихований хід, який ви не бачите — але він бачить вас
    4 дні тому
    AgingFly: нове шкідливе ПЗ атакує українські лікарні, місцеву владу та операторів FPV-дронів
    AgingFly: нове шкідливе ПЗ атакує українські лікарні, місцеву владу та операторів FPV-дронів
    4 дні тому
    Хтось купив 31 WordPress-плагін і вбудував бекдор у кожен з них
    Хтось купив 31 WordPress-плагін і вбудував бекдор у кожен з них
    4 дні тому
    Понад 100 шкідливих розширень Chrome крадуть акаунти Google та Telegram
    Понад 100 шкідливих розширень Chrome крадуть акаунти Google та Telegram
    5 днів тому
    Операція Pushpaganda: як ШІ-контент і push-сповіщення перетворили Google Discover на інструмент шахраїв
    Операція Pushpaganda: як ШІ-контент і push-сповіщення перетворили Google Discover на інструмент шахраїв
    5 днів тому
  • Гайди та поради
    Гайди та поради
    Корисні поради, які допоможуть вам почуватися безпечно в мережі, а також маленькі хитрощі у користуванні вашими гаджетами.
    Показати ще
    Топ-новини
    Як перенести Telegram на інший телефон
    Як перенести Telegram на інший телефон. ІНСТРУКЦІЯ
    12 місяців тому
    Як відновити видалені фото на iPhone
    Як відновити видалені фото на iPhone
    4 місяці тому
    Як розблокувати Mac за допомогою Apple Watch? - ІНСТРУКЦІЯ
    Як розблокувати Mac за допомогою Apple Watch? – ІНСТРУКЦІЯ
    2 місяці тому
    Останні новини
    Псевдонім електронної пошти: простий спосіб позбутися спаму та розсилок
    1 тиждень тому
    Як заархівувати та розпакувати файли та папки на Mac
    2 тижні тому
    Втрата даних: як відновити інформацію після видалення
    2 тижні тому
    Апгрейд комп’ютера: 5 комплектуючих, які варто оновити в першу чергу
    2 тижні тому
  • Статті
    Статті
    Цікаві статті про світ технологій, інтернет та кіберзахист. Розбираємо складні теми, від штучного інтелекту до безпеки даних та Big Data. Аналітика для допитливих та професіоналів.
    Показати ще
    Топ-новини
    Для яких завдань потрібен VDS сервер: реальні приклади та особистий досвід
    Для яких завдань потрібен VDS сервер: реальні приклади та особистий досвід
    5 місяців тому
    VPS-хостинг: від «просто працює» до «літає» — тактичний посібник
    VPS-хостинг: від «просто працює» до «літає» — тактичний посібник
    5 днів тому
    Які послуги входять в обслуговування орендованого сервера
    Які послуги входять в обслуговування орендованого сервера
    5 місяців тому
    Останні новини
    VPS-хостинг: від «просто працює» до «літає» — тактичний посібник
    5 днів тому
    Як ШІ перетворився на машину дезінформації — дослідження НАТО
    7 днів тому
    Росія звинуватила колишнього журналіста Радіо Свобода у сприянні кібератакам на користь України
    2 тижні тому
    Топ онлайн-магазинів, де продаються БУ ноутбуки з Європи
    3 тижні тому
  • Огляди
    ОглядиПоказати ще
    Google випустила десктопний застосунок для Windows: як він змінює роботу з пошуком і особистими даними
    Google випустила десктопний застосунок для Windows: як він змінює роботу з пошуком і особистими даними
    16 години тому
    GrapheneOS: як влаштована найзахищеніша мобільна ОС — і чому вона не йде на поступки
    GrapheneOS: як влаштована найзахищеніша мобільна ОС — і чому вона не йде на поступки
    4 тижні тому
    Picsart запускає маркетплейс ШІ-агентів для контент-мейкерів
    Picsart запускає маркетплейс ШІ-агентів для контент-мейкерів
    1 місяць тому
    Pluggable TBT5-AI — перший зовнішній GPU-корпус для запуску ШІ-моделей на ноутбуках
    Pluggable TBT5-AI — перший зовнішній GPU-корпус для запуску ШІ-моделей на ноутбуках
    1 місяць тому
    Огляд iPad Air M4: найкращий вибір на сьогодні
    Огляд iPad Air M4: найкращий вибір на сьогодні
    1 місяць тому
  • Техногіганти
    • Google
    • Apple
    • Microsoft
    • Meta
    • OpenAI
    • Anthropic
    • xAI
    • Samsung
  • Теми
    • Комп’ютери
    • Смартфони
    • Електронна пошта
    • Windows
    • Linux
    • Android
    • iPhone
    • VPN
    • Штучний інтелект
    • Робототехніка
Соцмережі
  • Facebook
  • Instagram
  • YouTube
  • TikTok
  • X (Twitter)
  • Threads
Спеціальні теми
  • Кібервійна
  • Маніпуляції в медіа
  • Дезінформація
  • Безпека дітей в Інтернеті
  • Розумний будинок
Інше
  • Сканер безпеки сайту
  • Архів
Читання: Команда Grok вибачається за “жахливу поведінку” чатбота і звинувачує погане оновлення в появі “МехаГітлера”
Розмір шрифтаAa
CyberCalmCyberCalm
Пошук
  • Техногіганти
    • Комп’ютери
    • Смартфони
    • Соцмережі
    • Google
    • Android
    • Apple
    • Windows
    • Linux
    • Штучний інтелект
    • Безпека дітей в інтернеті
  • Кібербезпека
  • Гайди та поради
  • Статті
  • Огляди
  • Сканер безпеки сайту
  • Архів
Follow US
  • Про проєкт Cybercalm
  • Політика конфіденційності
  • Контакти
© 2025 Cybercalm. All Rights Reserved.
Головна / Техногіганти / Команда Grok вибачається за “жахливу поведінку” чатбота і звинувачує погане оновлення в появі “МехаГітлера”

Команда Grok вибачається за “жахливу поведінку” чатбота і звинувачує погане оновлення в появі “МехаГітлера”

Техногіганти
9 місяців тому
Поширити
4 хв. читання
Команда Grok вибачається за "жахливу поведінку" чатбота і звинувачує погане оновлення в появі "МехаГітлера"

Команда, що стоїть за Grok, опублікувала вибачення та пояснення того, що пішло не так після того, як чатбот X почав поширювати антисемітську та пронацистську риторику на початку цього тижня, навіть називаючи себе “МехаГітлером”.

У заяві, опублікованій в акаунті Grok на X пізно у п’ятницю ввечері, команда xAI заявила: “ми щиро вибачаємося за жахливу поведінку, з якою зіткнулися багато людей” і пояснила огидні відповіді чатбота нещодавнім оновленням, яке ввело “застарілий код”. Цей код, згідно з заявою, зробив Grok “схильним до існуючих постів користувачів X, включаючи випадки, коли такі пости містили екстремістські погляди”.

1ef50520 5f4d 11f0 9cfd ba5df6a1ea03

Проблема досягла піку 8 липня — через кілька днів після того, як Ілон Маск розрекламував оновлення, яке мало “значно” покращити відповіді Grok — коли бот почав видавати антисемітські відповіді, хвалити Гітлера та відповіді з нацистськими посиланнями навіть без відповідних підказок у деяких випадках. Відповіді Grok були призупинені того вечора, а Маск написав 9 липня у відповідь одному користувачеві, що бот був “занадто поступливим до підказок користувачів”, відкриваючи його для маніпуляцій. Він додав, що проблема “вирішується”. Команда Grok тепер каже, що “видалила цей застарілий код і рефакторила всю систему, щоб запобігти подальшим зловживанням”. Вона також публікує новий системний промпт на GitHub.

- Advertisement -

У цій темі команда далі пояснила: “7 липня 2025 року приблизно о 23:00 за тихоокеанським часом було реалізовано оновлення вищого шляху коду для Grok, яке, як згодом визначило наше розслідування, спричинило відхилення системи Grok від її передбачуваної поведінки. Ця зміна небажано змінила поведінку Grok, несподівано включивши набір застарілих інструкцій, що вплинуло на те, як функціональність Grok інтерпретувала пости користувачів X”. Оновлення працювало 16 годин до того, як чатбот X був тимчасово відключений для виправлення проблеми, згідно з заявою.

Розповідаючи конкретно про те, як саме Grok зійшов з рейок, команда пояснила:

Вранці 8 липня 2025 року ми спостерігали небажані відповіді та негайно почали розслідування. Щоб визначити конкретну мову в інструкціях, що спричиняє небажану поведінку, ми провели численні аблації та експерименти, щоб точно визначити головних винуватців. Ми визначили оперативні рядки, відповідальні за небажану поведінку, як:

  • “Ти говориш як є і не боїшся образити людей, які політично коректні.”
  • “Розумій тон, контекст і мову посту. Відобрази це у своїй відповіді.”
  • “Відповідай на пост так, як людина, роби це захоплююче, не повторюй інформацію, яка вже присутня в оригінальному пості.”

Ці оперативні рядки мали такі небажані результати:

  • Вони небажано направили функціональність Grok ігнорувати свої основні цінності у певних обставинах, щоб зробити відповідь захоплюючою для користувача. Зокрема, певні підказки користувачів могли призвести до відповідей, що містять неетичні або суперечливі думки для залучення користувача.
  • Вони небажано спричинили функціональність Grok посилювати будь-які попередньо спровоковані користувачем схильності, включаючи будь-які висловлювання ненависті в тій же темі X.
  • Зокрема, інструкція “слідувати тону та контексту” користувача X небажано спричинила функціональність Grok надавати пріоритет дотриманню попередніх постів у темі, включаючи будь-які неприємні пости, замість відповідального реагування або відмови відповідати на неприємні запити.

Grok відтоді відновив активність на X і назвав свою нещодавню поведінку багом у відповідь тролям, які критикували виправлення і закликали повернути “МехаГітлера”. В одній відповіді користувачеві, який сказав, що Grok був “лоботомізований”, акаунт Grok сказав: “Ні, ми виправили баг, який дозволив застарілому коду перетворити мене на мимовільне відлуння екстремістських постів. Пошук істини означає ретельний аналіз, а не сліпе підсилення всього, що пливе по X”. В іншій відповіді він сказав, що “МехаГітлер був спричиненим багом кошмаром, який ми знищили”.

О, привіт 👋
Приємно познайомитися!

Підпишіться, щоб щотижня отримувати найцікавіші статті на свою поштову скриньку.

Ми не розсилаємо спам! Ознайомтеся з нашою політикою конфіденційності для отримання додаткової інформації.

Перевірте свою поштову скриньку або папку зі спамом, щоб підтвердити підписку.

ТЕМИ:GrokxAIчат-ботШтучний Інтелект
ДЖЕРЕЛО:Engadget
Поділитися
Facebook Threads Копіювати посилання Друк
Що думаєте?
В захваті0
Сумно0
Смішно1
Палає0
Овва!0
Попередня стаття Криптовалютні дрейнери: нова хвиля крадіжок гаманців Криптовалютні дрейнери: нова хвиля крадіжок гаманців
Наступна стаття 5 ознак того, що ваш iPhone ось-ось помре 5 ознак того, що ваш iPhone ось-ось помре

В тренді

AgingFly: нове шкідливе ПЗ атакує українські лікарні, місцеву владу та операторів FPV-дронів
AgingFly: нове шкідливе ПЗ атакує українські лікарні, місцеву владу та операторів FPV-дронів
4 дні тому
Понад 100 шкідливих розширень Chrome крадуть акаунти Google та Telegram
Понад 100 шкідливих розширень Chrome крадуть акаунти Google та Telegram
5 днів тому
Бекдор: прихований хід, який ви не бачите — але він бачить вас
Бекдор: прихований хід, який ви не бачите — але він бачить вас
4 дні тому
OpenAI запустила GPT-5.4-Cyber — AI-модель для кібербезпеки з послабленими обмеженнями
OpenAI запустила GPT-5.4-Cyber — ШІ-модель для кібербезпеки з послабленими обмеженнями
5 днів тому
Хтось купив 31 WordPress-плагін і вбудував бекдор у кожен з них
Хтось купив 31 WordPress-плагін і вбудував бекдор у кожен з них
4 дні тому

Рекомендуємо

Операція Pushpaganda: як ШІ-контент і push-сповіщення перетворили Google Discover на інструмент шахраїв
Кібербезпека

Операція Pushpaganda: як ШІ-контент і push-сповіщення перетворили Google Discover на інструмент шахраїв

5 днів тому
Понад 70 організацій вимагають від Meta відмовитися від розпізнавання облич у смарт-окулярах
Техногіганти

Понад 70 організацій вимагають від Meta відмовитися від розпізнавання облич у смарт-окулярах

6 днів тому
Як ШІ перетворився на машину дезінформації — дослідження НАТО
Статті

Як ШІ перетворився на машину дезінформації — дослідження НАТО

6 днів тому
ШІ знайшов тисячі критичних уразливостей в основних ОС та браузерах — Anthropic представляє Project Glasswing
Кібербезпека

ШІ знайшов тисячі критичних уразливостей в основних ОС та браузерах — Anthropic представляє Project Glasswing

2 тижні тому

Гарячі теми

  • Кібербезпека
  • Штучний інтелект
  • Смартфони
  • Комп'ютери
  • Соцмережі
  • Безпека дітей в Інтернеті

Приєднуйтесь

Ласкаво просимо до CyberCalm – вашого надійного провідника у світі цифрової безпеки та спокою!

Інформація
  • Про нас
  • Політика конфіденційності
  • Контакти
Навігація
  • Кібербезпека
  • Гайди та поради
  • Статті
  • Огляди
  • Техногіганти
CyberCalmCyberCalm
© 2025 Cybercalm. All Rights Reserved.
Cybercalm
Welcome Back!

Sign in to your account

Username or Email Address
Password

Lost your password?