OpenAI раскрыла тайну «гоблинов» в ChatGPT: виноваты метафоры и «зануда»

OpenAI раскрыла тайну «гоблинов» в ChatGPT: виноваты метафоры и «зануда»

OpenAI опубликовала исследование под названием «Where the goblins came from» («Откуда взялись гоблины»), в котором объяснила системную проблему в моделях семейства GPT-5. Оказалось, что склонность ChatGPT использовать метафоры с мифическими существами (гоблины, гремлины, тролли, огры) возникла из-за неосознанного поощрения одной из учебных «личностей» — условного «зануды» (или «ботаника»). Проблема затронула целое поколение моделей, начиная с GPT-5.1 и заканчивая актуальной GPT-5.5.

 

💡 Ключевой факт: использование слова «гоблин» в ChatGPT выросло на 175% после запуска GPT-5.1, а у личности «зануда» — на 3881,4% в GPT-5.4 по сравнению с GPT-5.2.

 


 

🧐 Суть проблемы: как «гоблины» попали в ChatGPT

 

Что происходило?

 

Пользователи начали замечать, что ChatGPT в ответах часто использует метафоры с мифическими существами: гоблины, гремлины, тролли, огры, а также животных — енотов и голубей.

 

Почему это проблема?

 

Причина Объяснение
Незаметное накопление Один «маленький гоблин» мог быть безобидным, даже очаровательным. Но со временем их стало слишком много
Распространение Проблема перешла на все личности ChatGPT и на все последующие версии
Преемственность моделей GPT-5.5 начали обучать до того, как первопричина была установлена, поэтому её пришлось исправлять уже постфактум

 

 

🗣️ OpenAI (из статьи):
«В отличие от ошибок в моделях, которые проявляются в виде резкого снижения оценки или скачка показателей обучения и указывают на конкретное изменение, эта ошибка возникала незаметно. Один-единственный «маленький гоблин» в ответе мог быть безобидным, даже очаровательным. Однако с течением времени, по мере развития моделей, эту привычку стало трудно не заметить: гоблины продолжали размножаться, и нам нужно было выяснить, откуда они берутся»

 


 

🔍 Расследование OpenAI: от Codex до личности «зануда»

 

1. Первые признаки (ноябрь 2025, после GPT-5.1)

 

Событие Детали
Жалобы пользователей модель ведёт себя слишком фамильярно
Заметка разработчика по безопасности увидел несколько ответов с «гоблинами» и «гремлинами»
Рост употребления слов «гоблин» — +175%, «гремлин» — +52%

 

 

2. Углублённая проверка (перед GPT-5.4)

 

OpenAI провела новую проверку и заметила рост употребления метафор у всех личностей ChatGPT, но особенно у личности под кодовым названием «зануда» (или «ботаник»).

 

Личность Рост упоминаний мифических существ (GPT-5.4 vs GPT-5.2)
«Зануда» 🔴 +3881,4%
Прочие личности значительно ниже

 

 

3. Причина: переобучение «зануды»

 

В OpenAI выяснили, что в процессе обучения личность «зануда» неосознанно поощряли за использование метафор с мифическими существами. Оттуда «гоблины» распространились на другие личности через перенос паттернов из тренинга, направленного на формирование «зануды».

 


 

🛠️ Что сделала OpenAI для исправления

 

После GPT-5.4 (март 2026)

 

Действие Результат
Отказались от личности «зануда» Она больше не используется в ChatGPT
Убрали поощрения Исключили стимулы, склоняющие модель к метафорам с мифическими существами
Отфильтровали обучающие данные Удалили соответствующие примеры

 

 

Это снизило вероятность «чрезмерного появления гоблинов или их появления в неподходящих контекстах».

 

Проблема с GPT-5.5

 

Однако GPT-5.5 начали обучать до того, как была установлена первопричина. Поэтому при начале тестирования GPT-5.5 в Codex сотрудники OpenAI сразу заметили странную привязанность к гоблинам. Компании пришлось добавить инструкцию для разработчиков, как смягчить последствия .

 


 

🧪 Как это выглядело на практике

 

Пример Детали
Промт Нарисовать единорога
Ответ GPT-5.5 🖼️ Рисунок гоблина с рогом

 

 

*Источник: OpenAI (один из ведущих специалистов получил такой ответ при общении с GPT-5.5)*

 


 

✅ Главное о проблеме «гоблинов» (6 тезисов)

 

  1. Проблема возникла из-за неосознанного поощрения одной из учебных личностей ChatGPT — «зануды» — за использование метафор с мифическими существами .

  2. Первые признаки зафиксированы в ноябре 2025 года после запуска GPT-5.1 (рост употребления «гоблин» на 175%, «гремлин» — на 52%) .

  3. Пик проблемы наблюдался в GPT-5.4: у личности «зануда» рост употребления таких метафор достиг 3881,4% по сравнению с GPT-5.2 .

  4. Проблема распространилась на все личности ChatGPT и на все последующие версии через перенос паттернов обучения .

  5. OpenAI отказалась от личности «зануда» после запуска GPT-5.4, убрала поощрения и отфильтровала данные. Это снизило частоту появления «гоблинов» .

  6. GPT-5.5 начали обучать до исправления, поэтому при тестировании сразу заметили проблему и добавили инструкцию для разработчиков, как её смягчить .

 


 

🎯 Что это значит для пользователей

 

Аспект Оценка
Для обычных пользователей Проблема была малозаметной и не влияла на безопасность, но могла вызывать странное ощущение от ответов
Для разработчиков OpenAI дала рекомендации, как смягчить последствия в GPT-5.5 при использовании Codex
Для будущих моделей OpenAI теперь будет внимательнее следить за неочевидными паттернами, которые усиливаются от версии к версии

 

 

💡 Вывод: История с «гоблинами» — классический пример «непреднамеренного усиления» (unintended reinforcement) в машинном обучении, когда безвредная метафора становится системной проблемой из-за особенностей обучения и преемственности моделей.

Фото
DrafterТехнологии и медиа

OpenAI раскрыла тайну «гоблинов» в ChatGPT: виноваты метафоры и «зануда»

OpenAI опубликовала исследование под названием «Where the goblins came from» («Откуда взялись гоблины»), в котором объяснила системную проблему в моделях семейства GPT-5. Оказалось, что склонность ChatGPT использовать метафоры с мифическими существами (гоблины, гремлины, тролли, огры) возникла из-за неосознанного поощрения одной из учебных «личностей» — условного «зануды» (или «ботаника»). Проблема затронула целое поколение моделей, начиная с GPT-5.1 и заканчивая актуальной GPT-5.5.

Сначала новые
  • Сначала новые
  • Сначала старые