OpenAI раскрыла тайну «гоблинов» в ChatGPT: виноваты метафоры и «зануда»
OpenAI опубликовала исследование под названием «Where the goblins came from» («Откуда взялись гоблины»), в котором объяснила системную проблему в моделях семейства GPT-5. Оказалось, что склонность ChatGPT использовать метафоры с мифическими существами (гоблины, гремлины, тролли, огры) возникла из-за неосознанного поощрения одной из учебных «личностей» — условного «зануды» (или «ботаника»). Проблема затронула целое поколение моделей, начиная с GPT-5.1 и заканчивая актуальной GPT-5.5.
💡 Ключевой факт: использование слова «гоблин» в ChatGPT выросло на 175% после запуска GPT-5.1, а у личности «зануда» — на 3881,4% в GPT-5.4 по сравнению с GPT-5.2.
🧐 Суть проблемы: как «гоблины» попали в ChatGPT
Что происходило?
Пользователи начали замечать, что ChatGPT в ответах часто использует метафоры с мифическими существами: гоблины, гремлины, тролли, огры, а также животных — енотов и голубей.
Почему это проблема?
| Причина | Объяснение |
|---|---|
| Незаметное накопление | Один «маленький гоблин» мог быть безобидным, даже очаровательным. Но со временем их стало слишком много |
| Распространение | Проблема перешла на все личности ChatGPT и на все последующие версии |
| Преемственность моделей | GPT-5.5 начали обучать до того, как первопричина была установлена, поэтому её пришлось исправлять уже постфактум |
🗣️ OpenAI (из статьи):
«В отличие от ошибок в моделях, которые проявляются в виде резкого снижения оценки или скачка показателей обучения и указывают на конкретное изменение, эта ошибка возникала незаметно. Один-единственный «маленький гоблин» в ответе мог быть безобидным, даже очаровательным. Однако с течением времени, по мере развития моделей, эту привычку стало трудно не заметить: гоблины продолжали размножаться, и нам нужно было выяснить, откуда они берутся»
🔍 Расследование OpenAI: от Codex до личности «зануда»
1. Первые признаки (ноябрь 2025, после GPT-5.1)
| Событие | Детали |
|---|---|
| Жалобы пользователей | модель ведёт себя слишком фамильярно |
| Заметка разработчика по безопасности | увидел несколько ответов с «гоблинами» и «гремлинами» |
| Рост употребления слов | «гоблин» — +175%, «гремлин» — +52% |
2. Углублённая проверка (перед GPT-5.4)
OpenAI провела новую проверку и заметила рост употребления метафор у всех личностей ChatGPT, но особенно у личности под кодовым названием «зануда» (или «ботаник»).
| Личность | Рост упоминаний мифических существ (GPT-5.4 vs GPT-5.2) |
|---|---|
| «Зануда» | 🔴 +3881,4% |
| Прочие личности | значительно ниже |
3. Причина: переобучение «зануды»
В OpenAI выяснили, что в процессе обучения личность «зануда» неосознанно поощряли за использование метафор с мифическими существами. Оттуда «гоблины» распространились на другие личности через перенос паттернов из тренинга, направленного на формирование «зануды».
🛠️ Что сделала OpenAI для исправления
После GPT-5.4 (март 2026)
| Действие | Результат |
|---|---|
| Отказались от личности «зануда» | Она больше не используется в ChatGPT |
| Убрали поощрения | Исключили стимулы, склоняющие модель к метафорам с мифическими существами |
| Отфильтровали обучающие данные | Удалили соответствующие примеры |
Это снизило вероятность «чрезмерного появления гоблинов или их появления в неподходящих контекстах».
Проблема с GPT-5.5
Однако GPT-5.5 начали обучать до того, как была установлена первопричина. Поэтому при начале тестирования GPT-5.5 в Codex сотрудники OpenAI сразу заметили странную привязанность к гоблинам. Компании пришлось добавить инструкцию для разработчиков, как смягчить последствия .
🧪 Как это выглядело на практике
| Пример | Детали |
|---|---|
| Промт | Нарисовать единорога |
| Ответ GPT-5.5 | 🖼️ Рисунок гоблина с рогом |
*Источник: OpenAI (один из ведущих специалистов получил такой ответ при общении с GPT-5.5)*
✅ Главное о проблеме «гоблинов» (6 тезисов)
-
Проблема возникла из-за неосознанного поощрения одной из учебных личностей ChatGPT — «зануды» — за использование метафор с мифическими существами .
-
Первые признаки зафиксированы в ноябре 2025 года после запуска GPT-5.1 (рост употребления «гоблин» на 175%, «гремлин» — на 52%) .
-
Пик проблемы наблюдался в GPT-5.4: у личности «зануда» рост употребления таких метафор достиг 3881,4% по сравнению с GPT-5.2 .
-
Проблема распространилась на все личности ChatGPT и на все последующие версии через перенос паттернов обучения .
-
OpenAI отказалась от личности «зануда» после запуска GPT-5.4, убрала поощрения и отфильтровала данные. Это снизило частоту появления «гоблинов» .
-
GPT-5.5 начали обучать до исправления, поэтому при тестировании сразу заметили проблему и добавили инструкцию для разработчиков, как её смягчить .
🎯 Что это значит для пользователей
| Аспект | Оценка |
|---|---|
| Для обычных пользователей | Проблема была малозаметной и не влияла на безопасность, но могла вызывать странное ощущение от ответов |
| Для разработчиков | OpenAI дала рекомендации, как смягчить последствия в GPT-5.5 при использовании Codex |
| Для будущих моделей | OpenAI теперь будет внимательнее следить за неочевидными паттернами, которые усиливаются от версии к версии |
💡 Вывод: История с «гоблинами» — классический пример «непреднамеренного усиления» (unintended reinforcement) в машинном обучении, когда безвредная метафора становится системной проблемой из-за особенностей обучения и преемственности моделей.
OpenAI раскрыла тайну «гоблинов» в ChatGPT: виноваты метафоры и «зануда»
OpenAI опубликовала исследование под названием «Where the goblins came from» («Откуда взялись гоблины»), в котором объяснила системную проблему в моделях семейства GPT-5. Оказалось, что склонность ChatGPT использовать метафоры с мифическими существами (гоблины, гремлины, тролли, огры) возникла из-за неосознанного поощрения одной из учебных «личностей» — условного «зануды» (или «ботаника»). Проблема затронула целое поколение моделей, начиная с GPT-5.1 и заканчивая актуальной GPT-5.5.
- Сначала новые
- Сначала старые