ИИ-боты повадились рассказывать истории об Элиасе Торне — и никто не знает, кто это такой

ИИ-боты повадились рассказывать истории об Элиасе Торне — и никто не знает, кто это такой — Tech | Versia.media

Программист Дэниел Мэй (Daniel May) одним из первых заметил, что ИИ-боты различных компаний систематически включают в создаваемые ими рассказы некоего Элиаса Торна. Долгое время оставалось загадкой, кем он является на самом деле. Теперь же был опубликован отчет по итогам исследования этого феномена. Вероятнее всего, появление имени Торна в историях, сгенерированных ИИ, связано с работой защитных механизмов нейросетей, внедряемых в процессе их обучения в целях безопасности.

Исследователи из Корнелльского университета в США, Сайл Гамильтон (Sil Hamilton) и Дэвид Мимно (David Mimno), решили разобраться в этом вопросе. Они задействовали несколько ИИ-моделей, включая OpenAI GPT-5.4 Mini, Anthropic Claude Haiku 4.5 и Google Gemini 3.1 Flash Lite, для генерации рассказов на основе пяти различных подсказок. Затем, проанализировав около 20 тыс. созданных ИИ-ботами историй, они выявили удивительное количество повторений.

Выяснилось, что слова «маяк», «смотритель», «пекарь», «мэр», «часовщик», «рыбак», «библиотекарь», «кондуктор», а также имена «Мара», «Элиас» и «Элара» присутствуют в 88 % всех сгенерированных историй. Ни одна другая комбинация из этого ограниченного набора существительных не встречается чаще, чем «Элиас, смотритель маяка». Она была обнаружена в двух третях созданных рассказов.

Так в чем же причина? Изначально исследователи предположили, что это может быть связано с данными, применявшимися для обучения языковых моделей. Однако от этой гипотезы они отказались, не найдя подтверждений того, что фраза «Элиас, смотритель маяка» чрезмерно часто фигурирует в обучающих наборах данных или в литературе.

Исследователи связали данную особенность с конкретным набором данных, который активно использовался для обучения ИИ-моделей разными разработчиками. В качестве примера они привели WildChat — открытый набор данных, включающий миллионы диалогов людей с чат-ботом на базе GPT-3.5. Этот набор был создан, чтобы помочь исследователям понять, как люди взаимодействуют с ботами, но с тех пор его многократно применяли для обучения ИИ-моделей.

По мнению исследователей, рассматриваемая особенность в генерации историй ИИ-ботами обусловлена работой защитных механизмов, которые должны отводить ИИ-модели от защищенных авторским правом персонажей и контента для взрослых. Вероятно, в результате этого и возникли «безопасные» альтернативы, такие как «Элиас, смотритель маяка». Отмечается, что имя Элиас встречается не только в сгенерированных детских сказках, но и в рассказах в жанре фэнтези. Элиас Торн также был найден как автор книг, в том числе справочника с информацией об альтернативных методах лечения рака.

Как бы то ни было, эта странная особенность повествования ИИ-моделей служит хорошим напоминанием о том, что нейросети не обладают креативностью. Проведенное в прошлом году исследование показало, что ИИ-модели создают изображения, попадающие в один из всего 12 конкретных мотивов, независимо от того, насколько необычное описание предоставляет пользователь.

← Tech