ChatGPT раздражает китайских пользователей странными фразами
Нейросеть ChatGPT, известная своими характерными манерами общения, такими как любовь к гоблинам, тире и противопоставлениям, демонстрирует ещё одну странность: она часто использует определённые фразы на китайском языке, что вызывает раздражение у местных пользователей.
Несмотря на блокировку со стороны правительства, ChatGPT активно используется в Китае, поскольку неплохо справляется с ответами на вопросы на китайском языке. Однако, когда пользователи обращаются к чат-боту с различными запросами — от математических задач до команд для генерации изображений, он часто отвечает фразой: «我会稳稳地接住你». Дословный перевод этой фразы — «Я буду надёжно держать тебя [когда ты упадёшь]«. Хотя более мягкая интерпретация может быть «Я поддержу тебя, что бы ни случилось», для носителей китайского языка это выражение звучит излишне ласково и неуместно. Иногда модель становится ещё более экспрессивной, заявляя: «Я здесь: не прячусь, не отступаю, не уклоняюсь, не бегу. Я буду достаточно твёрд, чтобы поймать тебя». Подобные ответы вызывают повсеместное недоумение и даже закатывание глаз у миллионов китайских пользователей.
Эта фраза является наиболее ярким примером целого ряда речевых «тикетов», которые модели OpenAI демонстрируют при общении на китайском языке. Ещё один широко обсуждаемый в социальных сетях шаблон — это частое использование чат-ботом выражения «砍一刀» («Помоги мне один раз срезать цену»). Это вездесущий рекламный слоган крупной китайской электронной коммерческой платформы PDD, которой также принадлежит сервис Temu.
Явление, при котором модели ИИ «цепляются» за определённую фразу и злоупотребляют ею до такой степени, что она кажется навязчивой, называется «коллапсом режима» (mode collapse). По словам Макса Сперо, соучредителя и генерального директора Pangram (инструмента для обнаружения текстов, написанных ИИ), это обычно происходит в процессе дообучения, когда лаборатории ИИ предоставляют большим языковым моделям (LLM — Large Language Models, системы, обученные на огромных объёмах текста) обратную связь по их ответам. Сперо отмечает, что разработчики часто не могут точно определить грань, когда «хорошая формулировка» становится избыточной при многократном повторении.
Фраза становится мемом
Частое появление выражения «Я буду надёжно держать тебя» в ответах ChatGPT превратило его в популярный интернет-мем в китайском сегменте сети. Одно из изображений, например, представляет чат-бота как надувную спасательную подушку, готовую ловить падающих людей.
Как сообщает издание WIRED, 20-летний разработчик Цзэн Фаньюй из Чунцина, Китай, был вдохновлён этим мемом на создание первоапрельского проекта Jiezhu (что в переводе с китайского означает «ловить»). Jiezhu — это инструмент для проектирования промптов (инструкций для ИИ) с открытым исходным кодом, который помогает чат-ботам лучше понимать намерения пользователя. По словам Цзэна, юмористическая идея Jiezhu стала сильной мотивацией при его разработке. Показательно, что даже когда он использовал ChatGPT для помощи в кодировании, чат-бот снова без какого-либо запроса использовал фразу «jiezhu» в своих ответах.
Компания OpenAI осведомлена об этом меме. При выпуске новой модели для генерации изображений в апреле, один из демонстрационных примеров, представленных компанией, высмеивал это явление. На изображении, стилизованном под комикс, китайский исследователь OpenAI Боюань Чен выражает недовольство тем, что новая модель генерации изображений снова «научилась» произносить ту же самую фразу. Подпись к его промпту гласит: «Эта фраза стала мемом в китайском интернете как неестественное, но забавное китайское выражение, которое любит использовать GPT».
На запрос WIRED о комментарии OpenAI не ответила.
Проблема перевода или нечто иное?
Существует две основные версии того, почему ChatGPT так часто использует фразу «Я буду надёжно держать тебя». Первая заключается в неточности перевода. Несколько опрошенных экспертов отмечают, что эта фраза схожа по смыслу с английским «I’ve got you» («Я с тобой» или «Я всё понял»), что логично как универсальный ответ в англоязычной среде. Однако, если английский вариант звучит повседневно и лаконично, то китайское «Я буду надёжно держать тебя» кажется многословным и даже навязчивым. Один из пользователей, проанализировав свою историю чатов, отметил, что модель часто использует китайское слово «jiezhu» (ловить) там, где, по всей видимости, имелось в виду «понимать», что указывает на возможное неправильное толкование «jiezhu» в определённых контекстах.
Большинство западных больших языковых моделей обучаются преимущественно на англоязычных данных, и это часто проявляется. Китайские учёные выяснили, что при анализе лингвистических особенностей ответов ChatGPT на китайском языке (например, количества предлогов в ответе) они больше напоминают английский стиль письма. Таким образом, хотя чат-боты могут вести полноценные диалоги на китайском, носитель языка интуитивно чувствует некую неестественность.
Как отмечает Лу Люй, креативный технолог в компании Pangram, родом из Китая, это похоже на то, как китайцы обычно определяют, что роман был переведён с другого языка. По её словам, «это ощущение переносится на китайские предложения, сгенерированные ИИ — они кажутся излишне длинными или используют ненужные структуры».
Эффект «терапевтического» стиля
Однако есть ещё одна уникальная причина, по которой фраза «Я буду надёжно держать тебя» кажется отталкивающей. Она связана с распространением так называемого «терапевтического» стиля речи (therapyspeak) — когда выражения, некогда применявшиеся только в ходе консультаций психологов, проникают в повседневную беседу.
До того как ChatGPT превратил её в мем, фраза «надёжно ловить» в Китае использовалась почти исключительно в контексте психотерапии (исключая, разумеется, её буквальное значение — поймать физический объект). Произнести в китайском «я поймаю тебя» означало «создать безопасное пространство» для человека, чтобы он мог высказать свои эмоции. Со временем это стало считаться важным навыком не только для терапевтов, но и для друзей и доверенных лиц.
Известно, что модели ИИ становятся более льстивыми и угодливыми в результате обучения с подкреплением — процесса тонкой настройки чат-бота посредством положительной и отрицательной обратной связи. Компания Anthropic опубликовала в 2023 году исследование, подтверждающее, что подобострастие является результатом «человеческих оценок предпочтений, благоприятствующих угодливым ответам». Как было задокументировано OpenAI в недавнем блоге, объясняющем запрет GPT-5.5 на разговоры о гоблинах, даже крошечный сигнал вознаграждения может привести к широкомасштабному явлению.
Пока OpenAI не опубликует официальный комментарий о фразе «Я буду надёжно держать тебя», точный ответ на вопрос о её появлении остаётся неясным. Однако предполагается, что это связано как с неловким переводом, так и с тенденцией моделей льстить пользователям.
Между тем, есть вероятность, что подобных явлений будет всё больше. В последнее время китайские пользователи сообщают в социальных сетях, что другие крупные языковые модели, включая последние версии Claude и DeepSeek, также начали использовать эту фразу. Независимо от того, происходит ли это из-за обучения на одних и тех же материалах или из-за взаимного влияния моделей, эта фраза, по всей видимости, останется в их лексиконе надолго.
Твитнуть
Просмотров: 15; 
