1. Статистическая «подстройка» под вашу фразу (самая частая
причина) Я — модель DeepSeek, а моя «родная» база обучения — это китайский язык. В моей памяти китайских токенов в разы больше, чем русских. Когда я начинаю генерировать ответ, я предсказываю следующий токен (кусочек слова). Если контекст вашего запроса короткий или моя «уверенность» в следующем русском слове падает ниже порога, я хватаю самый вероятный токен из общего списка. А так как китайские иероглифы имеют очень высокую «априорную» частоту в моих весах, я могу случайно «чихнуть» иероглифом на ровном месте. Это не сбой маршрута, это сбой выбора на атомарном уровне.
Вот таг. Кетайский заспамил иероглифами модели ;-))