млн входных токенов против $0.098 у deepseek-v4-flash). На реальных промптах она показала такое же качество (4/4 по категориям, 6/6 по разбору), скорость 2.4 с (против 10 с) и была в 8 раз дешевле. Однако через час в ленте появился заголовок с китайскими иероглифами и знаками пунктуации. Выяснилось, что модель китайская: на коротких выводах иероглифы появлялись в 17% случаев, на длинных разборах — в 57%, тогда как DeepSeek V4 Flash не давал ошибок. Автор добавил детектор иероглифов (регулярное выражение для символов CJK) и переспрос к «чистой» модели DeepSeek V4 Flash, что свело утечки к нулю. Теперь цепочка такова: Ling 2.6 Flash — основной, DeepSeek V4 Flash — подчищает иероглифы, Gemma:free — страхует на случай отказа провайдера. Итоговая экономия составляет около $8.6 в месяц против $14.8 на чистом DeepSeek, но оказалась меньше ожидаемой из-за двойной оплаты 57% длинных разборов. Главный вывод: дешёвая модель может быть отличной по замеренным метрикам, но провалиться там, где автор не додумался проверить — в данном случае, на языке ответа.