DeepSeek-R1, обучение которых обошлось всего в 5,6 миллиона долларов (с затратами на инференс до 6 миллионов долларов), компания изменила курс. В 2025 году появились слухи о выходе на IPO в Гонконге и строительстве дата-центра со 100 000 графических процессоров (GPU). DeepSeek также столкнулся с конкуренцией со стороны Alibaba Cloud (модель Qwen2.5-Max), Moonshot AI (Kimi K2) и Baidu (Ernie 4.5 и Ernie 5.0), но сумел привлечь внимание своей эффективной моделью. В конце 2024 года DeepSeek выпустил DeepSeek-R1, которая стала популярной среди сообщества разработчиков. Компания также внедрила архитектуру смеси экспертов (Mixture-of-Experts, MoE) и многоголовое латентное внимание (Multi-head Latent Attention, MLA), разработав собственные механизмы DeepSeekMoE и DeepSeekMLA. В начале 2025 года в ответ на ценовую войну DeepSeek снизил стоимость использования API на 75% для DeepSeek-R1 и на 50% для DeepSeek-V3, а также представил модель DeepSeek-R2. Одновременно ходили слухи о привлечении 2 миллиардов долларов финансирования от Alibaba Group и планах проведения IPO на сумму до 10 миллиардов долларов.