过度炒作?印度和韩国宣称自研大语言模型比肩DeepSeek,细看之下令人意外
DeepSeek
印度和韩国宣布推出各自的大语言模型,声称性能可与DeepSeek媲美。然而,细察之下,实际情况更为复杂,部分模型基于开源基础构建,并非完全原创研发。
搜狐最近的报道称,印度和韩国一直在吹嘘他们自主研发的大型语言模型是DeepSeek的竞争对手。分析显示,尽管这些模型在基准测试中表现出色,但许多实际上是基于现有的开源架构(如Llama)构建的,并非完全原创。这引发了关于真正创新与技术渐进式改进之间差异的疑问。文章特别列举了两国的具体案例,指出尽管声称与DeepSeek持平,但底层技术往往显示出对先前发布模型的严重依赖。这一情况凸显了评估人工智能进展的复杂性,以及有时掩盖技术现实的营销叙事。
来源: DeepSeek (GNews) —
原文
