本文写于 2025-01-28,保留当时的行业背景、事实认知与个人判断。模型数据、排行榜和市场状态均可能已经变化;文中的市场观点不构成投资建议。
前言:
最近DeepSeek模型因其强大的性能和极低的训练成本引发了广泛讨论,无论是专业领域还是大众社区,都充满了各种声音——有无脑吹捧的,也有不负责任的抹黑质疑。这样的争论有时确实验证了那句“屁股决定脑袋”。作为一名从事大模型研究的从业者,我希望通过中立且尽量全面的视角,来聊聊这次引发热潮的DeepSeek的模型,为大家提供一个理性思考的参考(蹭个热度)。
这篇文章适合那些对技术和模型背后价值感兴趣的读者,而非仅仅寻求情绪价值的人。如果你也希望了解DeepSeek的一些技术对比和意义,欢迎继续阅读。
先聊一波DeepSeek出圈的V3和R1模型的事实:
DeepSeek-V3:
DeepSeek V3是一个具备Mixture-of-Experts架构的开源大语言模型,训练资源只用到了2048张H800 GPU,两个月便完成了280万GPU小时的训练,总成本不到600万美元。相比LLaMA 3 405B模型需要11倍的成本,V3展示了在算法优化和资源效率上的极致追求。
DeepSeek-R1:
R1最大的技术亮点在于通过强化学习(RL)方法替代传统的“监督微调+RLHF”路径。这种技术路线在行业内近两年一直被讨论,而DeepSeek R1的成功实现,证明了这种方向的可行性。不仅性能跑分齐平GPT-o1,在资源需求上也大幅降低。(有兴趣可以看看《RLHF并不是RL》https://x.com/karpathy/status/1821277264996352246)。
这边扩展一些想法:现在AI的学习主要有两种,1是模仿学习,比如大模型的预训练和SFT,可以理解成孩子小时候学习知识的时候的死记硬背;2是通过强化学习(RL)来达成目标,比如Alpha Go时刻,可以理解成孩子学会一些知识之后,用这些知识不停的正确解决新的问题。显然第二种学习是产生质变的根本。而对于大模型的RL其实是很难的,我们可以用RL来做数学、代码、下棋等等,因为这些都有明确的答案,但写一篇作文,怎么样算是正确答案呢?扩展到这些领域其实还有很多的点需要突破。
我不太喜欢看各种跑分,因为基本都能刷分,但 Arena 榜单的评分还是很值得参考。

再聊一些八卦说法的可信度:
1、DeepSeek是否在资源使用上撒谎?
很多人听了V3训练的资源就觉得难以置信,开始怀疑DeepSeek是否没有说实话,尤其是很多人扒出来DeepSeek的母公司幻方量化其实手里有很多的H100,但H100因为美国的芯片管制其实是无法通过正常渠道进入中国的,所以严厉点的指控直接说DeepSeek说谎,好一点的怀疑也有说他们是在H100上训练完之后,再用H100和H800混合训练的。
我的观点:对于“DeepSeek是否在资源使用上撒谎”的质疑,我认为其技术报告的可信度依然很高,但这并不意味着算力需求变得不重要。DeepSeek团队能够在有限资源中实现高性能,很大程度上依赖于算法和数据优化。而母公司幻方量化的技术基因也在其中发挥了关键作用。LLM的训练仍然需要大型GPU集群,如果你想要节省资源,你必须保证你不浪费,在数据和算法层面有大量的工作要做。幻方本来就是做量化交易的,量化在基础设施方面追求极致的程度不比大模型差,他们有这样的团队能够想着怎么把光缆修的更短,机房搬的离交易所更近,把量化的每次交易延迟卷到纳秒。所以现在DeepSeek团队把每张卡的能效压榨到极致也是能够理解的。
希望川建国同学不要因为这一波连H800的卡也开始对我们封禁了。
2、DeepSeek代表这东大赢麻了?
只能说很让人开心,我们还有这么多追求极致的研究人员,以及还能看到这样的公司存在。有兴趣的同学可以去了解一下DeepSeek的人才招聘/培养体系。DeepSeek这次真的很强,在芯片被限制的情况下做出了这么惊艳的成绩。但其实他们真正做出这个产品的人员很清晰知道还有多少差距,可以看看被雷总挖走的AI天才少女罗福莉的态度就知道,非常的踏实谦虚。
DeepSeek的模型能这么顺利的做出来,少不了GPT带来的数据和方向指引,每一次出新的功能,我们的逆向工程就开始了。比如上午o1发布,下午DeepSeek就让o1吐出了整个思考过程,到晚上就有了上万条数据了。当然R1在RL方面的探索这次DeepSeek就是走在了前面,相信我们还有很多团队默默的在探索着更多的创新路子。而看美国那边,tesla的FSD其实也是大模型,视觉方面的;李飞飞团队的World Labs也在做空间智能模型。如果我们都是等他们做出来了之后再来逆向工程并且复刻,那么我们并不算自豪的说遥遥领先。当然不否认这需要时间去追赶,很开心DeepSeek让大家看到了我们还是有很多踏实的科研人才在默默的为之努力。
我个人更倾向于认为这是一次开源的胜利,OpenAI已经不如创办时候那么纯粹了,所以也有人戏称OpenAI->CloseAI, DeepSeek -> new OpenAI,确实很形象。那么,非要说打了谁的脸呢?某李姓帅哥伸出你的脸来吧,每次起个大早!
3、DeepSeek凭一己之力带崩美股?
确实,昨晚美股科技股惨不忍睹,英伟达收盘跌16.97%。所有人都觉得是DeepSeek的消息导致大家对AI算力的需求产生了怀疑,所以大科技泡沫被刺破。
但,如果你是一个美股投资者,你应该知道,英伟达过去几年涨的多么疯,华尔街需要一些负面消息来打压股价,现在英伟达的股价本来就有泡沫,那么来了个负面消息当然是最好的时机了。我并不认为是因为DeepSeek让投资者对算力需求产生怀疑而导致的下跌,而是华尔街想要打压股价趁这个时候制造一些情绪让股价回落,以便长期稳步的拉升。所以到写稿为止夜盘已拉升5%了,没有什么恐慌,很快就涨回来的(控制好仓位可以加仓了)。所以不要听什么DeepSeek一己之力带崩美股的情绪消息,先管好缅A吧。
收工,除夕夜,聊了这一波AI界的大事件,希望大家在新的一年里继续关注技术前沿,同时也能感受到科研带来的价值与乐趣。祝大家新年快乐!!!