> 自媒体 > (AI)人工智能 > DeepSeek 的“修炼”之路,还要闯几关?
DeepSeek 的“修炼”之路,还要闯几关?
来源:新华社
2025-03-21 08:32:35
345
管理

DeepSeek 的“修炼”之路,还要闯几关?

半月谈记者 张漫子

以小博大、逆袭吊打,曾是修仙爽文、微短剧里让人上头却略显荒诞的剧情,而今,DeepSeek(深度求索)让它在真实世界里发生了。

火爆全球超过一个月,DeepSeek掀起的风暴还在持续,随之而来的还有一波三折的戏码,同行的围剿、跨界的争议……正如影视作品中每一位“爽文大女主”升级打怪时所面对的关卡一样。

誉满天下,谤亦随之,DeepSeek的“修炼”之路,还要闯几关?

“爽文大女主”出三招

悄悄推出两款模型,即引发硅谷与华尔街的剧烈震荡,让OpenAI接连推出竞争产品并免费开放搜索,谷歌一股脑儿发布“满血版全家桶”,国内大厂的旗舰模型也开始免费开放。

深有“天上掉馅饼”之感的万千普通用户,倒是想给DeepSeek送锦旗了,不过,大家也想知道,凭一己之力就把曾经高不可攀的全球最顶级大模型的价格打下来了,究竟用了什么招?

——“乱”拳打伤老师傅。从架构到工程,从算法到部署,DeepSeek悟透的是“四两拨千斤”的中国武术古训,不理会“参数规模决定论”,反倒是秀出了数据质量优化与算法架构创新的乘数效应,在看似不可能的壁垒中突围。

——拆掉半壁卫城墙。一般来说,大模型开发者用了英伟达的GPU,也就得用他家的运算平台CUDA搞研发。毕竟CUDA已经封装好一些函数,后来者使用时直接调用接口搞加工就行,这样的低门槛当然方便资源有限的开发者,但是,这也意味着深度研发执行效率的折扣。

绕过CUDA,直接基于GPU的驱动函数开发,行不行?DeepSeek给出了肯定的答案。凭借独到软件算法优化,拆掉英伟达“卫城墙”,也就是不必仰赖其CUDA生态行事,DeepSeek走出了一条中国AI技术创新的新路子。

——小力也能出奇迹。自从OpenAI的ChatGPT发布以来,微软、谷歌、Meta等科技巨头一直在增加与人工智能相关的算力支出。“军备竞赛”式的投入,也催动了美国AI芯片股价一路攀升。

就当行业仍困囿于“算力军备竞赛”的思维定式之际,DeepSeek凭借区区558万美元训练成本就让V3模型达到了GPT-4o九成功力,R1模型更实现以纯强化学习突破推理能力边界,向世界证明,AI大模型的革命,不一定要靠算力堆出来。

是幻觉还是“真香”

DeepSeek的小而精、强且美,是炒作出来的“幻觉”,还是厚积薄发而得的“真香”?

自从在AI江湖中亮出名号,DeepSeek就不满足于追随者,这可以从其开发的一系列原创技术获得证明。MLA、GRPO、R1-Zero……门外汉对着这些字母大概会如坠五里雾中,但是,这些技术合力激发的“聚变”,恐怕是DeepSeek获得140多个国家用户认可的根本原因。

北京白领小游说,DeepSeek的回答不像GPT的回答那么干巴巴,像个只会写材料的书呆子,按部就班安排任务步骤,而像个鬼马精灵,只要你说明目的,她就能拆解和揣摩你的弦外之音、思考怎么实现你想要的:“甚至你可以问她一些你都没有答案的大问题。”

当然,DeepSeek依然在蓬勃的成长期。以最新的DeepSeek-R1为例,虽然其突破鼓舞人心,但学术界用起来还不免有点头疼——面对悠远文明时间中的复杂因果,现代学术论述的复杂规范,DeepSeek的回答还不免左支右绌。

而且,DeepSeek暂时还不谙图像处理,回应大规模用户需求也有“体力不支”的情况,这些困难都意味着,DeepSeek的修炼,“高原期”刚刚开始。

如何学习文明的智慧

技术革命的浪潮里,没有永恒的王者,只有不断的超越。具体到AI领域,大家的共识更是:充满不确定性、一直充满热度、但不乏过度反应。

无休止的波动,折射出的,其实是科技进化的深层图像——人工智能,就好像之前种种引发文明革命的重大科技进展一样,前进路线并非笔直的线性轨迹,而是永恒的螺旋。

谁来驱动这螺旋?不论DeepSeek参演的是爽剧还是正剧,角色与剧本背后的导演还是人类自己。

如果说AI是普罗米修斯之火,那么人类文明就是在自我颠覆中奔流不息、江声浩荡的赫拉克利特之河。我们最珍贵的不是回答和解决已有问题的能力,而是发现新问题的智慧、定义新问题的勇气——这更需要创造性与想象力。

DeepSeek式创新的下一次突破,其通关密码,就生成于回向文明深处寻求思考变革的努力中。以文明赋能人工智能,人工智能的“飞升”时刻,也许就会到来。

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
三菱退出中国?官方回应:将与现有伙伴继续合作
6月23日,有媒体报道称,三菱汽车将逐步取消包括欧洲、中国在内的市场业..
2026款三菱帕杰罗曝光,第二代超选四驱+2.4T/2.0T双动力..
硬派越野圈的“老将”居然换小排量了?2026款三菱帕杰罗刚露出消息,就把..
恩智浦计划退出5G功率放大器业务;三星或将退出SATA SSD市场;三菱化学出售..
五分钟了解产业大事每日头条芯闻 恩智浦计划退出5G功率放大器业务我国首..
实拍三菱全新欧蓝德!搭1.5T四缸,内饰配大屏,不比奇骏香?..
在重庆车展上,全新一代三菱欧蓝德终于在国内亮相了,相比其国外的发布时..
试驾广汽三菱奕歌:小巧灵动
■ 阅车试驾车型:广汽三菱奕歌长/宽/高(mm):4405/1805/1685轴距(mm..
新车 | 四驱越野MPV/配侧滑门/2.2T柴油机,新款三菱Delica D:5亮相..
文:懂车帝原创 高帅鹏[懂车帝原创 产品] 日前,2025东京车展开幕,新款..
三菱集团的传奇发家史
“三菱”两个字,在日本就像一把瑞士军刀:银行、飞机、汽车、火箭、寿司..
2026款三菱Montero曝光,S-AWC四驱+差速锁全配,普拉多见了..
当 “普拉多见了都得慌” 的话题在越野圈炸锅,2026 款三菱 Montero 的曝..
日韩巨擘数据,三星2.1万亿三菱21万亿,中国第一谁?..
图片来源于网络2025年,让人火大的资本较量又来一波。韩国三星手里握着2...
关于作者
横道不笑(普通会员)
文章
1710
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263552 电子证书1157 电子名片68 自媒体91237

@2022 All Rights Reserved 浙ICP备19035174号-7
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索