> 自媒体 > (AI)人工智能 > DeepSeek R2要来了!大摩率先曝光,参数翻倍、推理成本暴降88%
DeepSeek R2要来了!大摩率先曝光,参数翻倍、推理成本暴降88%
来源:人人都是产品经理
2025-08-30 10:21:50
91
管理

最近,摩根士丹利的一份研报提前曝光了R2的关键信息,引发了业内的广泛关注。本文将为你详细解读DeepSeek R2的核心亮点,供大家参考。

DeepSeek R2模型终于有新消息了!

最近,顶级投行摩根士丹利发布了一则研报,提前曝光了DeepSeek即将发布的全新一代模型——R2。

这个研报篇幅不长,但信息巨大。话不多说!快跟着乌鸦君一起来看看吧。

01 两大核心亮点:参数翻倍,价码暴跌88%

这次R2的核心变化有两个:参数翻倍和成本下降。

先说前者,R2 模型的体量直接飙到1.2万亿参数,是之前 R1 的两倍多,活跃参数也从370亿 涨到了780亿,推理时调用更多“脑细胞”,意味着模型思考得更深,输出质量自然也水涨船高。

这种思路,其实和 Google 的 Gemini、Anthropic 的 Claude 类似——通过增加每次调用中参与运算的参数量来增强推理质量。例如,Gemini 2.5 Pro使用的Token比R1-0528多30%。

虽然这会提升计算成本,但对于终端用户来说,换来的是更聪明、更会“想事”的模型,值了。

另一大变化是,模型成本更便宜了。

根据大摩消息,R2的每百万Token输入成本只有0.07美元,比R1的0.15-0.16美元下降了一半还多;输出成本更厉害,从原先R1模型的其每百万Token2.19美元,大幅下降到0.27美元。

这个价格远远低于OpenAI的GPT-4o等最先进的模型。GPT-4o的API定价为输入每1百万个Token2.50美元,输出每1百万个Token 10.00美元。

也就是说,R2的价格比GPT-4o等最先进的模型便宜了97%。

对创业公司、开发者、企业来说,这无疑是巨大诱惑:不仅推理效果强,还能把使用成本打到地板价,商业化空间大大拓宽。

除了参数和价格,R2还有三大升级亮点:

1)多语言推理和代码生成能力大幅提升。据说,DeepSeek正在优先提升R2的编码能力,以及英语以外语言的能力,以扩大该模型对全球受众的潜在影响和适用性;

2)引入了更高效的 MoE混合专家架构,推理效率更高,激活参数选择更智能。该架构将人工智能模型分成独立的子网,这些子网根据输入选择性地激活。这种方法可以显著降低预训练的计算成本,并实现更快的推理性能;

3)多模态支持更强,视觉能力也比之前更上一个台阶;

简单来说,R2不仅“想得更深”,还能“看得更清楚”。

在性能提升的同时,DeepSeek也正在摆脱对H100的依赖,实现本土算力突破。

据大摩透露,这次 DeepSeek 并没有依赖传统的 NVIDIA H100 芯片,而是用上了华为的昇腾910B芯片集群。虽然生态上华为还追不上英伟达,但这已经是国产芯片参与大模型实战的重要突破了。

DeepSeek正在努力建立一个本地硬件供应链,以减少对美国制造的芯片的依赖。时至今日,R2模型背后已经形成了一个强大的本土供应链体系。

02 版本优化刚刚完成,R2还得等等?

目前,DeepSeek的模型家族主要有三大产品:

V系列(V1~V4):通用大模型,全面覆盖推理、效率、Agent能力;R系列(R1 → R2):专注深度推理、数学、工具链整合等能力;Prover-V2:一个为数学生成专门优化的模型;

其中,DeepSeek-Prover-V2于今年4月发布的新模型。Prover-V2并非通用的模型,而是一个高度专业化的数学证明模型,基于DeepSeek V3,采用了改进的MoE架构和压缩的kV缓存以减少内存消耗。

抛开新发布的数学证明模型,DeepSeek的大模型升级路线主要有条:

V4:作为通用模型主线的全面迭代,强调推理性能、效率与 Agent 化能力的提升;R2:作为 Reasoner 专线的强化升级,对标 OpenAI的o3后续迭代模型和 Gemini 2.5 Pro 0605&正式版&未来的Gemini 3,进一步提升数理 工具链 多步推理表现;

从过去看,DeepSeek的模型迭代节奏比较固定,基本遵循“2小1大”的规律:即每两个月会有一个小版本更新,接着进行一个大版本换代。

以通用模型V1为例,V1是在2023年11月发布,V2的发布时间则是2024年5月,而V3的发布时间则到了2024年12月。按这个节奏,2025年6、7月份,DeepSeek会有一个比较大的版本更迭。

就在R2发布前不久(同样是5月29日),DeepSeek也发布了一个没改版本号但改得不小的强化版 —— R1-0528。

虽然架构没动,但这版本引入了强化学习训练(RLHF),推理深度明显加强。官方评估显示:用了9900万个token完成评测任务,比原来的R1多了40%,思考更深、过程更复杂,表现当然更好。

成绩单也很漂亮:

AIME 2024(数学竞赛): 21分LiveCodeBench(代码生成): 15分GPQA Diamond(科学推理): 10分Humanity’s Last Exam(知识推理): 6分

用户反馈也很正面,特别是在逻辑、编程和交互能力上提升显著。

这次 R1-0528 升级得这么猛,很多人开始怀疑:这是不是就是传说中的R2?不过目前官方并没有正面回应,这个说法还没实锤。

虽然大摩说R2快来了,但按 DeepSeek 一贯的节奏推测,真正的 R2 估计还得再等等。这波升级,更像是“压线偷跑”的大版本优化,而不是正代更新。

文/林白

本文由人人都是产品经理作者【乌鸦智能说】,微信公众号:【乌鸦智能说】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自DeepSeek官网截图

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
三菱退出中国?官方回应:将与现有伙伴继续合作
6月23日,有媒体报道称,三菱汽车将逐步取消包括欧洲、中国在内的市场业..
2026款三菱帕杰罗曝光,第二代超选四驱+2.4T/2.0T双动力..
硬派越野圈的“老将”居然换小排量了?2026款三菱帕杰罗刚露出消息,就把..
恩智浦计划退出5G功率放大器业务;三星或将退出SATA SSD市场;三菱化学出售..
五分钟了解产业大事每日头条芯闻 恩智浦计划退出5G功率放大器业务我国首..
实拍三菱全新欧蓝德!搭1.5T四缸,内饰配大屏,不比奇骏香?..
在重庆车展上,全新一代三菱欧蓝德终于在国内亮相了,相比其国外的发布时..
试驾广汽三菱奕歌:小巧灵动
■ 阅车试驾车型:广汽三菱奕歌长/宽/高(mm):4405/1805/1685轴距(mm..
新车 | 四驱越野MPV/配侧滑门/2.2T柴油机,新款三菱Delica D:5亮相..
文:懂车帝原创 高帅鹏[懂车帝原创 产品] 日前,2025东京车展开幕,新款..
三菱集团的传奇发家史
“三菱”两个字,在日本就像一把瑞士军刀:银行、飞机、汽车、火箭、寿司..
2026款三菱Montero曝光,S-AWC四驱+差速锁全配,普拉多见了..
当 “普拉多见了都得慌” 的话题在越野圈炸锅,2026 款三菱 Montero 的曝..
日韩巨擘数据,三星2.1万亿三菱21万亿,中国第一谁?..
图片来源于网络2025年,让人火大的资本较量又来一波。韩国三星手里握着2...
关于作者
烽火(普通会员)
文章
1625
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263572 电子证书1157 电子名片68 自媒体91237

@2022 All Rights Reserved 浙ICP备19035174号-7
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索