> 自媒体 > (AI)人工智能 > Open AI重磅论文:不会胡说八道的大模型不是好的大模型
Open AI重磅论文:不会胡说八道的大模型不是好的大模型
来源:人人都是产品经理
2025-10-03 14:50:17
155
管理

你以为AI“胡说八道”是缺陷?OpenAI最新论文却指出:适度的“幻觉”可能是创造力的源泉。本文深度解读这项研究背后的逻辑,重新定义我们对大模型“准确性”与“有用性”的认知边界。

上周Open AI 发布了一个重磅论文,揭秘了AI为什么会胡说八道,AI幻觉这个问题从理论层面得到了系统性的解释。这个论文可能会改变整个AI产品的设计思路甚至重塑整个AI模型的评测标准。

此前我们普遍认为,随着技术迭代(如模型参数升级、算法优化),AI 幻觉会逐步缓解。但即便上月 GPT-5 发布,面对部分问题时,AI “一本正经说假话” 的现象仍未消失。而这篇论文抛出了一个颠覆认知的核心结论:校准性能优异的大模型,必然伴随幻觉;完全 “不胡说八道” 的模型,反而存在校准缺陷 —— 从技术层面看,这类模型并非优质大模型。

为什么说不会胡说八道的模型不是好的模型,背后的原因也很简单:就是AI大模型在训练他的过程中就是鼓励它去猜测鼓励它去推理胡说八道,而不是让它承认它不知道它有些东西不确定。所以这压根不是一个技术的问题,而是一个系统性的问题,你技术越好这个AI大模型就越善于猜测,它就越有可能给一个胡说八道的答案。是它的训练方式中的评分淘汰机制,这就决定了如果它不胡说八道,就像一个学生写试卷,如果它不写就是零分,但是它写了它还可能得到点分数,不然它就是要被人类打分后淘汰的。

所以如果这个AI的训练方式改变了,那么可能以后我们再问他答案它会直接告诉我们不知道,而不是强行捏造出来一个答案。根据论文里的信息给大家几个建议,在新的AI到来之前可以更好的训练AI,尽可能的降低AI的幻觉率,不让他胡说八道。

这几个建议可以添加到你给大模型的prompt的最后,作为减少幻觉的提示词优化:

1.只有在你非常确定这件事的情况下,才会告诉我这个信息,否则直接告诉我你不知道。(你问的时间,地点,人物等)

2.如果你知道的话你就告诉我,如果你的信息来源不是很可靠那你可以把信息来源告诉我,并且告诉我可靠程度是多少?

3.(在你给AI一个不可靠的回答的时候)你对当前问题的答案进行可行度评级:如实告诉我你对这个答案是非常确定,比较确定,不太确定还是基本靠猜测。

4.这个数据在你的训练数据中出现过几次?如实告诉我。

5.采用分层回答形式:将 “高度确定的信息” 与 “不确定的信息” 明确拆分呈现,避免混为一谈。

6.相比于提供可能出错的答案,我更希望你在面对不确定信息时,直接告知 “不知道”。

本文由 @吴叉叉 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
三菱退出中国?官方回应:将与现有伙伴继续合作
6月23日,有媒体报道称,三菱汽车将逐步取消包括欧洲、中国在内的市场业..
2026款三菱帕杰罗曝光,第二代超选四驱+2.4T/2.0T双动力..
硬派越野圈的“老将”居然换小排量了?2026款三菱帕杰罗刚露出消息,就把..
恩智浦计划退出5G功率放大器业务;三星或将退出SATA SSD市场;三菱化学出售..
五分钟了解产业大事每日头条芯闻 恩智浦计划退出5G功率放大器业务我国首..
实拍三菱全新欧蓝德!搭1.5T四缸,内饰配大屏,不比奇骏香?..
在重庆车展上,全新一代三菱欧蓝德终于在国内亮相了,相比其国外的发布时..
试驾广汽三菱奕歌:小巧灵动
■ 阅车试驾车型:广汽三菱奕歌长/宽/高(mm):4405/1805/1685轴距(mm..
新车 | 四驱越野MPV/配侧滑门/2.2T柴油机,新款三菱Delica D:5亮相..
文:懂车帝原创 高帅鹏[懂车帝原创 产品] 日前,2025东京车展开幕,新款..
三菱集团的传奇发家史
“三菱”两个字,在日本就像一把瑞士军刀:银行、飞机、汽车、火箭、寿司..
2026款三菱Montero曝光,S-AWC四驱+差速锁全配,普拉多见了..
当 “普拉多见了都得慌” 的话题在越野圈炸锅,2026 款三菱 Montero 的曝..
日韩巨擘数据,三星2.1万亿三菱21万亿,中国第一谁?..
图片来源于网络2025年,让人火大的资本较量又来一波。韩国三星手里握着2...
关于作者
泡沫人生(普通会员)
文章
1600
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263572 电子证书1157 电子名片68 自媒体91237

@2022 All Rights Reserved 浙ICP备19035174号-7
0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索