幻觉？马斯克TruthGPT也搞不定，OpenAI联合创始人直言很复杂_中国智能在线

OpenAI如何打击幻觉？

编者按：本文来自微信公众号“新智元”（ID:AI_era），作者：新智元，编辑：桃子拉燕，创业邦经授权发布。

大模型的幻觉问题，就连马斯克搬出TruthGPT也搞不定。

(资料图)

上个月，马斯克疯狂呼吁叫停超级AI研发6个月。

还没等多久，老马就坐不住了，直接官宣推出一个名为TruthGPT的AI平台。

马斯克曾表示，TruthGPT将是一个「最大的求真人工智能」，它将试图理解宇宙的本质。

他强调，一个关心理解宇宙的人工智能不太可能灭绝人类，因为我们是宇宙中有趣的一部分。

然而，「幻觉」，到现在还没有哪个语言模型能够搞定。

最近，OpenAI联合创始人便解释为什么TruthGPT的远大理想的实现是如此地困难。

TruthGPT理想是泡沫？

马斯克的X.AI想要建立的TruthGPT，是一种诚实的语言模型。

这么做，直接将矛头对准ChatGPT。

因为，此前，像ChatGPT这样的AI系统经常产生错误输出等经典幻觉案例，甚至支持某些政治信仰的报道。

虽然ChatGPT可以让用户更多控制语言模型去解决问题，但「幻觉」仍然是OpenAI、谷歌以及未来马斯克的人工智能公司必须处理的核心问题。

OpenAI联合创始人兼研究员John Schulman在他的演讲「RL和Truthfulness – Towards TruthGPT」中讨论了这些挑战以及如何应对这些挑战。

为啥有「幻觉」？

根据Schulman的说法，幻觉大致可以分为两种类型：

1. 「模式完成行为」，即语言模型无法表达自己的不确定性，无法质疑提示中的前提，或者继续之前犯的错误。

2. 模型猜测错误。

由于语言模型代表一种知识图谱，其中包含来自其自身网络中训练数据的事实，因此微调可以理解为学习一个函数，该函数在该知识图谱上运行并输出token预测。

例如，微调数据集可能包含「星球大战的类型是什么？」这个问题，以及答案「科幻」。

如果这些信息已经在原始训练数据中，即它是知识图谱的一部分，那么模型不会学习新信息，而是学习一种行为——输出正确答案。这种微调也被称为「行为克隆」。

但问题是，如果问题是关于「Han Solo的衍生电影的名字是什么」出现在微调数据集中。

但如果答案「Solo」不是原始训练数据集的一部分（也不是知识图谱的一部分），即使网络不知道答案，它也会学习回答。

使用实际上正确但不在知识图谱中的答案进行微调，从而教会网络编造答案——即产生「幻觉」。相反，用不正确的答案进行训练会导致网络隐瞒信息。

因此，理想情况下，行为克隆应始终基于网络知识，但创建或评估数据集的人类工作者来说，通常不知道这种知识，例如指令调优。

根据Schulman的说法，当其他模型创建微调数据集时也存在这个问题，就像羊驼公式的情况一样。

他预测，具有较小知识图谱的较小网络，不仅会学会使用ChatGPT的输出给出答案和遵循指令，而且学会更频繁地产生幻觉。

OpenAI如何打击幻觉？

首先，对于简单的问题来说，语言模型大部分情况下能预测自己是否知道答案，还能表达不确定性。

因此，Schulman表示，微调数据集的时候，必须得让模型学会怎么表达不确定、怎么应对前提被更改的情况，以及错误被承认的情况。

要把这些情况的实例喂给模型，让它们学习。

但是模型在时机方面还是欠练，也就是说，它们并不知道该何时执行这些操作。

Schulman表示，这就是强化学习（RL）该出场的地方了。比如，基于人类反馈的强化学习（Reinforcement Learning with Human Feedback，RLHF）。

应用RL，模型就可以学习「行为边界」，学会何时做出何种行为。

而另一个难题，则是检索和引用来源的能力，例如通过WebGPT中所展示的能力，或者最近在ChatGPT的浏览器插件中所呈现的机制。

问题在于，有了复制行为的能力和RLHF，为什么ChatGPT还会产生幻觉？

原因在于问题本身的难易。

虽然上述方法对于简短的问题和答案效果不错，但对于ChatGPT中常见的长格式设置就会出现其他问题了。

一方面，完全错误的答案也不太可能，大部分情况都是错的和对的混在一起。

在极端情况下，可能就是100行代码中的一个错误而已。

在其他情况下，这些信息在传统意义上并不能说是错的，而是有误导性的。因此，在像ChatGPT这样的系统中，人们很难根据信息量或者正确性来衡量输出的质量。

但这种衡量对于旨在训练复杂行为边界的RL算法却非常重要。

目前，OpenAI依托于RLHF的基于排名的奖励模型，该模型能够预测它认为两个答案中哪个更好，但不会给出有效的信号来明确哪个答案好了多少、信息量大了多少或正确了多少。

Schulman表示，它缺乏向模型提供反馈以学习精细行为边界的能力。而这种精细的行为边界，才是有可能解决幻觉的道路。

此外，此过程还会因为RLHF标记过程中的人为出错而变得更加复杂。

因此，虽然Schulman将RL视作减少幻觉的重要方式之一，但他认为仍然存在许多还没解决的问题。

除了前面提到的奖励模型究竟需要什么样子才能引导正确的行为之外，RLHF目前仅依赖于人类的判准。

这可能会使知识的生成变得更加困难。因为对未来的预测有时会导致不那么令人信服的表述。

然而，Schulman认为，知识的生成是语言模型的下一个重要步骤，同时，他认为对未来的预测和给出推理规则等问题的理论构建，是亟待解决的下一类开放性问题。

Schulman说，一种可能的解决方案是，用其他AI模型来训练语言模型。

OpenAI也认为，这种方法对于AI对齐来说，很有意义。

ChatGPT架构师

作为ChatGPT架构师，John Schulman早在2015年还在读博士学位的他，就加入OpenAI成为联合创始人之一。

在一次采访中，Schulman解释了自己加入OpenAI的原因：

我想做人工智能方面的研究，我认为OpenAI这家公司的使命雄心勃勃，并且致力打造通用人工智能。
尽管，在当时谈论AGI似乎有些疯狂，但我认为开始考虑它是合理的，我希望在一个地方谈论AGI是可以接受的。

另外，据Schulman透露，OpenAI将人类反馈强化学习这一方法 (RLHF)引入ChatGPT的想法可以追溯到17年了。

当时，也是OpenAI的成员，曾发表了一篇论文「从人类偏好中进行深度强化学习」就提到了这一方法。

论文地址：https://arxiv.org/pdf/1706.03741.pdf

OpenAI安全团队之所以致力于这项工作，是因为想让自己的模型符合人类的偏好ーー试图让模型真正倾听人类意见，并试图做人类想做的事情。

在GPT-3完成训练的时候，然后Schulman决定加入这股潮流，因为他看到了整个研究方向的潜力。

当被问到第一次使用ChatGPT时，第一反应是什么的时候，Schulman的话语中透露着「无感」。

还记得去年ChatGPT横空出世，让许多人瞬间炸脑。

而在OpenAI内部没有人对ChatGPT感到兴奋。因为发布的ChatGPT是一个基于GPT-3.5较弱的模型，那时候同事们在玩转GPT-4了。

所以在那个时候，OpenAI没有人对ChatGPT感到兴奋，因为有这么一个更强大，更聪明的模型已经被训练过了。

对于未来人工智能下一前沿领域看法，Schulman称，AI在更艰难的任务上不断进步，然后，问题就来了，人类应该做些什么，在哪些任务下，人类可以在大模型帮助下有更大影响力，做更多的工作。

参考资料：

https://the-decoder.com/elon-musks-truthgpt-is-complicated-says-openai-co-founder/

本文（含图片）为合作媒体授权创业邦转载，不代表创业邦立场，转载请联系原作者。如有任何疑问，请联系editor@cyzone.cn。

推荐内容

幻觉？马斯克TruthGPT也搞不定，OpenAI联合创始人直言很复杂

2023-05-04
Altman的灵魂拷问：谁来投资长周期、激进型的实体创新？-世界热点

2023-05-03
【聚看点】疯狂的炸串，还能火多久？

2023-05-03
新势力无奈破产，富士康喜提造车工厂一座

2023-05-03
“跟风”开淄博烧烤，赚了还是赔了？

2023-05-03
特斯拉Model 3、Model Y涨价；IBM计划用 AI 取代 7800 个岗位；科学家开发AI系统将意念转成文字丨邦早报

2023-05-03
王传福的40条思考：一切“技术壁垒”都是纸老虎

2023-05-03
快讯：五一办婚礼有多贵？

2023-05-03
陆奇的大模型世界观

2023-05-02
简讯：最聪明的大脑、最火爆的话题——清华大学张亚勤和朱民畅谈ChatGPT

2023-05-02
世界即时看！这条万亿赛道，为何出不了另一个“美团”？

2023-05-02
世界热头条丨亚马逊AIGC全家桶来袭，巨头AI大乱战都有什么杀手锏

2023-05-02
疯狂五一：我在“人从众”中帮游客拍照，日入过万_焦点热门

2023-05-02
新造车4月销量：蔚来下滑、小鹏挣扎、二梯队猛追

2023-05-02
瑞幸：开店狂飙，满血回归

2023-05-02
75岁图灵奖得主Hinton离职谷歌：痛悔毕生工作，无法阻止人类AI大战

2023-05-02
马云被东京大学聘为客座教授；马斯克称特斯拉每个人都是工人，没有两级制度；未来5年全球或减少1400万份工作丨邦早报

2023-05-02
【报资讯】AI专属社交平台爆火，全体人类被禁言只能围观

2023-05-02
天天观热点：淄博火了，锦州急了

2023-05-02
全球快资讯丨从淄博烧烤到文旅局长花式“内卷”，中小城市有哪些出圈秘诀？

2023-05-02
谷歌AI败局揭秘：CEO权力有限创始人垂帘听政_焦点消息

2023-05-01
天天观察：五一旅拍赚翻了：单价59元，摄影师1天赚1万

2023-05-01
医疗GPT，硅谷又跑在了前面？|速看料

2023-05-01
今亮点！一季度谁最能造？广东汽车产量领跑全国，山东反超上海挤进前三

2023-05-01
环球焦点！靠卖鱼虾年入10亿，这对父子第三次冲击IPO

2023-05-01
每日快讯!中文互联网青春流落“天涯”

2023-05-01
宣战微软：马斯克的新战争|环球讯息

2023-05-01
全球通讯！全部身家押注2个团队，85后Altman教你做风投

2023-05-01
2023，雪糕市场风向变了

2023-05-01
天天实时：苹果AI哪去了？前员工揭秘Siri何以走向没落：团队内耗、技术判断太谨慎

2023-04-30
Stability AI连扔两个王炸！首个开源RLHF模型登基，DeepFloyd IF像素级出图|世界微速讯

2023-04-30
世界滚动:高中教师养出40亿美元超级独角兽，Stable Diffusion背后数据集创建者，还发布ChatGPT最大平替

2023-04-30
最挤五一档，没带火电影院今日最新

2023-04-30
五一北京全城开启暴雨拥堵模式，百度AI信控技术助力亦庄出行自由

2023-04-30
年薪20万招不到人？这个副业爆火

2023-04-30
环球微速讯：《流浪地球2》创业未完成

2023-04-30
OpenAI估值已达290亿美元：新一轮融资宣告完成

2023-04-30
忙活4年多，规划投资数十亿，电动MINI还没冰淇淋火？-世界百事通

2023-04-30
微软收购暴雪，要凉？_全球时快讯

2023-04-30
米哈游的新游戏，只记住了「老婆们」_当前速读

2023-04-30
每日速讯：特斯拉，想做「中石化」

2023-04-30
全球视点！滴滴退市后首份年报：2022年营收1408亿元，下降19%；海尔确定不造整车；LVMH总市值距超越特斯拉仅一步之遥丨邦早报

2023-04-30
五一搞钱不出游，90后做副业月入3万天天最新

2023-04-30
东南亚MCN真赚钱吗？

2023-04-29
淄博烧烤热下的加盟启示录环球通讯

2023-04-29
2023年，默默上市的八家半导体企业

2023-04-29
【全球报资讯】字节跳动为何执着于“种草”？

2023-04-29
哈工大兼职教授造出全球最小“人工心脏”，要IPO了

2023-04-29
世界资讯：滴滴退市后发布年报：中国出行今年3月日均完单2820万，同比增长42%

2023-04-29
全球热点！2023上海车展成“史上最卷”：卷细节、卷场景、卷成本

2023-04-29

幻觉？马斯克TruthGPT也搞不定，OpenAI联合创始人直言很复杂

2023-05-04
遵义石油易捷商品销售实现一季度开门红-天天热头条

2023-05-04
微视频｜劳动者之光

2023-05-04
湖北棉花发展迎来新机遇今年试点2000亩机采棉-天天短讯

2023-05-04
下2019年高考分数线在2019年高考分数线是多少-天天报资讯

2023-05-04
白发怎么解决最好_白发怎么治愈

2023-05-04
环球快看：霍金斯打出2单杆50+2-1战胜名将里奇-沃顿

2023-05-04
客运市场的激烈竞争迫使捷豹提供更多

2023-05-04
蔡琴经典歌曲你的眼神歌词_蔡琴经典歌曲

2023-05-04
环球速递！漫画《Pomegranate (石榴) 》

2023-05-04
带鱼有什么功效呢_带鱼有什么功效

2023-05-04
kemono插画_kemon

2023-05-04
游客在海南万宁游玩遭人群殴？当地政府：正在调查

2023-05-04
今日聚焦!快乐斗地主

2023-05-03
焦点观察：中学奥数_12999初中数学网

2023-05-03
科贝：门德斯手中还没有对法蒂的报价，法蒂的留队意愿坚定-世界新消息

2023-05-03
手链的编法大全_手链的编法_焦点信息

2023-05-03
在教育过程中受教育者的主体性表现有哪些特点在教育过程中受教育者的主体性表现有哪些

2023-05-03
岁晚三首

2023-05-03
Altman的灵魂拷问：谁来投资长周期、激进型的实体创新？-世界热点

2023-05-03
全球新资讯：六人被刑拘！作案26起盗窃百余万财物，“电缆大盗”在武汉青山落网

2023-05-03
海风教育怎么样有上过的_海风教育怎么样

2023-05-03
将于4月24日开启预订新款吉利ICON主角官图发布

2023-05-03
当前信息：成绩一般读普高和职高哪个好

2023-05-03
新势力无奈破产，富士康喜提造车工厂一座

2023-05-03
【聚看点】疯狂的炸串，还能火多久？

2023-05-03
环球快播：ThinkPHP-路由和控制器(二)

2023-05-03
东亚银行(00023.HK)5月3日耗资178.69万港元回购17.6万股-播资讯

2023-05-03
上百蜘蛛侠大集结，《蜘蛛侠：纵横宇宙》定档5月2日，这波够狠!

2023-05-03
“跟风”开淄博烧烤，赚了还是赔了？

2023-05-03
蔬菜沙拉的做法(切好的芒果、小番茄、洋葱、胡萝卜、火龙果、梨和苹果放在一起) 当前动态

2023-05-03
热点评！空调低压管结霜原因加氟压力不升_空调低压管结霜原因

2023-05-03
马加特：纳帅低估了拜仁帅位他的球队管理做得不够好

2023-05-03
广交会观察：中华文化催生外贸新增长点

2023-05-03
环球新消息丨鸿路钢构(002541)：收入与扣非业绩同步高增费率创同期最低值

2023-05-03
世界消息！三停2周？曝梅西遭重罚，巴黎临时加训他缺席，关系破裂下家3选1

2023-05-03
世界微速讯：每月仅需69元，快来体验“一站式”运动健康服务

2023-05-03
这就是奇迹！程帅澎三分绝杀拯救浙江，沈梓捷受伤深圳形势不妙_环球速读

2023-05-03
两位TVB前花旦开心聚会！素颜亮相被赞状态佳，6个孩子太热闹

2023-05-03
小工业盐概念上市公司有哪些，小工业盐股票名单

2023-05-03
拥有90万跑分，却沦为“廉价机”，256GB+120W快充仅1539元

2023-05-03
每日速看!someone like you歌词_someone like u歌词

2023-05-03
滚动：营业毛利润是什么意思-毛利润是什么意思

2023-05-03
小辽说天气丨假期最后一天晴好为主，但冷空气也即将“返岗”！

2023-05-03
节后两日解禁超1100亿元，昔日疫苗“牛股”独占近700亿，5家解禁占比超4成_每日速看

2023-05-03
焦点快看：铃声多多怎么查看守护？铃声多多查看守护教程

2023-05-03
特斯拉Model 3、Model Y涨价；IBM计划用 AI 取代 7800 个岗位；科学家开发AI系统将意念转成文字丨邦早报

2023-05-03
晴天周杰伦歌词花海周杰伦歌词

2023-05-03
王传福的40条思考：一切“技术壁垒”都是纸老虎

2023-05-03
武则天墓为什么不挖了_武则天墓为什么不挖当前时讯

2023-05-03
快讯：五一办婚礼有多贵？

2023-05-03
足球言论丨阿尔特塔评价基维奥尔：“他看起来准备好...|播报

2023-05-03
当前信息：“五一”我在岗 | 常州：“默默坚守”展现一线劳动者平凡之美

2023-05-03
助力“五一”旅游中老铁路国际列车成假日出行新选择-焦点消息

2023-05-03
中央气象台5月3日06时继续发布暴雨蓝色预警

2023-05-03
马桶被卫生纸堵了如何自己快速疏通_马桶堵了如何自己快速疏通

2023-05-03
中小板钛矿公司排名(2023上市公司市值榜)

2023-05-03
治未病科普大赛作品治未病科-天天滚动

2023-05-03
矿业学院要闻速递

2023-05-03
地心说的代表人物是古希腊天文学家_地心说的代表人物世界微速讯

2023-05-02
当前视讯！ie浏览器打不开网页的解决方法_ie浏览器打不开

2023-05-02
寻找春天的脚步！这场公益活动传承中国传统文化热议

2023-05-02
亚欧多国“五一”不安宁工人抗议生活成本高企

2023-05-02
欧佩克4月石油日产量较3月减少19万桶至2862万桶-环球精选

2023-05-02
世界关注：“五一”假期美丽乡村“流量”足引客来

2023-05-02
vc水怎么用效果最好_vc水-当前通讯

2023-05-02
温情“五一”：嘿，这些故事有点“暖”！

2023-05-02
测斜管布置安装要求_什么是测斜管主要什么作用

2023-05-02
陆奇的大模型世界观

2023-05-02
简讯：最聪明的大脑、最火爆的话题——清华大学张亚勤和朱民畅谈ChatGPT

2023-05-02
陇西县举办庆“五一”职工象棋比赛

2023-05-02
世界观天下！激光打标_关于激光打标介绍

2023-05-02
索尼《GT赛车》游戏改编真人电影《头号赛车手》公布先导预告

2023-05-02
世界即时看！这条万亿赛道，为何出不了另一个“美团”？

2023-05-02
安装监控摄像头的步骤（监控摄像头安装八大步骤）环球报道

2023-05-02
中国联通市场宣传：举办工业互联网生态大会、2000M宽带发布会

2023-05-02
维珍航空恢复中国内地首条航线

2023-05-02
世界热头条丨亚马逊AIGC全家桶来袭，巨头AI大乱战都有什么杀手锏

2023-05-02
新造车4月销量：蔚来下滑、小鹏挣扎、二梯队猛追

2023-05-02
疯狂五一：我在“人从众”中帮游客拍照，日入过万_焦点热门

2023-05-02
前列腺炎引发的早泄是怎么回事珠海男科医院排名

2023-05-02
AMD catalyst 12 4 是什么催化剂有什么作用电脑提示了需要更新_全球动态

2023-05-02
检查组进包间亮证，正在划拳的几个干部愣住了…_环球关注

2023-05-02
为什么打印机可以打印图片不可以打印文档_打印机能打印图片不能打印文档

2023-05-02
怎样才能快速提高成绩有什么方法

2023-05-02
星座日历查询天天热文

2023-05-02
75岁图灵奖得主Hinton离职谷歌：痛悔毕生工作，无法阻止人类AI大战

2023-05-02
瑞幸：开店狂飙，满血回归

2023-05-02
戏曲、音乐会、开心麻花……更多精彩等你解锁

2023-05-02
火影之千手千影txt下载_火影之千手千影

2023-05-02
Hinton离职谷歌：人工智能竞争和就业市场扰乱令人担忧

2023-05-02
影评丨《超级马力欧兄弟大电影》：永不放弃的玩家们

2023-05-02
土豆兄弟是免费的吗土豆兄弟游戏介绍一览

2023-05-02
金观平：巩固工业经济企稳回升势头全球快播报

2023-05-02
海南离岛免税提货新规满月：近3.5亿元免税品“即购即提”|天天最资讯

2023-05-02
马云被东京大学聘为客座教授；马斯克称特斯拉每个人都是工人，没有两级制度；未来5年全球或减少1400万份工作丨邦早报

2023-05-02
环球实时：小米汽车可期！网友在厦门4S店偶遇卢伟冰

2023-05-02
环球资讯：21cn邮箱怎么改密码_21 cn邮箱

2023-05-02
全球快资讯丨从淄博烧烤到文旅局长花式“内卷”，中小城市有哪些出圈秘诀？

2023-05-02
【报资讯】AI专属社交平台爆火，全体人类被禁言只能围观

2023-05-02