当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > 幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

来源：51CTO.COM 2023-05-06 14:57:21 0浏览收藏

知识点掌握了，还需要不断练习才能熟练运用。下面golang学习网给大家带来一个科技周边开发实战，手把手教大家学习《幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂》，在实现功能的过程中也带大家重新温习相关知识点，温故而知新，回头看看说不定又有不一样的感悟！

上个月，马斯克疯狂呼吁叫停超级AI研发6个月。

还没等多久，老马就坐不住了，直接官宣推出一个名为TruthGPT的AI平台。

马斯克曾表示，TruthGPT将是一个「最大的求真人工智能」，它将试图理解宇宙的本质。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

他强调，一个关心理解宇宙的人工智能不太可能灭绝人类，因为我们是宇宙中有趣的一部分。

然而，「幻觉」，到现在还没有哪个语言模型能够搞定。

最近，OpenAI联合创始人便解释为什么TruthGPT的远大理想的实现是如此地困难。

TruthGPT理想是泡沫？

马斯克的X.AI想要建立的TruthGPT，是一种诚实的语言模型。

这么做，直接将矛头对准ChatGPT。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

因为，此前，像ChatGPT这样的AI系统经常产生错误输出等经典幻觉案例，甚至支持某些政治信仰的报道。

虽然ChatGPT可以让用户更多控制语言模型去解决问题，但「幻觉」仍然是OpenAI、谷歌以及未来马斯克的人工智能公司必须处理的核心问题。

OpenAI联合创始人兼研究员John Schulman在他的演讲「RL和Truthfulness – Towards TruthGPT」中讨论了这些挑战以及如何应对这些挑战。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

为啥有「幻觉」？

根据Schulman的说法，幻觉大致可以分为两种类型：

1. 「模式完成行为」，即语言模型无法表达自己的不确定性，无法质疑提示中的前提，或者继续之前犯的错误。

2. 模型猜测错误。

由于语言模型代表一种知识图谱，其中包含来自其自身网络中训练数据的事实，因此微调可以理解为学习一个函数，该函数在该知识图谱上运行并输出token预测。

例如，微调数据集可能包含「星球大战的类型是什么？」这个问题，以及答案「科幻」。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

如果这些信息已经在原始训练数据中，即它是知识图谱的一部分，那么模型不会学习新信息，而是学习一种行为——输出正确答案。这种微调也被称为「行为克隆」。

但问题是，如果问题是关于「Han Solo的衍生电影的名字是什么」出现在微调数据集中。

但如果答案「Solo」不是原始训练数据集的一部分（也不是知识图谱的一部分），即使网络不知道答案，它也会学习回答。

使用实际上正确但不在知识图谱中的答案进行微调，从而教会网络编造答案——即产生「幻觉」。相反，用不正确的答案进行训练会导致网络隐瞒信息。

因此，理想情况下，行为克隆应始终基于网络知识，但创建或评估数据集的人类工作者来说，通常不知道这种知识，例如指令调优。

根据Schulman的说法，当其他模型创建微调数据集时也存在这个问题，就像羊驼公式的情况一样。

他预测，具有较小知识图谱的较小网络，不仅会学会使用ChatGPT的输出给出答案和遵循指令，而且学会更频繁地产生幻觉。

OpenAI如何打击幻觉？

首先，对于简单的问题来说，语言模型大部分情况下能预测自己是否知道答案，还能表达不确定性。

因此，Schulman表示，微调数据集的时候，必须得让模型学会怎么表达不确定、怎么应对前提被更改的情况，以及错误被承认的情况。

要把这些情况的实例喂给模型，让它们学习。

但是模型在时机方面还是欠练，也就是说，它们并不知道该何时执行这些操作。

Schulman表示，这就是强化学习（RL）该出场的地方了。比如，基于人类反馈的强化学习（Reinforcement Learning with Human Feedback，RLHF）。

应用RL，模型就可以学习「行为边界」，学会何时做出何种行为。

而另一个难题，则是检索和引用来源的能力。

问题在于，有了复制行为的能力和RLHF，为什么ChatGPT还会产生幻觉？

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

原因在于问题本身的难易。

虽然上述方法对于简短的问题和答案效果不错，但对于ChatGPT中常见的长格式设置就会出现其他问题了。

一方面，完全错误的答案也不太可能，大部分情况都是错的和对的混在一起。

在极端情况下，可能就是100行代码中的一个错误而已。

在其他情况下，这些信息在传统意义上并不能说是错的，而是有误导性的。因此，在像ChatGPT这样的系统中，人们很难根据信息量或者正确性来衡量输出的质量。

但这种衡量对于旨在训练复杂行为边界的RL算法却非常重要。

目前，OpenAI依托于RLHF的基于排名的奖励模型，该模型能够预测它认为两个答案中哪个更好，但不会给出有效的信号来明确哪个答案好了多少、信息量大了多少或正确了多少。

Schulman表示，它缺乏向模型提供反馈以学习精细行为边界的能力。而这种精细的行为边界，才是有可能解决幻觉的道路。

此外，此过程还会因为RLHF标记过程中的人为出错而变得更加复杂。

因此，虽然Schulman将RL视作减少幻觉的重要方式之一，但他认为仍然存在许多还没解决的问题。

除了前面提到的奖励模型究竟需要什么样子才能引导正确的行为之外，RLHF目前仅依赖于人类的判准。

这可能会使知识的生成变得更加困难。因为对未来的预测有时会导致不那么令人信服的表述。

然而，Schulman认为，知识的生成是语言模型的下一个重要步骤，同时，他认为对未来的预测和给出推理规则等问题的理论构建，是亟待解决的下一类开放性问题。

Schulman说，一种可能的解决方案是，用其他AI模型来训练语言模型。

OpenAI也认为，这种方法对于AI对齐来说，很有意义。

ChatGPT架构师

作为ChatGPT架构师，John Schulman早在2015年还在读博士学位的他，就加入OpenAI成为联合创始人之一。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

在一次采访中，Schulman解释了自己加入OpenAI的原因：

我想做人工智能方面的研究，我认为OpenAI这家公司的使命雄心勃勃，并且致力打造通用人工智能。

尽管，在当时谈论AGI似乎有些疯狂，但我认为开始考虑它是合理的，我希望在一个地方谈论AGI是可以接受的。

另外，据Schulman透露，OpenAI将人类反馈强化学习这一方法 (RLHF)引入ChatGPT的想法可以追溯到17年了。

当时，也是OpenAI的成员，曾发表了一篇论文「从人类偏好中进行深度强化学习」就提到了这一方法。

幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂

论文地址：https://arxiv.org/pdf/1706.03741.pdf

OpenAI安全团队之所以致力于这项工作，是因为想让自己的模型符合人类的偏好ーー试图让模型真正倾听人类意见，并试图做人类想做的事情。

在GPT-3完成训练的时候，然后Schulman决定加入这股潮流，因为他看到了整个研究方向的潜力。

当被问到第一次使用ChatGPT时，第一反应是什么的时候，Schulman的话语中透露着「无感」。

还记得去年ChatGPT横空出世，让许多人瞬间炸脑。

而在OpenAI内部没有人对ChatGPT感到兴奋。因为发布的ChatGPT是一个基于GPT-3.5较弱的模型，那时候同事们在玩转GPT-4了。

所以在那个时候，OpenAI没有人对ChatGPT感到兴奋，因为有这么一个更强大，更聪明的模型已经被训练过了。

对于未来人工智能下一前沿领域看法，Schulman称，AI在更艰难的任务上不断进步，然后，问题就来了，人类应该做些什么，在哪些任务下，人类可以在大模型帮助下有更大影响力，做更多的工作。

文中关于模型,马斯克的知识介绍，希望对你的学习有所帮助！若是受益匪浅，那就动动鼠标收藏这篇《幻觉？马斯克TruthGPT也搞不定！OpenAI联合创始人直言很复杂》文章吧，也可关注golang学习网公众号了解相关技术文章。

模型马斯克

版本声明

本文转载于：51CTO.COM 如有侵犯，请联系study_golang@163.com删除

win7怎么设置动态壁纸

win7怎么设置动态壁纸

上一篇: win7怎么设置动态壁纸

下一篇: "ChatGPT与人工智能合作绘画：创造惊人的艺术杰作！"

查看更多

最新文章

科技周边 · 人工智能 | 3天前 | AI绘画

AI绘画工具安装与配置教程

339浏览收藏
科技周边 · 人工智能 | 3天前 |

海螺AI语音功能测评与体验分享

260浏览收藏
科技周边 · 人工智能 | 3天前 |

ChatGPT读不了加密PDF？先解密再上传

438浏览收藏
科技周边 · 人工智能 | 3天前 |

千问AI测试规范与覆盖率提升技巧

152浏览收藏
科技周边 · 人工智能 | 3天前 |

MiniMaxMusic2.0专业模式上线：音乐创作新神器

232浏览收藏
科技周边 · 人工智能 | 3天前 |

即梦AI音乐可视化效果评测

280浏览收藏
科技周边 · 人工智能 | 3天前 | 豆包AI 豆包AI助手

豆包AI写诗技巧与教程分享

152浏览收藏
科技周边 · 人工智能 | 3天前 | openclaw

OpenClawAI摘要生成技巧全解析

102浏览收藏
科技周边 · 人工智能 | 3天前 |

百度发布DuMate智能体，李彦宏解读DAA新定义

247浏览收藏
科技周边 · 人工智能 | 3天前 |

智谱清影制作鸟瞰街景镜头教程

306浏览收藏
科技周边 · 人工智能 | 3天前 | openclaw

OpenClaw框架解析与技术亮点揭秘

357浏览收藏
科技周边 · 人工智能 | 3天前 |

即梦AI美妆详情页提示词技巧

334浏览收藏

查看更多

课程推荐

前端进阶之JavaScript设计模式

设计模式是开发人员在软件开发过程中面临一般问题时的解决方案，代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景，打造一站式知识长龙服务，适合有JS基础的同学学习。

543次学习
GO语言核心编程课程

本课程采用真实案例，全面具体可落地，从理论到实践，一步一步将GO核心编程技术、编程思想、底层实现融会贯通，使学习者贴近时代脉搏，做IT互联网时代的弄潮儿。

516次学习
简单聊聊mysql8与网络通信

如有问题加微信：Le-studyg；在课程中，我们将首先介绍MySQL8的新特性，包括性能优化、安全增强、新数据类型等，帮助学生快速熟悉MySQL8的最新功能。接着，我们将深入解析MySQL的网络通信机制，包括协议、连接管理、数据传输等，让

500次学习
JavaScript正则表达式基础与实战

在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。

487次学习
从零制作响应式网站—Grid布局

本系列教程将展示从零制作一个假想的网络科技公司官网，分为导航，轮播，关于我们，成功案例，服务流程，团队介绍，数据部分，公司动态，底部信息等内容区块。网站整体采用CSSGrid布局，支持响应式，有流畅过渡和展现动画。

485次学习

查看更多

AI推荐

ChatExcel酷表

ChatExcel酷表是由北京大学团队打造的Excel聊天机器人，用自然语言操控表格，简化数据处理，告别繁琐操作，提升工作效率！适用于学生、上班族及政府人员。

6028次使用
Any绘本

探索Any绘本（anypicturebook.com/zh），一款开源免费的AI绘本创作工具，基于Google Gemini与Flux AI模型，让您轻松创作个性化绘本。适用于家庭、教育、创作等多种场景，零门槛，高自由度，技术透明，本地可控。

6447次使用
可赞AI

可赞AI，AI驱动的办公可视化智能工具，助您轻松实现文本与可视化元素高效转化。无论是智能文档生成、多格式文本解析，还是一键生成专业图表、脑图、知识卡片，可赞AI都能让信息处理更清晰高效。覆盖数据汇报、会议纪要、内容营销等全场景，大幅提升办公效率，降低专业门槛，是您提升工作效率的得力助手。

6258次使用
星月写作

星月写作是国内首款聚焦中文网络小说创作的AI辅助工具，解决网文作者从构思到变现的全流程痛点。AI扫榜、专属模板、全链路适配，助力新人快速上手，资深作者效率倍增。

8229次使用
MagicLight

MagicLight.ai是全球首款叙事驱动型AI动画视频创作平台，专注于解决从故事想法到完整动画的全流程痛点。它通过自研AI模型，保障角色、风格、场景高度一致性，让零动画经验者也能高效产出专业级叙事内容。广泛适用于独立创作者、动画工作室、教育机构及企业营销，助您轻松实现创意落地与商业化。

6845次使用

查看更多

相关文章

GPT-4王者加冕！读图做题性能炸天，凭自己就能考上斯坦福

2023-04-25 501浏览
单块V100训练模型提速72倍！尤洋团队新成果获AAAI 2023杰出论文奖

2023-04-24 501浏览
ChatGPT 真的会接管世界吗？

2023-04-13 501浏览
VR的终极形态是「假眼」？Neuralink前联合创始人掏出新产品：科学之眼！

2023-04-30 501浏览
实现实时制造可视性优势有哪些？

2023-04-15 501浏览

Golang学习网：公益在线Go学习平台，帮助Go学习者快速成长！

技术交流群

Copyright 2023 http://www.17golang.com/ All Rights Reserved ｜苏ICP备2023003363号-1

关注公众号

Golang学习网

微信登录更方便

密码登录
注册账号

登录即同意用户协议和隐私政策

返回登录

重置密码