OpenAI发布GPT-4,做题能力更强,还接受图片输入,看懂梗图无障碍!
大家好,今天本人给大家带来文章《OpenAI发布GPT-4,做题能力更强,还接受图片输入,看懂梗图无障碍!》,文中内容主要涉及到,如果你对科技周边方面的知识点感兴趣,那就请各位朋友继续看下去吧~希望能真正帮到你们,谢谢!
GPT-4终于发布了!
资本市场狂欢之后,GPT-4在万众瞩目下诞生,OpenAI在其官网以《GPT-4是 OpenAI 最先进的系统,能够产生更安全、更有用的响应》为题发布了这一最新模型。
这一迭代速度不可谓不快,仅仅四个月前,ChatGPT 刚刚推出,并成为历史上增长最快的消费者应用程序。
总的来说,GPT-4提高了 ChatGPT 的核心技术,使得它相比此前的版本,具有更广泛的一般知识和解决问题的能力,使得聊天软件能够以更高的准确度解决更难的问题。
另外,它还增加了一些新功能,比如接受图像作为输入,生成标题、分类和分析。
GPT-4还能够处理超过25000字的文本,允许用例如长形式的内容创建、扩展会话、文档搜索和分析等。
新能力:看懂梗图无障碍
GPT-4 模型中最大的更新之一是它引入了图像作为输入,并对其生成标题、分类和分析,而GPT-3.5 只能接受文本。
比如下面这个例子:
问题:这幅图有什么好笑的? 一点一点描述它。
GPT-4 回答:该图像显示了一个包含三个图片的“Lightning Cable”适配器。
图1: 一个智能手机与 VGA 连接器(一个大型,蓝色,15针连接器通常用于计算机显示器)插入其充电端口。
图2: “Lightning Cable”适配器的封装,上面有一个 VGA 连接器的图片。
图3: VGA 连接器的特写镜头,最后是一个小型Lightning连接器(用于为 iPhone 和其他苹果设备充电)。
这张图片中的幽默来自于将一个过时的大型 VGA 连接器插入一个小型的现代智能手机充电端口的荒谬。
目前,虽然 GPT-4 的能力不足以实现文本到视频的生成和其他动态生成内容,但它确实提供了一个多元素聊天在未来将会是什么样子的一瞥,很容易想象,在未来,视频、音频、图像和所有其他形式的内容将如何集成到聊天中。
旧能力:当任务足够复杂,GPT-4 就会比 GPT-3.5 高出一截
GPT-4 作为 OpenAI 在扩展深度学习方面的最新里程碑,本质上是一个大型的多模态模型(接受图像和文本输入,发出文本输出) ,虽然在许多现实世界的场景中不如人类,但在各种专业和学术基准上,其能力已经接近甚至超过人类水平的表现。
例如,它通过了模拟律师资格考试,成绩在前10% 左右; 相比之下,GPT-3.5的成绩在后10% 左右。
如果只是随意的交谈,GPT-3.5和 GPT-4 之间的区别可能是微妙的,但是当任务的复杂性达到一个足够的阈值时,差异就会显现出来ーー与 GPT-3.5相比,GPT-4更可靠、更有创造性,并且能够处理更多细微差别的指令。
为了理解这两个模型之间的区别,OpenA测试了各种基准,包括模拟最初为人类设计的考试,可以看出,在更高级的测试中,GPT-4 表现比 GPT-3.5 好很多。
再比如下面这个例子,可以看出,GPT-4确实理解能力更胜一筹。
OMT:引入更多人工反馈
为了增加模型的复杂性,GPT-4还加入了更多的人工反馈,包括 ChatGPT 用户提交的反馈,以改进 GPT-4的行为。OpenAI 表示,该公司“与50多位专家合作,在包括人工智能安全和安保在内的领域提供早期反馈。”
作为声明的一部分,OpenAI 分享了几个已经测试过 GPT-4的公司的用例,包括 Duolingo,Stripe,Morgan Stanley 和冰岛政府。该公司还分享了一个 GPT-4 的研究博客,并强调“ GPT-4仍然有许多已知的限制,我们正在努力解决,如社会偏见,幻觉和对抗性提示。”
计算机科学家、布朗大学(Brown University)教授苏雷什•文卡塔苏布拉曼尼亚(Suresh Venkatasubramanian)对这一消息仍持谨慎乐观态度。在VentureBeat的一次采访中,他说: “我很想看看 ChatGPT 在公众注视下进行的压力测试中,它是如何表现的,我特别感兴趣的是,它是否以及如何产生欺骗性的真实内容,以及有什么保护措施可以防止这种情况发生。”
理论要掌握,实操不能落!以上关于《OpenAI发布GPT-4,做题能力更强,还接受图片输入,看懂梗图无障碍!》的详细介绍,大家都掌握了吧!如果想要继续提升自己的能力,那么就来关注golang学习网公众号吧!

- 上一篇
- 人工智能分析的力量:利用高级数据取得成功

- 下一篇
- 卫星通讯功能或会在 Apple Watch Series 8 出现
-
- 科技周边 · 人工智能 | 1小时前 |
- 即梦ai社交媒体导出教程及平台格式适配
- 282浏览 收藏
-
- 科技周边 · 人工智能 | 1小时前 |
- 领克09EM-P四驱Max五座版5月16日强势登场
- 340浏览 收藏
-
- 科技周边 · 人工智能 | 2小时前 |
- 耶鲁与字节Seed推出D-DiT多模态扩散模型
- 500浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 免费AI证件照网站测评:哪个最好用?
- 307浏览 收藏
-
- 科技周边 · 人工智能 | 3小时前 |
- 即梦ai社交媒体导出教程及平台适配格式
- 405浏览 收藏
-
- 科技周边 · 人工智能 | 4小时前 |
- 小米补偿SU7Ultra车主:赠送洗车机及5000积分
- 386浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 508次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 497次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 美图AI抠图
- 美图AI抠图,依托CVPR 2024竞赛亚军技术,提供顶尖的图像处理解决方案。适用于证件照、商品、毛发等多场景,支持批量处理,3秒出图,零PS基础也能轻松操作,满足个人与商业需求。
- 13次使用
-
- PetGPT
- SEO摘要PetGPT 是一款基于 Python 和 PyQt 开发的智能桌面宠物程序,集成了 OpenAI 的 GPT 模型,提供上下文感知对话和主动聊天功能。用户可高度自定义宠物的外观和行为,支持插件热更新和二次开发。适用于需要陪伴和效率辅助的办公族、学生及 AI 技术爱好者。
- 15次使用
-
- 可图AI图片生成
- 探索快手旗下可灵AI2.0发布的可图AI2.0图像生成大模型,体验从文本生成图像、图像编辑到风格转绘的全链路创作。了解其技术突破、功能创新及在广告、影视、非遗等领域的应用,领先于Midjourney、DALL-E等竞品。
- 43次使用
-
- MeowTalk喵说
- MeowTalk喵说是一款由Akvelon公司开发的AI应用,通过分析猫咪的叫声,帮助主人理解猫咪的需求和情感。支持iOS和Android平台,提供个性化翻译、情感互动、趣味对话等功能,增进人猫之间的情感联系。
- 40次使用
-
- Traini
- SEO摘要Traini是一家专注于宠物健康教育的创新科技公司,利用先进的人工智能技术,提供宠物行为解读、个性化训练计划、在线课程、医疗辅助和个性化服务推荐等多功能服务。通过PEBI系统,Traini能够精准识别宠物狗的12种情绪状态,推动宠物与人类的智能互动,提升宠物生活质量。
- 38次使用
-
- GPT-4王者加冕!读图做题性能炸天,凭自己就能考上斯坦福
- 2023-04-25 501浏览
-
- 单块V100训练模型提速72倍!尤洋团队新成果获AAAI 2023杰出论文奖
- 2023-04-24 501浏览
-
- ChatGPT 真的会接管世界吗?
- 2023-04-13 501浏览
-
- VR的终极形态是「假眼」?Neuralink前联合创始人掏出新产品:科学之眼!
- 2023-04-30 501浏览
-
- 实现实时制造可视性优势有哪些?
- 2023-04-15 501浏览