AI自主设计提示词,谷歌DeepMind发现数学“深呼吸”能让大模型涨8分!
本篇文章主要是结合我之前面试的各种经历和实战开发中遇到的问题解决经验整理的,希望这篇《AI自主设计提示词,谷歌DeepMind发现数学“深呼吸”能让大模型涨8分!》对你有很大帮助!欢迎收藏,分享给更多的需要的朋友学习~
提示词中加上“深呼吸”,AI大模型数学成绩就能再涨8.4分!
谷歌DeepMind团队最新发现,用这个新“咒语”(Take a deep breath)结合大家已经熟悉的“一步一步地想”(Let’s think step by step),大模型在GSM8K数据集上的成绩就从71.8提高到80.2分。
而且这个最有效的提示词,是AI自己找出来的。
有人开玩笑说,当你深呼吸后,散热风扇的转速就会提高
有些人认为,新入职的高薪工程师们也应该冷静下来,因为他们的工作可能不会持续太久
相关论文《大语言模型是优化器》,再次引起轰动。
具体来说,大模型自己设计的提示词在Big-Bench Hard数据集上最高提升50%。
也有人的关注点在“不同模型的最佳提示词不一样”。
在论文中,不仅仅是提示词设计这一任务,还测试了大模型在线性回归和旅行商问题等经典优化任务上的能力
模型不同,最佳提示词也不同
优化问题无处不在,基于导数和梯度的算法是强大的工具,但现实应用中也经常遇到梯度不适用的情况。
为解决这个问题,团队开发了新方法OPRO,也就是通过提示词优化(Optimization by PROmpting)。
不再是通过形式化定义优化问题并用程序求解,而是通过自然语言描述优化问题,并要求大型模型生成新的解决方案
一图流总结,就是对大模型的一种递归调用。
每一步优化中,以之前生成的解决方案和评分作为输入,大模型生成新的方案并评分,再将其添加到提示词中,供下一步优化使用。
论文主要使用谷歌的PaLM 2和Bard中的text-bison版本作为评测模型。
作为优化器,我们将使用四种模型,包括GPT-3.5和GPT-4
研究结果显示,不同的模型设计出的提示词风格以及适用的提示词风格也各不相同
此前在GPT系列上的AI设计出的最优提示词是“Let’s work this out in a step by step way to be sure we have the right answer.”
这个提示词使用APE方法设计,论文发表在ICLR 2023上,在GPT-3(text-davinci-002)上超过人类设计的版本“Let’s think step by step”。
在谷歌系的PaLM 2和Bard上,APE版本在这次作为基准测试中表现不如人类版本
OPRO方法设计出来的新提示词中,“深呼吸”和“拆解这个问题”对PaLM来说效果最好。
对于text-bison版的Bard大模型来说,更倾向于提供更详细的提示词
此外,该论文还展示了大型模型在数学优化器方面的潜力
线性回归作为连续优化问题的示例。
旅行商问题作为离散优化问题的示例。
仅仅通过提示,大模型就能找到不错的解决方案,有时甚至匹敌或超过手动设计的启发式算法。
然而,团队也认为大模型还无法替代传统基于梯度的优化算法。当问题规模较大时,例如节点数量较多的旅行商问题,OPRO方法的表现并不理想
团队提出了对未来改进方向的想法。他们认为目前的大模型还无法有效地利用错误案例,仅仅提供错误案例无法让大模型捕捉到错误的原因
一个有前景的方向是结合关于错误案例的更丰富的反馈,并总结优化轨迹中高质量和低质量生成提示的关键特征差异。
这些信息有可能帮助优化器模型更有效地改进过去生成的提示,并有可能进一步减少进行提示优化所需的样本数量
论文放出大量最优提示词
论文来自谷歌与DeepMind合并后的部门,但作者以原谷歌大脑团队为主,包括Quoc Le、周登勇。
共同一作为康奈尔大学博士毕业的复旦校友Chengrun Yang,和UC伯克利博士毕业的上交大校友陈昕昀。
团队还在论文中提供了许多实验中得到的最佳提示词,包括电影推荐、恶搞电影名字等实用场景。如果有需要的朋友,可以自行参考
论文地址:https://arxiv.org/abs/2309.03409
今天关于《AI自主设计提示词,谷歌DeepMind发现数学“深呼吸”能让大模型涨8分!》的内容介绍就到此结束,如果有什么疑问或者建议,可以在golang学习网公众号下多多回复交流;文中若有不正之处,也希望回复留言以告知!

- 上一篇
- Spotify 计划向 Premium 会员推出免费有声读物

- 下一篇
- 阿里国际站推出全球AI采购工具,引领行业变革
-
- 科技周边 · 人工智能 | 7小时前 |
- Deepseek联手Copy.ai,批量生成高质量文案
- 143浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 豆包AIWebSocket教程代码详解
- 349浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 特斯拉Robotaxi即将上线?最新消息揭秘
- 343浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 多模态AI解析工业图纸方法解析
- 206浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 文心一言短视频脚本怎么写?实战技巧全解析
- 337浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- PerplexityAI助力考古研究解析
- 342浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 即梦AI自动保存设置教程
- 119浏览 收藏
-
- 科技周边 · 人工智能 | 7小时前 |
- 多模态AI趋势:技术突破与市场前景
- 228浏览 收藏
-
- 科技周边 · 人工智能 | 8小时前 |
- 豆包AI优化NumPy的3个实用技巧
- 157浏览 收藏
-
- 科技周边 · 人工智能 | 8小时前 |
- 豆包AI生成with语句示例教程
- 129浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 542次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 509次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 497次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- 边界AI平台
- 探索AI边界平台,领先的智能AI对话、写作与画图生成工具。高效便捷,满足多样化需求。立即体验!
- 371次使用
-
- 免费AI认证证书
- 科大讯飞AI大学堂推出免费大模型工程师认证,助力您掌握AI技能,提升职场竞争力。体系化学习,实战项目,权威认证,助您成为企业级大模型应用人才。
- 384次使用
-
- 茅茅虫AIGC检测
- 茅茅虫AIGC检测,湖南茅茅虫科技有限公司倾力打造,运用NLP技术精准识别AI生成文本,提供论文、专著等学术文本的AIGC检测服务。支持多种格式,生成可视化报告,保障您的学术诚信和内容质量。
- 528次使用
-
- 赛林匹克平台(Challympics)
- 探索赛林匹克平台Challympics,一个聚焦人工智能、算力算法、量子计算等前沿技术的赛事聚合平台。连接产学研用,助力科技创新与产业升级。
- 629次使用
-
- 笔格AIPPT
- SEO 笔格AIPPT是135编辑器推出的AI智能PPT制作平台,依托DeepSeek大模型,实现智能大纲生成、一键PPT生成、AI文字优化、图像生成等功能。免费试用,提升PPT制作效率,适用于商务演示、教育培训等多种场景。
- 536次使用
-
- GPT-4王者加冕!读图做题性能炸天,凭自己就能考上斯坦福
- 2023-04-25 501浏览
-
- 单块V100训练模型提速72倍!尤洋团队新成果获AAAI 2023杰出论文奖
- 2023-04-24 501浏览
-
- ChatGPT 真的会接管世界吗?
- 2023-04-13 501浏览
-
- VR的终极形态是「假眼」?Neuralink前联合创始人掏出新产品:科学之眼!
- 2023-04-30 501浏览
-
- 实现实时制造可视性优势有哪些?
- 2023-04-15 501浏览