Science:多问蠢问题,能让人工智能很快变聪明
小伙伴们有没有觉得学习科技周边很有意思?有意思就对了!今天就给大家带来《Science:多问蠢问题,能让人工智能很快变聪明》,以下内容将会涉及到,若是在学习中对其中部分知识点有疑问,或许看了本文就能帮到你!
斯坦福大学一项新的研究表明,人工智能可以通过问一些看起来很愚蠢的问题来帮助它们变得更加聪明。研究人员研发的新系统在回答 Instagram 上的相似问题时,其准确率提高了 118%。
如果有人给你看一张鳄鱼的照片,并问你它是不是一只鸟?你可能会哈哈大笑。一项新的研究表明,这种在我们看来有些愚蠢的互动可能是帮助人工智能学习的关键。
在该研究中,这种方法显著提高了人工智能解释新图像的准确性,可以帮助人工智能开发者更快地设计程序,以完成从诊断疾病到引导机器人或其他设备自行在家中运转的所有工作。
一、让 AI 主动提问,弥补知识空白
“这是一项超酷的工作!”谷歌机器学习研究学者 Natasha Jaques 说,但她并未参与这项研究。
许多人工智能系统会选择一种被称为机器学习的方法使其变得更智能。这种方法是通过大量数据集来训练人工智能,其所需的时间和工作量都十分巨大。例如,系统在分析数千张家具图片后让人工智能找到椅子的样子。
但即使是巨大的数据集也会存在缺口。比如,图像中的物体可以被标记为一把椅子,但它是由什么制成的?你是否可以坐在上面?这些问题却无法得知。
为了帮助人工智能扩展它们对世界的理解,研究人员现在正试图开发一种计算机程序,用以实现在定位人工智能知识空白,并找出如何通过询问陌生人填补知识的方法。人工智能向陌生人提出自己不了解的问题,并期待得到回答,就像孩子问父母天空为什么是蓝的一样。这项新研究的最终目标是让人工智能能够正确回答有关它以前从未见过的图像的各种问题。
在之前的“主动学习”研究中,人工智能会评估自己的无知程度,并要求获得更多信息。这种方式通常需要研究人员向提供这类信息的在线工作者支付报酬,所以这种方法在一定程度上无法规模化。
因此,在这项新研究中,由计算机视觉和人机交互交叉领域学者 Ranjay Krishna 领导的 Stanford University(斯坦福大学)的研究人员训练了一个机器学习系统,不仅能发现该系统知识的空白,还能通过询问陌生人,如:“水槽是什么形状的?”等愚蠢的问题,以获得答案的方式进行学习。比如,机器学习系统询问:“图中是什么甜点?”陌生人回答:“它是椰子蛋糕。”

▲机器学习系统询问示例
二、发图、提问、学习一气呵成,准确率提升 118%
北卡罗来纳大学教堂山分校的社会心理学家 Kurt Gray 说:“非常重要的一件事是要思考人工智能应该如何呈现自己。 在这种情况下,你希望它像一个孩子,不是吗?”否则,人们可能会因为你问的问题看起来很荒谬而认为你是一个喷子。他的主要研究方向是人类与人工智能的互动,但没有参与这项工作。
该团队还为这一系统建立了“奖励”机制,当人工智能得到了人们反馈的问题答案,就会反过来让人工智能调整其内部运作,以便在未来能够有效应对相关问题。在这基础上,随着时间的推移,人工智能就能进一步学习语言和社会规范方面的知识,让自己变得越来越聪明,并提升它提出易于回答且更有意义的问题的能力。
这种新型的人工智能有几个组成部分,包括一些神经网络,受大脑结构启发的复杂数学函数。Krishna 说:“它们包含很多部分……都需要一起发挥作用。”其中一个部分会在社交媒体 Instagram 上选择一张图片,比如日落,第二个部分会就这张照片提出一个问题,例如,“这张照片是在晚上拍的吗?”其余部分则会从读者的回答中提取信息,并从中了解图像包含的内容的含义。
该团队昨天发表在《美国国家科学院院刊》上的报告显示,在 8 个月的时间里,通过在 Instagram 上提出超过 20 万个问题,该系统回答类似问题的准确率提高了 118%。而一个在 Instagram 上发布问题,但并没有经过明确的训练来提高反应率的比较系统,其准确率只提高了 72%,部分原因是人们更经常地忽略它。 三、AI 也卷起来了?主动向人类寻求帮助
Jaques 认为,主要的创新是奖励让人类做出反应的系统,“从技术角度来说,这并不疯狂,但从研究方向的角度来说非常重要。” Instagram 上大规模的问题发布也给她留下了深刻的印象。在发布所有人工智能生成的问题之前,人类会检查这些问题是否有冒犯性内容。
研究人员希望像他们这样的系统最终能帮助人工智能理解常识、帮助机器人主动交互、增强聊天机器人与人交流的能力等,比如人工智能通过询问问题知道椅子是木头做的、嵌入人工智能的吸尘器会询问去厨房的路、聊天机器人与人们谈论客户服务或天气等。
Jaques 说,社交技能也可以帮助人工智能快速适应新情况。例如,自动驾驶汽车可能会在施工区导航时寻求帮助。“如果你能有效地向人类学习,这是一项非常普遍的技能。”
结语:蠢问题或让 AI 走向更加智能之路
人们有时震惊于人工智能的学习能力,比如阿尔法狗。但人工智能在面临复杂问题时的表现却不尽如人意,往往答非所问。
这项新研究探索了机器学习的新方向,将会助力人工智能理解常识,变得更加智能。但这项技术对于提高人工智能处理复杂问题的能力仍需有待验证。
文中关于人工智能,科学的知识介绍,希望对你的学习有所帮助!若是受益匪浅,那就动动鼠标收藏这篇《Science:多问蠢问题,能让人工智能很快变聪明》文章吧,也可关注golang学习网公众号了解相关技术文章。
修复:Windows 11 保持随机冻结
- 上一篇
- 修复:Windows 11 保持随机冻结
- 下一篇
- eBay使用机器学习完善促销列表
-
- 科技周边 · 人工智能 | 10小时前 | 人工智能 · rag · 语义检索重排器 第二阶段重排 Cross-Encoder Retrieve and Re-Rank Recall@K
- 语义检索重排器何时值得加入第二阶段
- 449浏览 收藏
-
- 科技周边 · 人工智能 | 15小时前 | 缓存 · 人工智能 · 提示词工程 · 提示词缓存 cache_control Prompt Caching 静态前缀 cache_read_input_tokens
- 提示词缓存命中率低应如何划分静态前缀
- 453浏览 收藏
-
- 科技周边 · 人工智能 | 17小时前 |
- 模型路由怎样按任务难度分配不同推理预算
- 232浏览 收藏
-
- 科技周边 · 人工智能 | 19小时前 |
- 结构化输出遇到递归字段时怎样约束模式
- 215浏览 收藏
-
- 科技周边 · 人工智能 | 21小时前 | 人工智能 · 工具调用 ·
- 智能体工具调用失败后怎样设计可控重试
- 236浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- 多模态模型输入图片过大时如何控制视觉令牌
- 196浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- 推理服务连续批处理怎样减少 GPU 空转
- 404浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 | 人工智能 · LoRa PEFT merge_and_unload 量化推理 模型合并
- LoRA 合并权重后输出变化过大应检查什么
- 404浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 |
- RAG 分块重叠过大为什么会降低检索多样性
- 409浏览 收藏
-
- 科技周边 · 人工智能 | 1天前 | 人工智能 ·
- 合成数据能否替代真实样本:覆盖率与偏差检查方法
- 128浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 400次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 478次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 487次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 433次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 259次使用
-
- 本地大模型反复输出同一句话怎么调整生成参数
- 2026-09-06 501浏览
-
- Python 调用大模型时如何用结构化输出校验 JSON:从解析失败到可重试
- 2026-08-29 501浏览
-
- AI写作工具免费版安装教程(含豆包Clawdbot)
- 2026-05-30 501浏览
-
- WPS AI能自动生成PPT吗?输入主题一键制作演示文稿
- 2026-05-27 501浏览
-
- Canva手机闪退解决方法及适配指南
- 2026-05-25 501浏览
