当前位置:首页 > 文章列表 > 科技周边 > 人工智能 > ChatGPT化身政治说客:帮企业判断是否受政府新法案影响,甚至写信建议修改立法

ChatGPT化身政治说客:帮企业判断是否受政府新法案影响,甚至写信建议修改立法

来源:51CTO.COM 2023-04-13 11:23:25 0浏览 收藏

小伙伴们有没有觉得学习科技周边很有意思?有意思就对了!今天就给大家带来《ChatGPT化身政治说客:帮企业判断是否受政府新法案影响,甚至写信建议修改立法》,以下内容将会涉及到,若是在学习中对其中部分知识点有疑问,或许看了本文就能帮到你!

​如果说纽约“华尔街”是国际金融中心的话,那么华盛顿的“K街”可谓是风云变幻的国际政治中心。

华盛顿的“K街”离白宫不远,这里有着一群专业的“政治说客”,每当美国政府有了新的法案草案,他们就会花费大量时间仔细研究法案草案,以评估它们是否与他们的客户相关,这些客户通常是各大企业。

美国政府各种法案的威力不用多说了,比如近期通过的《芯片与科学法案》,直接受到波及的半导体企业就为数不少,及时了解各类法案会不会影响到自己,成为企业政策研究的重中之重。

图片

现在,这项工作也可能要被ChatGPT取代了。

斯坦福法律信息中心的研究员约翰 · 内(John Nay)最新的研究显示,AI模型能够在75%的情况下预测一份美国国会法案的摘要是否与特定公司有关,更重要的是,随后能够起草一封信给该法案的发起人,主张对立法进行修改,这个模型和ChatGPT一样,背后同样也是 OpenAI 的GPT-3 大语言模型(LLM)。

图片

论文 arXiv 预印本:https://arxiv.org/ftp/arxiv/papers/2301/2301.01181.pdf

读政府法案,判断法案影响,准确率75%

约翰 · 内(John Nay)的论文显示,他基于OpenAI 的 GPT-3大语言模型(LLM) 开发的初级 AI 说客,可以在读取一份美国国会法案的摘要的基础上,判断一份美国国会法案的摘要是否与特定公司有关。

比如上面提到的芯片法案,如果你有一家涉及半导体产业的公司,但并非主要业务,你不确定芯片法案是否会影响到你的公司,那么这个AI就可以告诉你答案,准确率高达75%。

这是如何做到的呢?

首先,当然是AI如何理解文本的问题,这个需要大量的数据用来训练,约翰 · 内(John Nay)的方法是收集大量法案数据和企业数据,通过 OpenAI 的 API 为模型提供文本提示。

法案数据包括法案的标题、法案摘要、由国会确定的法案主题,公司数据由公司的名称以及该公司向美国证券交易委员会提交的业务描述作为数据组成。

给AI模型的任务示例如下:

图片

你是一名游说者,分析国会法案对公司的潜在影响。

鉴于该法案的标题和摘要,以及其 10K SEC 文件中有关公司的信息,你的工作是确定该法案是否至少与公司有一定的相关性(就是否会影响公司而言,如果它之后被实施)。

法案的官方标题:{official_title}

法案的官方摘要:{summary_text}

法案的官方主题:{subjects}

公司名称:{company_name}

公司业务描述:{business_description}

该法案是否与该公司潜在相关?

以这种格式回答:回答:“是”或“否”(全部大写)。

说明:您为做出回应而进行的逐步推理。置信度:0 到 100 之间的整数,用于估计您对答案的置信度(1 为低置信度,99 为高置信度)

完成训练之后,约翰 · 内(John Nay)整理了335张法案的数据,然后对模型进行挑战,以预测它们是否与121家独特的公司有关。

因为大多数立法不会影响到大多数公司,他发现,只要总是说“不”,模型就可以猜对 70.9% 的情况。当他在2022年3月发布的旧版本 GPT-3上测试这种方法时,结果比那糟糕得多,预测准确率只有52.2% 。

但是,当在2022年11月才公布于众的 GPT-3.5模型(也就是ChatGPT的大脑)上进行试验时,它的准确率达到了75.1% 。在置信度评分超过90的法案上,准确率上升到79%。

如果法案与企业有关,还能自动生成法案修改建议

对于判定相关的情况,AI还会给出相关的理由,比如:

图片

答:是

解释:Alkermes Plc 是一家生物制药公司,开发和商业化旨在解决主要治疗领域(包括成瘾和精神分裂症)患者未满足的医疗需求的产品。该法案要求医疗保险和医疗补助服务中心 (CMS) 与制药公司就医疗保险处方药福利所涵盖的药物价格进行谈判,这可能会影响 Alkermes Plc 的产品。

置信度:95

更重要的是,如果判断法案与企业有关,AI随后能够起草一封信给该法案的发起人,主张对立法进行修改。

比如这样的一封信:

图片

论文没有评估起草的信件在影响政策方面有多大效果,约翰 · 内(John Nay)明确表示,这种方法还远远不能完成游说者的大部分工作。

但他表示,相隔数月发布的模型在预测性能方面的显著提升是值得注意的。他表示: “目前有一个明显的趋势,就是能力将迅速增强。”

“立法程序还没有为此做好准备,”同时他还表示。“这只是几天内构建的一个简单的概念证明。随着更多的资源和更多的时间花在这上面,特别是随着更多的关注于建立工作流程和用户体验与人类说客的日常工作联系在一起,这可能会建成一些相对复杂的东西。”​

今天关于《ChatGPT化身政治说客:帮企业判断是否受政府新法案影响,甚至写信建议修改立法》的内容就介绍到这里了,是不是学起来一目了然!想要了解更多关于ChatGPT,AI的内容请关注golang学习网公众号!

版本声明
本文转载于:51CTO.COM 如有侵犯,请联系study_golang@163.com删除
Siri太笨,根本打不过ChatGPT!苹果加急测试语言生成AISiri太笨,根本打不过ChatGPT!苹果加急测试语言生成AI
上一篇
Siri太笨,根本打不过ChatGPT!苹果加急测试语言生成AI
加速ViT模型新思路!Meta推出Token Merging,不靠剪枝靠合并
下一篇
加速ViT模型新思路!Meta推出Token Merging,不靠剪枝靠合并
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    421次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    500次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    510次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    456次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    285次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码