时间序列也能和大模型结合?亚马逊最新工作,大模型可解释时序预测
怎么入门科技周边编程?需要学习哪些知识点?这是新手们刚接触编程时常见的问题;下面golang学习网就来给大家整理分享一些知识点,希望能够给初学者一些帮助。本篇文章就来介绍《时间序列也能和大模型结合?亚马逊最新工作,大模型可解释时序预测》,涉及到,有需要的可以收藏一下
这几天亚马逊发布了一篇使用大模型做时间序列预测的工作,属于大模型在时序预测中的第一次探索,利用大模型提升金融场景预测中的多模态数据处理能力和可解释能力。这篇文章是一个有趣的探索工作,可以借鉴其思路,但要达到SOTA效果还需要进一步的研究。下面给大家介绍一下这篇文章的建模思路。

论文标题:Temporal Data Meets LLM - Explainable Financial Time Series Forecasting
下载地址:https://arxiv.org/pdf/2306.11025v1.pdf
1、问题背景
金融领域是时间序列预测技术的一个重要应用场景。与普通的时序预测不同,金融领域的时间序列预测建模面对着更加复杂的挑战,而这些挑战可以使用大模型来解决,主要体现在以下3个方面。
第一点是如何建模复杂的序列间关系。在股价预测中,不同股票价格之间存在很强的依赖关系或关联关系,因此能否建模好序列间关系至关重要。大模型的序列建模能力和多序列关系建模很强,因此我们可以尝试将大模型这些能力应用到序列预测中。
第二点是对文本数据的处理能力。目前的金融场景时间序列预测问题,很多都重点研究如何处理金融资讯信息,融入到时间序列预测建模中。股价的波动很多程度上来源于金融资讯,只靠单纯的时间序列建模是无法涵盖全部信息的。这种多模态信息的有效引入,对于金融场景时序预测效果有很大帮助。大模型天然的具有强大的文本处理能力,因此自然成为这个问题的有力解决方案。
第三点是可解释性,这也是各个领域的深度学习模型都追求的一个点,如何让模型的预测结果更具可解释性,能让预测结果更有价值,指导我们的行动。大模型的可解释性也很强,例如通过思维链等方式让大模型生成给出答案的原因。
基于以上考虑,本文尝试了利用大模型做时间序列,同时解决上述3个问题。
2、实现方法
整体的建模方法主要包括对时间序列的处理、对文本信息的引入、prompt设计、基于Instruction Tuning的大模型微调4个部分。
时间序列处理:文中将时间序列通过离散化的方式转换为符号表示,文中的预测目标是纳斯达克100各个公司股票投资回报,即周期末相比周期初股价涨幅。文中将涨幅变成符号,比如D1代表跌1%以内,U2代表涨2%以内等等。处理成这种符号化的表示,方便输入到后续的大模型中。
文本信息引入:在文本信息方面,文中利用GPT4进行信息生成,包括公司的整体介绍、可能影响股价的优势和劣势等文本信息。此外,对于新闻资讯信息,使用GPT4进行摘要生成和关键字抽取,作为后续的输入。公司介绍和摘要生成的例子如下:


prompt设计:有了上述信息,整体的预测prompt如下图所示,输入包括离散化后的时间序列符号化表示、GPT4生成的公司简介、新闻摘要等信息,让大模型给出预测结果。

Instruction Tuning:只基于这种zero-shot的方式可能无法发挥大模型最强的能力,因此文中进一步采用了Instruction Tuning,使用上述方式构造30k的周预测和7k月预测数据,用开源的LLaMa模型进行Instruction Tuning。(关于Instruction Tuning在之前的文章有过多次介绍,本质上就是将任务转换成文本,以语言模型为目标微调大模型)
3、实验结果
本表展示了本文中的实验结果,主要对比了大模型之间的效果,并与一些简单时间序列预测方法进行了效果差异比较。整体来看,用大模型进行这种粗粒度预测是可行的,同时GPT4的效果非常显著,GPT4的few-shot效果要优于基于LLaMa的instruction tuning方法。

4、总结
大模型在序列数据上的应用,是一个值得研究的点。文中通过这种离散化时间序列的方式,进行基于大模型的预测,是有潜力改变金融场景时间序列预测范式的一个方式。
到这里,我们也就讲完了《时间序列也能和大模型结合?亚马逊最新工作,大模型可解释时序预测》的内容了。个人认为,基础知识的学习和巩固,是为了更好的将其运用到项目中,欢迎关注golang学习网公众号,带你了解更多关于模型,亚马逊,时间序列的知识点!
使用Golang的Web框架Iris框架实现分布式系统监控
- 上一篇
- 使用Golang的Web框架Iris框架实现分布式系统监控
- 下一篇
- 如何在golang中使用正则表达式验证密码是否包含空格
-
- 科技周边 · 人工智能 | 3小时前 | 人工智能 · Python教程 · 图像尺寸 Pillow ControlNet diffusers 条件图
- Diffusers ControlNet 条件图尺寸匹配的处理
- 314浏览 收藏
-
- 科技周边 · 人工智能 | 15小时前 | python · 人工智能 · 模型评测 Hugging Face Evaluate 指标输入格式 predictions references
- Hugging Face Evaluate 统一指标输入格式
- 134浏览 收藏
-
- 科技周边 · 人工智能 | 17小时前 |
- RAG 检索结果去重与上下文长度控制
- 357浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 |
- Tokenizer padding_side 影响批量生成的对齐
- 206浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 | python · 人工智能 · 数据迭代 Hugging Face Datasets streaming IterableDataset 大语料
- Datasets streaming 读取大语料的迭代方式
- 337浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 | python · Transformers generate 停止条件 批量输出
- Transformers generate 的停止条件与批量输出
- 133浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 | 人工智能 · LoRa 显存优化 bitsandbytes QLoRA 4-bit量化
- bitsandbytes 量化模型配合 LoRA 训练的显存边界
- 249浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 | 人工智能 · LoRa PEFT load_adapter set_adapter 适配器切换
- PEFT LoRA 适配器按任务切换的加载方案
- 268浏览 收藏
-
- 科技周边 · 人工智能 | 3天前 | 人工智能 · LoRa PEFT merge_and_unload 适配器合并
- PEFT 适配器合并后为什么输出会变化
- 221浏览 收藏
-
- 科技周边 · 人工智能 | 4天前 |
- Tokenizer 左填充和右填充应该怎么选
- 399浏览 收藏
-
- 科技周边 · 人工智能 | 4天前 |
- Safetensors 为什么支持按需读取权重切片
- 258浏览 收藏
-
- 科技周边 · 人工智能 | 4天前 |
- MLflow Model Alias 怎么替代固定版本号部署
- 360浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 293次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 346次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 352次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 315次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 135次使用
-
- 本地大模型反复输出同一句话怎么调整生成参数
- 2026-09-06 501浏览
-
- Python 调用大模型时如何用结构化输出校验 JSON:从解析失败到可重试
- 2026-08-29 501浏览
-
- AI写作工具免费版安装教程(含豆包Clawdbot)
- 2026-05-30 501浏览
-
- WPS AI能自动生成PPT吗?输入主题一键制作演示文稿
- 2026-05-27 501浏览
-
- Canva手机闪退解决方法及适配指南
- 2026-05-25 501浏览

