当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > 1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

2025-01-27 22:52:18 0浏览收藏

IT行业相对于一般传统行业，发展更新速度更快，一旦停止了学习，很快就会被行业所淘汰。所以我们需要踏踏实实的不断学习，精进自己的技术，尤其是初学者。今天golang学习网给大家整理了《1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首》，聊聊，我们一起来看看吧！

谷歌Gemini 2.0 Flash Thinking升级版强势回归，再登Chatbot Arena榜首！

谷歌AI负责人Jeff Dean发布贺信，宣布此次更新引入了1M长度上下文窗口，显著提升了模型对长篇文本的分析能力，并改善了模型的可靠性及答案一致性。体验链接：https://aistudio.google.com/prompts/new_chat

回顾12月20日Gemini 2.0 Flash Thinking横空出世，其强大的推理能力曾盖过OpenAI的风头。该模型基于Gemini 2.0 Flash，通过引入思维链增强推理能力，一经发布便登顶Chatbot Arena榜首。

Gemini 2.0 Flash Thinking的两大技术突破：支持高达1M token的长上下文理解；具备多轮对话及推理中的自我纠错能力。

该模型的一大亮点是清晰展示其思考过程。Jeff Dean此前演示中，模型在1分钟内解答了物理问题并详细解释了推理步骤。有研究者反馈，最新模型Gemini-2.0-Flash-Thinking-Exp-01-21的实际运行速度甚至更快。

在AIME2024、GPQA Diamond和MMMU等测试中，Gemini 2.0 Flash Thinking均取得了显著进步，尤其数学能力提升了54%，远超前代模型Gemini 1.5 Pro 002和Gemini 2.0 Flash EXP。其进步之显著，即使与一个月前的自身相比也差异巨大。

在AGI House活动中，Jeff Dean和Mostafa Dehghani进一步揭秘了Gemini 2.0 Flash Thinking和Gemini 2.0的细节。 Gemini系列模型均集成在名为“Google AI Studio”的平台上。

该平台提供API密钥、提示词创建、实时对话、APP开发等功能，并支持模型调优、资源库管理及Drive集成等高级功能，同时配备提示词库、API文档和开发者论坛等资源。但目前界面功能分散，用户体验有待提升，Jeff Dean表示将在正式发布时提供完整技术报告，目前主要目标是收集用户反馈，持续改进。^{Gemini 2.0 Flash Thinking 互动界面}

谷歌的开发理念注重“全面均衡”，力求打造一个能够胜任各种任务的通用模型，而非在特定领域过度特化。他们将持续收集用户反馈，并利用更多数据进行改进。

Gemini 2.0 Flash Thinking 的超长上下文窗口是其一大亮点，但Jeff Dean强调，该模型能够在对话中保持思维连贯性，并有效利用先前信息完成当前任务。上下文窗口信息对于模型来说清晰明了，如同修改图片一样精准。

以下demo展示了Gemini 2.0的先进多模态理解能力，能够根据语音指令实时调整界面元素布局，甚至能根据颜色指令混合颜色。这得益于Project Mariner项目，该项目旨在探索人机交互方式，并赋予AI理解和操作网页浏览器能力，其功能类似于Claude的“computer use”。传送门：https://deepmind.google/technologies/project-mariner/