1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首-人工智能-PHP中文网

1M长上下文，满血版Gemini 2.0又一次登上Chatbot Arena榜首

DDD

发布： 2025-01-22 16:20:01

原创

1011人浏览过

谷歌 gemini 2.0 flash thinking升级版强势回归，再登chatbot arena榜首！

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

谷歌AI负责人Jeff Dean发布贺信，宣布此次更新引入了1M长度上下文窗口，显著提升了模型对长篇文本的分析能力，并改善了模型的可靠性及答案一致性。体验链接：https://www.php.cn/link/042b1cd756a6b6b7c3517cd63eea2325

回顾12月20日Gemini 2.0 Flash Thinking横空出世，其强大的推理能力曾盖过OpenAI的风头。该模型基于Gemini 2.0 Flash，通过引入思维链增强推理能力，一经发布便登顶Chatbot Arena榜首。

Gemini 2.0 Flash Thinking的两大技术突破：支持高达1M token的长上下文理解；具备多轮对话及推理中的自我纠错能力。

该模型的一大亮点是清晰展示其思考过程。Jeff Dean此前演示中，模型在1分钟内解答了物理问题并详细解释了推理步骤。有研究者反馈，最新模型Gemini-2.0-Flash-Thinking-Exp-01-21的实际运行速度甚至更快。

在AIME2024、GPQA Diamond和MMMU等测试中，Gemini 2.0 Flash Thinking均取得了显著进步，尤其数学能力提升了54%，远超前代模型Gemini 1.5 Pro 002和Gemini 2.0 Flash EXP。其进步之显著，即使与一个月前的自身相比也差异巨大。

在AGI House活动中，Jeff Dean和Mostafa Dehghani进一步揭秘了Gemini 2.0 Flash Thinking和Gemini 2.0的细节。 Gemini系列模型均集成在名为“Google AI Studio”的平台上。

该平台提供API密钥、提示词创建、实时对话、APP开发等功能，并支持模型调优、资源库管理及Drive集成等高级功能，同时配备提示词库、API文档和开发者论坛等资源。但目前界面功能分散，用户体验有待提升，Jeff Dean表示将在正式发布时提供完整技术报告，目前主要目标是收集用户反馈，持续改进。^{Gemini 2.0 Flash Thinking 互动界面}

SEEK.ai

AI驱动的智能数据解决方案，询问您的任何数据并立即获得答案

128

查看详情

谷歌的开发理念注重“全面均衡”，力求打造一个能够胜任各种任务的通用模型，而非在特定领域过度特化。他们将持续收集用户反馈，并利用更多数据进行改进。

Gemini 2.0 Flash Thinking 的超长上下文窗口是其一大亮点，但Jeff Dean强调，该模型能够在对话中保持思维连贯性，并有效利用先前信息完成当前任务。上下文窗口信息对于模型来说清晰明了，如同修改图片一样精准。

以下demo展示了Gemini 2.0的先进多模态理解能力，能够根据语音指令实时调整界面元素布局，甚至能根据颜色指令混合颜色。这得益于Project Mariner项目，该项目旨在探索人机交互方式，并赋予AI理解和操作网页浏览器能力，其功能类似于Claude的“computer use”。传送门：https://www.php.cn/link/b3bf6193684f3983bb8642c8add75a4a