Gemini 3.1 Pro 更新解读
Gemini 3.1 Pro 在 SWE-bench Verified 达到 80.6%,输出上限提升至 6.5 万 token,本文解读更新要点和适合纳入的工作流。

版本更新要点
Google 于 2026 年 2 月 19 日发布 Gemini 3.1 Pro,是 Gemini 系列首次采用".1"形式的中期更新[1][2]。核心编程相关基准都有明显提升:SWE-bench Verified 从上一代的 76.2% 提升到 80.6%,LiveCodeBench Pro 从 2439 Elo 提升到 2887 Elo,Terminal-Bench 2.0 从 56.9% 提升到 68.5%[2]。官方文档显示输出上限达到 6.5 万 token,比上一代有明显提升,缓解了此前对大文件做全量重构时容易被截断、需要反复"继续生成"的痛点[3]。
长上下文与性价比优势
Gemini 3.1 Pro 延续了系列一贯的长上下文优势,支持 100 万 token 的输入上下文,能一次性读入整个代码仓库或长篇文档[1][3]。价格方面维持在每百万 token 输入 2 美元、输出 12 美元的区间,同等定价档位里少有对手[2]。这次更新还引入了可调节的思维等级(Low/Medium/High),可以按任务复杂度在延迟、成本和推理深度之间做取舍[2][3]。
适合纳入的工作流
理解没有文档的大型遗留代码库、跨文件的架构梳理、需要一次性输出较大改动量的重构任务,是 Gemini 3.1 Pro 长上下文和更高输出上限组合发挥作用的典型场景。日常小范围的代码补全,用它和用其他轻量模型的体感差异不大,没必要为了这类任务专门切换。
常见问题
Gemini 3.1 Pro 和 3 Pro 版本能一起用吗?
不能,Google 官方公告 2026 年 3 月 9 日起停用 Gemini 3 Pro Preview,用户需要迁移到 3.1 版本[1]。
输出上限提升具体解决了什么问题?
此前版本的输出上限较低,处理大文件全量重构时容易被截断,需要手动多次触发继续生成;官方文档显示 Gemini 3.1 Pro 的输出上限已提升到 6.5 万 token,一次性输出更大篇幅的重构结果成为可能[3]。
长上下文场景下费用会不会很高?
Gemini 3.1 Pro 的输入输出单价在同类旗舰模型里属于较低区间,长上下文场景虽然消耗的输入 token 更多,但结合较低的单价,综合成本相比其他旗舰模型仍然有优势。