← Journal
  • 免费
ReviewFEB 19, 20263 min

Gemini 3.1 Pro 怎么看、怎么用、值不值得接入

收录于 AI 模型选型与评估 →

Gemini 3.1 Pro 怎么看、怎么用、值不值得接入

【核心内容】

这代 Gemini 3.1 Pro 的核心信息其实不复杂:价格没涨,长上下文还在,纸面能力继续往上推,真正影响使用体验的反而是输出上限、渠道差异和接入方式。把官网、API、评分站和几个常用入口都列了出来,适合拿来做一次快速选型。

适合谁看

  • 想试 Gemini 新版,但不想先啃一堆英文文档的人
  • 需要 API 接入,关心价格和上下文成本的人
  • 在 Cursor、Antigravity 这类 IDE 里直接调用模型的人
  • 会拿它做长文处理、代码生成、复杂问答的人

先说结论

如果你看重 1M 上下文、想用 Google 原生系模型做长任务,Gemini 3.1 Pro 还是值得试。单看价格,输入 $2 / 输出 $12,超过 200k 上下文后变成输入 $4 / 输出 $18,和上一版相比没变。账面参数也基本没变:1M 上下文、最大输出标称 64k、训练截止到 2025 年 1 月。

但真到实际使用,别按 64k 输出去设计流程。最终可见输出大约只有 15k,不含思维链;而 gemini-3-pro 大概只有 5k。也就是说,长上下文能吃进去,不代表一次能完整吐出来。要做长报告、长代码、长改写,最好拆任务,不要一把梭。

你需要准备什么

  • 一个可用入口:官网/App、AI Studio、OpenRouter、LMArena Direct Chat
  • 如果走开发接入:AI Studio API、GCP API 或 OpenRouter API
  • 如果走 IDE:Cursor 已上线;Antigravity 需要更新到 260219 版本
  • 基本判断标准:你是想低门槛体验,还是要稳定 API,还是要在 IDE 里直接干活

按这个顺序做

  1. 先决定用途。 只是体验模型能力,先用官网/App 或 LMArena Direct Chat。免费能用,但额度和输出都会受限。2. 要测真实成本,直接看官方文档和价格页。 重点盯住两个阈值:常规价格区间,以及 200k 以上上下文的加价区间。3. 要接 API,优先在 AI Studio 和 OpenRouter 之间选。AI Studio 更接近原生入口;OpenRouter 适合已经有统一转发层的人。GCP API 适合已经在 Google Cloud 体系里的人。4. 要在 IDE 里干活,先查版本。Cursor 已支持。Antigravity 不更新到 260219,用不了 3.1。5. 真正落地时,把长任务拆成多段。 先让它做提纲、分块、校对,再做最终拼接,别直接要求一口气输出超长成品。

这里最容易踩坑

  • 把“最大输出 64k”当成真实可用上限。实际不是这么回事。
  • 看到 1M 上下文就以为超长任务能一次完成,结果卡在输出阶段。
  • 用免费聊天入口测试后,直接拿结果判断 API 上限,结论会偏。
  • LMArena、Artificial Analysis、HLE、ARC-AGI-2 这些榜单只能辅助判断,不能替代你自己的业务测试。
  • LiveBench 当时还没上线,后续分数变化这里没展开,建议自行验证。

我的建议

如果你是普通用户,先从官网/App 或 LMArena 试手感;如果你是开发者,直接走 API 做三组测试:长上下文检索、代码生成、长文改写。重点不要看它“能不能答”,而要看它“能不能稳定答完”。

真要接入生产,先按 15k 实际输出上限设计流程,把摘要、重写、生成、校对拆开。这样最省钱,也最不容易翻车。