谷歌Gemini 3.1 Pro新王登场!一口气手搓Win11操作系统,造出模拟城市app,SVG效果绝了
智东西2月20日消息,今日凌晨,谷歌正式发布其新一代旗舰模型Gemini 3.1 Pro。根据谷歌放出的基准测试,谷歌最强复杂任务处理模型Gemini 3.1 Pro在12项测试中超过Gemini 3 Pro、Claude Opus 4.6、Claude Sonnet 4.6、GPT-5.2等模型,拿下第一。
从今日起,Google AI Pro、Ultra订阅用户可以在Gemini应用、AI助手NotebookLM中使用Gemini 3.1 Pro,免费用户可向Gemini 3.1 Pro提问2次。开发者和企业用户可以在AI Studio、Antigravity、Vertex AI、Gemini Enterprise、Gemini CLI及Android Studio的Gemini API预览版中使用Gemini 3.1 Pro。
研究人员在一系列基准测试中对Gemini 3.1 Pro进行了评估,包括推理、多模态能力、智能体工具使用、多语言性能和长上下文。
GDPval-AA Elo是当前衡量大模型在高价值知识工作中综合能力的相对评分体系,Gemini 3.1 Pro的表现优于GPT-5.2、GPT-5.3-Codex,仅次于Sonnet 4.6。
衡量大模型工具使用能力的τ2-bench、MCP Atlas、BrowseComp、多语言性能的MMLU、长上下能力的MRCR v2测试集中,新模型的表现同样优于其他模型。