# Google Gemini 原始搜索结果(2026年6月) > 搜索时间:2026-06-21 > 搜索关键词: > 1. "Google Gemini 2.5 Pro features 2026" > 2. "Gemini Deep Research Canvas Live features" > 3. "Gemini vs ChatGPT comparison 2026" > 4. "Gemini 3.1 Pro 3 Flash model family pricing 2026" > 5. "Gemini Personal Intelligence Gmail Drive Calendar integration 2026" > 6. "Gemini Project Mariner Computer Use 2026" > > 本文档为原始搜索结果汇总,未做精炼处理。 --- ## 目录 1. [模型矩阵与定价](#1-模型矩阵与定价) 2. [Gemini 2.5 系列核心能力](#2-gemini-25-系列核心能力) 3. [Gemini 3.x 系列最新进展](#3-gemini-3x-系列最新进展) 4. [Deep Research / Deep Research Max](#4-deep-research--deep-research-max) 5. [Canvas 功能](#5-canvas-功能) 6. [Gemini Live / Project Astra / Search Live](#6-gemini-live--project-astra--search-live) 7. [Personal Intelligence(Google生态整合)](#7-personal-intelligencegoogle生态整合) 8. [Project Mariner / Computer Use / Gemini Agent](#8-project-mariner--computer-use--gemini-agent) 9. [Gems(自定义AI助手)](#9-gems自定义ai助手) 10. [NotebookLM / Audio Overviews](#10-notebooklm--audio-overviews) 11. [多模态能力(Imagen / Veo / Lyria)](#11-多模态能力imagen--veo--lyria) 12. [Gemini vs ChatGPT 对比](#12-gemini-vs-chatgpt-对比) 13. [MCP 支持](#13-mcp-支持) 14. [Benchmark 性能数据](#14-benchmark-性能数据) 15. [定价与订阅方案](#15-定价与订阅方案) --- ## 1. 模型矩阵与定价 ### 来源:Google AI Developer 官方定价页 / Metacto 分析(2026年5月) #### 2026年5月 API 定价总表 | Gemini 模型 | 输入 ($/1M token) | 输出 ($/1M token) | Batch 输出 ($/1M) | 上下文窗口 | 定位 | |:------------|:-----------------|:------------------|:------------------|:----------|:-----| | 2.5 Flash-Lite | $0.10 | $0.40 | $0.20 | 1M | 最便宜层级,高吞吐 | | 3.1 Flash-Lite | $0.25 | $1.50 | $0.75 | 1M | 最新性价比模型 | | 2.5 Flash | $0.30 | $2.50 | $1.25 | 1M | 速度/成本平衡 | | 3 Flash | $0.50 | $3.00 | $1.50 | 1M | 最新代 Flash | | **3.5 Flash** (NEW 5月19日) | $1.50 | $9.00 | $4.50 | 1M | 编码能力超过 3.1 Pro | | 2.5 Pro (≤200K) | $1.25 | $10.00 | $5.00 | 1M | 推理、大上下文 | | 2.5 Pro (>200K) | $2.50 | $15.00 | $7.50 | 1M | 长上下文推理 | | **3.1 Pro** (≤200K) | $2.00 | $12.00 | $6.00 | 2M | 旗舰推理模型 | | 3.1 Pro (>200K) | $4.00 | $18.00 | $9.00 | 2M | 行业最大上下文 | #### 关键更新(2026年5月) - **Gemini 3.5 Flash** 在 Google I/O 2026(5月19日)发布,$1.50/$9 per 1M tokens,1M 上下文窗口,编码和智能体基准测试超越 3.1 Pro - **Gemini 2.0 Flash 于 2026年6月1日 关闭**,需立即迁移 - **2026年4月1日起** Pro 模型转为付费专用,免费层仅保留 Flash 和 Flash-Lite - **Batch API 折扣 50%**,24小时处理 SLA - **Context Caching** 可减少重复 prompt 成本高达 ~90% - **Gemini 3.1 Pro GA** 拥有 2M token 上下文窗口(行业最大) ### Gemini 3 代模型比较 | 模型 | 输入 ($/1M) | 输出 ($/1M) | 输入上下文 | 输出上限 | 定位 | |:-----|:----------|:-----------|:----------|:--------|:-----| | Gemini 3.1 Pro | $2.00/$4.00 | $12.00/$18.00 | 1M (实际2M) | 64K | 高级推理 + Agentic Coding | | Gemini 3 Flash | $0.50 | $3.00 | 1M | 65K | 前沿性能,低成本 | | Gemini 3.1 Flash-Lite | $0.25 | $1.50 | 1M | 65K | 最便宜最快 | > 注意:没有叫 "Gemini Ultra" 的 API 模型。"Ultra" 只是 Google AI Ultra 消费者订阅层级名称($249.99/月),不是 API 可寻址模型。 #### Gemini 2.5 退役计划 - Gemini 2.5 Pro, Flash, Flash-Lite 在 AI Studio / Gemini API 的弃用日期:**2026年6月17日** - Vertex AI 退役日期:**2026年10月16日** ### 免费层变更(2026年4月1日起) | 变更项 | 变更前(3月) | 变更后(4月起) | |:-------|:------------|:--------------| | Pro 模型访问 | 免费层可用(有配额) | 仅限付费用户 | | Flash 模型访问 | 免费层可用 | 免费层仍可用 | | 月度支出上限 | 无强制上限 | 分层强制上限 | | Gemini 3.x 新模型 | 部分免费预览 | 全部需付费 | #### 免费层配额 | 模型 | 免费层配额 | RPM | 每日请求 | Token 限制 | |:-----|:----------|:---|:--------|:----------| | Gemini 2.5 Pro | ✅ 保留 | 5 RPM | 100/天 | 250K/分钟 | | Gemini 2.5 Flash | ✅ 保留 | 10 RPM | 250/天 | 250K/分钟 | | Gemini 2.5 Flash-Lite | ✅ 保留 | 15 RPM | 1,000/天 | 250K/分钟 | | Gemini 3.1 Pro | ❌ 已移除 | — | — | 仅付费 | | Gemini 3 Flash | ❌ 已移除 | — | — | 仅付费 | --- ## 2. Gemini 2.5 系列核心能力 ### 来源:Google DeepMind 官方报告 #### Gemini 2.X 模型家族对比 | 能力 | Flash 1.5 | Pro 1.5 | Flash-Lite 2.0 | Flash 2.0 | Flash 2.5 | Pro 2.5 | |:-----|:---------|:--------|:--------------|:---------|:---------|:-------| | 输入模态 | 视频/音频/文本/图像 | 同左 | 同左 | 同左 | 同左 | 同左 | | 输入长度 | 1M | 2M | 1M | 1M | 1M | 1M | | 输出模态 | 文本 | 文本 | 文本 | 文本/图像* | 文本/音频* | 文本/音频* | | 输出长度 | 8K | 8K | 8K | 8K | 64K | 64K | | Thinking | 否 | 否 | 否 | 有* | 动态 | 动态 | | 工具使用 | 否 | 否 | 否 | 是 | 是 | 是 | | 知识截止 | 2023-11 | 2023-11 | 2024-06 | 2024-06 | 2025-01 | 2025-01 | #### Gemini 2.5 关键特性 1. **Gemini 2.5 Pro** — 最智能的思考模型,强大的推理和代码能力 - 擅长生成交互式 Web 应用 - 可理解整个代码库 - 涌现多模态编码能力(emergent multimodal coding) 2. **Gemini 2.5 Flash** — 混合推理模型,可控制思考预算 - 在质量、成本和延迟之间权衡 3. **原生多模态**:原生支持文本、图像、音频、视频、代码库 4. **超长上下文**:100万 token(约75万单词),可解析《指环王》全系列 5. **可处理3小时视频内容** 6. **工具使用能力**:函数调用、Web搜索、代码执行 #### 行业领先性能(2.5 Pro) - **LMArena 排行榜第一**,以40分优势超越 GPT-4.5 / Grok-3 - **AIME 2025 数学竞赛**:86.7% - **GPQA 科学基准**:84% - **SWE-Bench Verified**:63.8% - **Aider Polyglot 代码编辑**:68.6% - **视觉推理**:81.7% - **图像理解**:69.4% - **"Humanity's Last Exam"**:18.8%(无需外部工具) --- ## 3. Gemini 3.x 系列最新进展 ### 来源:jinrai.co.jp / AI Toolbox / 官方规格 #### Gemini 3.1 Pro(2026年2月19日发布) **核心基准测试** | 基准 | Gemini 3.1 Pro | Opus 4.6 | GPT-5.2 | 胜者 | |:-----|:--------------|:---------|:--------|:----| | ARC-AGI-2(抽象推理) | **77.1%** | 68.8% | — | Gemini | | GPQA Diamond(科学) | **94.3%** | 91.3% | — | Gemini | | LiveCodeBench Pro | **2887 Elo** | — | 2393 | Gemini | | MCP Atlas(工具协作) | **69.2%** | 59.5% | — | Gemini | | BrowseComp(Web调查) | **85.9%** | 83.7% | — | Gemini | | SWE-bench Verified | 80.6% | **80.8%** | — | Claude | | GDPval-AA(实务任务) | 1317 Elo | **1606 Elo** | — | Claude | | Terminal-Bench 2.0 | 68.5% | 65.4% | **77.3%** | GPT-Codex | **核心特性**: - "泛用性之王" — 18个基准测试中12个排名第一 - $2/$12 per 1M tokens — 比 Claude Opus 4.6 便宜 7.5 倍 - MCP(Model Context Protocol)原生支持 - Computer Use(通过 Project Mariner,后合并到 Gemini Agent) - Personal Intelligence(Gmail/Drive/Calendar 集成) - Search Live 在200+国家可用 #### Gemini 3.5 Flash(2026年5月19日 Google I/O 发布) - $1.50/$9 per 1M tokens - 1M 上下文窗口 - 编码和智能体基准测试超越 3.1 Pro - 价格只有 3.1 Pro 的 25%(输出) --- ## 4. Deep Research / Deep Research Max ### 来源:suprmind.ai / digitalapplied.com / aitoolly.com / botoi.com / dev.to #### Deep Research(标准版) - 通过 UI 切换激活,将 Gemini 从聊天模型转变为研究 Agent - 迭代检索增强生成(RAG)循环 - 将查询分解为子主题,迭代浏览数百个网站 - 可读取用户的 Gmail、Drive 和 Chat(若允许) - 输出:结构化研究文档,带编号引用 - 报告可以转换为 Audio Overview 格式、Canvas 编辑、互动探索格式或测验 #### Deep Research Max(2026年4月20日发布) - 更高层级变体,运行更长的迭代 - 更深入遍历链接源 - **MCP(Model Context Protocol)服务器集成** - **原生可视化图表和信息图** - 通过 Interactions API 调用 - API 暴露两个模型变体: - `deep-research-preview-04-2026`(速度/流式) - `deep-research-max-preview-04-2026`(最大限度全面性) #### 两个层级对比 | 维度 | Deep Research(标准) | Deep Research Max | |:-----|:--------------------|:-----------------| | 优化目标 | 速度和延迟 | 全面性和深度 | | 推理时长 | 短(秒到分钟) | 长(分钟到小时) | | Test-time Compute | 标准 | 扩展 | | 多轮迭代 | 1-2轮 | 多轮深度推理 | | 调用方式 | 同步/实时 | 异步/后台 | | 成本 | 低 | 高 | | 搜索配额 | 标准 | 每次任务最多 160 次查询 | | 最长运行时间 | 20分钟 | 60分钟 | #### 关键能力 - **93.3% on DeepSearchQA**(比 2025年12月的 66.1% 大幅提升) - **54.6% on Humanity's Last Exam** - 可上传 PDF、CSV、图像、音频、视频文件作为研究背景 - 协同规划功能:执行前审查和精炼研究计划 - 实时流式中推理步骤追踪 - 同时运行 Google Search + MCP 服务器 + URL 上下文 + 代码执行 + 文件搜索 #### 免费层配额 - 免费层:每月 5 次报告 - Google AI Plus/Pro/Ultra:更高配额 --- ## 5. Canvas 功能 ### 来源:suprmind.ai / ai-damn.com / justdoitblog.com / 腾讯云 / 各日文/韩文指南 #### 基本概念 - Gemini Canvas 是 Gemini 应用内的互动工作空间,独立于聊天界面 - 与 OpenAI 的 ChatGPT Canvas 和 Anthropic 的 Artifacts 概念类似 - 支持写作和编程项目,实时协作编辑 #### 核心功能 1. **文档创作与编辑** - 起草长篇文档(报告、博客、提案) - 选择特定段落调整语气、长度、格式 - 实时编辑工具栏 - 支持导出到 Google Docs 2. **代码生成与预览** - 语言支持:HTML, CSS, JavaScript, Python, React - 实时预览代码效果 - 迭代刷新预览 - 示例:"为网站创建电子邮件订阅表单" 3. **输出格式转换** - Audio Overview(双人播客风格音频摘要) - 测验/测试题 - 信息图 - 闪卡 - Web App 4. **上下文窗口利用** - 付费用户可达 100万 token - 可处理整本书籍级内容 #### 访问方式 - 点击 AI Mode 工具栏中的 "+" 按钮 - 从 prompt 栏下方选择 "Canvas" 选项 - 在所有平台(Web、移动端)可用 - 向全球所有 Gemini 用户免费开放 - 代码预览功能目前仅限网页端 #### 层级差异 | 比较项 | 免费版 | Plus/Pro/Ultra | |:-------|:------|:--------------| | Canvas 访问 | 可用 | 可用 | | 基础模型 | Gemini 3 Flash(部分受限) | Gemini 3 Flash / 3.1 Pro | | 上下文窗口 | 标准 | 最大 100万 token | | 付费 | 免费 | Plus $7.99/mo, Pro $19.99/mo, Ultra $249.99/mo | --- ## 6. Gemini Live / Project Astra / Search Live ### 来源:DeepMind 官方 / ai-souken.com / CSDN / gemilab.net #### Gemini Live - 语音基础的双向实时对话功能 - **核心特性**: - 可中断对话(用户可以在 AI 回答时插入新问题) - 支持免提语音对话 - 2026年3月起支持摄像头画面共享和屏幕共享 - 支持 Android 和 iOS - 2026年 UI 更新为浮动 pill 设计,支持多任务对话 - **集成 Google 服务**:Gmail, Calendar, Keep, Maps, YouTube Music, Tasks - **设备支持**:Google Pixel 9, Samsung Galaxy S25(免费),旧款 Pixel 需 Gemini Advanced 订阅 - **使用方式**: - 长按电源键唤醒 - 语音命令唤醒 - 应用内启动 #### Project Astra - Google DeepMind 的下一代多模态实时 AI 助手 - 核心能力: - **持续视觉识别**:摄像头画面实时处理 - **多模态融合**:同时处理音视频+文本 - **外部工具联动**:Search, Maps, Lens - **跨设备记忆**:可在手机和眼镜间切换对话 - **主动响应**:可主动开始对话 - **上下文感知对话**:忽略背景噪音和无关对话 - **设备形态**: - 手机(摄像头对着物体提问) - 原型眼镜(看世界的方式) - 部分能力已集成到 Gemini Live - 视障辅助版本正在开发(与 Aira 合作) #### Search Live - 200+ 国家可用 - 语音 + 摄像头搜索 - 对话式交互式搜索体验 - 通过 Google 应用使用 --- ## 7. Personal Intelligence(Google生态整合) ### 来源:koc.com.tw / saiteki-ai.com / findskill.ai / technerdiness.com / partnersense.co.jp #### 功能概述 - 允许 Gemini 深度连接用户的 Gmail、Google Drive、Calendar、Photos、YouTube 等 - 从过往邮件、照片、搜索记录中学习用户偏好 - 无需反复说明背景信息 #### 连接的 Google 服务清单 **Google Workspace(生产力)**: - Gmail — 搜索邮件、总结线程、草稿回复 - Google Docs — 总结文档、续写、重构内容 - Google Drive — 查找文件、获取摘要 - Google Calendar — 日程安排、查看周计划、自然语言添加事件 - Google Tasks — 创建、查看、勾选任务 - Google Keep — 添加或检索笔记 **旅行与实时信息**: - Google Flights — 实时价格和时刻表 - Google Hotels — 可用性、评分、价格 - Google Maps — 导航、附近地点、交通 **媒体与娱乐**: - YouTube — 搜索播放视频、推荐 - YouTube Music — 播放歌单、按情绪找音乐 - Spotify — 自然语言音乐流 - Google Photos — 搜索照片库 **通讯与控制**: - Phone — 拨打电话 - Messages — 免提发送短信 - WhatsApp — 通过 Gemini 发送消息 - 设备工具 — 设置闹钟、打开应用、调整设置 - Google Home — 控制智能家居设备 **教育/开发**: - OpenStax — 免费学术教材 - GitHub — 代码搜索和仓库导航 #### 实际应用场景 1. **技术问题排除**:用户描述 Chromecast 故障 → Gemini 从 Gmail 收据确认型号 → 提供设备特定调试步骤 2. **机场转机美食推荐**:综合饮食偏好 + 航班信息 + 登机口位置 + 时间 → 推荐餐厅 3. **旅行规划**:从确认邮件 + 日历事件 + Photos 回忆 + YouTube 观看记录 → 综合回答 #### 隐私与安全 - 每个应用独立开关 - Google 不会未经同意启用 - 欧洲经济区、瑞士、英国因监管原因排除 - 用户可随时在设置中关闭 #### 上线时间线 - 2026年1月:美国 Beta - 2026年3月:美国免费层开放 - 2026年4月14-15日:全球推送 - 目前所有 Google AI Plus/Pro/Ultra 付费用户可用 - 免费层逐步开放 --- ## 8. Project Mariner / Computer Use / Gemini Agent ### 来源:aiwiki.ai / ailearningguides.com / newclawtimes.com / callsphere.ai #### Project Mariner 背景 - Google DeepMind 开发的浏览器 AI Agent 研究原型 - 2024年12月11日随 Gemini 2.0 发布 - 能观察浏览器内容、规划步骤、点击链接、填写表单、滚动页面 - 采用混合方法:视觉理解渲染页面 + 访问底层 DOM 结构 #### 关键时间线 - 2024年12月:Chrome 扩展实验性发布 - 2025年5月(I/O):迁移到云托管虚拟机,支持最多10个并行任务 - 2025年5月:对 Google AI Ultra($249.99/月)订阅者开放 - **2026年5月4日:Project Mariner 正式关闭** #### 技术合并 - 关闭后技术分散并入: - **Gemini Agent** — Google 的广义个人 AI Agent - **Chrome Auto Browse** — Chrome 自动浏览功能 - **Gemini API / Vertex AI Computer Use** — API 层的 Computer Use 能力 - 合并原因:浏览器专用 Agent 产品无法与终端命令行工具竞争 - Claude Code 和 OpenClaw 的终端方式效率是浏览器截图方式的 10-100 倍 - 浏览器 Agent 使用率低(OpenAI's Operator < 100万周活) #### Gemini Agent - Mariner 技术的继承者 - 作为 Workspace, Search, Gemini App 内的一流助手运行 - 能力包括:邮件归档、酒店预订、浏览器控制 - 单一控制平面支持 Workspace 管理员 - 通过 Gemini API 提供开发者访问 --- ## 9. Gems(自定义AI助手) ### 来源:suprmind.ai / partnersense.co.jp #### 核心概念 - 可定制的 Gemini 聊天实例,通过 Gem Builder 创建 - 四字段构建模型: 1. **Persona**(角色) 2. **Task**(任务) 3. **Context**(上下文/如何执行) 4. **Format**(输出格式) #### 关键特性 - 每个 Gem 可附加最多 10 个参考文件 - 跨会话持久化记忆 - 预置 Gem:写作教练、代码助手、头脑风暴伙伴 - 可集成到 Google Workspace(Gmail, Docs, Drive) - 功能对标 OpenAI 的 Custom GPTs #### 可用性 - 免费层可用(有配额) - 完整创建功能在付费层 - 每天/每月创建限制未公开 --- ## 10. NotebookLM / Audio Overviews ### 来源:suprmind.ai / 腾讯云 IT之家 #### NotebookLM - Google 的个人研究图书馆 - 文档、网页和其他来源的 AI 驱动研究助理 #### Audio Overviews - 从 NotebookLM 引入 Gemini - 创建真实播客风格的音频摘要 - 支持多种格式文件 - 通过 prompt 栏上传文档触发 - Web 端和移动端可下载/分享 - 目前仅限英文音频摘要 - Canvas 中也可生成 Audio Overview --- ## 11. 多模态能力(Imagen / Veo / Lyria) ### 来源:techno360.in / suprmind.ai - **Imagen 4** — 图像生成 - **Veo 3.1** — AI 视频生成 - Veo 3.1 Lite: $0.05-$0.08/秒(预算视频) - **Lyria 3 Pro** — AI 音乐生成 - Gemini 2.5 Pro 原生支持视频理解(可处理 3 小时视频) - Gemini Omni 系列:实时音视频多模态对话 --- ## 12. Gemini vs ChatGPT 对比 ### 来源:腾讯云开发者 / aivoraai.github.io / ai-toolbox.co / toolchase.com / smillee.com #### 快速结论 **ChatGPT 整体更好**:写作、编码、复杂推理 **Gemini 更好**:实时研究、多模态任务、处理超大文档 #### 8 类别对比评分 | 类别 | Gemini | ChatGPT | 胜者 | |:-----|:-------|:--------|:----| | 写作质量 | 7/10 | 8.5/10 | ChatGPT | | 编码与调试 | 6.5/10 | 9/10 | ChatGPT | | 实时研究 | 9/10 | 5/10 | **Gemini** | | 长文档处理 | ★★★★★ | ★★★ | **Gemini** | | 多模态(输入) | ★★★★★ | ★★★ | **Gemini** | | 图像生成 | ★★★ (Imagen 3) | ★★★★ (DALL-E 3) | ChatGPT | | 创造力/写作语气 | ★★★ | ★★★★ | ChatGPT | | 幻觉控制 | ★★★★ | ★★★ | Gemini | #### Intelligence Index(人工智能分析指数) - Gemini 3.1 Pro: **57 分** - ChatGPT (GPT-5.x): **57 分** - 结论:两者在原始智能上不分伯仲 #### 核心差异 **选择 Gemini 如果你**: - 需要原生视频和音频处理 - 需要最大的上下文窗口(1M-2M tokens) - 深度使用 Google Workspace(Gmail, Docs, Drive) - 需要预算友好的 API 访问 - 处理超长文档、研究、多模态内容 **选择 ChatGPT 如果你**: - 需要桌面 Computer Use Agent - 需要持久对话记忆 - 需要复杂推理(Interactive Thinking) - 需要图像生成(DALL-E)、视频(Sora)、代码执行(Codex) - 需要最大插件/Custom GPTs 生态系统 - 中文写作更自然、更有人情味 #### 市场数据(2026年5月) - ChatGPT 占据约 60% 市场份额,但统治力在松动 - Gemini 凭借 Google 生态和免费策略快速增长 - ChatGPT 周活用户超 9 亿 - ChatGPT 整体评分 4.6/5 vs Gemini 4.3/5 #### 上下文窗口对比 | 平台 | 上下文窗口 | 约当字数 | |:-----|:----------|:--------| | Gemini(最新) | **1M-2M tokens** | 约 75万-150万字 | | ChatGPT | 约 128K tokens | 约 9.6万字 | | Claude | 200K tokens | 约 15万字 | #### 定价对比 | 层级 | Gemini | ChatGPT | |:-----|:-------|:--------| | 免费版 | ✅ 有(慷慨) | ✅ 有(有限,美国有广告) | | 入门付费 | Plus $7.99/月 | Go $6/月 | | 主力付费 | Pro $19.99/月 | Plus $20/月 | | 最高级 | Ultra $249.99/月 | Pro $120/月 | --- ## 13. MCP 支持 ### 来源:digitalapplied.com / botoi.com / wenatuo.ai #### MCP(Model Context Protocol)集成 - Deep Research Max 是 Google 生态中首个原生集成 MCP 的产品 - 一个 API 调用同时查询:公开网络 + MCP 服务器 + URL 上下文 + 代码执行 - MCP 服务器可连接:内部文档仓库、专有数据库、第三方数据服务 #### 首批 MCP 合作伙伴 - FactSet(金融数据) - S&P Global(金融数据) - PitchBook(融资数据) #### 使用方式 - 在 Gemini Advanced 设置中打开 Workspace Settings → Connectors → Add MCP Server - 通过 JSON 配置 MCP 服务器 - 支持 tool_filter 白名单机制 - 与 Google Search Grounding 可同时使用 --- ## 14. Benchmark 性能数据 ### 综合汇总 | 基准 | Gemini 2.5 Pro | Gemini 3.1 Pro | 对比 | |:-----|:--------------|:--------------|:-----| | LMArena Elo | ~1380 | — | 领先 GPT-4o, Claude 3.7 Sonnet | | ARC-AGI-2 | — | **77.1%** | Claude Opus 4.6: 68.8% | | GPQA Diamond | 84% | **94.3%** | 全模型最高 | | SWE-bench Verified | 63.8% | 80.6% | Claude 4.6: 80.8% | | Aider Polyglot | 68.6% | 72.0% | — | | AIME 2025 数学 | 86.7% | — | 持平 OpenAI o3-mini | | Humanity's Last Exam | 18.8% | — | — | | DeepSearchQA | — | **93.3%** | 上代 66.1% | | MCP Atlas(工具协作) | — | **69.2%** | Opus 4.6: 59.5% | | BrowseComp(Web调查) | — | **85.9%** | Opus 4.6: 83.7% | | LiveCodeBench Pro | — | **2887 Elo** | GPT-5.2: 2393 | | 视觉推理 | 81.7% | — | — | | 图像理解 | 69.4% | — | — | --- ## 15. 定价与订阅方案 ### 消费者订阅(2026年5月) | 层级 | Gemini | ChatGPT | |:-----|:-------|:--------| | Free | Gemini 2.5 Flash, 有限 Pro 访问 | GPT-4-class, 每日消息上限 | | Plus/Go | $7.99/月 | $6/月 | | Pro/Plus | $19.99/月 | $20/月 | | Ultra/Pro | $249.99/月 | $120/月 | ### Google AI 付费方案详细 - **Google AI Plus**: ~$7.99/月($1,200/年) - **Google AI Pro**: ~$19.99/月($2,900/年,首月免费) - **Google AI Ultra**: $249.99/月(前3个月$180/月) - **Gemini Business/Enterprise**: 商用许可,价格另议 ### API 定价对照(每百万 tokens) | 模型 | 输入 | 输出 | 对比 | |:-----|:----|:----|:-----| | Gemini 3.1 Pro | $2.00 | $12.00 | 比 Claude Opus 4.6 便宜 7.5 倍 | | Claude Sonnet 4.6 | $3.00 | $15.00 | — | | GPT-4o | $2.50 | $10.00 | — | | Gemini 2.5 Flash | $0.30 | $1.50 | 性价比之王 | | Gemini 2.5 Flash-Lite | $0.10 | $0.40 | 极致成本 | ### 强制月度支出上限(2026年4月起) - Tier 1: $250/月(个人开发者) - Tier 2: $2,000/月(中型团队) - Tier 3: $20,000-$100,000+/月(企业级) - 达到上限后 API 自动暂停 - 同一计费账户下所有项目共享此上限 --- > 本文档基于 2026年6月21日的网络搜索结果整理。 > 所有数据来自公开来源,包括 Google DeepMind 官方报告、Google AI Developer 文档、 > 以及各第三方评测网站。 > 原始数据来源请参见各搜索结果对应 URL。