gemini-3.5-flash

Google模型

字体:

Gemini 3.5 Flash 是谷歌于 2026 年 5 月 20 日在 Google I/O 大会上发布的轻量级、高性价比、超高速大模型,专为智能体(Agent)、编码与多步工作流优化,现已作为 Gemini App 和 Google 搜索 AI 模式的默认模型免费向全球开放。‌‌

  • ‌核心定位‌:不是“缩水版”,而是‌速度优先的前沿智能体模型‌,在 Terminal-Bench 2.1(76.2%)、MCP Atlas(83.6%)等编码与工具调用基准上超越前代旗舰 Gemini 3.1 Pro,但抽象推理(如 Humanity’s Last Exam,40.2%)略弱,属‌有意识取舍的“快而专”架构‌。

  • ‌速度与成本‌:官方实测输出达 ‌289 tokens/秒‌(约其他前沿模型的 ‌4 倍‌),首 token 延迟约 ‌65 毫秒‌;API 定价1.50/百万输入token、9.00/百万输出 token‌(较 Gemini 3.1 Pro 便宜 25–40%),支持缓存输入低至 ‌$0.15/百万‌。

  • ‌关键能力‌:支持 ‌1M 上下文窗口‌、原生多模态(文本/图像/音频/视频)、‌Dynamic Thinking‌(默认 thinking_level=medium,可调 low/medium/high)、思维保留(Think Retention)提升多轮代码/工具调用连贯性;‌不支持 Computer Use‌(需用 3.1 Flash 预览版)。

  • ‌应用场景‌:‌AI Agent 开发、实时交互、代码生成(Terminal-Bench 76.2%)、长流程自动化‌;在 Antigravity 2.0 平台内优化后速度可达竞品 12 倍。

  • ‌发布状态‌:2026 年 5 月 20 日 GA(正式版),模型 ID 为 gemini-3.5-flash,已集成于 ‌Gemini App、Google Search AI Mode、Google AI Studio、Gemini API、Android Studio‌;‌Gemini 3.5 Pro 将于 2026 年 6 月发布‌。

  • ‌注意‌:虽命名“3.5”,但非 3.1 的小更新,而是‌Flash 系列的性能跃迁‌——以不到 Pro 一半成本实现接近甚至超越上代 Pro 的智能体执行力,标志着谷歌从“追求最大模型”转向“‌智能体时代:快 > 极致强‌”。‌‌


立即使用大模型

免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能

立即使用此模型

免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能