gemini-3.5-flash
Google模型
Gemini 3.5 Flash 是谷歌于 2026 年 5 月 20 日在 Google I/O 大会上发布的轻量级、高性价比、超高速大模型,专为智能体(Agent)、编码与多步工作流优化,现已作为 Gemini App 和 Google 搜索 AI 模式的默认模型免费向全球开放。
核心定位:不是“缩水版”,而是速度优先的前沿智能体模型,在 Terminal-Bench 2.1(76.2%)、MCP Atlas(83.6%)等编码与工具调用基准上超越前代旗舰 Gemini 3.1 Pro,但抽象推理(如 Humanity’s Last Exam,40.2%)略弱,属有意识取舍的“快而专”架构。
速度与成本:官方实测输出达 289 tokens/秒(约其他前沿模型的 4 倍),首 token 延迟约 65 毫秒;API 定价1.50/百万输入token、9.00/百万输出 token(较 Gemini 3.1 Pro 便宜 25–40%),支持缓存输入低至 $0.15/百万。
关键能力:支持 1M 上下文窗口、原生多模态(文本/图像/音频/视频)、Dynamic Thinking(默认 thinking_level=medium,可调 low/medium/high)、思维保留(Think Retention)提升多轮代码/工具调用连贯性;不支持 Computer Use(需用 3.1 Flash 预览版)。
应用场景:AI Agent 开发、实时交互、代码生成(Terminal-Bench 76.2%)、长流程自动化;在 Antigravity 2.0 平台内优化后速度可达竞品 12 倍。
发布状态:2026 年 5 月 20 日 GA(正式版),模型 ID 为 gemini-3.5-flash,已集成于 Gemini App、Google Search AI Mode、Google AI Studio、Gemini API、Android Studio;Gemini 3.5 Pro 将于 2026 年 6 月发布。
注意:虽命名“3.5”,但非 3.1 的小更新,而是Flash 系列的性能跃迁——以不到 Pro 一半成本实现接近甚至超越上代 Pro 的智能体执行力,标志着谷歌从“追求最大模型”转向“智能体时代:快 > 极致强”。
免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能
免费体验最新的AI大模型,支持对话、写作、编程、图像、视频等多种功能
Google模型推荐
gemini-3.5-flash
Gemini3.5Flash是谷歌于2026年5月20日在GoogleI/O大会上发布的轻量级、高性价比、超高速大模
gemini-3.1-flash-lite-preview-
gemini-3.1-flash-lite-preview-thinking-high是GoogleDeepMind于2026年3月3日推出的Gemini
gemini-3.1-pro-preview-thinkin
Gemini3.1Pro-Preview(thinkinglevel:Medium)是GoogleDeepMind于2026年2月推出的旗舰级多
gemini-3.1-flash-lite-preview-
Gemini3.1Flash-LitePreview(thinkinglevel:Medium)是谷歌于2026年3月推出的Gemini3系列中速
veo3.1-components-4k
Veo3.1-Components-4K是谷歌DeepMind推出的面向企业级工业化视频生产的高阶模块化模型,专
veo3.1-components
Veo3.1-Components是Google推出的模块化视频生成专用模型,专为需要高精度控制与多组件协同的
veo3-pro
Veo3Pro是谷歌DeepMind在2025年I/O大会上推出的旗舰级AI视频生成模型,作为全球首款实现“
gemini-2.5-pro-nothinking
Gemini2.5Pro-NoThinking是Gemini2.5Pro系列中专为“极速响应”场景设计的轻量推理模式版本