面向通用生产工作的 3.6 Flash
3.6 Flash 在发布中被描述为主力模型,在编码、知识工作、多模态表现和电脑使用方面都强于 3.5 Flash。
Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 是 Google Flash 模型家族的新成员,面向构建生产级 AI agent 的开发者和客户推出。该发布将它们围绕三类需求进行定位:更高的 token 效率、更低的延迟,以及在大规模场景下更可靠的性能。
3.6 Flash 被定位为适用于编码、知识工作、多模态任务和 computer use 的主力模型。3.5 Flash-Lite 则面向该系列中速度最快、成本最低的一端,适合 agentic 搜索和文档处理等高吞吐工作流。3.5 Flash Cyber 被介绍为与 CodeMender 搭配、用于安全应用的专用网络安全模型。
3.6 Flash 在发布中被描述为主力模型,在编码、知识工作、多模态表现和电脑使用方面都强于 3.5 Flash。
发布内容称,3.6 Flash 在多步骤工作流中比 3.5 Flash 使用更少的输出 token、更少的推理步骤和更少的工具调用,从而降低成本和延迟。
3.5 Flash-Lite 被定位为速度最快的 3.5 级模型,在所引用的指标中吞吐量为每秒 350 个输出 token。
3.5 Flash-Lite 内置 computer use 支持,并可根据工作负载需求调节为最小、低或更高的 thinking level。
3.5 Flash Cyber 与 CodeMender 搭配用于网络安全工作,这类场景需要模型与 agent 基础设施之间进行谨慎编排。
这些模型被定位为生产级 AI agent 的工具,强调可靠性、效率和规模,而不是单轮聊天。
当任务需要更强的编码、文档理解或多模态分析能力时,使用 3.6 Flash,例如解析图表、审阅报告或起草工作成果。
当 agent 需要跨浏览器、移动端或桌面界面执行操作时,使用 3.6 Flash 或 3.5 Flash-Lite,尤其适用于长周期工作流和企业自动化。
当延迟和吞吐量比重型推理更重要时,使用 3.5 Flash-Lite 处理大规模搜索、分类、抽取或文档处理。
当较小模型仍需协调类似子 agent 或多步骤任务、同时又不能牺牲速度时,可将 3.5 Flash-Lite 与更高 thinking level 一起使用。
将 3.5 Flash Cyber 与 CodeMender 一起用于依赖模型与 agent 编排的安全相关工作,例如高效发现并修复漏洞。
该来源将 Gemini 3.6 Flash 描述为用于更强编码、知识工作、多模态任务和电脑使用的主力模型。Gemini 3.5 Flash-Lite 定位为适用于低延迟、高吞吐工作流(如 agentic 搜索和文档处理)的模型。Gemini 3.5 Flash Cyber 被介绍为与 CodeMender 搭配使用、面向安全工作的专用网络安全模型。
是的。来源说明 Gemini 3.6 Flash 和 3.5 Flash-Lite 都内置了 computer use,并且在更早的 computer use 公告中,Gemini 3.5 Flash 也已原生集成。开发者可将其用于在浏览器、移动端、桌面端和客户端界面之间执行操作的 agent。
来源称,开发者和企业可以通过 Gemini API 和 Gemini Enterprise Agent Platform 访问 Gemini 3.5 Flash 中的 computer use。它还提到,Gemini 3.6 Flash 可通过 Gemini API 和 Gemini Enterprise 以内置的客户端工具形式使用 computer use。
所提供的证据中没有可用的定价页面细节。不过,发布文章本身确实给出了 API 价格:3.6 Flash 为每 100 万输入 token 1.50 美元、每 100 万输出 token 7.50 美元;3.5 Flash-Lite 为每 100 万输入 token 0.30 美元、每 100 万输出 token 2.50 美元。
来源强调了面向企业和生产环境的用例,包括持续软件测试、知识工作、文档解析、图表和数据分析、报告撰写、agentic 搜索以及大规模文档处理。
AakarDev AI 帮助团队在一个仪表板中管理 AI 提供商访问、项目级配置、日志和分析,支持 BYOK 工作流,并涵盖 OpenAI、Google Gemini、Anthropic、Groq、Mistral AI、Perplexity AI 等提供商。
Orca 是面向编码代理的 Agent 开发环境,支持在隔离的 git worktree 中并行运行多个 CLI agent,并提供桌面端与移动端协作流程。
AI Magicx 是一体化 AI 工作区,集聊天、图片、视频、语音、音乐、邮件和开发任务于一处,帮助创作者、团队和开发者集中使用多种模型,无需在多个工具和订阅间切换。
Paper 是一款设计工具,连接画布、代码和 AI agent,让团队在一个工作流中完成创建、协作与交付。支持桌面应用、基于 MCP 的 agent 访问,以及真实内容和设计 token 工作流。
blop 是一款 QA agent,可在仓库中将浏览器测试以代码形式编写并运行于 CI,聚合重复失败,还可发起 PR 修复失效测试,适合需要可审查、版本控制浏览器 QA 的团队。
RLAMA 是一款本地 AI 平台,适用于在 macOS、Linux 和 Windows 上构建 RAG 系统与智能体。支持本地处理、交互式终端工作流和用于文档问答及多智能体自动化的 HTTP API。