logo
  • 环境
  • 企业版
  • 价格
Blogs
Sep 3, 2026

Gemini 3.8 Flash:编程与 AI 智能体的全新升级

Google 最快迭代的主力模型在编程、智能体推理和网络安全方面全面升级——以下是实际变化。

EigentEigent
Share to
Gemini 3.8 Flash:编程与 AI 智能体的全新升级
  • 什么是 Gemini 3.8 Flash?
  • 相比 Gemini 3.7 Flash 有哪些新变化
  • Gemini 3.8 Flash 基准测试
  • Gemini 3.8 Flash 定价
  • Gemini 3.8 Flash 的使用场景
  • Gemini 3.8 Flash Cyber:安全专用变体
  • 是否应该从 3.7 Flash 升级?
  • 用您自己的 AI 工作团队来实践
Automate Everything with
AI Workforce on Desktop
Download Eigent

Google 刚刚发布了 Gemini 3.8 Flash,这是其在约六周内推出的第三款 Flash 模型,也是迄今为止"最智能的主力模型"。核心卖点简单明了:在软件工程、智能体任务和多步推理方面取得显著进步——速度与价格却与 3.7 Flash 保持一致。此外,专为漏洞发现与修复设计的 Gemini 3.8 Flash Cyber 变体也同步推出。本文将介绍具体变化、Google 公布的基准测试数据、定价信息,以及它在 AI 智能体开发中的适用场景。

什么是 Gemini 3.8 Flash?

Gemini 3.8 Flash 是 Google Flash 系列中的一款轻量级多模态模型,专为长周期编程任务和自主智能体场景优化。Google 将其定位为"最智能的主力模型",在工程能力、智能体任务和专业领域推理方面全面超越 3.7 Flash(Google)。

该模型于 2026 年 9 月 2 日发布,距 3.7 Flash 发布仅三周——自 7 月下旬 Gemini 3.6 Flash 推出以来,Google 大约每三周发布一款新 Flash 模型(Thurrott)。

本次发布包含两个基于相同基础智能构建的变体:

  • Gemini 3.8 Flash — 面向编程、智能体和企业工作流的通用主力模型。
  • Gemini 3.8 Flash Cyber — 专注于网络安全的模型,用于漏洞检测和自动化修复,仅通过全新的 Fairwind 计划向受信任的防御方开放。

相比 Gemini 3.7 Flash 有哪些新变化

核心亮点在于:3.8 Flash 在"不提价"的前提下,相比 3.7 Flash"实现了显著提升",并"在性能上往往接近更高成本的前沿模型"(9to5Google)。

Google 将这一飞跃归因于一个设计决策:模型更加努力地工作。在处理复杂任务时,它会执行更多推理步骤并迭代调用工具,这意味着在高努力级别下可能产生更高的 token 用量。如果计算成本是主要约束,Google 表示可以降低努力级别,或继续使用 3.7 Flash——后者仍受支持,适合效率优先的工作负载。

这一权衡对智能体开发者至关重要。更强的执行力和迭代工具调用正是长时运行的智能体循环所需要的——但这也意味着在高并发、低复杂度任务中需要关注 token 消耗。

Gemini 3.8 Flash 基准测试

Google 公布了编程、金融、法律和通用推理方面的测试结果。以下所有数据均来自 Google 的发布材料,请将其视为厂商基准测试而非独立评测。

  • DeepSWE v1.1(长周期软件工程): 3.8 Flash 在自主端到端解决复杂工程问题方面超越了大多数更大规模的前沿模型,且成本仅为其一小部分(Google)。
  • Vals Finance Agent V2 和 Harvey 法律智能体基准: 3.8 Flash 在这些专业领域超越了 3.7 Flash 及其他前沿模型。
  • HLE-Verified(人类最后考试): 得分 54.9%,Google 将其作为跨 STEM、人文和专业领域多步推理能力的佐证(9to5Google)。

贯穿始终的核心能力是:在需要规划、使用工具并跨多步骤持续执行任务的专业领域中展现出色的智能体能力——而不仅仅是回答单个提示。

值得注意的一点:与上一代模型类似,Gemini 3.8 Flash 在部分领域的知识截止日期为 2026 年 3 月,而在其他领域可能仅限于 2025 年 1 月(9to5Google)。对于近期信息,建议通过检索工具或实时数据源为其提供最新上下文。

Gemini 3.8 Flash 定价

Google 将入门价格与 3.7 Flash 保持一致:

  • 每百万输入 token 0.75 美元
  • 每百万输出 token 3.75 美元

该入门价格有效期至 2026 年 12 月 31 日;此后标准价格将上调至每百万输入 token 1.50 美元、每百万输出 token 7.50 美元(Google)。如果您正在基于此模型构建应用,请将 1 月份的价格变动纳入长期成本模型——同时请记住,"更努力工作"的行为在处理复杂任务时可能推高输出 token 数量。

Gemini 3.8 Flash 的使用场景

Google 在发布首日即将其部署至消费者、开发者和企业端:

  • 消费者端: Gemini 应用、Google 搜索中的 AI 模式,以及 Google 表格中的 Gemini,面向 Google AI Pro 和 Ultra 订阅用户(Search Engine Journal)。
  • 开发者端: Google Antigravity、AI Studio、Android Studio 以及 Gemini API。
  • 企业端: Gemini Enterprise。

对于智能体开发者而言,API 访问是最关键的——它允许您将 3.8 Flash 集成到自己的编排系统中,而不局限于 Google 的应用生态。

Gemini 3.8 Flash Cyber:安全专用变体

Cyber 变体是本次发布中最具创新性的部分。它面向防御方,优先考虑漏洞修复而非攻击性能力。Google 报告称其在 CyberGym(自主漏洞发现的标准基准)上达到前沿水平,并在涵盖 20 种编程语言的内部基准测试中成功率超过 70%(Google)。

Google 引用的来自其内部安全团队的实际测试结果:

  • Chrome 安全团队发现,3.8 Flash Cyber 针对 Chrome 漏洞生成的正确补丁数量是大型商业模型的 2.6 倍(9to5Google)。
  • 安全厂商 Wiz 测量到,在内部渗透测试基准上,其召回率提升 7.5–9.7%,成本仅为其他领先前沿模型的 1/2.3 至 1/5.2。
  • Google 云漏洞研究团队利用它在两小时内发现了一个关键基础漏洞——而此类工作通常需要数月时间。

需要注意的是:3.8 Flash Cyber 通过 Fairwind 计划进行访问管控,仅面向受信任的政府机构、关键基础设施运营商和软件维护者开放,并非通用 API 发布。

是否应该从 3.7 Flash 升级?

基于 Google 公布的信息,以下是快速决策指南:

  • 正在构建编程或多步骤智能体? 升级到 3.8 Flash——更强的长周期工程能力和工具调用正是其核心优势。
  • 运行高并发、简单任务且成本优先? 继续使用 3.7 Flash 或降低努力级别;"更努力工作"的行为可能推高 token 费用。
  • 从事防御性安全工作且符合 Fairwind 资格? 申请使用 3.8 Flash Cyber。
  • 需要最新知识? 接入检索工具或实时数据源——模型的知识截止日期意味着它无法自行获取近期信息。

用您自己的 AI 工作团队来实践

Gemini 3.8 Flash 正是为 Eigent 所运行的模式而生:长周期、工具调用型智能体,能够规划并执行真实工作,而不仅仅是回答单个提示。Eigent 是一款开源"协作"桌面应用——一个多智能体工作团队,在本地自动化工作流,让您可以将强大的模型用于编程、研究和文档任务,同时将数据保留在本地。如果您看好 3.8 Flash 的智能体能力提升,不妨了解如何通过智能体工作团队审查 GitHub PR,或参阅我们对最佳开源 AI 编程智能体的深度解析。立即下载 Eigent,构建属于您自己的 AI 工作团队。

Recent Posts

Claude Fable 5.1 与 Mythos 5.1:新功能详解
Sep 3, 2026

Claude Fable 5.1 与 Mythos 5.1:新功能详解

Claude Fable 5.1 与 Mythos 5.1 详解:同一模型的两个安全防护层级,附最新基准测试成绩、约 25% 至 45% 的成本降幅及访问方式说明。

EigentEigent
GPT-6 Astra:OpenAI 新模型究竟能做什么
Sep 3, 2026

GPT-6 Astra:OpenAI 新模型究竟能做什么

GPT-6 Astra 是 OpenAI 的全新旗舰模型。本文详解其功能、基准测试表现、定价方案,以及 AGI 相关报道背后的注意事项。

EigentEigent
Muse Spark 1.3:Meta 前沿编程与智能体模型详解
Sep 3, 2026

Muse Spark 1.3:Meta 前沿编程与智能体模型详解

Muse Spark 1.3 是 Meta 最新的前沿编程与智能体模型。查看基准测试、定价、xhigh 与 max 变体对比、版本变化及与竞品的横向比较。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即体验 Eigent

下载开源桌面应用,在本地用 AI 工作团队开始自动化。

下载 Eigent
Eigent

获取关于 AI 员工自动化的最新更新和教程。

感谢订阅!

产品Eigent环境定价企业版
探索解决方案使用场景技能插件博客
开发者文档GitHubCAMEL-AI开源基金合作伙伴
下载开源版
公司关于我们品牌加入我们使用条款隐私政策安全与信任Cookie 政策退款与试用政策

保留所有权利 © 2026 EIGENT UK LTD