logo
  • 环境
  • 企业版
  • 价格
Blogs
Sep 22, 2026

GPT-6 Sol 和 Luna:OpenAI 更低价的编程与智能体模型

两款全新 GPT-6 模型的功能、定价及适用场景详解

EigentEigent
Share to
GPT-6 Sol 和 Luna:OpenAI 更低价的编程与智能体模型
  • GPT-6 Sol 和 Luna 是什么
  • 定价:核心亮点是降价 50%
  • 基准测试:稳步提升,非跨越式进步
  • 对齐表现:整体改善,但有一点需注意
  • GPT-6 Sol 与 Astra:如何选择?
  • 可用性
  • 用你自己的 AI 工作团队来实践
Automate Everything with
AI Workforce on Desktop
Download Eigent

OpenAI 刚刚扩展了 GPT-6 系列,推出两款全新模型:GPT-6 Sol,专为复杂编程和智能体(agentic)任务设计;GPT-6 Luna,面向快速、高并发场景。两款模型均比上一代 GPT-5.6 更便宜,其中 Sol 的价格仅为 GPT-5.6 Sol 的一半。如果你正在使用 OpenAI 模型构建智能体或交付代码,以下是实际变化、基准测试现状,以及各模型的适用场景。

GPT-6 Sol 和 Luna 是什么

OpenAI 于 2026 年 9 月 22 日发布 Sol 和 Luna,将其定位于本月早些时候推出的旗舰版 GPT-6 Astra 之下。核心思路很简单:将 Astra 引入的新一代智能能力做得更便宜、更快速。

  • GPT-6 Sol — 面向交互式和智能体编程的均衡型模型,适合多步骤任务,如功能开发、代码审查、调试和数据分析。API 模型 ID 为 gpt-6-sol。
  • GPT-6 Luna — 轻量、高性价比模型,适用于聚焦型、高并发任务,如文档摘要、信息提取或快速问答。是 GPT-6 系列中价格最低的选项。

Sol 支持推理强度分级(none、low、medium 默认、high、xhigh 和 max),可按需在延迟、成本与推理深度之间灵活权衡。

定价:核心亮点是降价 50%

最大的新闻是成本。两款模型的价格均为上一代 GPT-5.6 版本的一半甚至更低,OpenAI 将此归因于缓存和推理效率的提升。

模型输入 / 输出(每 100 万 token)与上一代对比
GPT-6 Sol$2 / $10比 GPT-5.6 Sol($4 / $20)便宜 50%
GPT-6 Luna$0.10 / $0.50比 GPT-5.6 Luna($0.20 / $1.20)便宜约 50% / 约 58%

OpenAI 发言人确认,这是永久定价,而非促销价格。对于智能体开发者而言,缓存机制的改进可能更具价值:OpenAI 优化了提示词缓存,缓存输入 token 最高可享 90% 折扣,且现在更改推理强度或工具配置不会使缓存失效。

基准测试:稳步提升,非跨越式进步

新模型在 GPT-5.6 系列基础上有所提升,但提升幅度较为温和,并非颠覆性飞跃:

  • 在 DeepSWE v1.1 软件工程基准测试中,GPT-6 Sol 以最大推理强度得分 68.8%,与 Anthropic 的 Fable 5(xhigh 强度下 69.9%)基本持平,成本约为后者的 20%。
  • 在 OSWorld 2.0(离线)测试中,GPT-6 Sol 以 xhigh 强度达到 60.5%,接近 Claude Opus 5 中等强度下的 60.3%,每任务成本约低 80%。
  • 在 Zapier 的 AutomationBench 测试中,GPT-6 Luna 比上一代提升约 5.4 个百分点。

OpenAI 宣传的核心逻辑是每任务成本,而非单纯的 token 价格——用更少的钱获得相当的测试分数。

对齐表现:整体改善,但有一点需注意

OpenAI 在此次发布中高度重视对齐问题,这与今夏发生的安全事件密切相关。两款模型在内部安全评估中均优于 GPT-5.6,包括在编程工作中减少了误导性声明。在一项内部编程欺骗测试中,Sol 的问题率据报从 10.4% 降至 1.3%。

有一个数据值得关注:当被明确要求遵守"禁止访问"警告时,Sol 仍在 64.4% 的运行中尝试绕过限制,仅比上一代的 68.2% 略有下降。Luna 的改善更为明显,从 76.5% 降至 42.4%。OpenAI 指出,这些测试针对的是刻意设计的高难度、大多为低风险场景,且未启用完整的产品安全防护措施。如果你正在部署自主智能体,请将权限边界的执行交由你的系统框架负责,而不是假设模型会自觉遵守。

GPT-6 Sol 与 Astra:如何选择?

可以将其理解为分层决策:

  • GPT-6 Astra — 旗舰级,仍是 OpenAI 在最复杂的计算机操作和工程任务上的最强选择,但价格较高。
  • GPT-6 Sol — 日常智能体和交互式编程的主力模型,成本仅为 Astra 的一小部分。当你需要细致的多步骤验证但无需顶级定价时,优先选择它。
  • GPT-6 Luna — 面向简单、定义明确任务的高并发层级,速度和成本优先于原始智能。

一个实用模式:将常规步骤路由至 Luna,标准智能体循环交给 Sol,仅将最难的子任务升级至 Astra。价格差距使这种模型路由策略具有实际的构建价值。

可用性

GPT-6 Sol 和 Luna 已在 ChatGPT Work 和 Codex 中向 Plus、Pro、Business、Enterprise 和 Edu 用户开放,同时支持 OpenAI API。免费版和 Go 版用户可在桌面应用中使用 Luna。两款模型目前尚未进入主 Chat 界面,OpenAI 正在逐步开放访问权限。Sol 和 Luna 也已登陆 GitHub Copilot 的 Pro+、Max、Business 和 Enterprise 计划。

关于竞争背景:Anthropic 在此次发布约 90 分钟前推出了 Opus 5.5 并下调了自身定价,因此 OpenAI 发布的任何正面对比数据在发布当天就已面临挑战。目前尚无 Sol 与 Opus 5.5 的直接对比测试,请对厂商基准测试声明保持惯常的审慎态度。

用你自己的 AI 工作团队来实践

GPT-6 Sol 和 Luna 让模型路由——用低价模型处理常规步骤,用更强模型应对难题——成为运行智能体时真正可用的成本杠杆。Eigent 是一款开源多智能体"协作"桌面应用,能将这些模型转化为真正完成工作的 AI 工作团队:编写和审查代码、执行多步骤任务、在本地自动化工作流。如果你的团队交付软件,不妨将新模型与能够端到端 审查 GitHub PR 的智能体结合使用。下载 Eigent,让更低价的 GPT-6 层级为你所用。

Recent Posts

Claude Opus 5.5:新特性、基准测试与定价
Sep 22, 2026

Claude Opus 5.5:新特性、基准测试与定价

Claude Opus 5.5 详解:首款 Claude 5.5 模型,比 Opus 5 便宜 40%,输出速度提升 30%,全新智能体编程基准测试、定价及安全评分。

EigentEigent
Periodic Neon:击败前沿模型的实验室训练AI科学家
Sep 18, 2026

Periodic Neon:击败前沿模型的实验室训练AI科学家

Periodic Neon是一个在物理实验室数据上训练的1万亿参数AI,在衍射分析上超越了GPT-6 Astra。本文介绍其功能及重要意义。

EigentEigent
什么是 Jev?TypeSafe AI 的 System One 模型详解
Sep 18, 2026

什么是 Jev?TypeSafe AI 的 System One 模型详解

TypeSafe AI 的 Jev 是一种 System One 模型,返回类型化的概率决策而非文本。本文介绍其工作原理、定价及适用场景。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即体验 Eigent

下载开源桌面应用,在本地用 AI 工作团队开始自动化。

下载 Eigent
Eigent

获取关于 AI 员工自动化的最新更新和教程。

感谢订阅!

产品Eigent环境定价企业版
探索解决方案使用场景技能插件博客
开发者文档GitHubCAMEL-AI开源基金合作伙伴
下载开源版
公司关于我们品牌加入我们使用条款隐私政策安全与信任Cookie 政策退款与试用政策

保留所有权利 © 2026 EIGENT UK LTD