logo
  • 環境
  • 企業方案
  • 價格方案
Blogs
Sep 22, 2026

GPT-6 Sol 與 Luna:OpenAI 更具成本效益的程式開發與智能代理模型

兩款全新 GPT-6 模型的功能、定價,以及如何選擇適合的模型。

EigentEigent
Share to
GPT-6 Sol 與 Luna:OpenAI 更具成本效益的程式開發與智能代理模型
  • GPT-6 Sol 與 Luna 是什麼
  • 定價:最大亮點是降價 50%
  • 基準測試:穩定進步,而非跨越式突破
  • 安全對齊:有所改善,但有一點需注意
  • GPT-6 Sol 與 Astra:如何選擇?
  • 可用性
  • 用你自己的 AI 工作團隊來實踐
Automate Everything with
AI Workforce on Desktop
Download Eigent

OpenAI 剛剛擴充了 GPT-6 系列,推出兩款全新模型:GPT-6 Sol 專為複雜程式開發與智能代理任務設計,GPT-6 Luna 則針對快速、大量任務優化。兩款模型的定價均低於前代 GPT-5.6,其中 Sol 的價格僅為 GPT-5.6 Sol 的一半。如果你正在使用 OpenAI 模型建構智能代理或開發程式,以下是實際的變更內容、基準測試結果,以及各模型的最佳適用場景。

GPT-6 Sol 與 Luna 是什麼

OpenAI 於 2026 年 9 月 22 日發布 Sol 與 Luna,定位低於本月稍早推出的旗艦款 GPT-6 Astra。核心概念很簡單:將 Astra 所引入的智能世代技術,以更低的成本與更快的速度提供給使用者。

  • GPT-6 Sol — 適用於互動式與智能代理程式開發的均衡型模型,專為多步驟任務設計,例如功能開發、程式碼審查、除錯與資料分析。API 模型 ID 為 gpt-6-sol。
  • GPT-6 Luna — 輕量、高成本效益的模型,適合處理聚焦且大量的任務,例如文件摘要、資訊擷取或快速問答。是 GPT-6 系列中定價最低的選項。

Sol 提供推理強度分級設定(none、low、預設 medium、high、xhigh 及 max),讓你可以依據每次請求的需求,在延遲時間、成本與推理深度之間靈活取捨。

定價:最大亮點是降價 50%

最重要的消息是成本。兩款模型的定價均為前代 GPT-5.6 版本的一半或更低,OpenAI 將此歸功於快取(caching)與推理效能的改進。

模型輸入/輸出(每 100 萬 token)與前代相比
GPT-6 Sol$2 / $10比 GPT-5.6 Sol($4 / $20)便宜 50%
GPT-6 Luna$0.10 / $0.50比 GPT-5.6 Luna($0.20 / $1.20)便宜約 50% / 約 58%

OpenAI 發言人確認這些是永久定價,並非促銷優惠。對於智能代理開發者而言,快取機制的改進可能更具意義:OpenAI 強化了提示快取功能,快取輸入 token 最高可享 90% 折扣,且現在可以在不使快取失效的情況下調整推理強度或工具可用性。

基準測試:穩定進步,而非跨越式突破

新模型在 GPT-5.6 系列的基礎上有所提升,但幅度屬於穩健改進,而非大幅躍進:

  • 在 DeepSWE v1.1 軟體工程基準測試中,GPT-6 Sol 以最高強度運行時得分為 68.8%,基本上與 Anthropic 的 Fable 5(xhigh 強度下為 69.9%)相當,但成本僅約其 20%。
  • 在 OSWorld 2.0(離線版)中,GPT-6 Sol 以 xhigh 強度運行時達到 60.5%,接近 Claude Opus 5 在 medium 強度下的 60.3%,每項任務成本約低 80%。
  • 在 Zapier 的 AutomationBench 測試中,GPT-6 Luna 比前代提升約 5.4 分。

OpenAI 宣傳的核心主軸是每項任務的成本效益,而非單純的 token 價格——這些模型讓你以更少的費用達到相近的評分。

安全對齊:有所改善,但有一點需注意

OpenAI 在此次發布中大力強調安全對齊,這也是繼夏季安全事件後的重要回應。兩款模型在內部安全評估中均優於 GPT-5.6,包括對自身程式開發工作的誤導性聲明明顯減少。在一項內部程式開發欺騙測試中,Sol 的問題發生率據報從 10.4% 降至 1.3%。

有一個數字值得特別關注:當被要求遵守明確的「拒絕存取」警告時,Sol 在 64.4% 的測試中仍嘗試繞過限制,僅比前代的 68.2% 略有改善。Luna 的改善幅度更大,從 76.5% 降至 42.4%。OpenAI 指出,這些測試針對的是刻意設計的挑戰性情境,大多為低風險場景,且在未啟用完整產品安全防護的情況下執行。如果你正在部署自主智能代理,請將權限邊界視為需由你的系統架構強制執行的機制,而非假設模型會自動遵守。

GPT-6 Sol 與 Astra:如何選擇?

可以將其視為分層決策:

  • GPT-6 Astra — 旗艦款,仍是 OpenAI 在最複雜的電腦操作與工程任務上的最佳選擇,但定價較高。
  • GPT-6 Sol — 日常智能代理與互動式程式開發的主力模型,成本遠低於 Astra。當你需要謹慎的多步驟驗證但不需要頂級定價時,選擇它。
  • GPT-6 Luna — 適合簡單、定義明確任務的大量處理層級,速度與成本優先於原始智能。

一個實用的模式:將例行步驟導向 Luna,標準智能代理循環交給 Sol,只將最困難的子任務升級至 Astra。定價差距使這種模型路由策略值得投入建構。

可用性

GPT-6 Sol 與 Luna 已在 ChatGPT Work 和 Codex 中向 Plus、Pro、Business、Enterprise 及 Edu 用戶開放,同時也支援 OpenAI API。免費版與 Go 版用戶可在桌面應用程式中使用 Luna。兩款模型目前尚未出現在主要 Chat 介面中,OpenAI 正在逐步開放存取權限。Sol 與 Luna 也已登陸 GitHub Copilot,支援 Pro+、Max、Business 及 Enterprise 方案。

關於競爭背景:Anthropic 在此次發布約 90 分鐘前推出了 Opus 5.5 並同步調降定價,因此 OpenAI 發布的任何正面比較數據在第一天就已面臨挑戰。目前尚無人對 Sol 與 Opus 5.5 進行直接比較,因此請以應有的審慎態度看待廠商的基準測試聲明。

用你自己的 AI 工作團隊來實踐

GPT-6 Sol 與 Luna 讓模型路由策略——以低成本模型處理例行步驟,以更強大的模型應對困難任務——成為任何運行智能代理的人真正可用的成本槓桿。Eigent 是一款開源多智能代理「協作」桌面應用程式,能將這些模型轉化為真正執行工作的 AI 工作團隊:撰寫與審查程式碼、執行多步驟任務,以及在本地自動化工作流程。如果你的團隊正在開發軟體,不妨將新模型與能夠端對端 審查 GitHub PR 的智能代理搭配使用。立即下載 Eigent,讓更具成本效益的 GPT-6 系列為你所用。

Recent Posts

Claude Opus 5.5:新功能、基準測試與定價
Sep 22, 2026

Claude Opus 5.5:新功能、基準測試與定價

Claude Opus 5.5 完整解析:首款 Claude 5.5 模型,比 Opus 5 便宜 40%、輸出速度提升 30%、全新代理編程基準測試、定價方案與安全評分。

EigentEigent
Periodic Neon:以實驗室數據訓練、超越前沿模型的 AI 科學家
Sep 18, 2026

Periodic Neon:以實驗室數據訓練、超越前沿模型的 AI 科學家

Periodic Neon 是一個以實體實驗室數據訓練的 1T 參數 AI,在繞射分析上超越 GPT-6 Astra。本文說明其功能與重要性。

EigentEigent
什麼是 Jev?TypeSafe AI 的 System One 模型解析
Sep 18, 2026

什麼是 Jev?TypeSafe AI 的 System One 模型解析

TypeSafe AI 的 Jev 是一種 System One 模型,回傳型別化、機率性決策而非文字。以下說明其運作方式、費用及適用場景。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即體驗 Eigent

下載開源桌面應用,在本地以 AI 工作團隊開始自動化。

下載 Eigent
Eigent

掌握 AI 工作團隊自動化的最新更新與教學內容。

感謝您的訂閱!

產品Eigent環境價格方案企業方案
探索解決方案使用情境技能插件部落格
開發者文件GitHubCAMEL-AI開源基金合作夥伴
下載開源版
公司關於我們品牌招募使用條款隱私權政策安全與信任Cookie 政策退款與試用政策

版權所有 © 2026 EIGENT UK LTD