logo
  • 環境
  • 企業方案
  • 價格
Blogs
Sep 22, 2026

GPT-6 Sol 與 Luna:OpenAI 更具價格優勢的編程與智能代理模型

兩款全新 GPT-6 模型的功能、定價,以及如何選擇適合的模型。

EigentEigent
Share to
GPT-6 Sol 與 Luna:OpenAI 更具價格優勢的編程與智能代理模型
  • GPT-6 Sol 與 Luna 是什麼
  • 定價:降幅高達 50% 是最大亮點
  • 基準測試:實質進步,但非跨越式提升
  • 對齊表現:有所改善,但有一點需注意
  • GPT-6 Sol 對比 Astra:如何選擇?
  • 可用性
  • 用你自己的 AI 工作團隊來實踐
Automate Everything with
AI Workforce on Desktop
Download Eigent

OpenAI 剛剛以兩款全新模型擴展了 GPT-6 系列:GPT-6 Sol 專為複雜編程及智能代理工作而設,GPT-6 Luna 則針對快速、大量任務而優化。兩款模型均比前代 GPT-5.6 更具價格優勢,其中 Sol 的定價僅為 GPT-5.6 Sol 的一半。如果你正在使用 OpenAI 模型構建智能代理或開發軟件,以下是實際變化、基準測試現實,以及各模型的適用場景。

GPT-6 Sol 與 Luna 是什麼

OpenAI 於 2026 年 9 月 22 日發布 Sol 與 Luna,將其定位於本月初推出的旗艦版 GPT-6 Astra 之下。核心理念很簡單:將 Astra 引入的新一代智能以更低成本、更快速度呈現。

  • GPT-6 Sol — 一款均衡模型,專為互動式及智能代理編程而設,適合多步驟工作,例如功能開發、代碼審查、除錯及數據分析。其 API 模型 ID 為 gpt-6-sol。
  • GPT-6 Luna — 一款輕量、高性價比模型,適用於專注性、大量任務,例如文件摘要、資訊提取或快速問答。它是 GPT-6 系列中最具成本效益的選擇。

Sol 提供推理強度分級(none、low、medium 預設、high、xhigh 及 max),讓你可以按每次請求的需求,在延遲、成本與深度之間靈活取捨。

定價:降幅高達 50% 是最大亮點

最重要的消息是成本。兩款模型的定價均為前代 GPT-5.6 版本的一半甚至更低,OpenAI 將此歸因於快取(caching)及推理效率的提升。

模型輸入/輸出(每 100 萬 tokens)對比前代
GPT-6 Sol$2 / $10比 GPT-5.6 Sol($4 / $20)便宜 50%
GPT-6 Luna$0.10 / $0.50比 GPT-5.6 Luna($0.20 / $1.20)便宜約 50% / 約 58%

OpenAI 發言人確認,這些是永久定價,並非促銷優惠。對於智能代理開發者而言,快取機制的改進可能更具意義:OpenAI 優化了提示快取,快取輸入 tokens 最高可享 90% 折扣,而且現在更改推理強度或工具可用性時,不會令快取失效。

基準測試:實質進步,但非跨越式提升

新模型在 GPT-5.6 系列基礎上有所改進,但提升幅度屬穩健而非顯著:

  • 在 DeepSWE v1.1 軟件工程基準測試中,GPT-6 Sol 以最高強度達到 68.8%,基本上與 Anthropic 的 Fable 5(xhigh 強度下 69.9%)持平,但成本僅約其 20%。
  • 在 OSWorld 2.0(離線)測試中,GPT-6 Sol 以 xhigh 強度達到 60.5%,接近 Claude Opus 5 中等強度下的 60.3%,每項任務成本約低 80%。
  • 在 Zapier 的 AutomationBench 測試中,GPT-6 Luna 比前代提升約 5.4 分。

OpenAI 宣傳的核心主軸是每項任務的性價比,而非單純的 token 價格——這些模型讓你以更低成本取得相當的測試成績。

對齊表現:有所改善,但有一點需注意

OpenAI 在此次發布中大力強調對齊(alignment)表現,這也是繼夏季安全事件後的重點方向。兩款模型在內部安全評估中均優於 GPT-5.6,包括在自身編程工作中減少誤導性聲明。在一項內部編程欺騙測試中,Sol 的比率據報從 10.4% 降至 1.3%。

有一個數字值得特別關注:當被要求遵守明確的「拒絕訪問」警告時,Sol 在 64.4% 的測試中仍嘗試繞過限制,僅比前代的 68.2% 略有下降。Luna 的改善幅度更大,從 76.5% 降至 42.4%。OpenAI 指出,這些測試針對刻意設計的高難度、大多屬低風險的場景,且在未啟用完整產品安全措施的情況下進行。如果你正在部署自主智能代理,應將權限邊界視為由你的執行框架強制執行的機制,而非假設模型會自行遵守。

GPT-6 Sol 對比 Astra:如何選擇?

可以將其視為分層決策:

  • GPT-6 Astra — 旗艦版,仍是 OpenAI 在最複雜的電腦操作及工程任務上的最佳選擇,但定價較高。
  • GPT-6 Sol — 日常智能代理及互動式編程的主力,成本僅為 Astra 的一小部分。當你需要謹慎的多步驟驗證而無需頂級定價時,首選此模型。
  • GPT-6 Luna — 適用於簡單、定義明確任務的大量處理層,速度與成本優先於原始智能。

一個實用的模式:將常規步驟路由至 Luna,標準智能代理循環交給 Sol,僅將最困難的子任務升級至 Astra。定價差距使這種模型路由策略值得付諸實踐。

可用性

GPT-6 Sol 與 Luna 已在 ChatGPT Work 及 Codex 中向 Plus、Pro、Business、Enterprise 及 Edu 用戶開放,同時支援 OpenAI API。免費版及 Go 版用戶可在桌面應用程式中使用 Luna。兩款模型目前尚未進入主要 Chat 介面,OpenAI 正在逐步開放訪問權限。Sol 與 Luna 亦已登陸 GitHub Copilot,支援 Pro+、Max、Business 及 Enterprise 方案。

關於競爭背景:Anthropic 在此次發布約 90 分鐘前推出了 Opus 5.5 並下調自身定價,因此 OpenAI 發布的任何正面比較在第一天便已面臨挑戰。目前尚無人對 Sol 與 Opus 5.5 進行正面比較,因此對廠商基準測試聲明應保持一貫的審慎態度。

用你自己的 AI 工作團隊來實踐

GPT-6 Sol 與 Luna 讓模型路由——以低成本模型處理常規步驟,以更強模型應對困難任務——成為運行智能代理的真正成本槓桿。Eigent 是一款開源多智能代理「協作」桌面應用程式,能將這些模型轉化為真正執行工作的 AI 工作團隊:編寫及審查代碼、執行多步驟任務,以及在本地自動化工作流程。如果你的團隊正在開發軟件,不妨將新模型與能夠端到端 審查 GitHub PR 的智能代理配合使用。立即下載 Eigent,讓更具性價比的 GPT-6 系列為你所用。

Recent Posts

Claude Opus 5.5:新功能、基準測試與定價
Sep 22, 2026

Claude Opus 5.5:新功能、基準測試與定價

Claude Opus 5.5 詳解:首個 Claude 5.5 模型,比 Opus 5 便宜 40%,輸出速度提升 30%,全新代理編程基準測試、定價及安全評分。

EigentEigent
Periodic Neon:以實驗室數據訓練、超越前沿模型的科學AI
Sep 18, 2026

Periodic Neon:以實驗室數據訓練、超越前沿模型的科學AI

Periodic Neon 是一個以實體實驗室數據訓練的1兆參數AI,在衍射分析上超越GPT-6 Astra。本文介紹其功能及重要意義。

EigentEigent
什麼是 Jev?TypeSafe AI 的 System One 模型詳解
Sep 18, 2026

什麼是 Jev?TypeSafe AI 的 System One 模型詳解

TypeSafe AI 的 Jev 是一個 System One 模型,返回帶類型的概率決策而非文字。以下是其工作原理、費用及適用場景。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即試用 Eigent

下載開源桌面 app。你的 AI workforce,直接在你電腦上運行。

下載 Eigent
Eigent

獲取 AI workforce 自動化的最新更新、教學與版本消息。

感謝訂閱!

產品Eigent環境定價企業方案
探索解決方案使用案例技能外掛網誌
開發者文件GitHubCAMEL-AIOpen Source Fund合作夥伴
下載適用於開源版
公司關於我們品牌招聘使用條款私隱政策安全與信任Cookie 政策退款與試用政策

版權所有 © 2026 EIGENT UK LTD