OpenAI 最近到底做了什麼?Plus 恢復 5 小時限制、Pro 200 縮水,再推出每月 500 美元的「超高速」方案
30秒摘要
2026 年下半年,OpenAI 接連調整 ChatGPT Work、Codex 與 Pro 訂閱制度:Plus 恢復 5 小時使用窗口,新版 Pro 200 的內含額度低於舊制,而全新的 Pro 500 則以每月 500 美元提供最高 25 倍 Plus 額度與 Astra Ultrafast。這些改變顯示 AI 訂閱正從單純的模型存取權,逐漸演變成算力、速度與優先級分層的服務市場。
重點摘要
- 01ChatGPT Plus 的 Work 與 Codex 已恢復 5 小時使用窗口,另外仍存在 weekly allowance。
- 02OpenAI 官方確認新版 Pro 200 的 included usage allowance 低於舊版本。
- 03Pro 500 定價每月 500 美元,官方標示提供相當於 Plus 25 倍的使用額度。
- 04Astra Ultrafast 目前僅包含於 Pro 500,最高速度可達標準 Astra 約 8 倍。
- 05AI 訂閱正在從模型存取權逐漸轉變為模型、額度、速度與算力優先級的多層商品。
OpenAI 最近到底做了什麼?
如果只看社群上的整理,最近的 OpenAI 看起來像是進入了一段相當奇妙的訂閱制度實驗期:Plus 用戶重新被套上 5 小時限制,原本每月 200 美元的 Pro 一度停止接受新訂閱,重新開放後額度又比過去少,接著 OpenAI 又推出價格高達每月 500 美元的 Pro 500。
乍看之下很容易濃縮成一句話:先限制算力,再把更多算力包裝成更昂貴的商品。
但實際拆開官方文件、OpenAI 工程團隊公開說法與媒體報導後,可以發現事情比單純的「漲價」更值得注意。
OpenAI 正在重新定義 AI 訂閱到底賣的是什麼。
過去使用者購買 ChatGPT Plus,很大程度可以理解成取得更好的模型、更高的使用限制與較新的功能;但到了 GPT-6、ChatGPT Work 與 Codex 世代,商品開始逐漸拆成幾個不同維度:
- 你能使用哪一個模型
- 一段時間內可以消耗多少算力
- 每週能使用多少總額度
- 推理任務可以跑多快
- 是否能使用更高優先級的運算服務
換句話說,模型本身已經不是唯一商品,Compute Quality of Service 正逐漸成為商品的一部分。
第一件事:Plus 的 5 小時限制真的回來了
2026 年 8 月,OpenAI 恢復 ChatGPT Plus 在 ChatGPT Work 與 Codex 上的 5 小時使用窗口。
這個限制並不是代表「每五小時只能傳固定幾則訊息」。
OpenAI 官方文件指出,Work 與 Codex 的用量會同時受到短期與週期性限制管理。Plus 使用者的 5 小時窗口會依模型、任務複雜度、輸入輸出長度以及推理設定產生不同消耗。
目前官方提供的估算中,Plus 使用 GPT-6.1 Sol 時,一個 5 小時窗口大約可以容納 15 至 160 則 local messages;GPT-6 Astra 則約為 5 至 45 則。
這個差距本身就透露了一件重要事情:
現在的 AI 訂閱額度,越來越不像傳統 SaaS 的「訊息次數」,而更接近一個抽象化的 Compute Budget。
一個簡單任務可能只消耗很少資源,一個大型程式碼分析、Agent 任務或多步驟 Work 工作則可能快速吃掉額度。
更引發討論的是 OpenAI 工程主管 Thibault Sottiaux 對這項政策的解釋。
他表示,恢復 5 小時限制其中一個原因是為了平滑 OpenAI 的運算負載;另一個原因則是 Plus 使用者相對屬於「casual and new users」,部分使用者可能在短時間內意外耗完整週額度。
這句話很快成為社群焦點。
因為在另一群 Plus 使用者眼中,他們使用 Work 或 Codex 的方式根本不是「休閒使用」,而是每天進行程式開發、研究、文件處理甚至正式工作。
因此真正的矛盾不是單純的 5 小時限制,而是:
OpenAI 對 Plus 的產品定位,開始與部分重度 Plus 使用者實際使用方式產生落差。
第二件事:每月 200 美元的 Pro 曾經停止接受新訂閱
OpenAI 先前一度暫停新的 Pro 200 訂閱與升級。
當時官方文件顯示,現有 Pro 200 用戶可以繼續使用,但其他方案無法升級至 Pro 200,直到暫停措施解除。
從系統角度來看,這種做法其實不難理解。
大型推理模型與 Agent 工作的運算消耗,遠高於傳統聊天模型。尤其當使用者開始使用長時間 Codex 任務、大型 Repository 分析、Work Agent 與高推理設定時,單一重度用戶消耗的 GPU 時間可能非常可觀。
AI 服務因此出現了一個 SaaS 很少遇到的問題:
最重度的付費客戶,反而可能是毛利最低的客戶。
如果一個每月支付 200 美元的使用者,實際消耗了遠超過 200 美元商業模型能負擔的推理資源,那麼 Unlimited 或非常寬鬆的方案就很難長期維持。
這也是生成式 AI 訂閱與 Netflix、Spotify 或一般雲端軟體非常不同的地方。
每一次複雜推理,都有真實的 GPU、記憶體、電力與資料中心成本。
第三件事:Pro 200 回來了,但額度真的變少
目前 OpenAI 已重新開放每月 200 美元的 Pro 200。
不過官方 Help Center 明確寫道:
新的 Pro 200 訂閱,其 included usage allowance 低於過去提供的額度。
OpenAI 給出的理由是模型效率正在提升,因此重新調整了內含使用量。
至於社群廣泛流傳的「20X 變成 10X」,目前主要來自媒體報導,而不是 OpenAI 官方 Help Center 直接列出的數字。
Business Insider 報導指出,新版 Pro 200 的 compute allowance 約從原本 Plus 的 20 倍降為 10 倍,GPT-6 Pro 的每週訊息額度亦由約 200 降至 100。
因此這部分應該分兩層理解:
已由 OpenAI 官方確認:
新版 Pro 200 的內含額度確實低於以前。
由媒體報導:
具體幅度約從 20X 調降至 10X。
這個區分很重要,因為 OpenAI 並沒有在目前的 Help Center 中直接把「舊方案 20X、新方案 10X」列成官方比較表。
舊 Pro 200 使用者則有一段過渡期。符合 grandfathering 條件的帳號,可以暫時保留先前的 included usage allowance 至 2026 年 10 月 29 日,之後才切換至新的較低額度。
第四件事:然後每月 500 美元的 Pro 500 出現了
就在 Pro 200 制度重新調整之後,OpenAI 在 2026 DevDay 正式推出新的 Pro 500。
價格非常直接:
每月 500 美元。
一年就是 6,000 美元。
OpenAI 官方給出的定位也非常清楚。
Pro 500 提供目前 Pro 系列最高的 included usage allowance,官方 DevDay 資料直接標示為:
25× ChatGPT Plus allowance。
除此之外,Pro 500 還有一個其他 Pro 方案目前買不到的功能:
Astra Ultrafast。
OpenAI 表示,在 ChatGPT Work 與 Codex 中,Ultrafast 的 GPT-6 Astra 最快可以達到標準 Astra 約 8 倍的速度。
而且這並不是購買額外 credits 就可以解鎖。
目前 Pro 100 或 Pro 200 即使額外購買點數,也無法使用 Ultrafast。
因此 OpenAI 第一次非常清楚地把「模型執行速度」本身切成不同商品等級。
這是一個非常關鍵的產品變化。
過去我們通常會問:
你能不能用 GPT-6?
未來問題可能變成:
你用的是哪一條 GPT-6 運算車道?
同一個模型可能存在 Standard、Fast、Ultrafast,不同訂閱方案獲得不同優先級、速度與額度。
這種結構其實更接近雲端 GPU、伺服器 Priority Queue 或航空公司的艙等制度,而不是傳統聊天機器人訂閱。
第五件事:GPT-6.1 Sol「被限速」目前沒有足夠證據
最近另一個常見抱怨是:
GPT-6.1 Sol 變慢了,就算開 Fast 還是很慢。
這部分必須與前面的方案變更分開處理。
GPT-6.1 Sol 確實已成為 ChatGPT Work 與 Codex 的主要模型之一,而且 OpenAI 也為不同模型建立明確的 usage cost 與運算等級。
但截至目前,沒有足夠官方資料證明 OpenAI 特別對 GPT-6.1 Sol 執行了秘密的速度限制。
使用者觀察到速度下降可能有很多原因:
- 服務尖峰負載
- Fast queue 壅塞
- 任務上下文變大
- Tool call 增加
- Agent 工作步驟變多
- Reasoning level 不同
- 後端路由策略調整
因此「最近 Sol 很慢」可以是一個真實的使用者體驗,但不能直接寫成「OpenAI 已經確認限速 GPT-6.1 Sol」。
這也是社群討論 AI 服務時非常容易混淆的地方:
Latency Observation 不等於 Throttling Policy。
真正值得注意的不是 500 美元,而是 AI 開始販售「算力階級」
把這幾件事情放在一起看,就會發現 OpenAI 的產品策略正在產生一個非常清楚的輪廓。
早期 ChatGPT 的商品大致可以理解成:
Free → Plus → Pro
你花更多錢,可以使用更好的模型與更多次數。
現在則逐漸變成:
模型能力 + 推理額度 + 短期 Compute Window + Weekly Allowance + 速度 Priority + 額外 Credits + Ultrafast Compute
這意味著 AI 訂閱正在走向真正的 Compute Tiering。
就像 AWS 不會只賣你「一台伺服器」,而是販售不同 CPU、GPU、記憶體、網路與優先級,OpenAI 也正在把原本藏在 ChatGPT 背後的運算資源逐漸商品化。
而 Pro 500 很可能只是這種模式第一次被普通消費者明顯看見。
為什麼 OpenAI 要這樣做?
原因其實很現實。
大型模型的 marginal cost 並不是零。
尤其 Agent 化之後,一次使用者操作可能不再只是:
User → Model → Answer
而是:
User → Planner → Model → Search → Tool → Model → Code → Validation → Model → Final Output
一個看起來只有一次「Send」的工作,後面可能跑了大量推理與工具呼叫。
這讓傳統的「每月固定價格,大家隨便用」模式越來越危險。
因此 AI 公司最終很可能都必須回答同一個問題:
誰來支付真正的 inference cost?
目前 OpenAI 給出的答案越來越明確:
輕度使用者由訂閱方案涵蓋;重度使用者需要更高級方案、更多 credits,甚至購買更高優先級的 Compute Tier。
從 Plus 到 Pro 500,ChatGPT 正在變得更像雲端平台
所以如果只把這一連串事件理解成「OpenAI 又漲價了」,其實會漏掉真正重要的部分。
Plus 恢復 5 小時限制、Pro 200 降低 included allowance,以及 Pro 500 出現,三件事情其實都指向同一個方向:
AI 的價格開始與實際消耗的運算資源重新綁定。
未來使用 AI,也許不再只有「免費版」和「付費版」。
我們可能會看到:
Standard Compute Fast Compute Priority Compute Ultrafast Compute Dedicated Compute
模型仍然是同一個模型,但排隊時間、推理速度、Agent 數量、上下文長度與使用額度全部不同。
到了那個時候,「我訂閱 GPT」這句話可能會變得跟「我有 AWS」一樣沒有太大資訊量。
真正重要的是:
你買了多少算力,以及你在隊伍裡排第幾個。
Tech English 專有名詞
Compute Allowance|運算額度:訂閱方案內允許使用的計算資源總量,不一定直接等於固定訊息數,會依模型與任務複雜度產生不同消耗。
Inference Cost|推論成本:AI 模型實際產生答案時需要消耗的 GPU、記憶體、電力與資料中心資源成本。
Rate Limit|速率限制:限制使用者在特定時間範圍內可以提出多少請求或消耗多少運算量的機制。
Compute Tiering|算力分級:將同一 AI 服務依速度、額度、優先級或硬體資源切分成不同價格等級。
Throttling|限速/節流:系統主動降低使用者請求處理速度或可用資源,通常用於控制系統負載或公平分配資源。
Quality of Service(QoS)|服務品質分級:系統依不同使用者或方案提供不同優先級、延遲、頻寬或運算資源保證的機制。
Core takeaway
OpenAI 最近的方案調整真正值得注意的不是單純漲價,而是 ChatGPT 正從「付費取得模型」轉向「付費購買模型、額度、速度與算力優先級」的分層服務。
Why it matters
Pro 500 將 Astra Ultrafast 與最高 25× Plus 額度綁定,代表生成式 AI 的商業模式開始接近雲端運算:同一套 AI 能力可能依算力、速度與優先級被拆成不同價格。對大量使用 AI 進行程式開發、研究與 Agent 工作的人而言,未來需要比較的可能不只是模型能力,而是每美元能購買多少實際 Compute。
Data story
04Data figure
OpenAI Pro 方案月費
2026 年 Pro 訂閱分級
Tech index
08限制與注意
05- 01OpenAI 官方確認新版 Pro 200 的 included usage allowance 低於過去版本,但官方 Help Center 並未直接列出「20X 降為 10X」的比較數字;該數字目前主要來自媒體報導。
- 02GPT-6.1 Sol 最近速度下降屬於部分使用者體感,目前沒有足夠官方證據證明 OpenAI 對 Sol 實施特定秘密 throttling。
- 03OpenAI 的 Work 與 Codex 額度不是固定訊息數,實際消耗會受到模型、上下文長度、輸入輸出、推理等級及工具使用影響。
- 04Astra Ultrafast 的最高 8 倍速度為 OpenAI 公布的最高值,不代表所有任務都能穩定達到 8 倍。
- 05OpenAI 的方案、使用額度與模型供應制度仍可能快速調整,本文反映 2026 年 10 月初公開資訊。
原始來源
openai.com

