Agent 成本要算到驗收通過,不只比較 Token 單價
真正值得比較的是同一個任務做到可接受結果的總成本。
來源重點
貼文引用一篇 Codex 成本整理,重點是把無關上下文、反覆重跑、錯誤修補與任務擴張納入整次支出。作者建議先限定目標、變更範圍與完成條件,再依任務難度安排推理強度及停止點。 9 月 8 日 Codex 研究ラボ以省額度為題,串文整理自主執行、承認時機、指令優先序、文體、分工與測試,以及 API 新功能與移轉設定;它提供工作量調整方向,沒有量化證明省下多少訂閱額度。
整理判斷
便宜模型若需要更多人工補救,不一定便宜;強模型若把小任務擴成重構,也可能浪費。應把模型費用、重試與人工檢查放在同一張紀錄表。
可以如何判斷
設定預算與最多修改輪數,先做能驗證方向的小樣,再決定是否擴大;遇到缺資料先回報,避免以猜測換取更多重做。
需要留意
原文中的個別帳單與省費比例未獨立核對,不把它們當成可保證的節省幅度。 新串文的 API 設定不能直接套成 Codex 訂閱省額度開關;async 是非同步而非串文所寫的同步。OpenAI 文件要求先完成已授權且可供審查的工作,不代表有權略過必要確認或解除權限限制。
用同一組小任務比較不同推理強度與提示範圍的總成本。
- 需要的條件
- 相同輸入、相同完成條件、可記錄的用量與人工修正時間。
- 怎麼驗證
- 選三個日常任務,各固定最多兩輪修改,記錄耗時、實際用量與驗收結果;只在品質維持時採用較省的設定,不以單次 Token 數宣布勝負。
來源與閱讀紀錄 · 2026.09.09
已讀成本主文、連結長文與 Gencoin8 七則展開作者回覆。本次只核對可取得的文字及所述畫面,未取得全部留言、未完整觀看影片或實際操作工具。補充來源的查閱日期與範圍另列,舊日期不代表本次重讀。
@huoshan007 原始貼文 · 2026.09.08
已讀主文與當時可見留言;來源日期依瀏覽器顯示,未取得全部留言。
Codex 任務成本整理 · 2026.09.08
已讀 2026-09-07 引用長文;未核對作者帳單
Codex 研究ラボ:Astra 工作量調整串文 · 2026.09.09
來源日期 2026-09-08;已讀主文及展開的七項補充。未執行建議,未驗證節省比例。
OpenAI:Astra 使用指南 · 2026.09.09
核對自主執行、授權前提、規則盤點、分工、測試範圍、非同步工具與移轉條件;不是訂閱額度保證。
OpenAI:GPT-6 Astra 模型頁 · 2026.09.09
核對 API 模型規格與計價分層,未用作 Codex 客戶端的實際限制。
後續更新
合併 Codex 研究ラボ的新串文,補上 API 與訂閱額度不能混用、非同步術語及必要授權邊界。原始來源與收錄日保留。