回到全部筆記
AI · 觀點X / @huoshan007 · 2026.09.07整理:Sidney收錄 2026.09.08更新 2026.09.09

Agent 成本要算到驗收通過,不只比較 Token 單價

真正值得比較的是同一個任務做到可接受結果的總成本。

來源重點

貼文引用一篇 Codex 成本整理,重點是把無關上下文、反覆重跑、錯誤修補與任務擴張納入整次支出。作者建議先限定目標、變更範圍與完成條件,再依任務難度安排推理強度及停止點。 9 月 8 日 Codex 研究ラボ以省額度為題,串文整理自主執行、承認時機、指令優先序、文體、分工與測試,以及 API 新功能與移轉設定;它提供工作量調整方向,沒有量化證明省下多少訂閱額度。

整理判斷

便宜模型若需要更多人工補救,不一定便宜;強模型若把小任務擴成重構,也可能浪費。應把模型費用、重試與人工檢查放在同一張紀錄表。

可以如何判斷

設定預算與最多修改輪數,先做能驗證方向的小樣,再決定是否擴大;遇到缺資料先回報,避免以猜測換取更多重做。

需要留意

原文中的個別帳單與省費比例未獨立核對,不把它們當成可保證的節省幅度。 新串文的 API 設定不能直接套成 Codex 訂閱省額度開關;async 是非同步而非串文所寫的同步。OpenAI 文件要求先完成已授權且可供審查的工作,不代表有權略過必要確認或解除權限限制。

延伸想法 · 尚待驗證

用同一組小任務比較不同推理強度與提示範圍的總成本。

需要的條件
相同輸入、相同完成條件、可記錄的用量與人工修正時間。
怎麼驗證
選三個日常任務,各固定最多兩輪修改,記錄耗時、實際用量與驗收結果;只在品質維持時採用較省的設定,不以單次 Token 數宣布勝負。
原始來源X / @huoshan007
前往原始內容
來源與閱讀紀錄 · 2026.09.09

已讀成本主文、連結長文與 Gencoin8 七則展開作者回覆。本次只核對可取得的文字及所述畫面,未取得全部留言、未完整觀看影片或實際操作工具。補充來源的查閱日期與範圍另列,舊日期不代表本次重讀。

@huoshan007 原始貼文 · 2026.09.08
已讀主文與當時可見留言;來源日期依瀏覽器顯示,未取得全部留言。

Codex 任務成本整理 · 2026.09.08
已讀 2026-09-07 引用長文;未核對作者帳單

Codex 研究ラボ:Astra 工作量調整串文 · 2026.09.09
來源日期 2026-09-08;已讀主文及展開的七項補充。未執行建議,未驗證節省比例。

OpenAI:Astra 使用指南 · 2026.09.09
核對自主執行、授權前提、規則盤點、分工、測試範圍、非同步工具與移轉條件;不是訂閱額度保證。

OpenAI:GPT-6 Astra 模型頁 · 2026.09.09
核對 API 模型規格與計價分層,未用作 Codex 客戶端的實際限制。

後續更新

合併 Codex 研究ラボ的新串文,補上 API 與訂閱額度不能混用、非同步術語及必要授權邊界。原始來源與收錄日保留。