什麼是「額度反推」
官方頁面很少公佈固定 token 上限。我們用反推:總額度 ≈ 已使用 token ÷ 進度條顯示的百分比。例如 5 小時視窗用了 1500 萬 token、進度 37.3%,意味著該視窗總額度約 4000 萬。我們再用 5 小時、7 天、月度三個視窗交叉驗證。
資料來自社群使用者實測反推,非官方固定上限。
沒有唯一「最好」的套餐,取決於你的作息:夜間重度使用,阿里千問 3.8 Max 月卡(¥39,約 15 億 token/月)價效比幾乎沒有對手;白天全時段程式設計,Kimi K3 Allegretto(¥159/月,約 9.5 億 token/月)更穩。
| 模型 | 最低/月↕ | 月額度↕ | 每元Token↕ | 5h視窗 | 夜間折扣 | 適合場景 | 詳情 |
|---|---|---|---|---|---|---|---|
| Kimi K3(Allegretto 檔)月之暗面 | ¥159 | ~9.5億 | ~600萬 | ~4000萬 | 無 | 全時段程式設計 / Agent | 詳情 → |
| 千問 3.8 Max Token Plan阿里雲 | ¥39 | ~15億(夜間) | ~3800萬(夜間) | 700 credits / 5h | 0.2折(夜間) | 夜間重度使用者 | 詳情 → |
| GLM 5.2智譜 AI | — | — | — | — | — | — | — |
資料來自社群使用者實測反推,非官方固定上限,模型方可能動態調整額度策略。點擊列名可排序。
官方頁面很少公佈固定 token 上限。我們用反推:總額度 ≈ 已使用 token ÷ 進度條顯示的百分比。例如 5 小時視窗用了 1500 萬 token、進度 37.3%,意味著該視窗總額度約 4000 萬。我們再用 5 小時、7 天、月度三個視窗交叉驗證。
額度是動態的:會隨模型版本、伺服器負載和商業策略變化。公開一個數字就等於做了承諾,也給了薅羊毛的目標,所以廠商有意保持模糊。請把這裡的每個數字當作快照,而非合同。
程式設計 / Agent 場景下,相同的上下文會反覆傳送。有使用者記錄到 93.7% 的快取命中率 —— 意味著只有約 6% 的輸入按全價計費。所以你「體感」到的額度,遠大於原始 token 數顯示的量。
訂閱制用靈活性換取滾動視窗內的固定價。按量計費 API 每個 token 都計費,但不會對你限速。用量穩定可預測時,訂閱更划算;用量波動大或需要併發時,API 更划算。
訂閱制鎖定月度收入,也降低了消費者對按 token 計費不可預測性的牴觸。同時讓廠商用額度視窗來削峰填谷,而不是單純漲價。
推理叢集按白天峰值超額配置,夜間閒置。 steep 夜間折扣(千問的 0.2 折)本質上是在給閒置算力定價 —— 廠商幾乎沒有額外成本,卻填滿了本會浪費的 GPU。
你實際能用多少,由三個隱藏槓桿決定:快取命中率、你的負載的輸入輸出比、以及時段折扣。同一套餐的兩個使用者,實際吞吐量可能相差 50 倍 —— 這正是我們反推而非只看標價的原因。
取決於你的作息。夜間使用,千問 3.8 Max 每元 token 數高得多(約 3800 萬 vs Kimi 約 600 萬)—— 但白天千問降到約 3 億/月。Kimi K3 全天穩定約 9.5 億/月,沒有時段限制。夜貓子選千問,全天程式設計選 Kimi。
純看每元 token 數,夜間千問 3.8 Max 沒有對手。要穩定 + 面向程式設計的工具鏈,Kimi K3 Allegretto 是最強的全能選手。想先試水,從 Qoder 的免費千問 3.8 Max 額度開始,先不花錢。
通常會提示額度已用完;你需要等滾動視窗釋放(5 小時視窗逐小時釋放、7 天視窗逐天釋放),或升級套餐。部分廠商會降低質量或速度,而不是硬性攔截。
對高強度突發會話(Agent 程式設計、大型重構),5 小時額度幾乎總是瓶頸 —— 月度額度還沒怎麼動,5 小時就先觸頂了。對細水長流的使用,你盯的會是月度額度。
有。Qoder 提供執行千問 3.8 Max 的免費檔,Kimi 也有(受限的)免費版。這是付費訂閱前衡量你真實用量的最佳方式。