
昨天8 月 13 日我才寫完「DeepSeek V4 Pro 評測」,結論是 Flash 性價比之王、無腦跑。
同一天,DeepSeek 發布了 Harness 開源框架。
兩天後,8 月 17 日漲價公告生效——最高漲 12 倍。
打臉來得很快。
漲價 + 發布框架,同一週發生。這不是巧合,這是 DeepSeek 的轉型宣言:便宜午餐結束了。
一、漲多少:最高 12 倍
新價格(每百萬 tokens,人民幣):
模型 | 時段 | 輸入(未命中) | 輸出 | 緩存命中 |
|---|---|---|---|---|
Flash | 空閒 | 1.5 | 4.5 | 0.05 |
Flash | 高峰 | 3.0 | 9.0 | 0.10 |
Pro | 空閒 | 4.5 | 13.5 | 0.15 |
Pro | 高峰 | 9.0 | 27.0 | 0.30 |
高峰時段:台北時間 9:00-12:00、14:00-18:00。其餘時間半價。
跟 8 月 17 日前的價格比:
Flash:輸入 1 → 高峰 3(3 倍);輸出 2 → 9(4.5 倍)
Pro:輸入 3 → 高峰 9(3 倍);輸出 6 → 27(4.5 倍)
緩存命中漲最兇:Flash 0.02 → 0.10(5 倍);Pro 0.025 → 0.30(12 倍)
換算成美金(高峰時段):
Flash:$0.42 / $1.27(原本 $0.14 / $0.28)
Pro:$1.27 / $3.80(原本 $0.42 / $0.84)
二、峰谷定價:AI 的「時間電價」
高峰、空閒差一倍。這是電力公司的玩法——把尖峰成本轉嫁給客戶,逼你避峰。
DeepSeek 的算力是固定的,白天全世界開發者都在跑,晚上閒置。
與其擴機器,不如漲價讓白天用量降下來。
說穿了:不是缺錢,是缺算力,用價格調度需求。
對開發者的意義:以後寫程式的人要學會看時鐘。
成本敏感的工作(批量分析、測試、題庫生成)排夜間,白天留給互動式任務。
峰谷定價的正確應對(通用做法)
漲價不是開玩笑,是基本數學。
以下三招,任何用 DeepSeek API 的開發者都能直接套用:
第一招:批量任務全部排谷價時段。高峰時段(台北 9:00-12:00、14:00-18:00)價格是離峰兩倍。資料分析、測試、報告、批次生成這種「不趕時間」的工作,全部排到 18:00 之後或中午 12:00-14:00。改個 cron 時間就省一半,零成本。
第二招:互動任務依時段選模型。白天高峰用便宜的 Flash($0.42/$1.27),晚上離峰重度任務切 Pro(離峰 $0.64/$1.90)——效能要、荷包也顧。關鍵:在你的程式裡依時間選模型,不要改全域設定:
import datetime
hour = datetime.datetime.now().hour
peak = (9 <= hour < 12) or (14 <= hour < 18)
model = "deepseek-v4-flash" if peak else "deepseek-v4-pro"
第三招:快取命中也要算成本。緩存命中漲最兇(Flash 5 倍、Pro 12 倍)。
同樣的 system prompt / 對話上下文重複送,快取價格雖便宜但漲幅最大——評估「重發 vs 快取」的平衡,別以為快取永遠划算。
附註:金牛座Anthony 的務實做法 — cron 全部改排谷價時段(台股分析中午 12 點、其他排 08:00 或夜間),競技場的 DeepSeek 也從 Pro 換成 Flash。
不搞自動切換 — 模型切換會牽動排程任務的模型快照,弄不好反而出錯。
老老實實改作業時間,最穩。
我的 StockGPT、題庫管線全部跑 Flash — 8 月 17 日起 cron 全部改排空閒時段。
這已經不是省錢,是基本數學。
三、DeepSeek Harness:從賣模型到賣框架
8 月 13 日,DeepSeek 發布 Harness v0.1,MIT 開源。
一句話:就是DeepSeek 版的 Claude Code / Codex。
核心主張「Everything is a plugin」— 模型、工具、技能、會話、沙箱、儲存、排程、UI,全部可插拔重組,底層是 Cordis 架構。
五月才組 harness 團隊,八月就開源預覽。
這個速度說明一件事:DeepSeek 不想只當賣鏟子的,它要賣「礦場 + 鏟子 + 地圖」整套。( 只是開發者預覽版就別想有多好用 )
「Agent = 模型 + Harness」— 這是 DeepSeek 對 agent 時代的判斷:模型不再是唯一戰場,包住模型的框架才是。
四、之後可能的變局
等等,才發文一天,Google 就來打臉了
8 月 13 日(跟 Harness 同一天),Google 發布 Gemini 3.7 Flash,主打程式開發 + AI 代理。年底前優惠價:輸入 $0.75 / 輸出 $3.75(每百萬 token),是 3.6 Flash 原價的一半。
拿 8 月 17 日漲價後的 DeepSeek 對比:
模型 | 輸入 / 百萬 | 輸出 / 百萬 |
|---|---|---|
Gemini 3.7 Flash(優惠價) | $0.75 | $3.75 |
DeepSeek Flash 高峰 | $0.42 | $1.27 |
DeepSeek Flash 空閒 | $0.21 | $0.63 |
DeepSeek Pro 高峰 | $1.27 | $3.80 |
DeepSeek Pro 空閒 | $0.63 | $1.90 |
三個重點:
第一,DeepSeek Flash 還是便宜王。
高峰輸出 $1.27 是 Gemini 的 1/3,空閒 $0.63 是 1/6。
第二,Google 的算盤不是 Flash 對 Flash。
Gemini 3.7 Flash 輸出 $3.75,幾乎等於 DeepSeek Pro 高峰的 $3.80
Google 的「輕量 Flash」直接定在 DeepSeek 旗艦的價位。
第三,時間點太巧。DeepSeek 漲價 8/17 生效,Google 8/13 發布、宣布「價格砍半」
一個漲一個降,DeepSeek 等於把「便宜」兩個字讓出來,Google 伸手就撿走了。
而且效能不是玩假的:DeepSWE v1.1 65.3%(3.6 是 49%)、WebDev Arena Elo 1588。Google 自報的 DeepSWE 甚至比 DeepSeek Pro 官方的 62.7 還高
Google 正用「Flash 定位」追 DeepSeek 的 agentic 主場。
價格戰沒有結束,是換了選手。
DeepSeek 漲價 = 把「價格屠夫」的位子讓出來,Google 在同一天(8/13)發布 Gemini 3.7 Flash 砍半價卡位——上面那張表就是證據。
接下來看 Kimi、Qwen 跟不跟,如果連他們也漲,那才是真的結束。
再者,峰谷定價會變成常態。
DeepSeek 開了先例,其他廠商一定抄。
以後 API 價格表都會有「時間」這一欄。
夜貓子開發者反而變成優勢群體。
另外,框架大戰開打。Grok Bot 跟 Cursor 合作、OpenAI 推 Codex、DeepSeek 開源 Harness——模型廠商全部往下吃 agent 層。
獨立 harness 廠商會很痛苦。( 痾
對我們這種重度用戶:便宜午餐結束了。
DeepSeek 漲價不是因為缺錢,是因為它有資格收錢 — 模型夠好、生態夠多、開發者離不開。( 不然有其他更便宜好用給我考慮嗎 ?
五、一句話收尾
模型強不強是廠商的事,賺不賺錢是你的事
但現在連跑模型都要學會做個時間管理大師了...
數據來源:DeepSeek 官方定價頁(api-docs.deepseek.com)、deepseek-ai/deepseek-harness(GitHub)、DeepSeek 官方 X(@deepseek_ai)
౨ৎ Anthony 不負責任編輯 ~
留言 (0)