DeepSeek 推出開源 Claude Code 對手,API 卻要漲價?開發者該怎麼看 封面圖
科技

DeepSeek 推出開源 Claude Code 對手,API 卻要漲價?開發者該怎麼看

DeepSeek 推出開源 agent harness,對標 Claude Code,同時 V4-Pro 上線並改採高峰低價。本文用白話拆解工具層、API 漲價、開發者成本影響,以及為什麼這招值得看。

我看完這則新聞,第一個感覺是:DeepSeek 不只想把模型賣好,還想把工具鏈也擺上桌。先講一個比喻:想像你以前買一台車,只比引擎馬力。現在車廠開始比誰的儀表板、排檔桿、自動駕駛輔助、後備箱空間都能換。DeepSeek 這次就是從「引擎很強」往前跨了一步:模型 DeepSeek-V4-Pro 更會做 agent 工作,同時推出開源 DeepSeek Harness v0.1,讓開發者可以組合模型、工具、沙盒、檔案系統和執行流程。對我們來說,這不只是又一個模型更新,而是 DeepSeek 想搶下 AI 到底怎麼幫你寫程式 這一層。問題是,它自家 API 也開始分高峰低峰,價格比之前貴。這就像店裡開始賣整套廚房設備,同時把外帶費調整了。

為什麼 DeepSeek 要搶「AI 幫你寫程式」那一層?

過去很多廠商比模型,比的是「誰更聰明」,再比「誰的 token 比較便宜」。但 coding agent 要做的不只是生成一段文字。它要讀 repo、改檔案、執行 shell、搜索文件和網頁、規劃步驟、叫 subagents 分頭做事,還要決定哪些操作要讓人批准。這些事情,光靠模型本身不夠,還需要一套執行環境。

DeepSeek Harness 就是來做這件事的。它建在 Cordis 上,採用 MIT license,核心口號是 Everything is a plugin。換句話說,模型、工具、技能、session、sandbox、檔案系統、orchestration 甚至 UI,都可以拆成插件。你可以把它想成一個開放源碼的 AI 寫程式「組裝架」

很多人第一反應會是:「模型很強?聽起來很厲害,但我的 code 到底能不能自動改、自動跑、自動提交 PR?」

這句 OS 很真實。Claude CodeCodex 已經把這種體驗做得很完整,DeepSeek Harness 目前還是 developer preview,官方也提醒會有 breaking changes。所以它現在不是直接替代,而是提供一個更開放、更模組化的基礎。對開發者來說,好處是可以自己換模型、換工具、換 sandbox,不用被綁死在單一廠商的生態裡。

錢包要開始算「高峰低峰」了

同一則新聞裡,另一個很實際的變化是 API 價格。DeepSeek 從 8 月 16 日 16:00 UTC 開始,把原本的 flat pricing 改成 peakoff-peak 兩種時段。peak 是 01:00–04:00 UTC 和 06:00–10:00 UTC,其他時間都是 off-peak。低峰價格約為高峰的一半,但對已經在跑 DeepSeek 的團隊來說,低峰也比舊價貴不少。

用一個簡單例子看:假設你一次用 100 萬 cache-miss input tokens 加 100 萬 output tokens。

模型 舊價(1M 輸入 + 1M 輸出) 低峰新價 高峰新價 白話說法
V4-Flash $0.42 $0.88 $1.76 便宜版也變貴,但彈性大
V4-Pro $1.305 $2.64 $5.28 旗艦版在高峰時段最燒錢

這裡要小心一個誤解:低峰比新高峰便宜一半,不代表低峰比舊價便宜一半。如果你看到「off-peak 50%」這種說法,先確認它是跟哪個價格比。對大量跑 agent 的團隊,排程、cache hit 比例、能不能自己部署,都會變成成本計算的一部分。

V4-Pro 變得更像「會做事的模型」

V4-Pro 本身是 1.6 兆參數、每 token 激活 490 億,並支援 100 萬 token context。對 agent 來說,長 context 很關鍵,因為它要同時看著 repo、log、工具輸出和歷史對話。這版官方版本強調 agent capabilities。它支援 OpenAI Responses API,也說對 Codex 有一鍵整合。文件裡也提到三種 reasoning effort:Non-think、Think High、Think Max。這對 agent 很有用,因為不是每一步都要最大腦力。看檔案、跑常規工具時可以快一點,遇到難 bug 或多階段改動時再提高推理強度。這樣可以省 token,也可以省時間。

benchmark 方面,DeepSeek 給出 Terminal Bench 2.1 87.9、Toolathlon-Verified 74.1 等數字。但要注意,部分 agent 成績是在 DeepSeek Harness 的 minimal mode 下測的。換句話說,那不只是「模型考卷」,而是模型坐在一個執行環境裡做事的成績。這其實正呼應了 DeepSeek 想搶的那一層:harness 會影響最終表現。

它不是 Claude Code,也不是 Codex 的完整替代

如果把 DeepSeek HarnessClaude CodeCodex 放一起看,差異很清楚。DeepSeek Harness 強調開源和可替換,模型也是一個 plugin;Claude Code 是 Anthropic 的成熟商業產品,權限和 sandbox 做得比較完整;Codex 則有 CLI、IDE、desktop、web/cloud 和 GitHub 工作流。三者都能讀寫 repo、跑 shell、規劃和呼叫工具,但成熟度和生態不一樣。

對開發者來說,DeepSeek Harness 最大的吸引力是可拆。你可以換模型、換工具、換 session 管理、換 sandbox,甚至換 UI。這種彈性在 prototype 或內部工具很有用。但如果你要直接上生產環境,還是得先測穩定性,尤其是官方明說會有 breaking changes

寫到這裡,給你幾個小提醒

  • 如果你已經在跑 DeepSeek API,先重算成本,特別是把 peak 時段和 cache hit 比例算進去。
  • 如果你評估 DeepSeek Harness,把它當成 developer preview,先在自己的 workspace 測試,別直接當穩定版用。
  • 如果你做 coding agent,別只比模型 benchmark,要比模型 + harness 整套跑出來的結果。
  • 如果你追求完整產品體驗,Claude CodeCodex 目前仍是成熟選項;DeepSeek Harness 更像開放基礎,不是完全替代。

DeepSeek 這招很聰明:把工具開放,同時讓自家 API 變貴。對開發者來說,機會在彈性,風險在成本。把時段、快取、部署方式都算進去,再決定要不要跟著跑。

延伸思考與常見問題

點選問題可展開答案

  • Q1:DeepSeek Harness 是什麼?

    它是一個開源的 agent harness,負責讓 AI 模型能讀寫檔案、執行 shell、搜索、規劃和呼叫工具,類似 Claude Code 的執行環境,但更強調模組化。

  • Q2:peak 和 off-peak API 定價怎麼影響成本?

    DeepSeek 從 8 月 16 日開始把 API 分成高峰與低峰,同一模型在高峰時段價格最高,低峰約為高峰一半,因此同樣 token 用量在不同時段成本可能差很多。

  • Q3:V4-Pro 的 benchmark 為什麼不能只看數字?

    部分 agent 成績是在 DeepSeek Harness 的 minimal mode 下測的,包含模型加上執行環境,不是純粹只考模型智商,所以比較時要留意測試條件。

🪙

開始您的加密貨幣之旅

立即註冊全球最大加密貨幣交易所 幣安 (Binance),使用專屬推薦碼 CLICK168,即可享有手續費終身優惠與專屬的新人迎新大禮包!

👉 領取幣安專屬註冊優惠