DeepSeek V4-Pro 正式版:香港用家点睇尖峰价同 Expert Mode

13次阅读
没有评论

翻译说明:本文为 MobileSetting 原文 的繁体中文转简体中文翻译。除繁简转换、明显错别字和排版外,保留原文标题、事实、观点、数字、结构和第一人称表达。

DeepSeek-V4-Pro 八月十三日正式上线,API 名仍系 deepseek-v4-pro;八月十六日起分尖峰离峰,香港返工上昼同下昼多数时段系尖峰,离峰先半价。

坊间一传就变成「DeepSeek 4 出咗」。其实官方名系 DeepSeek-V4-Pro 正式版,唔系再出一只全新家族。四月已经有 V4 预览。七月三十一日先把 V4-Flash 转公测,八月十三日先轮到 Pro 喺 App、网页同 API 全面开,偏偏网页入口叫 Expert Mode、API 模型名仍然写 deepseek-v4-pro,搞到好多人以为要换一串新 id。

先讲重点。呢篇按 DeepSeek 官方公告价目表 拆香港用家最易踩嘅三件事:几时出、几点计费、Pro 同 Flash 点拣,旧名 deepseek-chatdeepseek-reasoner 官方早讲过会停,而家应对 V4 两个型号,唔好再当永远可用。

正式版出咗咩,同预览差在边

V4-Pro 卖点唔系再加一截 context,而系官方自己讲嘅生产环境 agent。文件列出一串基准:HLE 无工具 42.7、有工具 60.0,Terminal Bench 2.1 去到 87.9,NL2Repo 61.5,Cybergym 83.3,DeepSWE 62.7,Toolathlon-Verified 74.1,Agents’ Last Exam 25.7,AutomationBench 31.8,DSBench-FullStack 71.1,DSBench-Hard 67.2。

数字系厂方自己报。明明一排八十分睇落好威,唔好直接当赢晒 GPT-5.6 或者 Claude Opus 5,对方用边套 harness、temperature、effort 档,官方注脚都写过唔同,我们建议当「Pro 正式版侧重 agent」呢句成立,能力榜就留俾自己场景实测。

Flash 官方版本标 DeepSeek-V4-Flash-0731,API 名 deepseek-v4-flash。两只都系 1M context、最大输出 384K,并行上限差一截:Flash 2500、Pro 500,长窗唔等于平,output 先系帐单大头。

思考力度而家有三档。简单分类用低,日常 agent 用高,复杂任务先 max;居然有人所有请求都开 max,token 一胀,所谓平价即刻唔平。

接口方面,DeepSeek API 原生支援 OpenAI Responses API 格式,并为 Codex 做过一键设定,同时留低 Chat Completions 同 Anthropic 介面,base URL 仍系 https://api.deepseek.com,Anthropic 格式行 /anthropic,JSON 同工具呼叫两边都有,FIM 只限非思考模式。

香港用家点入场,唔使改号

聊天用官方 App 或者网页。开 Expert Mode 就用到 V4-Pro,写程式、接自己服务就把模型名设成 deepseek-v4-prodeepseek-v4-flash,呼叫方法官方写不变。

香港用家多数已经喺 Cursor 用紧第二只顶模。本站八月写过 Grok 4.6 vs GPT-5.6 Sol vs Claude,七月亦有 Grok 4.5 香港介绍,DeepSeek 呢条线系官方 App 加官方 API,唔好同 Grok 喺 Cursor 嘅入口混为同一张帐单,跟官方同 IDE 提供嘅通道即可,唔使为咗用模型去学绕过地区限制。

坦白说,预览期已经用开 deepseek-v4-pro 嘅人,正式版最易漏睇嘅唔系新功能,而系八月十六日 16:00 UTC 开始嘅尖峰离峰价,价目变咗、模型名冇变,帐单一出先发觉日间贵咗一倍。

尖峰离峰点计,香港日间其实贵

新价按每百万 tokens、美元计。离峰系尖峰一半,官方尖峰系 UTC 01:00–04:00 同 06:00–10:00,换香港时间大约 09:00–12:00、14:00–18:00。

返工写 code 嘅上昼同下昼,多数时段明明系尖峰。午膳先松。傍晚六点之后同通宵都系离峰,想悭就把可延后嘅批次、评测、长 agent 搬去晚间,即时对答、会议跟住改 code,就接受尖峰价。

模型 Cache miss 输入(尖峰/离峰) 输出(尖峰/离峰) Cache hit 输入(尖峰/离峰) 并行上限
deepseek-v4-pro $1.32 / $0.66 $3.96 / $1.98 $0.044 / $0.022 500
deepseek-v4-flash $0.44 / $0.22 $1.32 / $0.66 $0.014 / $0.007 2500

单位每百万 tokens。Cache hit 平两个数量级,重复系统提示值得先设计到打中 cache,新价由二零二六年八月十六日 16:00 UTC 生效,之后以官网价目为准。

自己计一条。假设一次 agent 跑一千万 input(cache miss)、两百万 output,Pro 尖峰大约 10×1.32 加 2×3.96,即 13.2 加 7.92,合共 21.12 美元。离峰刚好一半。Flash 尖峰约 7.04 美元。竟然同一条任务,Pro 尖峰可以贵过 Flash 尖峰两倍不止,max 思考再加长输出,差距仲会拉开。

同 Grok、GPT、Claude 八月价点比

八月香港顶模唔止 DeepSeek 一条线。Grok 4.6 标准档每百万输入两美元、输出六美元,提示一过二十万 token 成笔跳到四美元同十二美元,GPT-5.6 Sol 输入五美元、输出三十美元,Claude Opus 5 五美元同二十五美元,Sonnet 5 两美元同十美元,七月对照表喺 Grok 4.5 vs GPT-5.6 vs Claude Fable 5

用返上面一千万加两百万、未踩 Grok 二十万崖:Grok 约 20 加 12 即 32 美元,Sol 约 50 加 60 即 110 美元,Opus 5 约 50 加 50 即 100 美元。V4-Pro 尖峰 21.12 美元仍然平一档,Flash 7.04 美元再平一截。

平唔等于最好用。长任务要稳、生态要齐,仍然可以拣 Claude 或者 Grok,DeepSeek 强项系官方 API 价同 1M 窗,唔系宣布取代所有 IDE 预设模型。

场景点拣:Flash、Pro、定继续用第二只

大量分类、摘要、便宜 tool call,用 Flash。要强啲嘅 agent、生产环境,先 Pro。同一条长任务开 max 再加尖峰输出,帐单可以快过你以为嘅「DeepSeek 好平」。

日常喺 Cursor 写细件 Python、前端,Grok 4.6 标准两美元六美元仍然顺手,提示控住二十万以下就得;要平坦长档、唔想踩 Grok 加价崖,Sonnet 5 每百万两美元十美元、一百万无崖,预算更好估;旗舰推理、输出可以贵,先 Sol 或者 Opus 5。

我们自己试过把重复系统提示做成可 cache 嘅前缀,hit 价低到几乎可忽略,偏偏第一转 miss 仍然跟尖峰表。团队如果日日开长 context,最抵嘅未必系换模型,而系拆任务同打中 cache。

核对官价。本页数字来自二零二六年八月官方文件,落单前请睇当时 DeepSeek 价目,价钱会改,唔当采购承诺。

常见问题 FAQ

DeepSeek 4 系咪今日先出?

答案系唔系。官方系 DeepSeek-V4-Pro 正式版,八月十三日 GA,唔系另一只叫 DeepSeek 4 嘅新系列,八月十六日起先改尖峰离峰价。

香港几点先算离峰?

睇香港时间。UTC 尖峰 01:00–04:00、06:00–10:00,即大约 09:00–12:00 同 14:00–18:00,其余时段离峰,价系尖峰一半。

API 模型名要不要改?

唔使改名。Pro 用 deepseek-v4-pro,Flash 用 deepseek-v4-flash,网页 Expert Mode 对应 Pro 正式版。

V4-Pro 同 V4-Flash 点拣?

量大、要平、工具呼叫密,用 Flash,并行上限 2500;生产 agent、要官方强调嘅正式版能力,用 Pro,并行上限 500。两只都系 1M context、最大输出 384K。

可唔可以当佢赢晒 Grok 同 Claude?

价平一档系事实。官方基准系厂方自己报,场景唔同,能力榜要自己测,长档稳阵同 IDE 生态,Grok、Claude 仍然有位置。

正文完
 0
bdspAdmin
版权声明:本站原创文章,由 bdspAdmin 于2026-09-03发表,共计3314字。
转载说明:除特殊说明外本站文章皆由CC-4.0协议发布,转载请注明出处。
评论(没有评论)