
中国AI新创公司深度求索(DeepSeek)全新系列模型V4的预览版本,24日上线并同步开源;该模型跨入「百万级超长上下文」普惠时代,也是DeepSeek首度采用华为AI芯片;V4分为Pro和Flash两个版本,媒体认为,其定价仍是一贯的「价格屠夫」风格。
DeepSeek V4在华为升腾AI 处理器上完成适配和部署——国产大模型+国产算力的标志性组合,且价格具竞争力;而Nvidia创办人暨首席执行官黄仁勋15日接受Dwarkesh Patel的播客专访时,说了一句分量很重的话:「如果DeepSeek先在华为平台上发布,那对我们国家来说将是灾难性的。」仅仅9天,这句话精准应验。
V4模型上下文处理长度由原有的128K显著扩展至1M,首次增加了KVCache滑窗和压缩算法,减少Attention计算和访存开销。该模型在Agent代理(智能体)运行力、世界知识储备及逻辑推理性能上均取得显著突破。
华尔街见闻报导,就在前一天,OpenAI刚上线GPT-5.5,每百万输出token定价30美元。DeepSeek V4-Flash的输出定价是人民币2元,折合不到0.3美元,也就是百分之一的价格。
路透报导,DeepSeek过去主要依赖Nvidia(辉达,又译英伟达)芯片训练模型,但这次V4版本转向与华为合作。华为升腾、天数智芯、寒武纪等芯片厂商已经支持DeepSeek-V4新模型。不过DeepSeek并未公开说明训练V4所使用的具体处理器芯片型号。这距离DeepSeek去年1月的大版本更新已时隔15个月。
值得一提的是,业界一直在关注DeepSeek-V4是否会用国产算力,从推文来看确实是与华为升腾合作。
V4 拥有百万字超长上下文,在AgenticCoding评测中,V4-Pro已达到当前开源模型最佳水平,并在其他Agent相关评测中同样表现优异。在数学、STEM、竞赛型代码的测评中,V4-Pro超越当前所有已公开评测的开源模型,取得比肩世界顶级闭源模型的成绩。
第一财经日报报导,V4模型按大小分为Pro和Flash两个版本,其中,Pro版参数为1.6兆,启动参数490亿,预训练数据量33兆;Flash版参数为2840亿,启动参数130亿,预训练数据量32兆。均支持100万token上下文,MIT协定完全开源。
国家超算互联网24日发布消息,DeepSeek-V4预览版已上线该平台AI社区。目前,企业、科研机构和个人开发者均可在其AI社区下载DeepSeek-V4模型文档,并依托平台进行快速部署、推理和开发。
世报陪您半世纪
-
·第一证券创办人刘锦杭深耕金融 不断前行
·油锅与40年的火候:邓贵兴用粤菜筑起法拉盛地标
·「红色时尚女王」王奇琦 用东方美学惊艳世界
·徐仕煌前黑帮大佬守护社区 走出江湖回馈社会


