参数减半股价重挫:DeepSeek V4.1 发布引爆港股震荡

核心要点

DeepSeek发布V4.1Flash模型,推理成本骤降并下调费率。受此冲击,智谱、MiniMax等港股大模型公司股价重挫,机构对行业竞争前景分歧加剧。同时,DeepSeek启动科创板IPO筹备,营收激增但估值争议犹

据 Woofun AI 消息,9 月 10 日 DeepSeek 正式推出 V4.1Flash 模型,标志着其在新一代轻量级架构上的关键突破。该模型在官网、App 及 API 三端同步上线,旨在通过极致的效率优化,在保持高能力上限的同时大幅提升推理速度与吞吐性能,直接重塑了当前大模型市场的成本基准线。

此次技术迭代的核心在于架构的彻底重构。V4.1Flash 作为该系列中尺寸最小的版本,总参数量达 552B,采用 MoE 架构并引入全新的 CausalEncoderDecoder 设计。其输入与输出阶段采用非对称计算策略,输入时仅激活约 8B 参数,输出时激活约 16B 参数,从而在保留庞大参数规模的同时,大幅降低实际推理时的调用量。

配合 FP4 精度的 KVCache 技术,HBM 需求降至上一代的四分之一,SSD 需求降至八分之一,相较初代模型,缓存规模缩小了约 437 倍。在推理流程上,CSA2 跨层复用缓存并通过 Top-K 索引筛选关键信息,DSpark 则利用轻量模块预判部分 token。官方测试表明,V4.1Flash 在软件工程、网络安全及自动化任务等 Agent 评测中表现优于 V4Pro

价格策略随之调整,新费率于 9 月 10 日中午生效,延续峰谷分时机制,闲时价格为高峰时段的一半。API 侧只需将模型名改为 deepseek-flash 即可切换,旧版本已下线,旧名称暂自动路由。9 月 14 日中午后,访问 deepseek-v4-pro 的请求将全部转向 V4.1Flash 并按新单价计费。腾讯 WorkBuddy、CodeBuddyOpenCode 已完成接入。

市场对此反应剧烈,港股大模型板块遭遇重挫。智谱盘中跌幅超 10%,尾盘报价约 814 港元;MiniMax 跌逾 9%,最低触及 288.60 港元。9 月以来,两家公司累计回撤分别接近三成和一成四。机构观点出现显著分歧。摩根士丹利认为无序恶性竞争概率不高,指出旗舰加轻量的双线布局已成行业标准,且调价后 V4Flash 整体费率仍高于 2026 年 4 月初水平,相对 Qwen3.8-flashGLM5.3-flash 仍具溢价。相反,杰富瑞认为中国大模型赛道过于拥挤,更看好算力和数据占优的全栈云厂商,并将智谱云业务市销率倍数从 50 倍下调至 30 倍。

Woofun AI 整理数据显示,DeepSeek 概念股板块全天收跌 1.19%,主力资金净流出 83.47 亿元,仅游族网络中新赛克两家涨停。

资本路径方面,DeepSeek 已聘请中信证券筹备科创板上市,计划年内启动 IPO 流程。21 世纪经济报道求证后补充,中信证券已进入尽职调查阶段,双方尚未签订正式上市辅导协议,浙江证监局官网亦无备案信息。按辅导备案不少于三个月的要求,公司需在 9 月提交材料才有望年内递交申请。财务数据显示,2026 年前七个月 DeepSeek 营收约 4.75 亿元,已是 2025 年全年的十倍左右,同期净亏损 7.15 亿元,综合毛利率 44.6%。市场最新估值为 5000 亿元人民币,分析人士据此推算,上市后市值区间可能落在 1.5 万亿到 2.5 万亿元。

这一估值预期与当前的市场震荡形成鲜明对比,反映出投资者对 AI 行业长期价值与短期竞争格局的深刻分歧。

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅