利好
中国 AI 模型 OpenRouter 周消耗占比升至多数
08:25
受硬件限制驱动,中国实验室通过架构与算法创新实现极致降本,其模型在OpenRouter平台占据主导份额。
据 Woofun AI 消息,Delphi Digital 指出,出口管制导致先进芯片获取受限,促使中国 AI 实验室转向低成本模型与高效技术栈。尽管国内加速器可支持推理,但前沿训练仍面临挑战,华为升腾芯片虽可用于推理,但 DeepSeek 曾因技术问题在升腾上训练 R2 后回归 NVIDIA,且国内加速器供应低于预估需求。
为突破瓶颈,中国实验室在系统效率、模型架构、训练数据及强化学习上取得创新。DeepSeek 优化数据移动以避免 GPU 闲置,字节跳动和 Moonshot 迅速跟进。架构方面,训练转向适配国产芯片的低成本数字格式,采用稀疏架构减少每 token 运行量,并重新设计注意力机制以控制长上下文内存成本。数据层面通过密集预测目标和优化器提升学习信号,强化学习方面 DeepSeek 的 GRPO 成为默认方案,字节跳动、阿里巴巴和 MiniMax 一年内推出继任方案。
目前中国模型已成为成本最低的前沿相邻系统。在 OpenRouter 平台上,中国开发模型的周 token 消耗占比从 2024 年底不足 1.2% 升至 2026 年多数。2024 年至 2026 年初,中国 AI 市场经历价格战,多家实验室隐含收入倍数约 47-117 倍,而 Anthropic 和 OpenAI 约为 15-21 倍。
WOOFUN AI
影响力评估 · 一键速读
中国 AI 实验室在硬件受限背景下,通过底层架构与算法创新实现了极致的成本控制,使其模型在推理市场获得显著份额优势。OpenRouter 数据表明,中国模型已从边缘走向主流,反映出全球 AI 算力格局的多元化趋势。较高的隐含收入倍数暗示市场对中国 AI 企业未来盈利能力的预期较高,但也需关注国内算力供应瓶颈对长期训练能力的制约。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论