DeepSeek推出低成本AI模型挑战竞争对手
核心要点
- 这家中国人工智能初创公司的 V4.1 Flash 模型包含 5520 亿个参数,而价格仅为竞争对手的一小部分,导致竞争对手股价暴跌 DeepSeek 只是让人工智能定价战让与会者更加不舒服。
- 这家总部位于杭州的初创公司于 9 月 10 日推出了 V4.1 Flash 模型,引入了 5520 亿个参数系

这家中国人工智能初创公司的 V4.1 Flash 模型包含 5520 亿个参数,而价格仅为竞争对手的一小部分,导致竞争对手股价暴跌
DeepSeek 只是让人工智能定价战让与会者更加不舒服。这家总部位于杭州的初创公司于 9 月 10 日推出了 V4.1 Flash 模型,引入了 5520 亿个参数系统,有望超越主要竞争对手,同时运行成本大幅降低。
市场的直接反应比任何基准图表都更能说明问题。消息公布后,中国人工智能竞争对手 MiniMax 和 Z.ai 的股价下跌超过 8%,而阿里巴巴的股价下跌超过 2%。
Gloria Stocks 在一个应用程序中,加密货币在另一个应用程序中,钱包无处不在?凯莱金融将您的整个投资组合一目了然。一起看看→
V4.1 Flash 有何不同
该模型使用混合专家架构,这是一种奇特的说法,它只针对任何给定任务激活其总参数的一小部分。结果是高性能,而无需同时点亮每个神经元的计算开销。
DeepSeek 构建了具有本机多模式功能的 V4.1 Flash,这意味着它可以本机处理文本、图像和其他数据类型。该公司专门优化了编码任务和业界所谓的“代理”工作流程的模型,其中人工智能系统自主规划和执行多步骤流程。
性能声明很引人注目,但定价才是真正具有颠覆性的地方。 DeepSeek 之前的模型定价约为每百万个输入代币 0.14 美元,输出代币为 0.28 美元。人们发现,V4-Flash 等早期 DeepSeek 模型的运行成本比同类替代品便宜 100 多倍,每次测试平均成本约为 3 美分,而 Anthropic 的 Claude Fable 5 的成本为 3.15 美元。
V4.1 Flash 预计将以低得多的价格超越 Moonshot 的 Kimi K3。
精心策划的破坏模式
该公司的 V3 模型在 2,000 个 Nvidia H800 GPU 上进行训练,据报道成本为 560 万美元。从这个角度来看,美国领先的人工智能实验室已经花费了数亿甚至数十亿美元来训练他们的旗舰模型。
早在 2025 年,DeepSeek 强调低推理成本和开放访问模型的策略引发了整个科技行业的显着市场抛售。更广泛的影响难以忽视:尽管在美国芯片出口限制下运行,中国的人工智能生态系统正在产生世界一流的模型。
这对人工智能市场意味着什么
股市对 V4.1 Flash 发布的反应表明投资者正在认真对待这一威胁。 MiniMax 和 Z.ai 的跌幅超过 8%,反映出人们对 DeepSeek 的定价策略可能压缩整个中国人工智能行业利润率的真正担忧。即使是业务更加多元化的阿里巴巴也感受到了震动。
有关 DeepSeek 正准备在上海科创板 IPO 的报道为这一情况增添了另一个维度。公开上市将使该公司获得大量资本,同时提供估值基准,进一步重塑投资者对人工智能行业的看法。
