发布时间:2026-09-12 04:01 更新时间:2026-09-12 04:01 阅读量:0
9月10日,DeepSeek 发布 V4.1 Flash。据公开报道,这一版本采用新的模型结构,原生支持多模态,官方称其在性能、速度与成本三项指标上均优于此前的 V4 Pro。与模型发布同步落地的是 API 调价:缓存命中的输入价格降至每百万 Token 0.02 元,未命中部分同样下调,不同媒体给出的降幅口径在 50% 到 60% 区间。具体档位、生效时间与计费细节,以官方定价页面为准。
对已经接入 DeepSeek API 的站长和开发者来说,比参数更值得关注的是调用路由。按照公开说法,V4 Pro 的请求会被自动路由到 V4.1 Flash,也就是说代码里的模型名不用改,但返回风格、首字时延和 token 计费口径都可能随之变化。对于依赖结构化输出的业务,比如内容站点的自动摘要、工单分类或客服问答,建议在小流量侧做一次回归测试,重点验证 JSON 字段是否稳定、函数调用参数是否符合预期,以及长文本输入的截断行为。
价格下探的意义也不只体现在账单上。回顾今年节奏,DeepSeek 在 8 月已上线 V4-Pro 正式版,并从 8 月 17 日起实行峰谷分时定价,空闲时段输出价格明显更低。如今 Flash 版本再降一档,等于把"非高峰跑批处理"这件事的性价比又抬高了一截。站长常见的批量生成 sitemap 描述、批量翻译、正文打标签这类任务,可以考虑放到空闲时段执行。
据媒体报道,DeepSeek 已聘请中信证券筹备科创板 IPO,目前进入尽职调查阶段。公开梳理的融资历程显示:公司 4 月开启融资,6 月首轮交割募资超 500 亿元,投后估值超 3500 亿元;约六周后启动第二轮,投前估值升至 5000 亿元,两轮累计超过 1000 亿元,被媒体称为中国 AI 领域的融资纪录。不过也有投行人士认为,按流程推算最快也要到明年二季度才具备申报条件,最终节奏以官方披露为准。
值得一提的是,九月上旬国内 AI 一级市场并不平静。快手旗下可灵 AI 披露获国家人工智能产业投资基金 14 亿元现金入股,投后估值约 180 亿美元;AI 推理芯片方向的微纳核芯完成 10 亿元 C1 轮融资。模型端降价与资本端密集出手叠加,反映的仍是同一条逻辑:推理成本往下走,调用量才有向上的空间。
大模型 API 的价格与版本迭代速度,已经接近云主机厂商的节奏。建议在两个地方留好缓冲:一是把模型调用封装成独立服务层,模型名、超时和重试策略走配置而非硬编码,换版本时只需改一处;二是在监控里单独统计 token 消耗与失败率,按周对比,出现异常增长时能第一时间定位到是哪条业务链路在放大调用量。至于 V4.1 Flash 的实际表现是否匹配宣传,最稳妥的验证方式还是拿自己的真实业务样本跑一轮对比测试。
| 📑 | 📅 |
|---|---|
| 可灵AI获国家人工智能基金14亿元注资,国资加码视频生成 | 2026-09-11 |
| 智能体集中上线,国内AI从办公桌走进家庭与车间 | 2026-09-11 |
| 大模型公司扎堆冲刺IPO,DeepSeek与月之暗面领衔 | 2026-09-11 |
| 国产端侧小模型密集开源,智能密度成新战场 | 2026-09-11 |
| 十万卡集群写进“十五五”,国产算力基建加速 | 2026-09-11 |
| 十万卡智算集群写入十五五规划,国产算力加速落地 | 2026-09-12 |
| 可灵AI获14亿元注资,视频生成赛道再受关注 | 2026-09-12 |
| 百度搭子接入小度硬件,AI智能体走进家庭场景 | 2026-09-12 |
| 星火X2.5发布并开源端侧模型,百万上下文下探端侧 | 2026-09-12 |
| 国产端侧大模型密集开源,小参数模型开始扛活 | 2026-09-13 |