DeepSeek,重磅发布

发布时间:

2026-09-10 16:56:23

来源:格隆汇

9月10日,DeepSeek正式发布V4.1Flash模型,官网、App和API三端同步上线。

官方给V4.1Flash的定位是新一代模型结构系列里尺寸最小的版本,目标却要同时抬高能力上限、推理速度和吞吐能力。

模型总参数552B,属MoE架构,采用全新的CausalEncoderDecoder设计。输入与输出走非对称计算,输入阶段激活约8B参数,输出阶段激活约16B参数。参数规模留着,实际推理只调用其中一部分。

配合FP4精度的KVCache,HBM需求降到上一代的四分之一,SSD需求降到八分之一,相较初代模型,缓存规模已缩小约437倍。

推理流程上,CSA2跨层复用缓存并用Top-K索引挑出重要信息,DSpark用轻量模块提前预判一部分token。官方测试显示,V4.1Flash在软件工程、网络安全和自动化任务等多项Agent评测中超过V4Pro。

价格同步下调,新费率9月10日中午生效,仍沿用峰谷分时机制,闲时价格是高峰时段的一半。API侧把模型名改成deepseek-flash即可切换,旧版本已经下线,旧名称暂时自动路由。9月14日中午之后,访问deepseek-v4-pro的请求会全部转向V4.1Flash,并按Flash的单价计费。腾讯WorkBuddy、CodeBuddy与OpenCode已完成接入。

港股两家大模型今日下跌,智谱盘中跌逾10%,尾盘报价在814港元附近,MiniMax跌逾9%,最低触及288.60港元。9月以来,两家公司累计回撤分别接近三成和一成四。

机构对大模型行业竞争的看法存在分歧。

摩根士丹利认为无序恶性竞争的概率不高,旗舰加轻量的双线布局已是行业标准,调价后V4Flash的整体费率仍高于2026年4月初,相对Qwen3.8-flash和GLM5.3-flash也还留着溢价。

杰富瑞的看法相反,直言中国大模型赛道过于拥挤,更看好算力和数据占优、资产负债表强健的全栈云厂商,并把智谱云业务的市销率倍数从50倍砍到30倍。

DeepSeek概念股板块全天收跌1.19%,主力资金净流出83.47亿元,板块里涨停的只有两家,游族网络中新赛克双双封板。

根据路透社报道,DeepSeek已聘请中信证券筹备科创板上市,计划年内启动IPO流程。21世纪经济报道求证后补充,中信证券已进入尽职调查阶段,双方尚未签订正式的上市辅导协议,浙江证监局官网目前也查不到上市备案信息。

按辅导备案不少于三个月的要求,公司需要在9月提交材料,才有望在年内递交申请。

2026年前七个月DeepSeek营收约4.75亿元,已是2025年全年的十倍左右,同期净亏损7.15亿元,综合毛利率44.6%。

市场给的最新估值是5000亿元人民币,有分析据此推算,上市后市值区间落在1.5万亿到2.5万亿元。

免责声明:所有平台仅提供服务对接功能,资讯信息、数据资料来源于第三方,其中发布的文章、视频、数据仅代表内容发布者个人的观点,并不代表泡财经平台的观点,不构成任何投资建议,仅供参考,用户需独立做出投资决策,自行承担因信赖或使用第三方信息而导致的任何损失。投资有风险,入市需谨慎。

古东管家

请先登录后发表评论

0条评论