今天,发布我们正式发布 DeepSeek V4.1 Flash 模型。具备觉理解这是原生我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。多模调A定新模型结构的态视设计初衷是:能力上限更高、推理速度更快、力下ex集团官网吞吐更大、发布可扩展到更大参数模型。具备觉理解
非对称模型结构,原生小成本大智能

DeepSeek V4.1 Flash 为 552B 参数的多模调A定 MoE 模型,采用了全新的态视 Causal-Encoder-Decoder 结构,输入和输出不对称,力下输入激活只有 8B,发布输出激活 16B,具备觉理解成本显著低于已知的原生exness外汇官网登录同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。


DeepSeek-V4.1-Flash 与主流前沿模型在 Agentic Benchmark 上的性能对比


更少缓存,更省成本

新一代模型大幅减少了 KV Cache 缓存的ex外汇官网网站入口大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。


如图展示了 DeepSeek 在减少上下文存储方面的持续进展。相对于初代模型,KV Cache 已经缩小了 437 倍。
API支持
DeepSeek V4.1 Flash 已同步上线 DeepSeek API,原生支持多模态,将模型名称更改为 deepseek-flash 即可调用最新的 V4.1 Flash 模型。旧版本模型 V4 Flash 与 V4 Flash Vision Exp 现已下线,出于兼容考虑,模型名 deepseek-v4-flash、deepseek-v4-flash-vision-exp 将被暂时路由到 V4.1 Flash。
同时,经多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro,因此我们计划有序下线V4 Pro 模型。北京时间 2026 年 9 月 14 日 12:00 之后,至未来 V4.1 Pro 上线之前,用户访问 deepseek-v4-pro 的请求将全部路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。
腾讯(WorkBuddy、CodeBuddy)和 OpenCode 作为官方合作伙伴,现已全量接入 DeepSeek V4.1 Flash,欢迎使用!
API定价调整
得益于模型架构的创新,DeepSeek V4.1 Flash 能够以更低的成本服务更多的用户,因此我们相应下调了 V4.1 Flash 的定价。同时,为了更合理地调配资源,我们仍然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格于 2026 年 9 月 10 日 12:00 开始生效。



今年3月以来,某财经数据监测平台收录的开户类咨询量环比上涨约34%,其中带“ex”关键词的提问占到近四成。问题高度集中:走哪条渠道能顺利办下来、要备什么材料、最容易卡在哪一步。把过去半年各机构的公开办

第三方应用监测平台7月更新的记录显示,过去一个月里,名称含"Ex"、图标与外汇交易类应用高度相似的安卓安装包新增了40余个,其中超过一半的签名文件与官方发行版本对不上。这意味着不少用户在搜索框里点下去

上午10点提交资料,下午2点收到一封题为"地址证明无法辨认"的邮件——这是上周一位读者在交流群里贴出的截图。他不是个例。2024年以来,多家经纪商按新的合规口径收紧了开户审核,Exness这边材料清单

3月第一周,外汇类App的搜索量比上个月同期涨了四成,每到美联储议息窗口,下载需求就跟着放大。但真到装的时候,不少人卡在第一步:App Store搜不到,官网链接跳转到第三方页,群里发的安装包名字还各

2024年第一季度,Exness在MT4/MT5上的标准账户欧美点差多数时段报在1.0—1.2个点,而同期三家主流离岸平台的平均值约在1.4—1.8个点之间。这个差距看着不大,放到日内十几次进出的高频

3月18日晚10点提交Exness开户申请,10点07分收到邮箱验证码,10点23分账户状态变为"已验证"。同一周另一位用户上传的身份证照片边缘反光,材料被退回一次,整个流程拖了26小时才走完。把流程