2026 / 09 / 17
U8国际官网-DeepSeek V4.1

【CNMO科技动静】DeepSeek近日发布新一代AI模子V4.1-Flash。根据官方先容,V4.1-Flash虽然总参数范围及激活参数均低在V4-Pro,但于机能、推理速率及成本节制方面体现更凸起,特别于智能体及编程相干使命上,部门基准测试成就跨越V4-Pro以和GPT-5.6 Sol等部门前沿模子。

DeepSeekDeepSeek

CNMO科技留意到,V4.1-Flash采用专家混淆架构,总参数为5520亿,输入阶段激活参数为80亿,输出阶段为160亿。比拟之下,上一代V4-Flash总参数为2840亿,V4-Pro总参数则到达1.6万亿。该模子的一项重点改良是年夜幅压缩KV缓存,缓存占用降至每一个token约890字节,同时输出速率到达每一秒约214.4个token,首个token相应时间为1.13秒。自力评测机构AA给出了“速率显著较快”的评价。

DeepSeek V4.1-Flash代理与编码速度超越GPT-5.6 Sol

于机能方面,DeepSeek称,V4.1-Flash于高推理强度设置下,在终端操作、代码修复及主动化使命等测试中领先在GPT 5.6 Sol及Claude Opus 5。不外于更广泛的高难度通用推理使命中,该模子成就相对于一般。AA数据显示,V4.1-Flash的综合智能指数为40分,高在大都同类开源权重模子中位程度,但仍低在头部前沿模子。需要留意的是,AA近期进级了评测系统,总体评分尺度较着收紧,不少高分模子的分数也呈现下调。

DeepSeek V4.1-Flash代理与编码速度超越GPT-5.6 Sol

价格方面,AA数据显示,V4.1-Flash每一100万输入token价格为0.3美元,每一100万输出token价格为1.2美元,综合成本约0.184美元,低在同档模子中位数。若掷中缓存,价格可进一步降至每一100万token 0.006美元。AA同时指出,该模子回覆偏长,评测中输出token总量较着高在同类模子,可能对于现实利用中的时间及用度带来影响。

技能层面,V4.1-Flash引入名为CED的新布局,将40层Transformer拆分为20层因果编码器及20层解码器,削减传统交织留意力带来的反复计较,并联合CSA二、FP4量化等要领压缩缓存与内存占用。

总体来看,DeepSeek这次更新重点放于智能体履行、代码能力及部署成本优化上。

版权所有,未经许可不患上转载

-U8国际官网