查询
| 恒生指数1 | 24,954.47 | 0.00 | -- |
| 国企指数1 | 8,274.78 | 0.00 | -- |
| 返回 放大 + 缩小 - | |
|
DeepSeek发布DeepSeek V4.1 Flash模型 基准测试超越V4 Pro等旗舰模型水平
2026-09-10 14:32:08 DeepSeek公布,正式发布DeepSeek V4.1 Flash模型,是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。 DeepSeek V4.1 Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显着低於已知的同尺寸模型。同时,V4.1 Flash还采用新的预训练方式、经过更大规模的强化学习後训练,在基准测试中,成功超越包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。 新一代模型大幅减少KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低Agent类任务的使用成本。 腾讯(00700.HK)旗下WorkBuddy及CodeBuddy,和OpenCode作为官方合作夥伴,现已全量接入DeepSeek V4.1 Flash。 同时,为了更合理地调配资源,DeepSeek仍然采用峰谷定价,闲时价格为高峰时段价格的一半。新价格於今日(10日)12时开始生效。(jl/u)~ 阿思达克财经新闻 网址: www.aastocks.com | |