IT之家 9 月 10 日消息,深度求索今日(9 月 10 日)正式发布 DeepSeek V4.1 Flash 模型。这是其全新模型结构系列中的最小尺寸的模型,官方称经多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。DeepSeek V4.1 Flash 是552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B。V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,从 DeepSeek 官方放出的测试成绩来看,DeepSeek V4.1 Flash 超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。此外,新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 内存的需求减少到 1/4,对 SSD 的需求减少到 1/8。相比 DeepSeek-V1 初代模型,DeepSeek V4.1 Flash 的 KV Cache 只有原来的 1/437,智能体类任务的成本大幅降低,不愧是 AI 界的“蜜雪冰城”。DeepSeek V4.1 Flash 已同步上线 DeepSeek API,原生支持多模态,将模型名称更改为 deepseek-flash 即可调用最新的 V4.1 Flash 模型。还有好消息,随着成本的降低,DeepSeek V4.1 Flash 欣然宣布降价!梁文锋的“滑动变祖器”看来又要动一动了,空闲时段输入(缓存命中)定价大降 60%,输出微降 11%。空闲时段输入缓存命中单价 0.02 元、输入缓存未命中单价 1 元,输出单价 4 元;高峰时段价格为空闲时段价格的 2 倍。近期热文AI界的“蜜雪冰城” ↓↓↓