Loading...

资讯动态

DeepSeek推出新模型V4.1-Flash,力求更普惠发展

DeepSeek曾被认为是大模型领域的一个重要标杆,以其出色的性能和高性价比,竞争对手的生存空间受到压缩。然而,DeepSeek最近做出了一个令人意外的决定,停用了其尚在开发阶段的V4-Pro模型。9月10日,DeepSeek在其微信公众号上发布了V4.1-Flash模型,声称其“更强、更快、更普惠”。根据简介,新版本不仅全面重构了V4系列模型的架构,还减少了总参数和激活参数的规模。

有趣的是,DeepSeek在发布文档中明确表示,V4.1-Flash的性能超越了之前饱受批评的V4-Pro,并决定将V4-Pro逐步下线,接口将转向新模型。在经历了一段混乱的时期后,DeepSeek正尝试通过削减和优化来重返巅峰。

根据官方消息,V4.1-Flash的关键变化是引入了一种名为“Causal-Encoder-Decoder”的新架构,以高总参数、低激活输入和高激活输出的方式提升模型性能。官方基准测试显示,V4.1-Flash凭借仅约三分之一的总参数,超越了V4-Pro在多个权威测试中的表现。新模型在资源需求上也做出了显著优化,明确降低了对高带宽内存和固态硬盘的需求,而这引起了存储市场投资者的关注。 球友会

对于DeepSeek的新发布,开发者社区的反馈可以用“听劝”来形容。DeepSeek在发布V4.1-Flash时,聚焦于提升模型的多模态视觉理解能力。过去,DeepSeek系列在图像识别方面受到批评,表现多停留于基础的“看图识字”。此外,DeepSeek决定下线V4-Pro,回应开发者的负面反馈。尽管V4-Pro在发布时备受期待,但其在测试中频繁出现的推理延迟和性能下降,引发了社区的失望和批评。

DeepSeek此次推出的新模型,也进行了价格调整。V4.1-Flash采用峰谷定价,闲时输入缓存命中价格为0.02元/百万词元,未命中为1元,输出价格为4元,相比之下,V4-Pro的价格更高。而随着V4-Pro的停用,其定价体系也随之消失。

这次发布将DeepSeek重新带回了其“斩杀线”的战略定位。与此同时,全球AI领域的目光集中在OpenAI的最新大模型“Astra”上,展现出强大的功能和定价。与此相比,DeepSeek在国内前沿模型的发展似乎并未达到预期。自8月以来,DeepSeek进行了多次大动作,包括价格调整和推出官方工具,但整体反响并不理想,尤其是提价导致其在第三方平台上的使用量暴跌,而其开发的“沙盒”工具在市场适应性上存在不足。 球友会