DeepSeek发布新模型,腾讯全面接入
DeepSeek于9月10日推出了其最新的DeepSeek V4.1 Flash模型,这是该公司新一系列模型中尺寸最小的一款,具备强大的多模态视觉理解能力。该模型参数达到552B,采用创新的Causal-Encoder-Decoder结构,输入激活为8B,输出激活为16B。通过独特的预训练方式和大规模的强化学习训练,DeepSeek V4.1 Flash在基准测试中表现优异,超越了包括DeepSeek V4 Pro在内的众多领先模型,性能也强于市场上大部分主流模型,且其价格大幅低于竞争者。与前代产品相比,这款新模型对HBM和SSD的需求显著减少,分别缩减至1/4和1/8。腾讯的WorkBuddy、CodeBuddy及OpenCode作为官方合作伙伴,已全面接入该模型。此外,DeepSeek采用峰谷定价策略,闲时价格为高峰期价格的一半,新定价自9月10日中午12时起生效,最便宜的收费标准甚至低于每100万词元1美仙。