DeepSeek新模型V4.1 Flash开启内测,速度与成本引发关注
从9月8日起,DeepSeek在官方平台上宣布开始V4.1 Flash模型的中间版本内测。这一版本采用了全新的模型架构,支持原生多模态,使得模型在能力和速度上均有显著提升,同时还声称运营成本将进一步降低。对于开发者来说,使用该模型的API时,只需保留原base_url不变,并将模型名称设为deepseek-v4.1-flash-expires-on-0910,就能开始进行调用,但每个账号的并发调用限制为20个。
有些开发者对此次内测的性质提出疑问,认为这实际上更像是一次小范围的公开测试,因为接口、模型名称和定价已经完全公开。目前,一些在社交媒体上进行的反馈显示,此次的并发调用限制被认为过于严格,适合于功能验证和效果测试,并不适合处理大量线上业务。此外,从模型名称中可以得知,此次内测将在9月10日即自动下线,留给开发者的体验时间仅有两天。
首批开发者纷纷表示V4.1 Flash给他们带来了极大的速度提升。部分开发者反映,在同样任务的端到端处理上,新模型的表现明显优于V4 Flash Vision-Exp,例如SVG代码生成速度提升了6倍,而长上下文检索则提升了超过5倍。这一版本不仅在多模态支持上更为出色,同时在速度上亦有了质的飞跃。
然而,对于官方声称的“成本更低”,一些开发者表示并未感受到明显的变化,提到“5分钟花费10块钱”,甚至有人抱怨消耗“瞬间几十块”。对此,有人猜测,能耗可能是由于提升的速度所致,即在相同时间内Tokens的消耗也相应加快。根据官方信息,目前内测的计费与DeepSeek V4 Flash相同,分别在空闲和高峰时段对每百万Tokens进行定价,具体价格有所不同。总体来看,开发者实际支付的每Token成本并没有降低,所谓的成本下降可能是参考了模型推理效率的提升,或者是完成同样任务所需的计算资源和Token数量的减少。是否能将这些优势转化为开发者账单的降低,还需更多的实测验证。
DeepSeek尚未通过官方博客发布该新模型的正式介绍,更多的信息可能要等到内测结束后才能揭晓。近两个月来,DeepSeek的更新频率明显加快。自7月31日发布V4 Flash正式版以来,不到两周后便推出V4 Pro,并进行了API价格的大幅调整。同日,DeepSeek Harness的开发者预览版开放测试及开源。紧接着,在8月19日推出的新版本中,补充了多模态输入、子智能体协作和工具调用等新功能,而8月21日则上线了V4 Flash Vision-Exp的API,随后8月31日开放了模型权重。到了9月8日,基于新结构的V4.1 Flash也正式进入内测阶段。
在不到40天的时间内,DeepSeek围绕模型、多模态支持及Agent开发工具进行了连续不断的更新,这种快速的迭代显示了该公司在构建从底层模型到Agent基础设施的产品体系方面的决心。不过,从当前模型的能力来看,DeepSeek在今年的竞争中排名有所下降,尚未在最新的模型评比中占据领先地位。根据AI基准评测机构Artificial Analysis的数据,DeepSeek的智能指数为36分,排在第15位,前两名依然被国际厂商的Claude和GPT-6占据。在国内竞争中,智谱和Kimi分别名列第7和第9位,而千问排名第13。这也是外界对V4.1 Flash寄予期望的原因之一。有观察人士指出,DeepSeek这次更新并非简单的增量优化,而可能还进行了预训练的重构。开发者们期盼新架构能带来显著的能力提升,帮助DeepSeek重回全球模型能力的领先行列。
发表评论