DeepSeek近日宣布启动其最新模型DeepSeek V4.1 Flash中间版本的内测活动,标志着该公司在多模态人工智能领域迈出重要一步。新版本采用创新型模型架构,不仅原生支持多模态交互能力,还在综合性能、推理效率及使用成本方面实现显著优化。开发者可通过简单配置快速接入测试环境,无需修改基础网络地址,仅需将模型名称设置为"deepseek-v4.1-flash-expires-on-0910"即可完成部署。
在调用限制方面,内测版本对单个开发者账号设置20并发请求的上限。计费机制延续DeepSeek V4 Flash的阶梯定价模式,根据时段和缓存命中情况分为三个收费档位:空闲时段缓存命中的输入处理费用为每百万tokens 0.05元,未命中时升至1.5元,输出费用为4.5元;高峰时段对应价格分别为0.1元、3元和9元。值得注意的是,该版本名称中的日期标识显示其将于9月10日自动终止服务。
近期DeepSeek产品迭代呈现加速态势。7月31日,V4 Flash正式版API率先开启公测;8月13日同步推出V4 Pro正式版API与Harness开发者预览版v0.1,后者当日即实现开源;8月19日预览版快速迭代至v0.1.0-rc.8版本;8月21日上线的V4 Flash Vision Exp模型随后于8月31日完成开源。这一系列动作显示出公司在技术研发与生态建设方面的双重布局。











