9月14日,DeepSeek-V4.1-Flash正式上线千问AI平台,相关API服务与Token Plan同步开放。开发者可通过API接口将模型能力接入应用及业务系统,也可在Qoder、千问App、Codex等AI工具中直接调用。
据悉,DeepSeek-V4.1-Flash是一款面向高效率应用场景优化的多模态大模型,原生支持文本与图像理解能力,最长支持100万Token上下文,可应用于代码开发、长文档处理、视觉理解以及智能体任务等场景。
据官方介绍,通过新一代缓存压缩技术,模型运行所需的HBM需求降至上一代模型的四分之一,SSD存储需求降至八分之一,有助于提升长上下文、高频调用场景下的部署效率。










