DeepSeek: DeepSeek V4.1 Flash API

DeepSeek-V4.1-Flash 是一款多模态混合专家模型,拥有 552B 的主干参数,能够原生处理高达 1M 标记上下文的图像和文本。其因果编码器-解码器架构在预填充期间仅激活 8B 参数,解码期间仅激活 16B 参数,从而将键值缓存占用量减少到 DeepSeek-V4-Flash 的约四分之一,从而显著降低智能体工作负载的成本效益。

常见问题

DeepSeek V4.1 Flash 的上下文窗口有多大?

DeepSeek V4.1 Flash 支持最高 1,040,000 token 的上下文窗口。

DeepSeek V4.1 Flash 支持函数调用(Function Calling)吗?

支持。DeepSeek V4.1 Flash 支持工具调用 / 函数调用。

DeepSeek V4.1 Flash 支持推理(Reasoning)吗?

支持。DeepSeek V4.1 Flash 是具备推理能力的模型。