高峰时段为北京时间周一至周五 09:00-12:00、14:00-18:00,其余为空闲时段。
缓存命中价远低于未命中价,多轮对话会自动复用缓存(官方定价页)。
估算基于当前模型与档位单价,实际费用以服务端结算为准。
DeepSeek V4.1 Flash 核心特性
- 非对称新架构:552B MoE(含视觉编码器 763B),Causal-Encoder-Decoder 结构,输入激活仅 8B、输出激活 16B,成本显著低于同尺寸模型。
- 原生多模态:DeepSeek-ViT 视觉编码器从预训练第一步参与,文档识别(DocVQA 95.6)、图表理解表现突出。
- KV Cache 大幅压缩:FP4 缓存约 890 字节/token,HBM 需求降至上代 1/4、SSD 降至 1/8,相对初代累计缩小 437 倍,Agent 类长上下文任务成本大幅下降。
- 能力超越旗舰:官方基准显示在 HumanEval、GSM8K、DeepSWE、Terminal-Bench 上均超过 V4 Pro,其中 DeepSWE 领先约 11.5 分。
- 1M 上下文 / 384K 输出:可一次读入超长文档或代码仓库,并发上限 2500(V4 Pro 为 500)。