深度求索: DeepSeek V4 Flash

deepseek/deepseek-v4-flash

DeepSeek-V4-Flash 是 DeepSeek 最新开源的混合专家(MoE)模型,总参数量达 2840 亿,推理时仅激活 130 亿参数,在保持极快推理速度的同时兼顾强大性能。原生支持 100 万 token 超长上下文,并提供 Non-Think、Think High、Think Max 三种推理模式,可按任务复杂度灵活切换,以 MIT 协议完全开放。

立即体验
输入类型
输出类型
上下文长度
1M
发布时间
2026/04/24
4 家服务商
服务商上下文最大输出价格区间输入(M/Tokens)输出(M/Tokens)缓存(M/Tokens)延迟吞吐稳定性
topenrouter-cn
1M
¥0.6
¥1.2
¥0.02
3.0 s264.51tps100.00%
wanqing-cn
1M
¥0.7
¥1.4
¥0.14
8.1 s135tps样本不足
siliconflow-cn
¥0.8
¥1.6
¥0.16
3.2 s130tps样本不足
qianfan-cn
1M
¥1.5
¥4.5
¥0.15
1.1 s195tps样本不足

稳定性

通过智能路由聚合多家服务商,保障调用稳定

性能

各服务商渠道监控数据对比

快速开始

查看 API 文档
curl https://api.tokplus.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $TOKGEN_API_KEY" \
  -d '{
    "model": "deepseek/deepseek-v4-flash",
    "messages": [
      {"role": "user", "content": "你好,介绍一下你自己"}
    ],
    "stream": true
  }'