DeepSeek-V3.2 是一款兼具高计算效率与卓越推理和 Agent 性能的模型。其方法建立在三大关键技术突破之上:DeepSeek 稀疏注意力(DSA),一种高效的注意力机制,在保持模型性能的同时显著降低了计算复杂性,并特别针对长上下文场景进行了优化;可扩展的强化学习框架,通过该框架,模型性能可与 GPT-5 相媲美,其高算力版本在推理能力上可与 Gemini-3.0-Pro 匹敌;以及大规模 Agent 任务合成管线,旨在将推理能力整合到工具使用场景中,从而提高在复杂交互环境中的指令遵循和泛化能力。该模型在 2025 年国际数学奥林匹克(IMO)和国际信息学奥林匹克(IOI)中取得了金牌表现。
| 服务商 | 上下文 | 最大输出 | 价格区间 | 输入(M/Tokens) | 输出(M/Tokens) | 缓存(M/Tokens) | 延迟 | 吞吐 | 稳定性 |
|---|---|---|---|---|---|---|---|---|---|
siliconflow-cn | — | — | — | ¥2 | ¥3 | ¥0.2 | 5.6 s | 18tps | 样本不足 |
通过智能路由聚合多家服务商,保障调用稳定
curl https://api.tokplus.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $TOKGEN_API_KEY" \
-d '{
"model": "deepseek/deepseek-v3.2",
"messages": [
{"role": "user", "content": "你好,介绍一下你自己"}
],
"stream": true
}'