deepseek
深度求索(DeepSeek)开源系列大模型,以高性价比、强推理能力与 1M 长上下文著称。提供 V3 / V4 Pro / V4 Flash 多档型号,并支持硬盘上下文缓存(disk cache),缓存命中价仅约 26% 输入价,长上下文场景极具成本优势。
1M token 上下文窗口;硬盘缓存(cache_hit ~26% cache_miss);视觉理解;Function Calling;JSON 模式;FIM 补全;兼容 OpenAI Chat Completions 接口;批量 API 折扣。
高性价比推理任务;代码生成与补全;长文档分析;中文场景理解;Agent 工作流;批量数据处理;学术研究与教育。
不支持图像生成;缓存依赖命中(非保证);高并发需联系销售;部分企业功能需单独开通;FP8 量化版本价格更低但精度略损。
| Model | Input / 1M tokens | Output / 1M tokens | Per 1M tokens |
|---|---|---|---|
| $0.1458 | $0.2188 | 1M tokens | |
| $0.1458 | $0.2917 | 1M tokens | |
| $1.7500 | $3.5000 | 1M tokens | |
| $0.2917 | $1.1667 | 1M tokens |