为 V4-Flash-Vision-Exp 指定并发限制为 2500
使用此模型的开发者现在拥有明确的 2500 并发限制用于速率限制
模型 APIplatform.deepseek.com10 条已发布变化
使用此模型的开发者现在拥有明确的 2500 并发限制用于速率限制
用户现在可以看到该新模型的透明定价:缓存命中 $0.007/$0.014 每百万输入令牌,缓存未命中 $0.22/$0.44 每百万输入令牌,其他令牌类型费率更高
开发者现在可以使用新的 deepseek-v4-flash-vision-exp 模型处理图像和文本,实现多模态 AI 能力。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化
所有 DeepSeek API 用户将面临 2026 年 8 月 16 日生效的新定价结构。峰值时段(01:00-04:00 和 06:00-10:00 UTC)收费是非峰值费率的两倍。非峰值费率是峰值费率的一半
API 用户需要将模型引用从 'deepseek-v4-pro' 更新为 'deepseek-v4-pro-0813' 以正确指定模型。
使用 DeepSeek-V4-Pro 的开发者现在可以使用 Responses API,该功能之前仅限于 deepseek-v4-flash 模型。
开发者现在可以通过调用 deepseek-v4-pro 访问更新的 DeepSeek-V4-Pro 模型(版本 0813)。调用方法保持不变。
API 定价在高峰时段(北京时间 9:00–12:00 和 14:00–18:00,UTC+8)每天增加 2 倍。影响所有计费项目。生效日期待官方公告。
使用 deepseek-v4-flash 的开发者将自动获得最新模型版本 (0731),无需更改 API 调用或代码。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化
使用这些旧版模型名称的 API 用户必须在弃用日期前迁移至 deepseek-v4-flash,以避免服务中断。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化