deepseek-flash 上下文长度增加至 100 万 tokens
开发者现在可以在 flash 模型中处理更大的文档和对话,提高了其在长文本应用中的实用性。
模型 APIplatform.deepseek.com12 条已发布变化
开发者现在可以在 flash 模型中处理更大的文档和对话,提高了其在长文本应用中的实用性。
使用 deepseek-v4-flash 的开发者应迁移到 deepseek-flash。旧名称仍可使用但映射到 V4.1-Flash 模型,按 Flash 价格计费。
使用此模型的开发者现在拥有明确的 2500 并发限制用于速率限制
用户现在可以看到该新模型的透明定价:缓存命中 $0.007/$0.014 每百万输入令牌,缓存未命中 $0.22/$0.44 每百万输入令牌,其他令牌类型费率更高
开发者现在可以使用新的 deepseek-v4-flash-vision-exp 模型处理图像和文本,实现多模态 AI 能力。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化
所有 DeepSeek API 用户将面临 2026 年 8 月 16 日生效的新定价结构。峰值时段(01:00-04:00 和 06:00-10:00 UTC)收费是非峰值费率的两倍。非峰值费率是峰值费率的一半
API 用户需要将模型引用从 'deepseek-v4-pro' 更新为 'deepseek-v4-pro-0813' 以正确指定模型。
使用 DeepSeek-V4-Pro 的开发者现在可以使用 Responses API,该功能之前仅限于 deepseek-v4-flash 模型。
开发者现在可以通过调用 deepseek-v4-pro 访问更新的 DeepSeek-V4-Pro 模型(版本 0813)。调用方法保持不变。
API 定价在高峰时段(北京时间 9:00–12:00 和 14:00–18:00,UTC+8)每天增加 2 倍。影响所有计费项目。生效日期待官方公告。
使用 deepseek-v4-flash 的开发者将自动获得最新模型版本 (0731),无需更改 API 调用或代码。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化
使用这些旧版模型名称的 API 用户必须在弃用日期前迁移至 deepseek-v4-flash,以避免服务中断。
api-docs.deepseek.com · 另有 1 个来源报告了同一变化