
AI大模型厂商DeepSeek于2026年8月14日宣布,最新迭代的DeepSeek-V4-Pro-0813大模型在硅基流动(SiliconFlow)平台实现Day-0首发。该模型支持1M超长上下文窗口,搭配低/高/最大三档可调推理强度,主打编码、工具调用与智能体工作流场景,沿用MIT开源协议,定价为输入每百万token 1.32美元、输出3.96美元,缓存命中仅0.44美元。

对长期深耕智能体开发的团队而言,长上下文推理的成本始终是悬在头顶的达摩克利斯之剑:一次涉及十万级token企业知识库的调用,反复跑几次就能烧掉小团队一周的算力预算。而DeepSeek本次上线的新模型,直接把最影响这类场景成本的缓存价格打了下来。
最近一年来,大模型的上下文窗口长度从128K快速跃升至1M乃至更高,长文档解析、全量代码库调试、企业级智能体等场景的可行性大幅提升,但对应的推理成本却没有同步下降。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录