产品

DeepSeek-V4

DeepSeek V4

DeepSeek-V4 是 DeepSeek 于 2025 年推出的新一代基础模型系列,采用 MoE(混合专家)架构,参数规模达到 1.6T。据「葬AI」2026 年 8 月的评测,V4 Pro 正式版在任务执行速度上优于同期竞品,平均每轮任务耗时约 7.9 分钟,快于智谱 GLM 5.3 的 12.7 分钟。

与 2025 年初的 V3 系列相比,V4 延续了 DeepSeek 在工程优化上的路径。V3 时代的关键技术——包括 256 个路由专家的 MoE 架构、MLA 多头潜在注意力机制、FP8 混合精度训练——已被验证为降低推理成本的核心手段。V3-0324 版本通过将专家数量从 160 个增至 256 个,并采用 FP8 训练,实现了计算效率翻倍。V4 在此基础上进一步扩展参数规模,同时 Flash 版本展现出以 1/3 参数量打平后训练优化模型的能力。

2026 年 8 月,DeepSeek 还发布了配套工具 DeepSeek Harness(DSH),用于释放模型在 Agent 任务中的实际能力。实测显示,DSH 配合 V4 Pro 可在约 20 分钟内完成复杂交互网站开发,缓存命中率接近 99%,4 个任务总费用不到 5 元。

由 AI 生成,可能出现错误,请仔细核对内容。

DeepSeek-V4产品
DeepSeek V4
渲染中…
在 3 篇文章中被提及

相关报道