公司

DeepSeek

DeepSeek

DeepSeek 是一家由梁文锋创立的人工智能公司,背靠量化交易公司幻方量化,2024 年因开源模型 DeepSeek-V2 以极低 API 定价掀起行业降价潮而进入主流视野,2025 年初凭借推理模型 R1 的发布真正"破圈"。

其技术路线以工程极致化著称。V3 模型采用 671B 参数的 MoE 架构,每次推理仅激活 37B 参数,配合 MLA 多头潜在注意力机制与 FP8 混合精度训练,将训练成本压至约 600 万美元,性能却对标 OpenAI 的 GPT-4o 和 Claude-3.5-Sonnet。R1 则是首个开源的"thinking 模型",通过强化学习让模型涌现推理能力,并公开了完整的训练论文——这在硅谷亦属罕见。据峰瑞资本分析,这种工程能力部分源于幻方量化在量化交易中对 FPGA 定制、PTX 底层编程等硬件优化经验的迁移。

开源策略是 DeepSeek 最核心的标签。它不仅以 MIT 协议开源模型,还公开技术论文与训练细节,被云启资本投资人评价为"第一梯队模型里唯一的开源,而且比较有诚意"。这一策略直接冲击了 OpenAI 的闭源垄断格局,也精准打击了同样主打"安全、可控、自主"的智谱 AI 的生态位。

2026 年 6 月,据 elsewhere 报道,DeepSeek 完成一轮约 30 亿元人民币的融资,参与方包括 Monolith 砺思资本、IDG 资本、正心谷资本、溥泉资本等,LP 结构涵盖多地国资、险资及上市公司。

由 AI 生成,可能出现错误,请仔细核对内容。

DeepSeek公司
DeepSeek
渲染中…
在 479 篇文章中被提及

相关报道