公司

DeepSeek

DeepSeek

DeepSeek 是梁文锋创办的人工智能公司,由幻方量化孵化,以开源大模型和极致工程优化在 2024-2025 年迅速崛起。2024 年 5 月,深度求索以百万 tokens 输入 1 元的开源模型 DeepSeek-V2 掀起行业降价潮;同年 12 月发布 671B 参数的 V3,性能接近 GPT-4 等顶级闭源模型,采用 MoE 架构、MLA 注意力机制、FP8 混合精度训练等创新,被蓝驰创投评价为"唯一一家真正将最核心能力开源"的中国公司。2025 年 1 月开源的推理模型 R1 进一步打破 OpenAI 在推理赛道的独大局面,首次公开验证了思维链与强化学习的技术路径。

其技术风格带有鲜明的幻方基因——绕过 CUDA 直接用 PTX 编程、对 FPGA 和底层硬件的深度定制经验,转化为模型训练中的成本优势。峰瑞资本认为,DeepSeek 的成功在于 AI 行业创新放缓时,中国团队工程能力的集中释放。

2025 年中,DeepSeek 启动新一轮融资,据 elsewhere 报道,IDG 资本出资约 30 亿人民币、Monolith 砺思资本 30 亿、正心谷资本 15 亿,拾象科技亦有参与,险资、国资及产业资本构成主要出资方。同期,其生态位已显著挤压智谱 AI 等先行者,并带动红松、熵简科技等被投企业接入模型能力。

由 AI 生成,可能出现错误,请仔细核对内容。

DeepSeek公司
DeepSeek
渲染中…
在 258 篇文章中被提及

相关报道