新闻资讯
关于我们 产品中心 解决方案 新闻资讯 客户案例 知识专区 售后服务 联系我们
新闻资讯:智库观点:解码DeepSeek
2025-2-14    点击关注我们

2025年春节期间,DeepSeek爆火出圈,发布开源大模型,在数学、代码、自然语言推理等任务上表现追平OpenAI,在美国对我国AI产业链全方位打压遏制的背景下,成功走出了一条低成本、高性能、国产化“突围之路”并震惊世界,为加速国产AI大模型降本提效、生态繁荣注入了强大动力。

出圈情况

DeepSeek凭借“低成本+高性能”模型全球破圈。DeepSeek早前发布的V3模型每训练1万亿tokens仅需在2048块H800 GPU集群上耗时3.7天,总计278万 GPU小时、557.6万美元的训练成本,约为GPT-o1的1/20、Llama 3.1的1/10。

新发布的R1模型API服务价格为每百万输入tokens 1-4元、每百万输出tokens 16元,远低于同期 OpenAI o1 API定价水平,且在逻辑、数学及中文任务中表现优异。DeepSeek应用程序霸榜苹果应用商店第一名,获全球主流公有云公司平台接入。

成功原因

DeepSeek通过较少算力实现高性能模型表现,主要通过算法创新和工程优化等方式大幅提升模型效率。一是成功走通“纯”强化学习(RL)路径。DeepSeek-R1抛开以预设思维链模板和监督式微调等为特点的AI推理能力传统训练方法,仅依靠简单的奖惩信号来指导优化模型行为,不仅省去了SFT和复杂的奖惩模型对计算资源的需求,还促使模型以“顿悟”的形式学会思考。二是实现算法、框架和硬件的优化协同。为大幅减少内存占用和计算量,DeepSeek系列模型在算法层面引入专家混合模型、多头隐式注意力、多token预测,框架层面实现FP8混合精度训练,硬件层面采用优化的流水线并行策略,同时高效配置专家分发与跨节点通信,实现最优效率配置和资源节约。

DeepSeek具有拥抱AI的创始基因丰富的算力资源储备、极具天赋的本土人才团队。一是自带AI创始基因。创始人梁文锋毕业于浙江大学电子信息工程和计算机科学专业,早年创立对冲基金“幻方量化”,实现投资策略全面AI化,2023年5月成立深度求索,聚焦发展通用人工智能。二是丰富的算力资源储备。幻方量化曾投资超过10亿元,先后研发了AI超级计算机“萤火一号”和“萤火二号”。其中,“萤火二号”搭载了约1万张英伟达A100显卡。三是极具天赋的本土人才团队。DeepSeek团队工程师和研发人员几乎都来自清华大学、北京大学、中山大学、北京邮电大学等国内顶尖高校,鲜有“海归”,以走出校园不久的博士为主,也有部分成员有英伟达、微软等国外企业工作或实习经历。

产业影响

一是DeepSeek打破大模型发展路径依赖,基本确立了符合中国实际的AI发展道路。DeepSeek 打破了 AI 大模型发展对算力和标注数据的高度依赖,展示了通过改进模型架构和训练方法,以较少的数据标注量和算力消耗提升模型推理能力的可行性,标志着我国在硬件上长期存在代际差距的情况下,可采取软硬协同方式实现对海外顶尖大模型的性能追赶和成本领先。

二是DeepSeek提升行业对模型的后训练和推理需求,长期提振算力需求。DeepSeek R1在 V3 的基础上进行了两次强化学习,明显提升了训练的探索时间和推理思考时间,将在后训练阶段延续Scaling Law法则。随着高性能低成本模型的出现将大幅降低国内AI赋能千行百业的应用开发门槛,推动AI产业链从“训练驱动”向“推理驱动”转变,带动推理算力需求加速释放。

三是DeepSeek以模型开源推动AI平权,开源路线有望打造应用繁荣的“安卓时刻”。DeepSeek完全开源了模型权重,允许其他开发者将模型用于商业用途并进行模型蒸馏。已发布了基于R1蒸馏Llama与Qwen的6个小模型,在多项基础测试集中性能对标 o1-mini,被Facebook首席人工智能科学家杨立昆誉为“开源模型对闭源模型的胜利”。开源模型通过知识蒸馏快速打造高性能、轻量化小模型,将驱动端侧模型在手机、电脑、眼镜等智能硬件上的部署应用,形成AI应用百花齐放的格局。

阅读:137
阿里变革后开启上市“竞速赛”:菜鸟、阿里云,钉钉、盒马,谁先冲线?
阿里变革后开启上市“竞速赛”:菜鸟、阿里云,钉钉、盒马,谁先冲线?
OpenAI 推出轻量级 ChatGPT 深度研究工具,免费用户也能用
OpenAI 推出轻量级 ChatGPT 深度研究工具,免费用户也能用
6G,“6”在哪儿
6G,“6”在哪儿
揭露四种支付码诈骗套路 扫一扫背后的各种风险
揭露四种支付码诈骗套路 扫一扫背后的各种风险
AI应用持续深化 打破游戏行业“不可能三角”
AI应用持续深化 打破游戏行业“不可能三角”
近4500亿的大数据市场 运营商如何创造新价值?
近4500亿的大数据市场 运营商如何创造新价值?
英特尔翻盘大作战,胜算不小
英特尔翻盘大作战,胜算不小
年度移动通信领域盛会,MWC2022来了!都有哪些看点?
年度移动通信领域盛会,MWC2022来了!都有哪些看点?
家家有本难念的“WLAN经”,何种技术能解忧?
家家有本难念的“WLAN经”,何种技术能解忧?
17款移动App存在隐私不合规行为被通报
17款移动App存在隐私不合规行为被通报
上一篇:DeepSeek引爆本地部署热,个人企业争相入局
下一篇:国产大模型破局:垂直深耕 场景为王
关于我们 产品中心 解决方案 新闻资讯 客户案例 知识专区 售后服务 联系我们
我们的联系方式
100元上门4个小时服务电话-初中生100元3小时二维码联系方式是同城约茶联系方式,人到付款,找服务,不限次数,附近约茶联系方式,怎么,如何,00元3小时上门服务电话,上门服务电话号码、叫小妹服务,100/200/300/400/500/6789、本地同城附近服务,品茶,喝茶,过夜,酒店宾馆,qq,微信,会所,同城包小妹
点击拨打 100元上门4个小时服务电 咨询我们
长按指纹即可关注我们
微网站由云港互联设计开发  点击进入
【版权声明】本站部分内容由互联网用户自行发布,著作权或版权归原作者所有。如果侵犯到您的权益请发邮件致info@ynjwz.com,我们会第一时间进行删除并表示歉意。