
智东西2月6日报道,国产AI大模型DeepSeek的产业影响力还在蔓延。短短六天内,国产AI芯片企业(华为昇腾、沐曦、天数智芯、摩尔线程、海光信息、壁仞科技、太初元碁、云天励飞、燧原科技、昆仑芯)相继宣布适配或上架DeepSeek模型服务
▲截至2月6日,官宣支持DeepSeek模型的国产AI芯片企业(按时间顺序排列,智东西制表)
其中海光信息是科创板CPU+GPU上市公司,云天励飞是科创板AI上市公司,昆仑芯科技是百度旗下AI芯片公司,燧原科技、壁仞科技、摩尔线家AI芯片独角兽均已启动IPO进程。云计算与智算企业也积极行动。华为云、天翼云、腾讯云、阿里云、百度智能云、火山引擎、京东云、联通云、移动云等9家国内云计算巨头,无问芯穹、硅基流动、云轴科技ZStack、PPIO派欧云、超算互联网、青云科技、算力互联、并济科技、优刻得、神州数码等至少10家独立云及智算
2月1日,华为昇腾打响国产AI芯片支持DeepSeek系列模型的第一枪。随后群雄毕至,9家独立AI芯片企业相继宣布支持DeepSeek的快速部署,乃至训练。
2月1日,华为云宣布与硅基流动联合首发并上线基于华为云昇腾云服务的DeepSeek R1/V3推理服务。得益于自研推理加速引擎加持,该服务支持部署的DeepSeek模型可获得持平全球高端GPU部署模型
2月4日,DeepSeek R1、V3、V2、Janus-Pro模型正式上线昇腾社区,支持一键获取DeepSeek系列模型,支持昇腾硬件平台上开箱即用,推理快速部署。
国产GPU独角兽沐曦对DeepSeek的支持,由国内一站式大模型托管平台Gitee AI
2月4日,天数智芯与Gitee AI联合发布,在双方的高效协作下,仅用时一天
4、摩尔线日,摩尔线程宣布快速实现DeepSeek R1蒸馏模型推理服务在摩尔线程夸娥(KUAE)GPU智算集群上的高效部署。摩尔线程即将开放夸娥GPU智算集群,全面支持DeepSeek V3、R1模型及新一代蒸馏模型的分布式部署。
用户也可以基于摩尔线显卡进行DeepSeek-R1蒸馏模型的推理部署。早在1月28日,就已经有B站UP主在MTT S80上手动完成推理DeepSeek R1模型的实践。基于Ollama开源框架,摩尔线程完成DeepSeek-R1-Distill-Qwen-7B蒸馏模型的部署,并在多种中文任务中展现了优异的性能,验证了摩尔线程全功能GPU的通用性与CUDA兼容性。
2月4日~5日,海光信息宣布其技术团队近日成功完成DeepSeek V3模型、R1模型、Janus-Pro多模态大模型与海光DCU的适配优化,并正式上线。
DCU(深度计算单元)是海光信息推出的高性能GPGPU架构AI加速卡,DeepSeek模型可直接在DCU上运行,并不需要大量适配工作,技术团队的主要工作是进行精度验证和持续的性能优化。用户可通过“光合开发者社区”中的“光源”板块访问并下载相关模型,或登录 [搜索“DeepSeek”,即可基于DCU平台快速部署和使用相关模型。
该服务具备两大核心优势:一是零部署成本,实现“开箱即用”的云端推理体验;二是多场景覆盖,针对大语言模型等不同任务预置优化配置方案。壁仞科技已联合上海智能算力科技有限公司、中兴通讯、科华数据、无问芯穹、开源中国(Gitee AI)、UCloud优刻得、一蓦科技等战略伙伴,基于壁砺系列训推产品106M、106B、106E、110E,全面开展DeepSeek全系列模型的适配与上线。
同日,UCloud优刻得发文宣布,优刻得与壁砺系列进行适配兼容,仅用数小时即完成了对DeepSeek R1全系列蒸馏模型的支持。
2月5日,太初元碁宣布在太初T100加速卡上仅用2小时便完成DeepSeek R1系列模型的适配工作,快速上线多款大模型服务。
2月5日,云天励飞宣布其芯片团队完成DeepEdge10芯片平台与DeepSeek R1(1.5B、7B、8B)大模型的适配,可以交付客户使用。
目前,DeepSeek的全量模型已在庆阳、无锡、成都等智算中心完成了数万卡的快速部署。这一成果标志着
燧原科技与并济科技、并行科技、东华软件、道客网络、光环云、迈富时、清程极智、燧弘华创、未来速度、无问芯穹、向量栈、亿算智能、中科加禾等合作伙伴紧密合作,积极推进DeepSeek全量模型的更多系统级优化,进一步推理性价比。
2月6日,昆仑芯宣布已完成Deepseek R1、V3系列模型训练推理全版本适配,包括MoE模型及其蒸馏小模型,且性能卓越、成本效率极致,一键部署。
据介绍,P800显存规格优于同类主流GPU 20%-50%,对MoE架构更加友好,且率先支持8bit推理,单机8卡即可运行671B模型,可轻松完成DeepSeek-V3/R1全版本推理任务;并能支撑Deepseek系列MoE模型大规模训练任务,
昆仑芯前身为百度智能芯片及架构部,于2021年4月完成独立融资。2月5日,百度智能云宣布其成功点亮昆仑芯三代P800万卡集群,三万卡集群也将于近日点亮。
2月1日,华为云宣布上线推理服务,成为国内最早支持DeepSeek-R1模型的云服务商。
同日,中国电信天翼云紧随其后宣布支持DeepSeek,成为国内首家完成DeepSeek大模型国产化适配的运营商。接着,腾讯云、阿里云、百度智能云、火山引擎、京东云、联通云、移动云相继宣布上线DeepSeek模型服务。
2月1日,华为云宣布与硅基流动联合首发并上线基于华为云昇腾云服务的DeepSeek R1/V3推理服务。
得益于自研推理加速引擎加持,硅基流动和华为云昇腾云服务支持部署的DeepSeek模型可获得持平全球高端GPU部署模型的效果。
2月1日,中国电信天翼云宣布天翼云智算产品体系(息壤-科研助手、天翼AI云电脑、魔乐社区、“息壤”智算平台、GPU云主机/裸金属)已实现R1模型的部署、推理、微调、应用。
2月6日,天翼云再度发文,强调其自主研发的“息壤”智算平台率先完成国产算力与DeepSeek R1/V3系列大模型的深度适配优化,使天翼云成为国内首家实现DeepSeek模型全栈国产化推理服务落地的运营商级云平台。“息壤”智算平台同步推出DeepSeek R1/V3系列模型的限时免费推理API服务,可快速调用。该平台支持DeepSeek-R1满血版至轻量化蒸馏模型的灵活部署。
2月2日,腾讯云宣布高性能应用服务HAI支持DeepSeek-R1大模型一键部署,开发者仅需3分钟就能接入调用。
2月4日,腾讯云TI平台推出“开发者大礼包”:DeepSeek全系模型一键部署,从千亿级“满血版”(671B参数)到轻量级(1.5B)均可选用,提供R1和R1-1.5B模型限时免费在线日,阿里云宣布阿里云PAI Model Gallery支持云上一键部署DeepSeek V3、R1。在该平台上,用户可以零代码实现从训练到部署再到推理的全过程,简化模型开发流程。
2月3日,百度智能云宣布千帆平台已正式上架DeepSeek R1、V3模型,推出了超低价格方案,还可享受限时免费服务,登录百度智能云千帆ModelBuilder即可快速体验。
2月4日,火山引擎宣布将支持V3、R1等不同尺寸的DeepSeek开源模型,可通过两种方式使用:一是在火山引擎机器学习平台veMLP中部署,已支持全尺寸DeepSeek模型;二是在火山方舟中调用模型,已支持4个模型版本,提供有竞争力的API价格和全网最高限流。
2月4日,京东云宣布言犀AI开发计算平台已经支持DeepSeek V3、R1以及所有蒸馏小参数模型的一键部署,支持公有云在线部署、专混私有化实例部署两种模式,供用户按需部署,快速调用。
联通云骨干云池已在全国270+城市部署;联通云7.5版本已上架DeepSeek R1镜像,形成预部署能力;同时可将超百款行业应用与DeepSeek模型融合,在医疗、政务等行业提供定制化AI解决方案。联通云基于联合创新和自研加速引擎,构建昇腾全栈自主可控智算底座,与DeepSeek R1模型深度对接,简化调用流程,具备复杂任务下推理能力,持平国际主流算力部署效能。
同时,联通云基于A800、H800、L40S等多款主流算力卡,预置DeepSeek R1多尺寸模型。用户可按需灵活选择、快速扩展,快速搭建DeepSeek-R1推理和微调环境。
2月5日,移动云宣布全面上线DeepSeek,实现全版本覆盖、全尺寸适配、全功能畅用。移动云支持DeepSeek V1、V2、V3、R1等全量版本,包括满血版(671B)以及7B、14B等高效蒸馏小模型。
移动云将DeepSeek集成至移动云智能体平台。中国移动覆盖全国的13个智算中心全面上线上述能力。目前移动云智算平台、移动云代码大模型、弹性计算和AI原生存储等产品,深度集成融合DeepSeek模型,并搭载自研COCA算力原生平台,实现开箱即用。
移动AI云电脑也将全面升级,用户可选择DeepSeek内核实现AI秘书能力。同时移动云针对DeepSeek R1模型定制算力方案,为互联网企业创新、高校科研提供高性价比算力与开发环境。
移动云全链路深度扎根国产昇腾生态,支持DeepSeek全系列产品。移动云已集成昇腾、壁仞、天数、昆仑芯、寒武纪等多元国产智算芯片,依托4+N+31+X全网资源池,在热点区域布局千-万卡级算力,31省按需布局百-千卡级资源。
1月28日,无问芯穹、硅基流动、PPIO派欧云宣布上架DeepSeek模型,拉开了国内云计算及智算企业适配DeepSeek的帷幕。这份名单里的企业名字正在快速增加中。
1月28日,AI基础设施企业无问芯穹宣布DeepSeek-R1蒸馏模型已上架无问芯穹Infini-AI异构云平台,DeepSeek-R1(加速优化版)、DeepSeek-V3(加速优化版)正在上线,DeepSeek-R1(国产推理版)即将上线,并提供DeepSeek系列模型专属优惠,每位用户百万token免费用。
1月28日,分布式云服务商PPIO派欧云宣布,一站式AIGC云服务平台PPIO派欧算力云已全面集成DeepSeek R1。开发者只需一行代码即可轻松调用API。
2月2日,PPIO派欧算力云宣布全量上线DeepSeek全系列模型,一键支持DeepSeek V3满血版、R1满血版以及R1 70B蒸馏模型,模型价格与官方价一致,并即将上线蒸馏模型。
2月5日,PPIO派欧云再度发文,宣布自DeepSeek模型上线以来,已有超千家开发团队接入。
1月28日,AI基础设施企业硅基流动宣布其大模型云服务平台SiliconCloud第一时间上线了DeepSeek Janus-Pro-7B(限时免费),支持轻松调用API。平台还支持开发者自由对比体验数十款大模型。同时,ComfyUI云节点BizyAir也在第一时间支持了Janus-Pro-7B,用户可在选择模型时直接调用。
2月3日,由科技部指导发起的国家超算互联网宣布,其平台已正式上线(lite)、Coder、Math等模型,将于近期陆续更新R1模型的32B、70B等版本。
超算互联网为DeepSeek-R1小版本模型提供一键推理服务,无需下载本地;还支持根据私有化需求,引入专有数据,对模型进行定制化训练和开发。次日,超算互联网宣布上线DeepSeek Chatbot可视化界面功能,提供全天候不间断不限量免费体验服务,以便让更多领域的用户便捷体验。
2月4日,算力互联宣布正式上线基于天数智芯GPU芯片的DeepSeek-R1模型服务,包括7B、14B、32B等版本。
算力互联是中国领先的算力互联网与AI基础设施建设与运营服务商,以“资管+交易”模式在全国布局“自营+互联”大规模算力基础设施。
2月5日,四川AI高性能算力服务商并济科技宣布与燧原科技深度合作,成功在内江市成渝中心算力枢纽智能运算中心、简阳市天府智算西南算力中心完成DeepSeek全系列开源模型(V3、R1等)的推理服务规模化部署。
2月5日,“科创板云计算第一股”Ulcloud优刻得宣布,优刻得近日基于壁仞科技国产芯片全面开展包括R1在内的DeepSeek全系列模型适配工作,以满足不天博平台安全性评测同规模参数量模型的个性化部署需求。开发者可在优刻得算力共享平台上云端体验DeepSeek模型服务。
优刻得与壁砺系列进行适配兼容,仅用数小时即完成了对DeepSeek R1全系列蒸馏模型的支持,涵盖了从1.5B到70B各等级参数版本。
除了基础算力资源支持,优刻得还提供DeepSeek模型的私有化部署服务。
2月6日,IT分销龙头神州数码宣布,DeepSeek系列模型首发即支持昇腾平台,神州数码旗下神州鲲泰推理服务器产品搭载昇腾硬件,可全面支持DeepSeek系列模型的快速部署。
神州数码还将DeepSeek集成到其自主研发的神州问学平台中,仅需3分钟部署DeepSeek模型。目前神州问学平台已经接入了超过40款主流基础大模型。
除了国内企业外,英伟达、AMD、英特尔、Cerebras Systems、Groq等海外AI芯片企业,以及亚马逊云科技、微软Azure两大海外云计算巨头,早在1月份就宣布支持DeepSeek模型。
昨日AMD董事长兼CEO苏姿丰称赞DeepSeek展现了“AI世界创新的速度和步伐”、“模型和算法创新有利于AI普及”。今日高通总裁兼CEO安蒙提到像DeepSeek R1这样的模型正在快速发展,变得更加紧凑、强大、高效,使其在发布后不久就能在搭载骁龙的智能手机、PC、耳机上运行。
这些凭借中国科学家和工程师的聪明才智研发出的先进模型,用轰动全球的产业号召力,证明了只要实力过硬、拥抱开源,“自有大儒为我辩经”。