中外多家算力芯片公司宣布适配DeepSeek

春(chūn)节假期期间,DeepSeek的爆火如“平地一声雷”。这家于2023年成立的人工智能基础技术研究企业,在今年1月20日正式开源其R1推理模型,该模型在数学(xué)、代(dài)码(mǎ)、自(zì)然语言推理等任务上,性能比肩OpenAI-o1正式版,且开发成本仅为600万美元,仅相当于OpenAI-o1 模型开发成本的1.2% 。DeepSeek于2024年12月26日宣布上线并同步开源的DeepSeek-V3模型,以1/11的算力、仅2000个GPU芯片训练出性能(néng)超(chāo)越(yuè)GPT-4o的(de)大(dà)模(mó)型(xíng),且(qiě)训(xun)练(liàn)成(chéng)本(běn)仅(jǐn)相(xiāng)当(dāng)于(yú)GPT-4o的(de)5.6%。

业(yè)内(nèi)人(rén)士(shì)表(biǎo)示(shì),DeepSeek此(cǐ)举(jǔ)开(kāi)拓(tà)出(chū)高(gāo)性(xìng)能(néng)模(mó)型(xíng)训(xun)练(liàn)的(de)新(xīn)思(sī)路,其(qí)以(yǐ)低(dī)成(chéng)本(běn)实(shí)现(xiàn)大(dà)模(mó)型(xíng)训(xun)练(liàn),也(yě)引(yǐn)发(fā)了(le)业界对海外AI企业耗费巨量算力资源训练模型必要性的怀疑。近日,多家中外算力芯片企业纷纷发布适配DeepSeek模型的消息。

燧原科技:实现全国各地智算中心DeepSeek的全量推理服务部署

2月6日,燧原科技宣布,完成了对DeepSeek全量模型的高效适配,包括DeepSeek-R1/V3 671B原生模型、DeepSeek-R1-Distill-Qwen-1.5B/7B/14B/32B、DeepSeek R1-Distill-Llama-8B/70B等蒸馏模型。截至目前,DeepSeek的全量模型已在庆阳、无锡、成都等智算中心完成了数万(wàn)卡(kǎ)的(de)快(kuài)速(sù)部(bù)署(shǔ)。

华(huá)为(wèi):支(zhī)持DeepSeek系列模型“一键获取”、“开箱即用”

2月5日,华为技术有限公司宣布,DeepSeek-R1、DeepSeek-V3、DeepSeek-V2、Janus-Pro正式上线昇腾社区,支持一键获取DeepSeek系列模型,支持昇腾硬件平台上开箱即用。

image001.jpg

DeepSeek系列模型上线昇腾社区

海光信息:DCU适配三大模型,相关模型已正式上线

2月(yuè)4日(rì),海(hǎi)光(guāng)信(xìn)息(xi)宣布,其技术团队成功完成DeepSeek V3和R1模型与海光DCU(深度计算单元)的适配,并正式上线。2月5日,海光信息宣布其技术团队成功完成DeepSeek-Janus-Pro多模态大模型与海光DCU的适配优化,并正式上线。因DCU采用了GPGPU通用加速计算架构,DeepSeek模型可直接在DCU上运行,并不需要大量适配工作,技术团队的主要工作是进行精度验证和持续的性能优化。本次适配优化的DeepSeek-Janus-Pro模型具备跨模态(tài)理(lǐ)解(jiě)与(yǔ)生(shēng)成(chéng)能(néng)力(lì),专(zhuān)注(zhù)于(yú)结(jié)合(hé)视(shì)觉(jué)与(yǔ)语(yǔ)言(yán)理(lǐ)解(jiě)能(néng)力(lì),旨(zhǐ)在(zài)处(chù)理(lǐ)更(gèng)复(fù)杂(zá)的(de)跨(kuà)模(mó)态(tài)任(rèn)务(wu)。

image002.jpg

Janus-Pro生成示例(图源:海光信息)

天数智芯:一天完成DeepSeekR1适配

2月4日,天数智芯与(yǔ) Gitee AI 联(lián)合(hé)发(fā)布(bù)消(xiāo)息(xi),成(chéng)功(gōng)完(wán)成(chéng)了(le)与(yǔ) DeepSeek R1 的(de)适(shì)配(pèi)工(gōng)作(zuò),并(bìng)且(qiě)已(yǐ)正(zhèng)式(shì)上(shàng)线(xiàn)多款大模型服务,其中包括 DeepSeek R1-Distill-Qwen-1.5B、DeepSeek R1-Distill-Qwen-7B、DeepSeek R1-Distill-Qwen-14B等,其过程仅耗时1天。

image003.jpg

天(tiān)数(shù)智(zhì)芯(xīn)上(shàng)线(xiàn)多(duō)个(gè)DeepSeek大(dà)模(mó)型(xíng)服(fú)务(wu)

摩(mó)尔(ěr)线程(chéng):已(yǐ)部(bù)署(shǔ)DeepSeek蒸(zhēng)馏(liú)模(mó)型(xíng)推(tuī)理(lǐ)服(fú)务(wu)

2月(yuè)4日(rì),摩(mó)尔(ěr)线(xiàn)程(chéng)宣(xuān)布(bù)实(shí)现(xiàn)了(le)对(duì)DeepSeek蒸(zhēng)馏(liú)模(mó)型(xíng)推(tuī)理(lǐ)服(fú)务(wu)的(de)部(bù)署(shǔ)。基(jī)于(yú)Ollama开源框架,完成了对DeepSeek-R1-Distill-Qwen-7B蒸馏模型的部署,并在多种中文任务中展现了优异的性能。用户也可以基于MTT S80和MTT S4000进行DeepSeek-R1蒸(zhēng)馏(liú)模(mó)型(xíng)的(de)推(tuī)理(lǐ)部(bù)署(shǔ)。

英(yīng)特(tè)尔(ěr):支(zhī)持(chí)AI PC本(běn)地(de)部(bù)署(shǔ)

1月(yuè)31日(rì),英(yīng)特(tè)尔(ěr)宣(xuān)布(bù),DeepSeek目(mù)前(qián)能(néng)够(gòu)在(zài)英特尔产品上运行,更可以在AI PC上实现离(lí)线(xiàn)使(shǐ)用(yòng),强(qiáng)调(diào)DeepSeek的(de)本(běn)地(de)部(bù)署(shǔ)能(néng)力(lì)。DeepSeek的(de)蒸(zhēng)馏(liú)模(mó)型(xíng)在(zài)至(zhì)强(qiáng)和(hé)Gaudi平(píng)台(tái)上(shàng)得(de)到(dào)了(le)支(zhī)持(chí),能够帮助客户实现更低的成本和单价性能优势。一如,在最新发布的酷睿Ultra 200H(Arrow Lake H)平台上,DeepSeek-R1-1.5B模型能够顺利运行,且能够解决数学难题。DeepSeek最新的Janus-Pro图像生成和理解模型能够在英特尔酷睿Ultra 200V系列处理器(Lunar Lake)上运行。

image004.png

酷睿Ultra 200H可本地运行DeepSeek-R1-1.5B解数学题

英伟达:推理微服务支持DeepSeek-R1

1月30日,英伟达宣布,其开发者网站现已提供6710 亿参数的 DeepSeek-R1 模型微服务预览版。单个 NVIDIA HGX H200 系统上每秒可为DeepSeek-R1 提供多达 3872 个tokens。开发人员可以测试和试验可下载的NIM微服务应用程序编程接口(API)。通过将 NVIDIA AI Foundry 与 NVIDIA NeMo 软件结合使用,企业还将能够为专用 AI 代理创建自定义的 DeepSeek-R1 NIM 微服务。