发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

Cerebras AI芯片因DeepSeek服务需求激增,大语言模型推理成新热点

2025-02-12来源:ITBEAR编辑:瑞雪

AI芯片巨头Cerebras近期遭遇了一场前所未有的挑战,其CEO Andrew Feldman在一次访谈中透露,公司正被大量运行DeepSeek-R1大语言模型的订单淹没。

Cerebras,这家以推出高性能AI晶圆级芯片著称的公司,其单块芯片便能提供惊人的125 PFLOPS峰值算力,并搭配高达1.2PB的内存容量,一直以来都是AI领域的佼佼者。然而,这次DeepSeek-R1的火爆需求,显然超出了他们的预期。

DeepSeek-R1,这款被视作AI领域分水岭的模型,其预训练成本仅为GPTo1等主流模型的十分之一,但效果却与之相近甚至更佳。Feldman表示,DeepSeek不仅在当前展现出了巨大影响力,更将推动更大规模AI系统的诞生。随着成本的降低,AI市场的潜力正在被不断挖掘。

在Cerebras的官方展示中,其晶圆级AI芯片在部署DeepSeek-R1 70B时,性能达到了1508 tokens/s,远超GPU。然而,这款模型在推理过程中,却需要消耗大量算力。由于采用了Chain-of-thought(CoT)方法增强推理能力,模型需要将多步问题分解为中间步骤,并在需要时执行额外计算。这种逐字推理的方式,对于整段提示词的推理需要多次进行,从而导致了算力的巨大需求。

面对这一痛点,Cerebras提出了利用蒸馏技术将大模型的“知识”转移到小模型中的解决方案。大模型被称为教师模型,而较小的模型则被称为学生模型。通过这种方式,客户可以在保持模型精度的同时,降低推理过程中的算力需求。

Cerebras在官网上表示,DeepSeek R1在蒸馏到Llama 70B后,精度几乎没有下降。为了改善用户体验,Cerebras为客户提供了一种标准做法:利用开源在Hugging Face上的DeepSeek模型参数作为教师模型,蒸馏出一个较小的学生模型用于实际部署。

Feldman强调,DeepSeek作为首个顶级的开源推理模型,是开源AI的重大胜利。通过蒸馏技术,开源模型只需公开模型参数,研究人员无需访问源码便能复制新AI模型的进步。他认为,DeepSeek的经济性不仅震撼了整个AI行业,更将吸引更多投资流向尖端AI芯片和网络技术。

尽管有些人担心计算成本的下降会导致市场萎缩,但Feldman指出,过去50年的历史表明,降低成本反而能够扩大市场容量。无论是电脑还是智能手机,价格的降低都推动了产品的普及。因此,他相信DeepSeek和Cerebras的推动将进一步加速AI市场的增长。

自去年8月开始提供公共推理服务以来,Cerebras自称是“世界上最快的人工智能推理服务提供商”。然而,面对高昂的405B模型成本,该公司目前主要提供的是蒸馏后的70B模型。Feldman表示,虽然有一部分客户愿意为更高的准确性支付更高的成本,但大多数客户更倾向于选择价格实惠的模型。

中国电信2025年云网路由交换设备集采结果揭晓
中国电信近日宣布,其云网路由交换设备(2025年)集中采购项目已顺利完成评审工作。此次采购项目规模庞大,涉及多个关键网络设备领域,旨在进一步优化和提升云网基础设施能力。

2025-11-13

Kernelcom“智能键盘”来袭:12.5英寸超宽屏,AMD/Intel双版本可选
快科技11月12日消息,近日一款名为Kernelcom的设备正在Kickstarter上众筹,虽然其本质上是一款功能完备的笔记本电脑,但制造商还是将其宣传为“智能键盘”。 这款设备最大的特点是其12.5英寸超…

2025-11-13

漫步者花再拍拍耳机拆解:时尚设计遇上趣味彩屏,内部配置大揭秘
耳机内部搭载了13mm大动圈单元,内置一颗麦克风拾音,采用MIC-POWER微电新能源3.85V/40mAh钢壳扣式电池供电;主板上,搭载了JL杰理科技JL6973D8的蓝牙音频SoC,WINSEMI稳先微…

2025-11-10

2025年AI智能鼠标深度体验:星火大模型赋能,它能替代哪些办公工具?
AI智能鼠标2025深度测评:星火大模型加持,AI问答、AI绘图能替代哪些工具?当一款鼠标,内嵌了如科大讯飞星火这般强大的认知大模型时,它所带来的,远不止是光标移动的流畅,更是一场关于效率与创造力的革命。我们…

2025-11-10

王江:借互联网之力 促多元文化交流 共筑网络空间文化新辉煌
王江认为,随着互联网深度融入人类生产生活,网络空间已成为全球多元文化繁荣发展的新平台、文明交流互鉴的新场域、各国人民情感共鸣的新纽带,网络文化交流发展呈现了许多新气象。要高度重视青年群体在网络文明对话和交流…

2025-11-09

即时配送系统深度剖析:万象生鲜系统如何助力企业配送效率与服务双提升
通过有效整合这些功能和应用场景,即时配送系统能够支撑企业在激烈市场中处于竞争优势。万象生鲜系统如何优化配送效率与服务体验万象生鲜系统通过集成先进的即时配送技术,大幅提升了配送效率和服务体验。 结论即时配送系…

2025-11-08

HPE深耕中国40年:以科技之力,共答可持续数字化转型的时代之卷
作为全球领先的科技企业,HPE在推动2040年全价值链净零的过程中,通过在人工智能、混合云与网络技术领域提供低碳高效的解决方案,帮助企业在数字化转型的同时加速IT的可持续发展,携手上下游生态合作伙伴以更可持续…

2025-11-07

小米通话App即将停服,王化回应称与手机通话功能无关,服务终止时间已定
王化在其个人微博发文表示,2010年12月10日发布的米聊中就嵌入了小米通话的功能,当时市面上的“网络通话”App有限,小米通话的初衷是解决米粉之间移动网络沟通的需求。 而如今大家可以通过很多常见的App实…

2025-11-07

中兴AI全光智会屏亮相移动大会,以融合创新赋能多行业数字化转型
具体而言,AI全光智会屏以中兴通讯领先的全光网技术为核心底座,具备4K无损画面、零延迟智能交互、可靠安全及统一运维四大核心优势,能够为高端智能会议应用提供极致服务体验。 从应用价值来看,AI全光智会屏以全光…

2025-11-07

中兴携手中国移动推出移动屏,融合多技术成家庭智慧生活新枢纽
此次推出的移动屏,依托中国移动爱家泛屏一体化解决方案,深度融合5G通信与AI智能技术,集超大PAD、电视、云电脑等多元功能于一身。27英寸高清触控大屏成为家庭信息交互的核心载体,打破传统设备功能边界,将通信、…

2025-11-07