DeepSeek、OpenAI 等厂商布局自研 AI 推理芯片
上周三
近期 DeepSeek、OpenAI、Anthropic 等 AI 大厂一边采购英伟达 GPU,一边纷纷布局自研 AI 芯片,核心原因在于通用 GPU 在大模型推理的 Decode 阶段效率极低,数据搬运成本高,算力浪费严重。此前因大模型技术路线不明,大厂对推理芯片并不重视,而随着深度推理、AI Agent 等技术路线确立,推理负载暴增,专用推理芯片的优势凸显。谷歌早年推出的 TPU 采用脉动阵列技术解决数据搬运问题,如今各厂自研路径各异:Anthropic 结合脉动流水线与 AWS Trainium 并反向优化编译器。Groq 砍掉 HBM 显存,用 SRAM 提升效率。阿里采用灵活通用架构。OpenAI 联合博通从集群层面优化 KV Cache 绑定。DeepSeek 也将基于自身模型技术特点布局推理芯片。未来 AI 厂商将从适配 GPU 转向主动选择适配自身的软硬件,摆脱硬件厂商制约。
DeepSeek 们狂造芯片,英伟达终于不香了?
36Kr/搜狐科技/maomu.com/投资界/太平洋电脑网
体验专业版特色功能,拓展更丰富、更全面的相关内容。