重磅!英伟达将为中国市场推出Groq AI芯片

发布时间:2026-03-19 阅读量:1718 来源: 发布人: bebop

导读:在地缘政治与技术竞争交织的背景下,全球AI芯片巨头英伟达正加速调整其中国市场战略。于2026年GTC大会期间,公司首次披露将基于去年收购的Groq技术,推出一款专为中国市场打造、但性能未作妥协的人工智能推理芯片。


2025年底,英伟达以170亿至200亿美元的高价完成对AI芯片初创企业Groq的全资收购,震惊业界。Groq以其独创的“语言处理单元”(LPU)架构闻名,尤其在低延迟、高吞吐的AI推理任务中表现卓越。此次收购不仅补强了英伟达在推理领域的短板,更被视为其应对美国对华出口管制、拓展非受限市场的重要布局。


彼时,外界普遍猜测Groq技术将被整合进英伟达下一代产品线。而今,在GTC 2026大会上,这一猜想终于落地——英伟达明确表示,将基于Groq核心技术开发面向中国市场的AI芯片,并计划于2026年5月正式上市。


不同于以往专门为中国市场设计降级版本的做法,消息人士强调,此次准备销往中国的芯片并非性能降级版,也不是专门为中国市场从零设计的。这款新型芯片可以适配其他系统,预计将于今年5月正式上市。


英伟达计划将Groq的芯片应用于人工智能的“推理”环节,即AI系统回答问题、编写代码或执行任务的实时响应阶段。在GTC 2026大会展示的产品线中,英伟达计划将无法在中国销售的Vera Rubin芯片与Groq芯片结合使用,而在面向中国的方案中,Groq芯片将扮演更独立的角色。


尽管英伟达在AI训练市场占据主导地位,然而,在推理环节——即AI模型部署后的实时响应阶段——英伟达面临日益严峻的竞争压力。一方面,谷歌TPU、亚马逊Trainium/Inferentia等云厂商自研芯片不断侵蚀市场份额;另一方面,中国本土企业如华为昇腾、寒武纪、阿里平头哥等加速推出高性能推理芯片,试图构建自主可控的AI算力体系。


Groq芯片的优势在于其采用SRAM内存架构,拥有高达150TB/s的内存带宽,是Rubin GPU的7倍,专门针对低延迟token生成进行了优化。这种架构非常适合需要快速响应的推理任务,而这正是我国互联网巨头们所急需的。


此次“中国特供”芯片的推出,标志着英伟达从被动合规转向主动布局。过去,受美国出口管制影响,英伟达不得不推出A800、H800等性能受限版本以维持在华业务,但市场反响平平。如今,借助Groq这一非美源技术(注:Groq虽为美国公司,但其架构设计独立于传统GPU生态,且可通过本地化合作规避部分管制风险),英伟达找到了一条既能满足监管要求、又不牺牲用户体验的中间路线。

相关资讯
我们还需要GPU吗?从LineShine登顶看纯CPU超算的四层技术突围

在英伟达GPU与CUDA生态长期主导AI训练与科学仿真的背景下,国产LineShine(灵晟)纯CPU超算以2.198 EFlops持续双精度性能登顶TOP500,印证了“矩阵增强型CPU”正在重构HPC底层硬件标准。 近日,Jack Dongarra、Satoshi Matsuoka、Torsten Hoefler三位HPC权威联合发表《Do We Still Need GPUs? Rethinking AI and Scientific Computing on Matrix-Enhanced CPUs》,系统拆解了无GPU同构超算的四层技术体系:处理器指令集硬件加速、统一HBM高带宽内存架构、全精度混合运算单元、原生高速互联网络。

从“回答问题”到“完成任务”:AI产业正在发生的五个结构性转向

回顾AI今年的发展轨迹,我们能察觉到一种质的变化:AI不再只是被展示、被调用的“展品”,而是拥有了更明确的“行动感”。从代码编写到机器人奔跑,从算力基建到未来接口,行业正集体从“回答问题”走向“完成任务”。 我们试图透过五个数字,捕捉这一轮产业变革中的关键切片。

ROHM车载MOSFET新品:抑制二次击穿,SOA范围扩大5倍

全球知名半导体制造商ROHM近日宣布,面向车载安全功能和保护电路开发出100V耐压MOSFET新品“RS4P063BPHZG”

斩获SAIL最高奖背后:DF1000如何破解国产算力“存不够、改不动”?

2026 WAIC落下帷幕,国内AI算力产业的共识正发生清晰转向:单点参数竞赛逐渐退潮,超节点集群、全产业链自主可控与底层架构原始创新成为核心主线。在此背景下,首次参展的东方算芯凭借“高能效软件定义近存计算芯片DF1000”斩获大会最高荣誉SAIL奖。这座奖杯背后,指向了一条不依赖先进制程与既有生态的突围之路。