问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
AI芯片初创企业Groq于2025年底以200亿美元价格,向英伟达非独家授权自研LPU推理技术、部分核心团队同步转入英伟达后,于2026年6月宣布正式转型AI推理云服务商,同时完成总额6.5亿美元(约合人民币44亿元)的新融资,其核心竞争力来自全球独有的大规模LPU落地运营经验。

去年底Groq官宣200亿美元授权LPU技术给英伟达的消息传出时,行业内普遍唱衰这家曾靠极致推理速度出圈的初创公司:核心技术出手、核心团队出走,留给Groq的似乎只有没有技术支撑的空壳。但仅仅半年时间,Groq就用明确的新业务方向和亮眼的融资数据,打破了外界所有的负面预判。
随着大语言模型应用向实时交互场景渗透,AI推理算力的供需缺口正在持续拉大,而传统GPU架构在高并发推理场景下的延迟瓶颈,已经成为制约实时AI产品体验的核心痛点。相关测算显示,2026年全球AI推理云服务市场规模将突破500亿美元,其中对延迟要求在100ms以内的高价值场景占比超过40%,恰好是LPU架构的优势领域。
Groq自研的LPU(语言处理单元)是全球首款专门面向大语言模型推理设计的专用芯片,曾凭借比主流GPU低60%的推理延迟,在开发者社区积累了极高的知名度。
虽然LPU技术的非独家授权已经卖给英伟达,但Groq仍然掌握全球唯一具备大规模LPU实际运营经验的工程团队,多年落地过程中积累的架构调优、集群调度、场景适配经验,构成了其他云服务商无法轻易复制的核心壁垒。
目前Groq已经在北美、欧洲、中东、亚太四大区域完成了首批LPU算力节点的部署,可对外提供稳定的低延迟推理服务。
此次Groq完成的6.5亿美元(约合44亿元人民币)融资,将全部用于LPU算力节点的扩张和推理云服务的场景适配,重点面向实时AI对话、实时AIGC生成、自动驾驶云推理等对延迟敏感的高价值客户。
不同于传统云服务商以GPU算力为核心的服务体系,Groq的LPU推理云主打极致低延迟卖点,有望在高度集中的云服务市场撕开一道差异化的口子,也为AI算力市场的多元化发展提供了新的可能性。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。