NEW CONSUMER
人工智能

OpenAI公布首款自研推理芯片成绩,AI算力竞争进入全栈协同阶段

OpenAI披露Jalapeño首轮实测结果,称其在公开推理基准中展现更高的单位功耗吞吐量和更低延迟,算力布局进一步延伸至芯片与数据中心。

OpenAI 8月25日公布首款自研推理芯片Jalapeño的首批实测结果。公司称,在使用GPT-OSS 120B的InferenceX公开基准中,该芯片的单位功耗峰值吞吐量和令牌延迟优于对比中的商用系统,并在DeepSeek R1和Kimi K2等模型上保持较好表现。

这意味着AI公司的竞争正在从模型能力延伸至芯片、内存、网络、推理软件和数据中心的全栈协同。自研芯片可为高频推理和常驻代理提供更精细的成本、延迟和能效控制,同时也为外部供应商体系增加新的选择。

OpenAI表示,其算力组合仍包含微软、英伟达、AWS、AMD、Broadcom、Cerebras、CoreWeave、Oracle等合作伙伴。自研路线并非简单替代外部硬件,而是针对不同训练和推理工作负载进行更灵活的配置。

对于AI产业链而言,推理成本下降可能扩大企业级智能体、个性化分析和实时服务的可行范围。但公开结果仍需结合具体模型、服务质量、总拥有成本和量产规模审慎评估。

来源:OpenAI官方文章。 https://openai.com/index/the-full-stack-behind-abundant-intelligence/

← 返回 新消费志