OpenAI首款推理芯片Jalapeño专为ChatGPT和Codex量身定制
OpenAI代号为“Jalapeño”的首款定制推理芯片近期进入流片阶段,该芯片专门针对ChatGPT与Codex等自研大模型的推理任务进行深度优化。区别于通用GPU,Jalapeño的架构从底层围绕Transformer类模型的计算特性设计,旨在显著提升海量并发请求下的响应效率与能效比。
根据公开的半导体供应链信息,Jalapeño采用台积电3纳米级先进制程,并依托博通在专用集成电路领域的合作经验完成协同设计。芯片内置大容量高带宽内存与定制化稀疏计算单元,可高效处理长文本和代码生成场景中典型的自回归解码逻辑,大幅降低单次推理的功耗与延迟。
在实际运行表现上,该定制芯片有望将ChatGPT等对话模型的单次查询成本压缩至通用方案的数分之一,同时满足更高并发下的稳定服务等级。对于Codex的代码补全与复杂指令生成,Jalapeño的低精度混合推理引擎可进一步加速输出,使实时编程辅助体验更加流畅。
从产业布局观察,此举标志着OpenAI在基础设施层面向自主垂直整合的关键一步。通过摆脱对第三方通用硬件的完全依赖,并为主力模型量身定制推理集群,整体服务效率与供应链韧性均获得强化。该系列芯片后续的迭代路线图亦被供应链视为影响AI加速计算市场格局的重要变量。
AI芯片战场从单一GPU竞赛进入GPUASICCPU多维竞争新阶段
« 上一篇
2026-07-12