OpenAI 如何利用其自身的 LLM 设计其墨西哥辣椒芯片
人工智能大幅缩短了设计时间;而且速度只会越来越快。
8月25日, OpenAI 正式发布了其首款AI加速芯片Jalapeño。Jalapeño可提供高达13.4 petaflops的4位计算能力,并可访问232GB最先进的内存,连接速度高达15.4TB/s。OpenAI引用的 基准测试 芯片相比,Jalapeño可将端到端延迟(从提示符到最后一个令牌之间的时间)降低高达3.6倍, 表明,与该公司目前使用的Nvidia GB300 同时功耗更低。
这些数据能否转化为Jalapeño在OpenAI推理集群中广泛应用后的实际收益还有待观察,但性能仅仅是故事的一半。另一半在于芯片的设计——正如你所预料的,OpenAI的 大型语言模型 (LLM)加速了这一过程。Jalapeño从最初的架构概念到首枚芯片的制造仅用了不到20个月。从首批RTL代码(定义芯片逻辑的寄存器传输级代码)到流片(最终设计交付制造),仅用了9个月的时间。
虽然这个时间表进展迅速,但专家认为,随着LLM(层级模型)的改进以及与 芯片设计 工具的深度集成,这个速度很快就会显得缓慢。不出所料,OpenAI对这一机遇充满信心。OpenAI硬件 副总裁Richard Ho 表示:“这些模型赋予了我们的工程师超能力。我们的工程师仍然是工作的主导者,他们仍然是最终的决策者。但他们的工作速度更快了,可以探索更多的路径。”
