①在與英偉達GB300的對比測試中,OpenAI的Jalapeno在兩個指標上佔據優勢:單位功耗所能處理的AI工作量,以及響應的速度;②OpenAI高管Ho表示,一些芯片在運行AI任務時擁有更強的處理能力,而另一些芯片則更擅長快速響應,Jalapeno兼具這兩方面的優勢。
財聯社8月26日訊(編輯 趙昊)OpenAI聲稱其新款「Jalapeno」芯片在測試中的表現優於英偉達當前的產品陣容,凸顯出該公司自主研發AI處理器取得的進展。
OpenAI芯片業務負責人Richard Ho在接受採訪時表示,該芯片與英偉達GB300進行了對比,該測試將GB300視爲現有最領先的產品。在測試中,Jalapeno在兩個指標上佔據優勢:單位功耗所能處理的AI工作量,以及響應的速度。
OpenAI此次公開測試Jalapeno時,使用了自家規模較小的開源模型GPT‑OSS 120B,以及DeepSeek和Moonshot AI的第三方模型。在Moonshot的模型Kimi K2.5 1T上,Jalapeno展現出的優勢更爲明顯。

OpenAI表示,在內部測試中,Jalapeno運行一些尚未發佈的大型先進模型時同樣表現良好。這表明,隨着工作負載變得更大、更復雜,該芯片的設計「價值將進一步提升」。
OpenAI與博通合作開發了Jalapeno,公司計劃從今年晚些時候開始使用該芯片爲其AI模型提供支持,這是其打造自有AI基礎設施、更大規模推進芯片自研計劃的一部分。
博通爲衆多客戶生產定製芯片,兩家公司於去年宣佈合作,並在今年6月大力宣傳這款處理器的研發速度,稱其以創紀錄的速度完成開發。
目前,越來越多的公司正在開發自研AI芯片,而這一領域目前仍由英偉達佔據主導地位。
Ho表示,通常情況下,一些芯片在運行AI任務時擁有更強的處理能力,而另一些芯片則更擅長快速響應,但Jalapeno兼具這兩方面的優勢。
OpenAI將決定哪些AI模型採用Jalapeno運行,從而讓客戶能夠根據需求選擇較低成本或較高性能的方案。
Ho說:「在實驗室測試中,Jalapeno在高吞吐量領域展現出很強的性能,這意味着它能夠以更低的成本服務大量客戶;與此同時,它在低延遲領域也表現出色,這意味着對於重視響應速度的客戶而言,其響應時間將非常非常快。」
Ho表示,由於Jalapeno能夠在較低功耗下實現強勁性能——功耗爲700瓦——因此可以幫助OpenAI降低數據中心的運營成本。對於數據中心而言,電力是最重要的成本之一。

需要指出的是,Jalapeno並未與英偉達最新一代的Vera Rubin芯片進行測試,後者剛剛開始出貨。此外,Jalapeno也並非爲AI模型訓練而設計,而訓練恰恰是英偉達技術最擅長的領域之一。
Jalapeno主要面向AI推理階段,即模型完成訓練後,根據用戶提示生成響應並執行任務的階段。在速度方面的優勢意味着,OpenAI可以通過它實現過去只有採用不同內存類型和芯片架構的處理器才能達到的效果。
OpenAI目前仍依賴 $Cerebras Systems (CBRS.US)$ 的技術運行部分模型,這類芯片更適合規模較小的模型。相比之下,Jalapeno能夠處理規模更大的模型。Ho表示,OpenAI的技術短期內不會取代Cerebras等供應商。
Ho說道:「我們對算力的需求非常龐大,這也是爲什麼我們與這麼多不同的供應商簽約。這種情況還會持續一段時間。」他表示,OpenAI希望公開展示自身的研發成果,以推動AI芯片領域的創新。
其他初創公司也在探索類似方向。Etched上週表示,公司已在一輪融資中獲得約210億美元估值,並開始出貨一款低電壓芯片。由兩名前谷歌芯片業務員工創立的MatX,目前正在開發一種半導體產品,目標同樣是兼顧高吞吐量和低延遲。
OpenAI還表示,公司利用自身AI模型加快了芯片的開發進程。第二代芯片目前也已進入較爲深入的研發階段。Ho表示,公司預計將在「未來幾個月」完成該芯片的流片(tape-out),即芯片設計進入最終定型階段。
與此同時,OpenAI已經開始設計第三代芯片,希望進一步降低其正在全球範圍內大規模建設的AI基礎設施成本。Ho表示:「我們目前已經達到了一個能夠降低基礎設施成本的成本水平和功耗水平。這只是第一步。」
儘管OpenAI正在積極宣傳自研芯片,並將其性能與英偉達產品進行比較,但Ho仍特別強調,OpenAI依然將英偉達視爲關鍵芯片供應商。
「英偉達是一家非常優秀的合作伙伴,我們仍然需要大量使用英偉達的芯片。」
編輯/stephen