Infrastruktur AI
OpenAI melancarkan cip inferens AI buatan sendiri Jalapeño: Pertandingan infrastruktur AI memasuki fasa baharu.
OpenAI dan Broadcom bersama-sama melancarkan cip inferens AI rekaan sendiri pertama, Jalapeño, menandakan persaingan infrastruktur AI meluas dari lapisan model ke lapisan cip. Artikel ini menganalisis ciri teknikal cip tersebut, kesan industri serta implikasinya kepada vendor awan dan perusahaan.
Acara: OpenAI Lancar Cip Pemikiran AI Pertama Buatan Sendiri
Pada 24 Jun 2026, OpenAI bersama gergasi semikonduktor Broadcom melancarkan cip pemikiran AI tersuai pertama mereka – Jalapeño. Ini merupakan litar bersepadu khusus aplikasi (ASIC) yang direka khusus untuk pemikiran model bahasa besar, dengan OpenAI mereka bentuk seni bina asas, Broadcom bertanggungjawab untuk pelaksanaan silikon dan perkakasan rangkaian, manakala pengilang perkhidmatan elektronik Kanada Celestica mengintegrasikan papan dan sistem rak.
OpenAI menyatakan bahawa nisbah prestasi kepada penggunaan kuasa Jalapeño akan mengatasi tahap terkini sedia ada. Kini, sampel kejuruteraan telah menjalankan pelbagai beban kerja pembelajaran mesin di makmal pada frekuensi sasaran dan penggunaan kuasa pengeluaran, termasuk GPT-5.3, Codex dan Spark. Cip ini dirancang untuk digunakan pertama kali pada akhir tahun 2026.
Latar Belakang: Kos Pemikiran AI Meningkat Dorong Cip Buatan Sendiri
OpenAI sebelum ini bergantung terutamanya pada perkongsian eksklusif dengan Microsoft, menyewa kluster Azure yang terdiri daripada puluhan ribu GPU NVIDIA untuk latihan dan pengehosan model. Namun dengan skala pengguna model siri GPT yang semakin besar, kos pemikiran meningkat secara mendadak. Menurut anggaran industri, kos pemikiran untuk model bahasa besar mungkin melebihi 70% daripada perbelanjaan operasi. Pada masa sama, persaingan pasaran semakin sengit – Google memperoleh kelebihan kos pengiraan yang ketara menerusi TPU buatan sendiri, manakala Anthropic terikat rapat dengan Amazon dan Google.
OpenAI menegaskan bahawa dunia sedang menuju ke arah "ekonomi berpusatkan pengiraan", dan Jalapeño merupakan sebahagian daripada strategi infrastruktur sepenuh timbunan jangka panjang mereka. Kos operasi yang tinggi, persaingan pasaran dan tekanan rantaian bekalan bersama-sama mendorong keputusan untuk melancarkan cip buatan sendiri pada pertengahan 2026.
Analisis Teknikal: Kelebihan ASIC Pemikiran Khusus
- Jalapeño sebagai ASIC khusus, dioptimumkan secara melampau untuk senario pemikiran model bahasa besar. ASIC melaksanakan algoritma tertentu melalui logik fungsi tetap, memberikan kecekapan tenaga yang lebih tinggi berbanding GPU tujuan umum. Ciri utamanya termasuk:
- Nisbah prestasi kepada penggunaan kuasa tinggi: Melalui teras tersuai dan seni bina memori, mengurangkan penggunaan tenaga bagi setiap token yang dijana.
- Kependaman rendah: Dioptimumkan untuk pemprosesan kelompok dan mekanisme cache pemikiran, mengurangkan masa respons.
- Sinergi dengan timbunan perisian OpenAI: Disesuaikan secara mendalam dengan rangka kerja seperti PyTorch, Triton, menyokong model seperti GPT-5.3.
Pelancaran cip ini menandakan peralihan infrastruktur AI daripada "pengkomputeran selari GPU tujuan umum" kepada "kuasa pengiraan khusus model". CEO NVIDIA, Jensen Huang, dalam mesyuarat pemegang saham pada hari yang sama menekankan bahawa industri AI terbahagi kepada lima lapisan: tenaga, cip dan sistem, infrastruktur, model, dan aplikasi, manakala tugas teras "kilang AI" adalah menjana token – ini menjelaskan mengapa permintaan terhadap pengiraan begitu kukuh.
Analisis Kesan kepada Perusahaan: Perubahan Dwi dalam Kos dan Seni BinaBagi perusahaan yang menggunakan perkhidmatan AI awan, cip buatan sendiri OpenAI mungkin membawa kesan berikut:
- Kesan kos: Jika penggunaan Jalapeño berjaya, OpenAI dijangka menurunkan harga perkhidmatan inferens, sekali gus mengurangkan jumlah kos penggunaan model GPT oleh perusahaan. Walau bagaimanapun, kos awal penggunaan adalah tinggi, dan kesannya perlu dipantau.
- Kesan penggunaan: Perusahaan tidak perlu menguruskan perkakasan sendiri, tetapi perlu memberi perhatian kepada perubahan strategi harga OpenAI.
- Kesan operasi: Cip khusus mungkin mengurangkan kebergantungan kepada GPU NVIDIA, mengurangkan risiko akibat kekurangan bekalan GPU.
- Keselamatan dan pematuhan: Pada peringkat cip, mungkin terdapat ciri keselamatan seperti akar kepercayaan, yang bermanfaat untuk perlindungan data perusahaan.
Walau bagaimanapun, perusahaan harus berwaspada terhadap perubahan API yang disebabkan oleh lelaran versi cip, serta risiko terikat kepada satu pembekal dalam jangka panjang.## CloudTechDaily Insight
- Pelancaran cip Jalapeño oleh OpenAI mempunyai signifikan yang jauh melampaui pelancaran produk biasa. Ia menandakan peralihan industri AI daripada "perlumbaan model" ke fasa "perlumbaan infrastruktur". Apabila keupayaan model menjadi semakin homogen, kecekapan pengiraan menjadi faktor penentu dalam persaingan perniagaan. Bagi CIO dan CTO perusahaan, trend ini bermaksud:
- Pemilihan pembekal AI tidak lagi hanya melihat prestasi model, tetapi juga kos dan kemampanan seni bina pengiraan asas mereka.
- Seni bina IT dalaman perusahaan perlu mempertimbangkan keserasian dengan pelbagai platform AI, bagi mengelakkan penguncian oleh ekosistem cip tunggal.
- Perancangan pusat data harus menyediakan ruang penempatan untuk pemecut AI khusus, dan menilai keperluan kuasa serta penyejukan.
Kami meramalkan bahawa dalam tempoh tiga tahun akan datang, sekurang-kurangnya tiga syarikat model AI besar akan melancarkan cip inferens rekaan sendiri, manakala NVIDIA, AMD dan Intel akan mempercepatkan pelancaran produk yang dioptimumkan untuk inferens. Model penetapan harga keseluruhan industri perkhidmatan awan juga mungkin beralih daripada "pengecasan berdasarkan contoh GPU" kepada "pengecasan berdasarkan token atau unit inferens". Perusahaan perlu bersiap sedia dengan memasukkan kebolehskalaan dan kebolehramalan kos infrastruktur AI ke dalam perancangan strategik mereka.
(CloudTechDaily | 25 Jun 2026)
Konteks artikel · cloudtechdaily
cloudtechdaily meletakkan nota ini dalam Cloud Tech Daily menerbitkan analisis dan taklimat berbilang bahasa.: tarikh, nama dan perubahan status masih perlu disemak. Platform awan / Pusat data / SaaS perusahaan menerangkan sudut editorial setempat; Pautan sumber perlu dibuka sebelum ringkasan digunakan semula.