Langsung ke konten utama

OpenAI Rilis Chip AI Jalapeño, Langkah Besar Kurangi Ketergantungan pada NVIDIA

OpenAI Rilis Chip AI Jalapeño, Langkah Besar Kurangi Ketergantungan pada NVIDIA

OpenAI secara resmi memperkenalkan chip kecerdasan buatan pertamanya yang diberi nama Jalapeño, hasil kolaborasi dengan raksasa semikonduktor Broadcom. Chip ini dirancang khusus untuk menjalankan model AI (inferensi) dan menjadi tonggak penting dalam strategi OpenAI membangun infrastruktur komputasi mandiri.

Infografis chip AI Jalapeño buatan OpenAI dan Broadcom. Ilustrasi prosesor dengan logo OpenAI dan Broadcom.

Pengumuman ini dilakukan bersamaan dengan peluncuran model GPT-5.6, menandai pekan bersejarah bagi OpenAI di mana perusahaan tidak hanya menghadirkan model AI terbaru tetapi juga chip kustom pertamanya.

Jalapeño: Prosesor Inferensi yang Dirancang dari Nol

Berbeda dengan GPU serbaguna buatan NVIDIA yang selama ini menjadi tulang punggung komputasi AI, Jalapeño adalah ASIC (Application-Specific Integrated Circuit) yang dioptimalkan khusus untuk beban kerja inferensi large language model (LLM).

Artinya, chip ini dirancang spesifik untuk menjalankan model AI seperti ChatGPT, Codex, dan produk AI OpenAI lainnya, bukan untuk melatih model baru. Pendekatan ini membuat Jalapeño lebih efisien dan lebih murah dibandingkan GPU serbaguna untuk tugas-tugas inferensi.

Beberapa keunggulan utama Jalapeño yang diungkap OpenAI:

  • Performa per watt yang lebih baik dibandingkan perangkat tercanggih saat ini
  • Dirancang dari nol berdasarkan pemahaman mendalam OpenAI tentang kebutuhan LLM
  • Mendukung semua LLM, tidak hanya model OpenAI, tetapi juga model AI di masa depan
  • Menggabungkan throughput tinggi dengan latensi rendah, ideal untuk produk AI interaktif

Rekor Pengembangan: 9 Bulan dari Desain ke Produksi

Salah satu pencapaian paling mencolok dari proyek ini adalah kecepatan pengembangannya. OpenAI dan Broadcom menyelesaikan desain hingga tahap tape-out hanya dalam waktu 9 bulan, yang diklaim sebagai siklus pengembangan ASIC tercepat dalam sejarah semikonduktor berkinerja tinggi.

Presiden OpenAI Greg Brockman mengungkapkan bahwa kecerdasan buatan digunakan untuk mempercepat proses desain chip itu sendiri. "Tingkat di mana model kami mampu mempercepat proses ini sangat mengejutkan bagi kami," ujar Brockman.

Richard Ho, yang memimpin program perangkat keras OpenAI, menjelaskan bahwa Jalapeño dioptimalkan di sekitar kernel, pergerakan memori, jaringan, dan pola pelayanan yang paling penting untuk model AI.

Strategi Full-Stack OpenAI: Dari Chip hingga Produk

Jalapeño bukan sekadar proyek chip biasa. Ini adalah bagian dari strategi full-stack OpenAI untuk mengontrol seluruh lapisan teknologi—dari chip, sistem, model, hingga produk yang digunakan pengguna.

"Dengan mendesain lebih banyak tumpukan sendiri, kami dapat memberikan lebih banyak kecerdasan dengan efisiensi lebih besar dan terus mendorong AI canggih menuju akses yang lebih luas," kata Greg Brockman.

Broadcom CEO Hock Tan menggambarkan permintaan komputasi dari pelanggannya sebagai "sangat tidak pernah terpuaskan." Tan mengatakan bahwa permintaan ini tidak hanya untuk 2026, tetapi juga 2027 dan 2028.

Mengurangi Ketergantungan pada NVIDIA

Langkah OpenAI mengembangkan chip sendiri merupakan upaya strategis untuk mengurangi ketergantungan pada NVIDIA, yang selama ini menjadi pemasok utama GPU untuk perusahaan AI.

Sejak meledaknya popularitas ChatGPT pada 2022, OpenAI menjadi salah satu pembeli GPU NVIDIA terbesar. Namun, dengan pertumbuhan pengguna yang eksplosif dan keterbatasan pasokan, OpenAI membutuhkan sumber chip tambahan.

Selain bekerja sama dengan Broadcom untuk Jalapeño, OpenAI juga telah menjalin kesepakatan dengan AMD, Cerebras, dan Amazon Web Services (Trainium) untuk mendiversifikasi pasokan chip-nya.

Strategi multi-vendor ini memberi OpenAI kendali lebih besar atas biaya dan peta jalan kinerja, serta mengurangi risiko ketergantungan pada satu pemasok.

Deploymen dan Masa Depan

Jalapeño akan mulai digunakan di pusat data pada akhir 2026, dengan pengembangan kecil pada awalnya dan peningkatan skala yang signifikan pada 2027 hingga puncaknya pada paruh pertama 2028.

Broadcom dan OpenAI berencana menerapkan chip ini di pusat data berskala gigawatt dengan mitra seperti Microsoft. Ini adalah langkah pertama dalam platform komputasi multi-generasi yang akan terus dikembangkan di tahun-tahun mendatang.

Kesimpulan

Peluncuran chip Jalapeño menandai perubahan fundamental dalam strategi OpenAI. Tidak lagi hanya perusahaan model AI, OpenAI kini menjadi pemain di ranah perangkat keras dengan chip kustom yang dirancang untuk kebutuhan inferensi LLM.

Dengan kecepatan pengembangan 9 bulan yang memecahkan rekor dan kinerja per watt yang diklaim lebih baik dari perangkat tercanggih saat ini, Jalapeño berpotensi mengubah lanskap komputasi AI. Bagi industri, langkah ini menunjukkan bahwa perusahaan AI besar semakin serius membangun infrastruktur mandiri—sebuah tren yang akan mempengaruhi persaingan di pasar chip AI global.

Pertanyaan yang Sering Diajukan (FAQ)

1. Apa itu chip AI Jalapeño?

Jalapeño adalah chip AI kustom pertama yang dikembangkan OpenAI bersama Broadcom. Chip ini adalah ASIC yang dirancang khusus untuk menjalankan model AI (inferensi), bukan untuk melatih model.

2. Berapa lama waktu pengembangan Jalapeño?

OpenAI dan Broadcom menyelesaikan desain hingga tahap produksi dalam waktu hanya 9 bulan, yang diklaim sebagai siklus pengembangan ASIC tercepat dalam sejarah.

3. Mengapa OpenAI membuat chip sendiri?

OpenAI ingin mengurangi ketergantungan pada NVIDIA dan mengendalikan infrastruktur komputasinya sendiri. Dengan chip kustom, OpenAI dapat mengoptimalkan kinerja dan menekan biaya operasional.

4. Kapan Jalapeño mulai digunakan?

Jalapeño akan mulai digunakan di pusat data pada akhir 2026, dengan peningkatan skala pada 2027-2028.

5. Apakah Jalapeño menggantikan GPU NVIDIA?

Tidak sepenuhnya. Jalapeño dirancang khusus untuk inferensi, sementara NVIDIA GPU masih akan digunakan untuk pelatihan model dan beban kerja lain yang membutuhkan fleksibilitas lebih tinggi.

Baca

Sumber dan Referensi

Artikel ini merupakan karya tulis orisinal yang disusun berdasarkan informasi dari sumber-sumber tepercaya. Artikel tidak menyalin isi sumber dan dibuat untuk memberikan konteks serta informasi tambahan kepada pembaca.

Postingan populer dari blog ini

DSX AI Factory Firmus di Batam: Pusat Komputasi AI Terbesar di Asia Tenggara

DSX AI Factory Firmus di Batam: Pusat Komputasi AI Terbesar di Asia Tenggara "AI-Native companies need access to scalable, energy and cost-efficient compute infrastructure to compete globally. This partnership with Nvidia provides AI-Natives with unprecedented access to the most advanced AI accelerators in the world." — Tim Rosenfield, Co-CEO Firmus Technologies Featured Snippet Answer: DSX AI Factory Firmus di Batam adalah pusat komputasi AI berkapasitas 360 megawatt yang dibangun oleh Firmus Technologies bersama Nvidia dan DayOne. Fasilitas ini akan menjadi salah satu klaster GPU terbesar di Asia Tenggara dengan hingga 170.000 chip akselerator AI Nvidia. Proyek ini ditargetkan beroperasi pada kuartal pertama 2027 dan diperkirakan menghasilkan nilai kesepakatan US$25-30 miliar dalam enam tahun pertama. Ringkasan Singkat: Firmus Technologies dan Nvidia bangun DSX AI Factory 360 MW di Batam dengan 170.000 chip AI. Fasilitas ini akan menjadi pusat komputasi AI terbes...

NVLink: Teknologi Interkoneksi GPU NVIDIA untuk Infrastruktur AI

NVLink: Teknologi Interkoneksi GPU NVIDIA untuk Infrastruktur AI "NVLink is a high-speed connection for GPUs and CPUs formed by a robust software protocol, typically riding on multiple pairs of wires printed on a computer board. It lets processors send and receive data from shared pools of memory at lightning speed." — NVIDIA Featured Snippet Answer: NVLink adalah teknologi interkoneksi berkecepatan tinggi milik NVIDIA yang menghubungkan GPU dan CPU dalam sistem akselerasi. Generasi kelima (Blackwell) menawarkan 1,8 TB/s per GPU, sementara generasi keenam (Rubin) mencapai 3,6 TB/s — 14 kali lebih cepat dari PCIe Gen6. NVLink memungkinkan akses memori bersama antar GPU dan komunikasi langsung tanpa CPU, sangat penting untuk pelatihan dan inferensi AI skala besar. Ringkasan Singkat: NVLink adalah teknologi interkoneksi GPU-ke-GPU berkecepatan tinggi dari NVIDIA untuk komunikasi dalam server dan rack. Generasi ke-6 menawarkan 3,6 TB/s per GPU, 14x lebih cepat dari PCI...

InfiniBand: Jaringan Berkecepatan Tinggi untuk Infrastruktur AI dan HPC

InfiniBand: Jaringan Berkecepatan Tinggi untuk Infrastruktur AI dan HPC "InfiniBand is a critical component in modern data center networking, because it delivers high throughput with consistently low latency." Featured Snippet Answer: InfiniBand adalah teknologi jaringan berkecepatan tinggi yang dirancang khusus untuk komputasi paralel di superkomputer dan klaster GPU AI. Berbeda dengan Ethernet, InfiniBand memiliki latensi sub-mikrodetik (0,6 mikrodetik), RDMA native untuk transfer data langsung antar memori tanpa CPU, dan efisiensi bandwidth hingga 95%. Generasi terbaru Quantum-X800 menawarkan 800 Gb/s dengan SHARP v4 untuk in-network computing. Ringkasan Singkat: InfiniBand adalah teknologi jaringan berkecepatan tinggi yang dirancang untuk komputasi paralel dengan latensi sub-mikrodetik dan RDMA native. Menjadi standar untuk superkomputer dan klaster GPU AI, InfiniBand menawarkan bandwidth hingga 800 Gb/s, efisiensi 95%, dan manajemen terpusat melalui Subnet Man...