- OpenAI menandatangani perjanjian tujuh tahun $38.000 bilion dengan AWS untuk mendapatkan pengkomputeran besar-besaran dengan Nvidia GB200/GB300 dan EC2 UltraServers.
- Penggunaan penuh sebelum 2026 dan pilihan untuk pengembangan kemudian; kapasiti khusus yang sudah digunakan dan kemudahan baharu yang disesuaikan dengan keperluan anda.
- Kepelbagaian utama bergerak melangkaui Microsoft, dengan latar belakang komitmen infrastruktur sebanyak $1,4 trilion dan tanda-tanda kemungkinan gelembung.

OpenAI telah membuat langkah penting dalam dunia teknologi dengan memuktamadkan perjanjian bernilai berbilion dolar dengan Amazon Web Services untuk mendapatkan kuasa pengkomputeran jangka panjang. Perjanjian yang bernilai $38.000 bilion itu menjamin akses segera dan peningkatan kepada awan AWS untuk menjalankan dan menskalakan beban kerja kecerdasan buatan yang paling mencabar oleh syarikat yang diketuai oleh Sam Altman.
Di luar angka tersebut, apa yang relevan ialah skopnya: OpenAI akan dapat memanfaatkan infrastruktur peringkat tertinggi AWS, dengan penggunaan penuh dirancang sebelum akhir tahun 2026 dan pilihan untuk berkembang dari tahun 2027 dan seterusnya. Perjanjian ini mewakili kepelbagaian pembekal berbanding pergantungannya pada Microsoft, di samping memperkukuh keupayaan latihan dan inferens ChatGPT dan model sempadan akan datang yang sedang dibangunkan oleh syarikat itu.
Apakah sebenarnya yang telah ditandatangani OpenAI dan AWS?

Perjanjian ini bertempoh berbilang tahun, dengan tempoh tujuh tahun, dan menetapkan bahawa OpenAI akan mula menggunakan kapasiti AWS khusus dengan segera. Menurut kedua-dua syarikat, sebahagian daripada kapasiti khusus ini sudah beroperasi , dan selebihnya akan diaktifkan secara progresif sehingga siap sebelum akhir tahun 2026, dengan ruang untuk berkembang pada tahun-tahun berikutnya bergantung pada permintaan.
Dari segi operasi, OpenAI akan memanfaatkan pusat data AWS sedia ada, manakala Amazon pada masa yang sama akan membina kemudahan yang direka khusus untuk keperluannya dan menjurus ke arah pengkomputeran awan asli . Lokasi baharu ini akan menggabungkan reka bentuk seni bina yang canggih yang bertujuan untuk memaksimumkan prestasi dan kecekapan tenaga, satu aspek kritikal apabila permintaan pengkomputeran berkembang pada kadar yang sangat pantas.
Perikatan ini merangkumi penggunaan Amazon EC2 UltraServers, satu seni bina yang mengumpulkan kelompok besar GPU dalam rangkaian yang sama untuk meminimumkan kependaman antara nod. Dalam praktiknya, ini bermakna cip generasi terkini Nvidia (GB200 dan GB300) akan dapat berkomunikasi dengan kelewatan minimum, yang penting untuk melatih model besar-besaran dan memberikan inferens pada skala global tanpa kesesakan.
Objektif yang dinyatakan oleh pihak-pihak tersebut adalah jelas: untuk menyediakan OpenAI dengan pangkalan pengkomputeran yang besar, andal dan selamat bagi menyokong latihan model sempadan baharu, menyokong trafik ChatGPT dan menggunakan beban kerja yang lebih kompleks, termasuk beban kerja agentif, dengan keanjalan yang hanya boleh disediakan oleh hiperskala seperti AWS.
- Tempoh dan nilai: $38.000 bilion semasa tujuh tahun, dengan penggunaan penuh sebelum 2026 dan pilihan untuk pertumbuhan seterusnya.
- Kapasiti khusus: bahagian tersedia dari hari pertama dan selebihnya di tanjakan, disokong oleh pusat data semasa dan dalam kemudahan baharu yang dibina khas.
- Senibina: Amazon EC2 UltraServers dengan GPU dan kluster Nvidia GB200/GB300 pada rangkaian yang sama untuk kependaman ultra rendah.
- Kegunaan yang dimaksudkan: latihan model generasi akan datang, Inferens ChatGPT dan beban kerja AI berketumpatan tinggi.
Dimensi teknikal: cip, kluster dan prestasi

Model bahasa latihan dan sistem multimodal berskala besar yang dikendalikan oleh OpenAI memerlukan pengumpulan ratusan ribu GPU dan kluster berprestasi tinggi dan menghubungkannya dengan rangkaian berkelajuan sangat tinggi. Cadangan AWS sesuai dengan corak ini: ia mengintegrasikan pemecut Nvidia GB200 dan GB300 ke dalam UltraServers yang disambungkan dalam jaringan yang sama, untuk mengurangkan latensi komunikasi antara cip dan mempercepatkan latihan teragih dan penghantaran respons yang besar-besaran.
Apabila bekerja pada skala besar-besaran, setiap milisaat yang dikurangkan daripada komunikasi dalaman boleh diterjemahkan kepada penjimatan masa latihan selama berminggu-minggu. Itulah sebabnya AWS memberi tumpuan kepada interkoneksi, pengurusan giliran dan pengaturan sumber untuk memaksimumkan kecekapan setiap cip dan setiap kluster , mengelakkan kapasiti yang dibazirkan dan memastikan penggunaan yang berterusan.
Reka bentuk ini juga mempertimbangkan senario campuran: bukan sahaja latihan canggih, tetapi juga inferens berprestasi tinggi untuk produk pengeluaran seperti ChatGPT. Apabila pangkalan pengguna berkembang dan ciri menjadi lebih kompleks, kos setiap permintaan dan latensi yang dirasakan untuk pengguna akhir menjadi metrik penting untuk mengekalkan daya saing.
Dalam konteks ini, AWS mempunyai rekod prestasi mengendalikan kluster besar-besaran dalam sektor seperti bioteknologi, penyelidikan iklim dan kewangan. Pengalaman itu—dalam projek yang memerlukan lebih daripada setengah juta cip dalam operasi yang diselaraskan—kini sedang digunakan untuk pelanggan yang menuntut tahap kestabilan dan keselamatan yang luar biasa walaupun mengikut piawaian awan perusahaan.
Hasilnya ialah platform yang direka untuk diskalakan dengan pantas, mampu menyerap permintaan puncak dan mengekalkan beban latihan dan inferens yang berterusan selama berbulan-bulan. Bagi OpenAI, mempunyai tahap fleksibiliti dan ketersediaan ini bukanlah satu kemewahan, tetapi prasyarat untuk terus menembusi sempadan AI canggih tanpa menghalang pelan hala tujunya.
Pergerakan strategik dan hubungan dengan penyedia awan lain

Dari tahun 2019 hingga 2023, OpenAI telah mengikat kontrak untuk semua pengkomputerannya dengan Microsoft, pelabur terbesarnya. Perjanjian itu merangkumi hak penolakan pertama, yang bermaksud ia hanya boleh menggunakan penyedia awan lain dengan kelulusan Redmond. Sekatan ini baru-baru ini ditarik balik selepas terma dirundingkan semula, membolehkan OpenAI menandatangani perjanjian secara bebas dengan mana-mana platform awan—keputusan yang membuka pintu kepada perjanjian seperti yang sedang kita bincangkan dengan AWS.
Secara selari, OpenAI telah memeterai komitmen pembelian besar-besaran dengan beberapa pemain dalam rantaian nilai: satu lagi perjanjian dengan Azure bernilai $250.000 bilion telah didedahkan , satu lagi dengan Oracle untuk $300.000 bilion untuk pusat data dan kontrak dengan pengilang dan pembekal seperti Nvidia, AMD, Broadcom atau Google, sebagai tambahan kepada perjanjian $22.400 bilion dengan CoreWeave, salah satu penanda aras bagi apa yang dipanggil neo-awan yang berorientasikan kepada pembangun AI.
Sehingga pengumuman ini, AWS merupakan penyedia awan utama AS yang menyokong OpenAI; kini ia menjadi rakan kongsi peringkat tertinggi. Langkah ini penting kerana Amazon mengekalkan hubungan yang sangat rapat dengan Anthropic , pesaing langsung OpenAI. Amazon telah melabur berbilion-bilion dalam syarikat itu dan sedang membina kampus bernilai $11.000 bilion di Indiana untuk beban kerjanya, dengan penggunaan Trainium2 berskala besar sudah beroperasi.
OpenAI, bagi pihaknya, terus mengutamakan pemecut Nvidia untuk beban kerja yang paling kritikal, berbanding pemproses Trainium AWS, satu trend yang telah ditunjukkan oleh pasaran. Di bahagian komersial, kerjasama dengan Amazon juga jelas dalam ekosistem perkhidmatan: Amazon Bedrock mengintegrasikan model berbilang rumah, dan, menurut syarikat, pelanggan AWS boleh mengakses model OpenAI dalam persekitaran tersebut untuk kes penggunaan perusahaan.
Konsensus industri adalah bahawa mempelbagaikan penyedia bukanlah satu kehendak, tetapi ukuran daya tahan. Apabila permintaan pengkomputeran sangat besar dan berterusan, bergantung pada penyedia awan tunggal menimbulkan risiko operasi dan kewangan yang harus dikurangkan. Kemasukan AWS ke dalam persamaan ini menawarkan redundansi OpenAI, rundingan harga dan masa penghantaran yang lebih baik, dan kesinambungan yang terjamin dalam menghadapi potensi gangguan bekalan cip.
Kesan kewangan, pasaran dan implikasi kepada industri

Perjanjian dengan AWS merupakan sebahagian daripada usaha OpenAI yang belum pernah terjadi sebelumnya untuk menjamin kuasa pengkomputeran dan sumber pengkomputeran secara berskala besar. Syarikat itu telah mengakui komitmen bernilai $1,4 trilion dalam infrastruktur untuk membina dan memperkasakan model AInya. Angka ini, jauh melebihi piawaian industri biasa, telah menimbulkan kebimbangan tentang potensi gelembung pelaburan yang menyelubungi ekonomi AI.
Secara perspektifnya, Altman telah menganggarkan bahawa memenuhi komitmen ini memerlukan kira-kira 30 gigawatt kuasa elektrik , lebih daripada 2% daripada jumlah kapasiti terpasang di Amerika Syarikat menjelang akhir tahun 2023, menurut data rasmi. Proses membina pusat data, mendapatkan bekalan cip dan menutup kontrak tenaga jangka panjang telah menjadi perlumbaan sebenar di sebalik perlumbaan AI.
Di bahagian korporat, OpenAI sedang menyelesaikan transformasinya daripada struktur bukan berasaskan keuntungan kepada struktur yang mampu menjana pulangan untuk pelabur . Perubahan organisasi ini membuka jalan untuk potensi IPO, satu langkah yang dianggarkan oleh pelbagai saluran media pada penilaian sehingga satu trilion dolar, sentiasa tertakluk kepada keadaan pasaran.
Metrik kewangan yang paling segera juga menawarkan pandangan. OpenAI dijangka menjana pendapatan sekitar $13.000 bilion tahun ini, walaupun syarikat itu tidak menjangkakan mencapai keuntungan sehingga 2029. Jangka masa yang panjang ini, digabungkan dengan tahap perbelanjaan modal yang komited, menjelaskan mengapa sesetengah pelabur mengambil pendirian berhati-hati meskipun terdapat minat umum terhadap AI generatif.
Pasaran saham bertindak balas secara optimistik terhadap pengumuman itu: Saham Amazon meningkat sekitar 5% pada awal dagangan, kadangkala memuncak sehingga 6%, dan saham Nvidia meningkat hampir 2,7%, selaras dengan peranannya sebagai penyedia dominan pemecut AI. Bagi AWS, perjanjian itu memperkukuh keupayaannya untuk membina dan mengendalikan rangkaian pusat data yang besar-besaran dalam era baharu kecerdasan buatan.
Dalam konteks ini, syarikat teknologi utama telah meningkatkan perbelanjaan modal mereka. Tahun lepas sahaja, Amazon, Google, Meta dan Microsoft melabur lebih $360.000 bilion dalam perbelanjaan modal, sekali gus mencetuskan perdebatan tentang kemampanan kitaran pelaburan. Hubungan kitaran yang terjalin antara penyedia awan, pengeluar cip dan pembangun AI—dengan komitmen silang dan pengambilalihan jangka panjang—merupakan pemacu pertumbuhan dan sumber risiko sistemik jika permintaan gagal mengikuti rentak.
Bagi AWS, perjanjian dengan OpenAI juga mempunyai implikasi yang kompetitif: ia menyatukan katalognya sebagai infrastruktur utama untuk beban kerja AI berskala besar dan, seterusnya, mengukuhkan penawarannya untuk pelanggan perusahaan yang menggunakan model melalui perkhidmatan terurus. Bagi OpenAI, keuntungannya adalah dua kali ganda: kapasiti dan daya tahan, dengan fleksibiliti untuk diskalakan tanpa bergantung pada satu pembekal sahaja.
Perkara utama untuk CTO dan pasukan seni bina
Pengajaran pertama ialah tiada strategi AI tanpa strategi pengiraan . Jika peneraju industri mengamankan kluster dengan pemecut generasi akan datang dan rangkaian latensi rendah, organisasi harus mengutamakan kecekapan beban kerja mereka (daripada latihan hingga inferens) dan melayan metrik seperti kos setiap token dan latensi p95 seolah-olah ia adalah penunjuk perniagaan.
- Pengoptimuman hujung ke hujung: daripada prapemprosesan kepada latihan dan kepada penyajian inferensmengatur sumber untuk mengurangkan masa menunggu dan meningkatkan penggunaan.
- Seni bina yang disediakan kesalahan: reka bentuk dengan lebihan, berbilang AZ/berbilang wilayah dan Awan berbilang terpilih apabila risiko membenarkannya.
- Pelan tenaga dan kapasiti: pertumbuhan saiz dengan senario realistik, jangkakan puncak dan menyesuaikan komitmen pembelian yang fleksibel.
- Tadbir urus dan keselamatan: melindungi model, data dan saluran paip dengan kawalan identiti, penyulitan dan audit berterusan dalam persekitaran hibrid.
Dari segi operasi, langkah OpenAI dan AWS menunjukkan bahawa kesesakan AI bukan lagi bakat atau perisian, tetapi akses berterusan kepada perkakasan berprestasi tinggi , kuasa dan rangkaian yang diatur dengan baik. Sesiapa yang menjamin ketiga-tiga elemen ini akan dapat mempercepatkan kitaran produk dan membezakan diri mereka.
Kenyataan awam syarikat-syarikat tersebut semuanya menunjukkan arah yang sama: terdapat permintaan yang belum pernah terjadi sebelumnya untuk kuasa pengkomputeran, dan pengkomputeran yang besar dan andal diperlukan untuk meningkatkan model canggih. Pada masa yang sama, Microsoft mengekalkan peranan utama sebagai rakan kongsi OpenAI utama di Azure, Oracle sedang mengembangkan jejak pusat datanya, Google Cloud sudah pun menjadi antara yang memacu ChatGPT, dan CoreWeave sedang memenuhi beban kerja pembangun AI dengan perjanjian bernilai puluhan bilion.
Masih belum dapat dilihat bagaimana beban kerja akan diagihkan merentasi platform dan bagaimana kos sebenar latihan dan inferens akan berkembang apabila generasi cip baharu diperkenalkan dan susunan perisian dioptimumkan. Tetapi trendnya jelas: kepelbagaian vendor dan rizab pengkomputeran jangka panjang menjadi tuas strategik untuk mengekalkan rentak inovasi.
Perikatan antara AWS dan OpenAI ini bukan sahaja menjamin kapasiti untuk tahun-tahun akan datang; ia juga mengesahkan bahawa fasa AI seterusnya akan diputuskan di peringkat asas: cip, pusat data dan tenaga , diselaraskan dengan seni bina yang memaksimumkan setiap milisaat. Dalam arena ini, menjamin perjanjian sebesar ini adalah sama pentingnya dengan teknologi dan strategi korporat.