- Pembangunan pemecut Instinct MI350 dan MI400 untuk bersaing dalam pusat data dengan lebar jalur memori yang lebih tinggi.
- Pelancaran Ryzen AI Max PRO dengan NPU bersepadu untuk menjalankan model bahasa kompleks secara tempatan.
- Bertaruh pada ROCm sebagai alternatif sumber terbuka kepada dominasi ekosistem CUDA NVIDIA.
- Integrasi pemproses EPYC Venice dengan sehingga 256 teras untuk mengoptimumkan infrastruktur pelayan AI.

Persaingan untuk menguasai kecerdasan buatan telah berubah daripada sekadar janji kepada perang perkakasan habis-habisan. Dalam arena ini, AMD sedang mempercepatkan usahanya untuk menawarkan alternatif yang boleh dipercayai yang membolehkan perniagaan dan pengguna akhir menggunakan model AI tanpa kos yang melambung tinggi atau infrastruktur menjadi usang dalam beberapa hari.
Matlamatnya jelas: untuk beralih daripada projek perintis mudah kepada pengeluaran sebenar yang boleh diskala . Untuk mencapai matlamat ini, syarikat bukan sahaja memberi tumpuan kepada kuasa mentah tetapi juga untuk menyelesaikan masalah biasa, seperti pengurusan tenaga, tadbir urus data dan perjuangan berterusan untuk mengelakkan pergantungan pada satu vendor dalam pasaran.
Pemecut Naluri: Cabaran Langsung kepada NVIDIA
Apabila melibatkan pusat data, GPU konvensional tidak mencukupi; pemecut adalah penting. Di sinilah Instinct MI350 memainkan peranan , menjanjikan lonjakan besar ke hadapan, sehingga 35 kali lebih pantas dalam tugasan inferens berbanding model sebelumnya. Kehebatan ini mempunyai memori HBM3E 288 GB, membolehkannya mengendalikan aliran kerja yang besar dengan sangat mudah.
Tetapi AMD tidak berhenti di situ dan sudah menetapkan sasarannya pada Instinct MI400 untuk tahun 2026. Cip ini dijangka mencapai 40 PFLOPS dalam ketepatan FP4 dan menampilkan memori HBM4 sehingga 432 GB. Semua ini akan disepadukan ke dalam rak Helios, satu seni bina yang direka untuk bersaing secara bersemuka dengan penyelesaian NVIDIA, menawarkan kapasiti lebar jalur yang benar-benar menakjubkan .
Dalam jangka masa panjang, pelan tindakan tersebut merangkumi EPYC Verano dan Instinct MI500X, yang boleh memanfaatkan nod pembuatan 1,6nm TSMC. Strateginya jelas: mengatasi persaingan dari segi kapasiti memori dan kelajuan pemindahan, yang merupakan kelebihan sebenar apabila melatih model bahasa yang besar.
Ekosistem perisian dan dinding CUDA
Ia bukan sahaja tentang perkakasan yang berkuasa. Kelemahan terbesar AMD dari segi sejarah adalah perisian. Walaupun NVIDIA mendominasi CUDA, standard yang digunakan oleh semua orang, AMD telah memilih ROCm . Versi 7 platform sumber terbuka ini bertujuan untuk merapatkan jurang, malah menjadi lebih cekap daripada CUDA dalam senario tertentu seperti model DeepSeek R1.
Walaupun begitu, perjalanan di hadapan adalah mencabar kerana ramai pembangun merasakan bahawa perisian AMD masih mempunyai pepijat yang merumitkan latihan . Kunci kejayaan masa depan bukanlah terletak pada penambahan lebih banyak teras, tetapi pada memastikan pengalaman pengaturcaraan yang lancar yang tidak menyusahkan jurutera.
AI pada desktop dan komputer riba: Ryzen AI dan Radeon
Bagi pengguna yang tidak mempunyai pusat data asas, AMD telah melancarkan pemproses Ryzen AI Max PRO . Cip ini menyepadukan NPU khusus yang mencapai 50 TOPS, membolehkan tugas seperti Llama 3.1 70B dijalankan secara tempatan dan luar talian—sesuatu yang kelihatan seperti fiksyen sains dalam peranti padat tidak lama dahulu—menjadikannya lebih mudah untuk menjalankan model AI pada PC anda.
Dari segi grafik, Siri Radeon RX 9000, terutamanya RX 9070 dengan VRAM 16 GB, merupakan titik permulaan yang mudah diakses bagi mereka yang ingin melakukan inferens AI tanpa berbelanja besar. Bagi pengguna yang paling mencabar, Radeon AI PRO R9700 meningkatkan standard kepada 32 GB, sekali gus menghapuskan sebarang kesesakan pada peranti.
Infrastruktur pelayan: EPYC Venice
GPU ini bergantung pada pemproses pelayan. Pemproses EPYC Venice yang akan datang , berdasarkan Zen 6, menjanjikan varian dengan sehingga 256 teras. Peningkatan prestasi 70% berbanding generasi sebelumnya adalah penting untuk mengelakkan CPU daripada menjadi penghalang bagi pemecut AI yang berkuasa ini.
Sungguh menarik untuk melihat bagaimana pasaran mula bertindak balas. Tokoh-tokoh seperti Sam Altman dari OpenAI telah pun mengakui bahawa penyelesaian AMD akan menjadi komponen yang menakjubkan dalam pusat data mereka. Ini menunjukkan bahawa, walaupun NVIDIA mempunyai bahagian pasaran terbesar, industri ini terdesak mencari alternatif yang lebih cekap dan, yang paling penting, lebih murah untuk dilaksanakan.
Strategi AMD menggabungkan perkakasan yang mengganggu dalam memori dan kuasa pemprosesan dengan usaha agresif untuk mendemokrasikan perisian AI. Dengan mengintegrasikan enjin AI khusus daripada komputer riba hingga rak pelayan yang paling kompleks, syarikat itu berhasrat untuk menjadikan AI bukan lagi satu kemewahan yang mahal tetapi alat yang mudah diakses dan cekap untuk sebarang jenis profesional atau perniagaan.



