- AMD melancarkan siri Instinct MI350, menampilkan model MI350X dan MI355X, dengan peningkatan inferens sehingga 35x ganda berbanding generasi sebelumnya.
- GPU baharu dihasilkan dalam 3nm, menampilkan 185.000 bilion transistor dan 288GB memori HBM3E, serta menampilkan prestasi cemerlang dan kecekapan kuasa.
- Supermicro dan rakan kongsi teknologi utama seperti Meta, Microsoft, OpenAI dan Oracle telah menerima pakai penyelesaian ini untuk melatih dan menskalakan model lanjutan IA.
- Infrastruktur berasaskan MI350 dan perisian ROCm 7 memberikan fleksibiliti, skalabiliti dan pengurangan dramatik dalam kos dan penggunaan tenaga pusat data AI.

AMD telah mengambil langkah tegas dalam strateginya untuk bersaing dalam bidang kecerdasan buatan dengan pelancaran keluarga pemecut AMD Instinct MI350 . Siri baharu ini, yang diperkenalkan di acara Advancing AI 2025, menjanjikan untuk menjadi penanda aras dalam prestasi, kecekapan dan kebolehskalaan untuk AI generatif dan tugas pengkomputeran berprestasi tinggi. Hasil gabungan perkakasan canggih dan ekosistem perisian terbuka, AMD mengukuhkan kedudukannya berbanding pengeluar utama lain dan menarik perhatian gergasi teknologi seperti Meta, Microsoft, OpenAI dan Oracle.
Siri MI350 mewakili lonjakan generasi yang ketara: ia memberikan prestasi sehingga empat kali ganda berbanding pendahulunya dan mencapai kecekapan sehingga 35 kali ganda lebih tinggi dalam proses inferens . Penambahbaikan radikal ini bertujuan untuk memenuhi permintaan kuasa yang semakin meningkat dalam pusat data dan aplikasi AI, yang memerlukan pemprosesan dan latihan model yang semakin kompleks.
Berita teknikal siri AMD Instinct MI350
Inti siri ini terdiri daripada model MI350X dan MI355X , kedua-duanya dihasilkan menggunakan proses 3-nanometer TSMC . Ia mengintegrasikan 185 bilion transistor , menghasilkan ketumpatan dan kecekapan tenaga yang luar biasa. Setiap GPU dilengkapi dengan memori HBM3E 288 GB (disokong oleh Micron dan Samsung), yang mampu mencapai lebar jalur sehingga 8 TB/s.
Dari segi seni bina, kad baharu ini berdasarkan reka bentuk yang menampilkan 256 unit pengkomputeran dan 16.384 teras , yang diedarkan merentasi lapan zon dengan XCD bebas. Ia juga memanfaatkan teknologi Infinity Fabric generasi keempat untuk sambungan dan cache Infinity 256MB, mengoptimumkan pemindahan data dalam beban kerja intensif AI.
Satu lagi faktor pembezaan ialah keserasiannya dengan jenis data lanjutan seperti FP4 dan FP6 , sesuai untuk membuat inferens model besar. Siri ini memenuhi pelbagai keperluan penyejukan, kerana ia tersedia dalam versi penyejukan udara dan cecair, yang membolehkan penggunaan dalam pelbagai konfigurasi rak. Rak tunggal boleh menampung sehingga 64 GPU dengan penyejukan udara atau sehingga 128 GPU dengan penyejukan cecair langsung, mencapai prestasi FP4/FP6 2,6 exaFLOPS yang mengagumkan merentasi keseluruhan sistem.
Perbandingan dengan persaingan dan kecekapan tenaga

AMD telah mengeluarkan data yang menunjukkan bahawa MI355X mengatasi prestasi kad siri B200 Nvidia , mencapai kelajuan sehingga 2,2 kali lebih pantas dalam senario tertentu. Dalam ujian inferens menggunakan model AI seperti Llama 3.1 405B, syarikat itu mendakwa bahawa MI355X memberikan prestasi 35 kali ganda daripada siri MI300 sebelumnya dan mengatasi persaingan dari segi kelajuan pengiraan dan kapasiti memori, menghasilkan 40% lebih banyak token bagi setiap dolar yang dilaburkan.
Kecekapan tenaga juga merupakan titik kukuh generasi ini. Menurut AMD, siri MI350 telah mencapai peningkatan kecekapan kuasa sehingga 38 kali ganda berbanding penjanaan asas lima tahun lalu, melebihi sasaran yang dirancang. Ia bertujuan untuk meningkatkan kecekapan ini sebanyak 20 kali ganda menjelang 2030 di peringkat rak. Ini boleh membenarkan, dalam beberapa tahun, model yang pada masa ini memerlukan ratusan rak untuk latihan diuruskan dengan sebahagian kecil daripada sumber tersebut.
Infrastruktur, ekosistem dan kerjasama dengan rakan kongsi utama

Integrasi ke dalam platform pusat data merupakan satu lagi fokus utama AMD. Pengilang seperti Supermicro sudah menawarkan penyelesaian pelayan yang dioptimumkan dengan GPU MI350, tersedia dalam versi sejukan udara atau cecair dan direka bentuk untuk diskalakan kepada ratusan GPU setiap rak. Platform ini menggunakan CPU AMD EPYC dan teknologi interkoneksi Pollara untuk memaksimumkan prestasi, kebolehskalaan dan kecekapan sistem keseluruhan, memudahkan penggunaan dalam awan dan untuk perusahaan yang memerlukan AI berskala besar.
Syarikat-syarikat teknologi utama telah pun menerima pakai teknologi AMD untuk pelbagai tujuan. Meta telah melaksanakan generasi sebelumnya (MI300X) untuk inferens dalam model Llama mereka dan merancang untuk menaik taraf kepada siri MI350 sebaik sahaja ia tersedia, menonjolkan kuasa pengkomputeran dan kapasiti memori mereka. Prestasi AI pada sistem Windows juga didorong oleh kemajuan seperti ini. Microsoft Azure menggunakan pemecut AMD untuk menjalankan kedua-dua model AI proprietari dan sumber terbuka dalam pengeluaran, dan Oracle Cloud Infrastructure akan menggunakan kluster besar-besaran yang dilengkapi dengan MI355X untuk mencapai zettascale. Sementara itu, OpenAI dan Cohere telah menekankan kecekapan dan prestasi yang disediakan oleh penyelesaian AMD.
Dari segi perisian, versi ROCm 7 yang dikemas kini meningkatkan prestasi AI dan memudahkan keserasian dengan rangka kerja dan model terkemuka seperti Llama dan DeepSeek . Di samping itu, syarikat itu telah melancarkan AMD Developer Cloud, platform awan yang dioptimumkan untuk pembangun dan penyelidik AI.
Persediaan untuk masa depan: pelan hala tuju dan generasi baharu
AMD tidak berhenti di situ dan telah pun memajukan pembangunan pemecut generasi seterusnya, siri Instinct MI400 , berdasarkan memori HBM4 dan seni bina yang lebih bercita-cita tinggi. Barisan ini akan tiba bersama infrastruktur "Helios", pemproses EPYC Venice (Zen 6), dan kad rangkaian baharu berdasarkan seni bina Vulcan, dengan matlamat untuk meningkatkan prestasi sistem inferens sepuluh kali ganda.
Dengan semua perkembangan baharu ini, AMD nampaknya berazam untuk mendemokrasikan akses kepada kecerdasan buatan dan meletakkan dirinya sebagai salah satu pemain utama dalam ekosistem AI terbuka, baik dari segi perkakasan dan perisian, serta sokongan untuk komuniti teknologi.
Pemecut Instinct MI350 akan tersedia kepada rakan kongsi firma pada suku ketiga 2025, dan penggunaan mereka dalam pusat data dan perkhidmatan awan dijangka menandakan titik perubahan dalam cara cabaran kecerdasan buatan termaju ditangani. Gabungan prestasi mentah, kecekapan dan fleksibiliti infrastruktur, bersama-sama dengan sokongan syarikat utama dalam sektor ini, menunjukkan bahawa kesan teknologi ini akan menjadi besar pada tahun-tahun akan datang.
Penulis yang bersemangat tentang dunia bait dan teknologi secara umum. Saya suka berkongsi pengetahuan saya melalui penulisan, dan itulah yang akan saya lakukan dalam blog ini, menunjukkan kepada anda semua perkara yang paling menarik tentang alat, perisian, perkakasan, trend teknologi dan banyak lagi. Matlamat saya adalah untuk membantu anda mengemudi dunia digital dengan cara yang mudah dan menghiburkan.
