Z.ai mengumumkan pada 14 Ogos bahawa model GLM-5.3 baharunya tidak akan dikeluarkan dengan pemberat terbuka (open weights) seperti yang dijanjikan. Syarikat tersebut akan mengekalkan model itu di sebalik API dan perkhidmatan langganan selama dua minggu lagi, menangguhkan muat turun awam ke sekitar 28 Ogos sementara menjalankan semakan keselamatan. Z.ai menyatakan bahawa kelewatan tersebut berpunca daripada keupayaan keselamatan ofensif model itu yang sangat kuat di luar jangkaan—kemahiran yang boleh disalahgunakan sebagai senjata jika model tersebut boleh dimuat turun secara percuma.
Mengapa penangguhan ini penting
GLM-5.3 diperkenalkan sebagai pakar dalam pengekodan, tugasan ejen jangka panjang (long-horizon agent tasks), dan keselamatan siber. Dalam keluaran terdahulu, Z.ai menyediakan pemberat model secara serta-merta, menarik minat pembangun yang menjalankan model bahasa besar pada perkakasan mereka sendiri. Kali ini, butang “Akan Datang” pada halaman muat turun menggantikan pautan akses segera, menandakan peralihan daripada keterbukaan kepada sikap berhati-hati.
Pasukan keselamatan menandakan model tersebut selepas ujian dalaman menunjukkan ia memperoleh kemahiran keselamatan ofensif dengan lebih cepat daripada yang dijangkakan. Z.ai menyifatkan penangguhan ini sebagai langkah yang bertanggungjawab: semakan selama dua minggu untuk menilai risiko penyalahgunaan sebelum sesiapa pun boleh menyalin pemberat tersebut dan menjalankan model secara luar talian.
Peralihan industri yang lebih luas ke arah keluaran terkawal
Z.ai bukan satu-satunya syarikat yang mengetatkan akses kepada ejen paling berupaya miliknya. Langkah terbaharu oleh tiga makmal terkemuka lain menggambarkan konsensus yang semakin meningkat bahawa pengedaran tanpa sekatan bagi model berkuasa yang menggunakan alatan membawa risiko sebenar.
- OpenAI kini memerlukan pengesahan identiti untuk menggunakan model berfokuskan keselamatan sibernya, sekali gus mengehadkan siapa yang boleh membuat pertanyaan (query).
- Anthropic telah mengekalkan model berprestasi tingginya secara dalaman, dan hanya menawarkannya melalui antara muka yang terkawal.
Tindakan ini menunjukkan industri sedang beralih fokus daripada skor penanda aras (benchmark) yang menarik perhatian kepada keupayaan model untuk melaksanakan pelan pelbagai langkah, memanipulasi alatan luaran, dan pulih daripada ralat—keupayaan yang juga menarik minat aktor berniat jahat.
Apa yang dipertaruhkan
Jika pemberat tersebut akhirnya dikeluarkan di bawah lesen permisif seperti MIT, penyelidik keselamatan boleh mengkaji teknik model tersebut, membangunkan langkah pencegahan, dan menyepadukan teknologi itu ke dalam alatan pertahanan. Keluaran sumber terbuka akan memperkukuh prinsip bahawa ketelusan membantu komuniti kekal selangkah di hadapan ancaman.
Sebaliknya, lesen yang lebih ketat akan menandakan bahawa walaupun penyokong tegar pemberat terbuka melihat keperluan untuk mengehadkan siapa yang boleh menjalankan model tersebut. Ini boleh menetapkan preseden, mendorong bidang ini ke arah ekonomi “akses-melalui-API”.
Ketegangan utama tetap ada: sebaik sahaja fail model disiarkan secara awam, penerbit hilang keupayaan untuk menghalang penggunaan semula yang berniat jahat. Semakan keselamatan selama dua minggu tidak dapat menghapuskan pertukaran (trade-off) tersebut, tetapi ia memberi masa untuk merangka garis panduan, menyepadukan kawalan penggunaan, atau mengubah suai pelesenan.
Apa yang perlu diperhatikan pada 28 Ogos
Dua soalan konkrit akan menentukan bab seterusnya bagi GLM-5.3:
- Adakah pemberat tersebut benar-benar dikeluarkan mengikut jadual? Kegagalan menepati tarikh akhir akan membayangkan rintangan teknikal atau polisi yang lebih mendalam, yang mungkin mendorong Z.ai untuk melanjutkan semakan tersebut.
- Apakah lesen yang disertakan dengan keluaran tersebut? Lesen MIT yang tidak berubah akan menjadi kemenangan bagi keterbukaan; peralihan ke arah lesen terkawal akan mengesahkan kawalan industri yang semakin ketat terhadap model ejen (agentic models).
Pembangun yang merancang penyelidikan berkaitan keselamatan harus bersedia untuk menguji model tersebut pada tugasan ofensif dunia sebenar sebaik sahaja pemberat tiba. Ini akan mendedahkan sama ada kelewatan tersebut hanyalah langkah berjaga-jaga atau isyarat bahawa keupayaan model itu benar-benar mengatasi alatan pertahanan semasa.
Kesimpulan
Keputusan Z.ai untuk menangguhkan pemberat GLM-5.3 menandakan satu titik perubahan: model bahasa berkuasa yang menggunakan alatan tidak lagi dihargai semata-mata kerana kelancaran perbualan, tetapi kerana keluasan tindakan yang boleh diautomasikan. Memandangkan lebih banyak makmal mengutamakan prestasi ejen, risiko keupayaan tersebut disalahgunakan terhadap pihak pertahanan semakin meningkat. Minggu-minggu mendatang akan menunjukkan sama ada komuniti dapat mengimbangi penyelidikan terbuka dengan keperluan untuk mengekang penyalahgunaan, dan sama ada lesen permisif dapat bertahan dalam dunia di mana “pemberat terbuka” mungkin menjadi liabiliti sama seperti aset.
