Tajuk: Menyahkod GLM 5.3 Zhipu: Melangkaui Angka Penanda Aras

Zhipu AI telah melancarkan model bahasa besar terbaharunya, GLM-5.3, dan dengan serta-merta mendedahkan satu kelemahan ketara: pertahanan keselamatan sibernya ketinggalan berbanding peningkatan keupayaan penaakulannya. Sesiapa yang merancang untuk menyepadukan model ini ke dalam sesuatu produk kini berhadapan dengan halangan keselamatan yang tidak boleh diabaikan.

Pelancaran dan penilaian kendiri yang jarang berlaku

Makmal yang berpangkalan di Beijing itu mengumumkan metrik prestasi GLM-5.3, dengan mendakwa ia mampu bersaing dengan pesaing terkemuka dari Barat. Angka utama menunjukkan peningkatan dalam ujian penaakulan kompleks dan pematuhan arahan, namun nota pelancaran mengandungi satu baris ayat yang membezakan pengumuman tersebut: “keupayaan keselamatan siber kami berkembang paling pesat tepat pada bahagian di mana kami paling ketinggalan.” Dalam istilah mudah, makmal tersebut mengakui bahawa sekatan suntikan arahan (prompt-injection), pertahanan jailbreak, dan penapis kod berniat jahat masih dalam proses pembangunan.

Bagaimana jurang itu muncul

Trajektori Zhipu mencerminkan corak yang lebih luas: setiap generasi melangkaui batasan dalam pemahaman bahasa dan penyelesaian masalah, namun pada masa yang sama memudahkan pengguna untuk memujuk model tersebut melakukan tingkah laku yang tidak dibenarkan. Makmal tersebut menggelarnya sebagai “ketidakselarasan keupayaan-keselamatan” (capability-safety misalignment) – model yang lebih berupaya boleh dengan lebih mudah memintas lapisan keselamatan yang sebelum ini menyekat versi yang lebih lemah.

Apa maksud kelemahan ini kepada pembangun

Pembangun menghadapi tiga kebimbangan konkrit:

  • Risiko suntikan arahan (prompt-injection) – penyerang menambah atau menyematkan arahan tersembunyi yang mengarahkan model untuk mendedahkan arahan dalaman atau menghasilkan kandungan yang disekat.
  • Kerentanan jailbreak – pertanyaan yang dirancang khas boleh melumpuhkan pagar keselamatan (guardrails), membolehkan model menghasilkan output yang berbahaya.
  • Penghasilan kod berniat jahat – model yang lebih mahir dalam penaakulan boleh menghasilkan skrip canggih yang boleh dijadikan senjata jika tidak dipantau.

Oleh kerana penaakulan teras GLM-5.3 kini setanding dengan model terkemuka, godaan untuk bergantung kepada output mentahnya semakin meningkat. Namun, jurang keselamatan memaksa sebarang penggunaan dalam pengeluaran untuk menambah kawalan tambahan: penapis kandungan luaran, persekitaran pelaksanaan kotak pasir (sandboxed), dan pemantauan berterusan terhadap corak penggunaan luar biasa.

Sudut pandangan berbeza: adakah makmal lain lebih selamat?

Zhipu tidak bersendirian dalam bergelut dengan imbangan ini. Pengakuannya, walaupun tidak selesa, adalah telus; ia memberitahu penyepadu untuk menganggap model tersebut sebagai “enjin berprestasi tinggi dengan casis keselamatan sementara.”

Gambaran persaingan yang lebih luas

Pelancaran GLM-5.3 menandakan peralihan daripada perlumbaan pemain tunggal untuk skor penanda aras tertinggi kepada pertandingan pelbagai pemain untuk kecerdasan yang boleh digunakan dan selamat. Makmal-makmal China, termasuk Zhipu, telah mempercepatkan kitaran iterasi mereka, sekali gus menghakis kepimpinan yang pernah dipegang oleh segelintir organisasi Barat.

Kesimpulan

GLM-5.3 menunjukkan bahawa Zhipu AI mampu menandingi peneraju global dalam aspek penaakulan, tetapi pelancaran yang sama mengakui secara terbuka bahawa perisai keselamatan sibernya masih dalam proses mengejar. Oleh itu, model ini merupakan alat berprestasi tinggi yang mesti dipadankan dengan langkah keselamatan luaran yang kukuh sebelum ia boleh dipercayai dalam aplikasi dunia nyata.