Stanford’s 2026 AI Index menunjukkan insiden keselamatan meningkat kepada 362 pada tahun lepas, menekankan jurang yang semakin melebar antara penambahbaikan model yang pesat dengan langkah perlindungan yang ketinggalan untuk memastikan kebolehpercayaannya. Setiap kegagalan yang tidak diperiksa menghakis keyakinan terhadap sistem yang telah diterapkan dalam kewangan, kesihatan, dan perkhidmatan awam.

Data di sebalik jurang tersebut

Indeks tersebut, yang disusun oleh Institute for Human-Centered Artificial Intelligence, membandingkan prestasi utama dengan kebolehpercayaan dunia nyata. Model tahap tinggi masih cemerlang dalam ujian penanda aras, namun kadar "halusinasi" mereka—iaitu keadaan di mana mereka menjana kenyataan palsu atau rekaan—merangkumi julat yang mengejutkan antara 22% hingga 94% dalam bidang ini. Apabila pengguna memberikan premis yang sengaja palsu kepada model, ketepatan GPT-4o menjunam daripada 98.2% kepada 64.4%; DeepSeek R1 pula jatuh daripada lebih 90% kepada 14.4% di bawah ujian yang sama. Langkah perlindungan keselamatan yang sepatutnya menyekat arahan berniat jahat sering kali gagal apabila penyerang mengujinya.

Mengapa syarikat-syarikat sedang bergegas

Penerapan polisi mendahului penguatkuasaan. Peratusan firma tanpa sebarang tadbir urus AI menurun daripada 24% kepada 11% antara tinjauan sebelum ini dengan tahun ini, dan ramai kini memetik piawaian seperti ISO/IEC 42001 atau NIST AI Risk Management Framework. Merangka polisi tidak sama dengan melaksanakannya. Jurang pengetahuan dalaman menjejaskan 59% responden, kekangan bajet menghalang 48%, dan ketidakpastian kawal selia menyulitkan 41%. Laporan ini menyifatkannya sebagai "masalah teknikal": memperketat kawalan privasi secara tidak sengaja boleh melemahkan metrik keadilan, dan sebaliknya, menyebabkan jurutera terpaksa mengimbangi objektif yang bercanggah tanpa peralatan atau pembiayaan yang mencukupi.

Ilusi semakan keselamatan semasa

Skor ketelusan—agregat tentang sejauh mana pembangun mendedahkan had model dan kaedah pengujian secara terbuka—merosot daripada 58 kepada 40, menunjukkan bahawa pelaporan sukarela semakin hilang kredibiliti. Syarikat bergantung kepada audit dalaman yang sering terlepas kegagalan kes ekstrem yang direkodkan dalam Indeks. Hasilnya ialah rasa selamat yang palsu; organisasi percaya mereka dilindungi sedangkan kerentanan tersembunyi masih wujud.

Hujah balas: piawaian semakin mendapat tempat

Penyokong berhujah bahawa merujuk kepada rangka kerja ISO dan NIST adalah satu langkah ke hadapan. Piawaian formal memberikan bahasa yang sama dan jangkaan asas kepada juruaudit dan pengawal selia, menjadikan perbandingan antara firma lebih mudah. Pengguna awal melaporkan penyelarasan dalaman yang lebih lancar dan laluan eskalasi yang lebih jelas apabila sesuatu polisi wujud. Peningkatan dalam penerapan polisi menunjukkan industri menyedari risiko tersebut dan bersedia untuk melabur dalam tadbir urus.

Apa yang masih kurang

Walaupun dengan adanya polisi di atas kertas, pelaksanaannya masih goyah. Indeks tersebut mengetengahkan tiga halangan praktikal:

  • Jurang pengetahuan: Pasukan kekurangan kepakaran mendalam dalam risiko AI, yang membawa kepada semakan pematuhan yang cetek.
  • Kekurangan dana: Peralatan keselamatan, audit pihak ketiga, dan pemantauan berterusan memerlukan bajet yang tidak dapat dijustifikasikan oleh banyak firma.
  • Kekaburan kawal selia: Undang-undang yang samar atau sentiasa berubah menyukarkan reka bentuk pelan hala tuju pematuhan jangka panjang.

Menangani isu-isu ini berkemungkinan memerlukan pengesahan luaran. Laporan tersebut mengesyorkan peralihan daripada penilaian kendiri kepada penilaian bebas yang mensimulasikan penggunaan dunia nyata dan serangan adversarial. Ia juga menyeru penyelesaian kejuruteraan yang menyematkan semakan keselamatan secara terus ke dalam saluran (pipeline) model dan bukannya menganggapnya sebagai perkara sampingan.

Apa yang perlu diperhatikan seterusnya