Satu pendekatan baharu memaksa ejen pentest dipacu LLM untuk membuktikan pencerobohan dan bukannya sekadar mendakwa berlaku pencerobohan, dengan menggunakan nonce cabaran-respons yang menghapuskan positif palsu. Teknik ini, yang didemonstrasikan dalam rangka kerja HALO, mengubah “nampaknya kita telah mendapat shell” kepada “kita benar-benar mempunyai shell”.

Mengapa pencerobohan positif palsu itu penting

Enjin eksploitasi automatik yang dibina berasaskan model bahasa besar boleh menghasilkan berpuluh-puluh kompromi port yang “berjaya” dalam satu larian. Banyak perkhidmatan memaparkan rentetan seperti “uid=0” dalam banner, dan sasaran yang direka khas boleh meniru output tersebut tanpa perlu melaksanakan kod penyerang. Apabila ejen mempercayai paparan tersebut, setiap keputusan seterusnya—sama ada untuk melakukan pivot, mengeksfiltrasi data, atau bergerak secara lateral—berasaskan satu penipuan. Pasukan keselamatan membazirkan masa berjam-jam mengejar tapak pencerobohan yang tidak wujud, dan pasukan tindak balas insiden mungkin tersalah memberi keutamaan kepada ancaman sebenar.

Mengubah dakwaan menjadi bukti

Penyelesaian ini meminjam daripada teknik pengesahan klasik. Sebelum melancarkan eksploitasi, sistem penyerang menjana token unik, atau nonce, dan menyematkannya ke dalam payload. Eksploitasi tersebut mesti mengembalikan token yang tepat supaya pengawal dapat menerima keputusan itu sebagai pencerobohan yang tulen. Banner palsu tidak dapat meneka nonce tersebut; ia mesti melaksanakan kod penyerang untuk menyematkan token ke dalam respons. Jika data yang dikembalikan tidak mempunyai nonce yang sepadan, percubaan tersebut akan diketepikan sebagai positif palsu.

Peralihan ini mengubah model pengesahan daripada “output kelihatan betul” kepada “output membuktikan pelaksanaan”. Ia menghapuskan bias optimisme yang sering membelenggu alatan serangan autonomi.

Membina tangga penghantaran yang boleh dipercayai

Menghantar payload ke sasaran masih memerlukan rantaian penghantaran yang kukuh. HALO mengklasifikasikan tiga laluan biasa:

  • Reverse shells – hos yang telah dikompromi memulakan sambungan kembali ke pendengar (listener) yang dikawal oleh penyerang. Berguna apabila trafik masuk disekat.
  • Bind shells – penyerang menyambung terus ke perkhidmatan pendengar pada sasaran. Berfungsi apabila penapis keluar adalah longgar.
  • Blind callbacks – isyarat sehala (contohnya, permintaan DNS) yang mengesahkan pelaksanaan dalam persekitaran yang sangat terhad di mana tiada saluran terus boleh dibuka.

Setiap langkah dalam tangga tersebut mesti mengekalkan nonce, jika tidak, langkah pembuktian akan gagal di peringkat seterusnya.

Memastikan eksploitasi yang lengkap (self-contained)

Satu lagi punca keyakinan palsu adalah pergantungan kepada perpustakaan luaran yang mungkin tiada pada sasaran. HALO membungkus setiap komponen yang diperlukan ke dalam satu fail tunggal sebelum dihantar. Bungkusan tersebut kemudian diuji dalam sandbox yang sengaja tidak mempunyai kebergantungan (dependencies) asal. Jika eksploitasi masih berjalan, artifak tersebut benar-benar lengkap (self-contained) dan boleh dipercayai pada sistem yang dikunci ketat.

Membersihkan jejak pembangunan

Semasa menyediakan untuk pelancaran awam, penulis mendapati alamat IP sebenar masih tersisa dalam sejarah Git. Pokok kerja (working tree) yang bersih tidak memadamkan rekod tersebut; Git menyimpan setiap commit. Penulis menulis semula repositori kepada satu commit bersih dan menggantikan alamat yang bocor dengan julat khusus dokumentasi yang ditetapkan oleh RFC 5737 (sebagai contoh, 192.0.2.0/24). Ini mengelakkan pendedahan infrastruktur pengeluaran secara tidak sengaja apabila alatan tersebut dikongsi.

Peraturan praktikal untuk alatan keselamatan

  • Gunakan julat IP khusus dokumentasi dalam setiap pemuat tetap (test fixture).
  • Buang rahsia dan fail skop daripada commit awal.
  • Gunakan nonce cabaran-respons untuk mengesahkan sebarang dakwaan pencerobohan.
  • Sahkan fail tepat yang akan dihantar, bukan skrip yang hanya berkaitan secara longgar.

Bukti mengatasi optimisme. Dengan memaksa ejen pentest autonomi untuk membentangkan token yang boleh disahkan, HALO menunjukkan bahawa pencerobohan hanyalah pencerobohan apabila sasaran dapat membuktikan ia telah menjalankan kod penyerang. Pintu gerbang dibina terlebih dahulu; segala-galanya menyusul kemudian.