Wrapper Bash menghabiskan lebih banyak token daripada Model Context Protocol (MCP) tujuh skema dalam satu sesi 12 pertanyaan, menunjukkan bahwa shell bukanlah jalan pintas murah seperti yang dikira banyak insinyur. Penggunaan token berbanding lurus dengan biaya bagi agen large-language-model (LLM) yang berjalan dalam skala besar.
Eksperimen yang membalikkan keadaan
Seorang pengembang mengukur empat cara agen LLM dapat mengambil data kapal:
- MCP – tujuh skema alat yang dihosting di balik Model Context Protocol.
- Bash + curl (cold) – panggilan shell mentah tanpa perintah tambahan.
- Bash + curl (warm) – panggilan shell yang sama ditambah prompt sistem yang memandu penggunaan yang aman.
- Alat CLI khusus – antarmuka baris perintah yang dibuat khusus untuk tujuan tersebut.
Keempatnya dijalankan melalui percakapan 12 pertanyaan. Konsumsi token, yang memicu tagihan API, hasilnya adalah sebagai berikut:
- MCP: 109.779 token
- Bash + curl (cold): 158.021 token
- Bash + curl (warm): 178.577 token
Angka untuk alat CLI khusus tidak diungkapkan, tetapi dua varian Bash sudah menghabiskan lebih banyak biaya daripada MCP.
Mengapa shell lebih mahal daripada protokol
Setiap alat Bash membutuhkan sekitar 2.700 token "harness prompts" – instruksi yang memberi tahu agen cara memanggil shell dengan aman, mengurai output, dan menangani kesalahan. Prompt tersebut saja sudah melebihi total bobot token dari ketujuh skema MCP jika digabungkan.
Biayanya bukan hanya pada panggilan awal. Dalam produksi, agen yang sama memuat 11 server MCP di awal, menghabiskan 19.800 token sebelum pertanyaan pertama pengguna tiba. Kemudian, pada setiap giliran, agen membaca ulang setiap skema dari setiap server, sehingga permintaan sepele seperti "jam berapa sekarang?" pun harus membayar harga token dari setiap deskripsi alat lainnya.
Pemborosan tersembunyi dari eager loading
Ketika agen LLM melakukan eager loading pada setiap server alat di setiap giliran, tagihan token membengkak secara drastis. Eksperimen menunjukkan bahwa biaya "sebenarnya" dari penggunaan Bash bukanlah perintah shell itu sendiri, melainkan konteks di sekitarnya yang harus dikirimkan ke model setiap saat.
- Alat dengan biaya tetap (skema MCP) menambah overhead token yang dapat diprediksi per giliran.
- Payload dinamis (respons curl) menambah utang yang terus tumbuh seiring dengan panjang percakapan dan ukuran data.
Dengan demikian, shell yang terlihat "gratis" di permukaan sebenarnya membebankan pajak token variabel yang lebih besar.
Apa yang harus dilakukan insinyur AI selanjutnya
- Terapkan lazy loading. Muat server alat hanya saat skemanya benar-benar dibutuhkan, dan simpan di memori selama beberapa giliran alih-alih membacanya ulang setiap saat.
- Anggap skema alat sebagai pengeluaran tetap per giliran. Rencanakan anggaran token berdasarkan ukuran definisi MCP yang sudah diketahui, daripada berasumsi bahwa perintah shell itu gratis.
- Evaluasi kembali asumsi “shell = murah”. Lakukan profiling penggunaan token untuk setiap jalur alat sebelum menetapkan sebuah desain.
- Tetap gunakan alat yang terstruktur untuk model kecil. Bahkan dengan jendela konteks yang terbatas, skema yang terdefinisi dengan baik akan meningkatkan penalaran, konversi unit, dan penanganan kesalahan.
Intinya: ekonomi token, bukan desain protokol, yang menentukan biaya. Mengelola kapan dan bagaimana server alat dimuat dapat menghemat puluhan ribu token dalam sebuah percakapan, yang secara langsung menurunkan pengeluaran operasional.
Sumber: https://dev.to/clarkbw--/enabling-bash-costs-more-context-than-seven-mcp-tool-schemas-2h82
