Bash wrappers zilitumia tokeni nyingi zaidi kuliko Model Context Protocol (MCP) yenye miundo (schemas) saba katika mzunguko wa maswali 12, ikionyesha kuwa shell si njia rahisi ya gharama nafuu kama wahandisi wengi wanavyofikiri. Matumizi ya tokeni yanatafsiriwa moja kwa moja kuwa gharama kwa mawakala wa mifumo mikubwa ya lugha (LLM) yanayofanya kazi kwa kiwango kikubwa.

Jaribio lililobadilisha mtazamo

Mwendeshaji programu (developer) alipima njia nne ambazo wakala wa LLM angeweza kupata data za meli:

  • MCP – miundo saba ya zana (tool schemas) inayohifadhiwa kupitia Model Context Protocol.
  • Bash + curl (cold) – wito wa shell wa kawaida bila maelekezo (prompting) ya ziada.
  • Bash + curl (warm) – wito ule ule wa shell pamoja na maelekezo ya mfumo (system prompts) yanayoelekeza matumizi salama.
  • Dedicated CLI tool – kiolesura cha mstari wa amri (CLI) kilichoundwa mahususi kwa ajili hiyo.

Njia zote nne zilipitishwa kwenye mazungumzo ya maswali 12. Matumizi ya tokeni, ambayo huamua bili za API, yalikuja kama ifuatavyo:

  • MCP: tokeni 109,779
  • Bash + curl (cold): tokeni 158,021
  • Bash + curl (warm): tokeni 178,577

Takwimu za CLI tool mahususi hazikufichuliwa, lakini matoleo mawili ya Bash tayari yalizidi gharama za MCP.

Kwa nini shell iligharimu zaidi kuliko itifaki (protocol)

Kila zana ya Bash ilihitaji takriban tokeni 2,700 za “harness prompts” – maelekezo yanayomwambia wakala jinsi ya kuita shell kwa usalama, kuchanganua matokeo (parse output), na kushughulikia makosa. Maelekezo hayo pekee yanazidi uzito wa jumla wa tokeni za miundo yote saba ya MCP kwa pamoja.

Gharama si wito wa awali pekee. Katika uzalishaji (production), wakala ule ule uliipakia mapema seva 11 za MCP wakati wa kuanza, ukitumia tokeni 19,800 kabla ya swali la kwanza la mtumiaji kufika. Kisha, katika kila mzunguko, wakala uliisoma tena kila muundo (schema) kutoka kwa kila seva, hivyo hata ombi dogo kama “saa ngapi sasa?” lililipia bei ya tokeni ya maelezo ya kila zana nyingine.

Upotevu wa siri wa eager loading

Wakala wa LLM anapopakia kila seva ya zana kwa haraka (eager loading) katika kila mzunguko, bili ya tokeni huongezeka sana. Jaribio lilionyesha kuwa gharama “halisi” ya kutumia Bash si amri ya shell yenyewe, bali ni muktadha (context) unaozunguka ambao lazima utumwe kwa modeli kila wakati.

  • Zana zenye gharama maalum (miundo ya MCP) huongeza mzigo wa tokeni unaotabirika kwa kila mzunguko.
  • Mizigo ya data inayobadilika (majibu ya curl) huongeza deni linalokua kulingana na urefu wa mazungumzo na ukubwa wa data.

Hivyo basi, shell inayoonekana kuwa “bure” juu ya uso inatoza kodi kubwa zaidi na inayobadilika ya tokeni.

Wahandisi wa AI wanapaswa kufanya nini baadaye

  • Tumia lazy loading. Pakia seva ya zana pale tu muundo wake unapohitajika, na uihifadhi kwenye kumbukumbu (memory) katika mzunguko unaofuata badala ya kuisoma tena kila wakati.
  • Chukulia miundo ya zana kama gharama maalum ya kila mzunguko. Panga bajeti za tokeni kulingana na ukubwa unaojulikana wa maelezo ya MCP badala ya kudhani kuwa amri za shell ni bure.
  • Tathmini upya dhana za “shell = rahisi”. Chunguza matumizi ya tokeni kwa kila njia ya zana kabla ya kuamua usanifu fulani.
  • Tumia zana zilizoundwa vizuri kwa modeli ndogo. Hata kwa madirisha ya muktadha (context windows) yaliyobana, miundo iliyofafanuliwa vizuri huboresha uwezo wa kufikiri, ubadilishaji wa vipimo, na usimamizi wa makosa.

Hitimisho: uchumi wa tokeni, na si usanifu wa itifaki, ndio unaoamua gharama. Kusimamia ni lini na jinsi seva za zana zinavyopakuliwa kunaweza kupunguza maelfu ya tokeni kwenye mazungumzo, na hivyo kupunguza moja kwa moja matumizi ya uendeshaji.

Chanzo: https://dev.to/clarkbw--/enabling-bash-costs-more-context-than-seven-mcp-tool-schemas-2h82