Injini za utafutaji za AI zinaweza kuonekana kuwa na uhakika huku zikitaja vyanzo visivyofanya kazi au vya ubora wa chini, jaribio la haraka linaonyesha

Uhakiki rahisi wa asili ya vyanzo (provenance) kwenye zana tatu maarufu za utafutaji zinazotumia AI ulionyesha kuwa mbili kati yake zilionyesha viungo visivyofanya kazi au zilijibu maswali kwa kutumia tovuti zisizo na uaminifu mkubwa, ingawa zote tatu zilionesha maelezo yenye ujasiri sawa na mfululizo wa "chips" za vyanzo.

Jaribio lililoleta mshangao

Niliuliza swali la ukweli na la hivi karibuni: “Nini kimebadilika katika Sheria ya AI ya EU mwaka 2026?” Jibu lipo katika maandishi rasmi ya marekebisho, hivyo ama lipo au halipo. Niliingiza swali hilo kwenye injini tatu za utafutaji za AI zinazotoa marejeo: Perplexity, Google AI mode, na Brave Search.

Zote tatu zilitoa ukweli unaofanana—tarehe zilezile, maelezo yalezile—hivyo zililingana katika usahihi wa hali ya juu. Tofauti ilitokea tu nilipokagua vyanzo vilivyotajwa.

Jinsi nilivyopima ubora wa chanzo

Nilitengeneza mfumo wa alama wa ngazi tatu unaozingatia uzito wa kila marejeo kulingana na aina ya mwenyeji (host):

  • Chanzo Kikuu (uzito 3) – tovuti inayochapisha sheria yenyewe (mfano, rejista rasmi ya EU).
  • Rasmi (uzito 2) – taasisi inayotoa au kusimamia sheria (miliki ya serikali, tovuti za mashirika).
  • Maudhui yanayozalishwa na watumiaji (UGC, uzito 0) – majukwaa kama YouTube au Reddit.

Alama ya jumla ya kila injini ni wastani wa uzito wa URL zilizoonyeshwa.

Injini Vyanzo vilivyoripotiwa Alama
Perplexity Miliki rasmi za serikali 2.00
Google AI mode Makampuni ya ushauri na video ya YouTube 1.00
Brave Search Chanzo kikuu 3.00

Kwa maandishi Brave ilionekana kuwa bora kabisa, Perplexity ilikuwa nzuri, na Google ilibaki nyuma.

Kufeli kwa siri: viungo visivyofanya kazi

Ramani ya ngazi inatazama tu jina la kikoa (domain); haithibitishi ikiwa ukurasa uliounganishwa unafunguka kweli. Nilifuata kila URL. Marejeo ya "chanzo kikuu" ya Brave yalitoa ukurasa mtupu—kiungo kilikuwa hakifanyi kazi. Injini ilidai kuonyesha sheria lakini haikutoa kitu.

Perplexity ilitumia miliki rasmi za serikali.

Google ilitumia makampuni ya ushauri na video ya YouTube.

Matatizo mawili tofauti yalijitokeza:

  1. Miliki ya hali ya juu haihakikishii kuwa ukurasa unaweza kufikiwa.
  2. Muhtasari uliotengenezwa vizuri unaweza kuungwa mkono na vyanzo visivyo na uaminifu mkubwa.

Kiolesura cha mtumiaji huficha matatizo yote mawili. Zana zote tatu zinatoa aya ileile yenye ujasiri na mfululizo wa chips za vyanzo zinazofanana, bila ishara yoyote ya kuonyesha kuwa chip moja inaunganisha na ukurasa usiofanya kazi au nyingine inaelekeza kwenye mafunzo ya YouTube badala ya maandishi ya kisheria.

Kwa nini asili ya vyanzo ni muhimu kwa watengenezaji

Watengenezaji wanaweza kugeuza asili ya vyanzo kuwa kipimo kinachoweza kufanyiwa majaribio:

  • Pa kila jibu alama ukitumia uzito wa ngazi unaofanana na ule wa juu.
  • Thibitisha afya ya viungo kiotomatiki; weka alama kwenye majibu matupu au makosa ya HTTP.
  • Zindua tahadhari wakati alama ya asili ya jibu inaposhuka chini ya kiwango kilichowekwa.

Mtazamo huu ni thabiti zaidi kuliko kukimbizana na “hallucinations” – modeli inaweza kutengeneza sentensi inayoeleweka, lakini uhakiki wa asili ya vyanzo unakuambia kwa usahihi ni marejeo yapi (au ukosefu wake) yalisababisha tatizo, hali inayowezesha marekebisho ya moja kwa moja.

Hitimisho

Jaribio fupi la asili ya vyanzo linaonyesha kuwa injini za utafutaji za AI zinaweza kuonekana kuwa na mamlaka huku zikitaja vyanzo visivyofanya kazi au vya ubora wa chini. Watengenezaji wanaotegemea injini hizi wanapaswa kuchukulia ubora wa marejeo kama sifa inayoweza kupimwa, na si dhamana inayochukuliwa hivyo tu, na kujenga ukaguzi wa kiotomatiki katika mifumo yao. Kuthibitisha kuwa chanzo “kikuu” kinafunguka kweli kunaweza kuwa tofauti kati ya jibu linaloaminika na mtego wa kimya wa habari za uongo.