Los motores de búsqueda con IA pueden sonar seguros mientras citan fuentes muertas o de baja calidad, según muestra una prueba rápida
Una simple comprobación de procedencia en tres populares herramientas de búsqueda impulsadas por IA reveló que dos de ellas apuntaban a enlaces rotos o respaldaban sus respuestas con sitios de baja credibilidad, a pesar de que las tres mostraban la misma prosa segura y una fila de "chips" de fuentes.
La prueba que despertó la sorpresa
Hice una pregunta factual y reciente: “¿Qué cambió en la Ley de IA de la UE en 2026?”. La respuesta existe en el texto oficial de la enmienda, por lo que o está ahí o no está. Introduje la consulta en tres motores de búsqueda de IA que muestran citas: Perplexity, el modo de IA de Google y Brave Search.
Los tres devolvieron hechos idénticos (mismas fechas, misma descripción), por lo que empataron en cuanto a exactitud pura. La divergencia apareció solo cuando examiné las fuentes citadas.
Cómo juzgué la calidad de las fuentes
Creé un esquema de puntuación de tres niveles que pondera cada cita según el tipo de host:
- Primaria (peso 3) – el sitio que realmente publica la ley (p. ej., el registro oficial de la UE).
- Oficial (peso 2) – la institución que emite o supervisa la ley (dominios gubernamentales, sitios de agencias).
- Contenido generado por el usuario (UGC, peso 0) – plataformas como YouTube o Reddit.
La puntuación general de cada motor es el promedio del peso de las URLs que mostró.
| Motor | Fuentes reportadas | Puntuación |
|---|---|---|
| Perplexity | Dominios gubernamentales oficiales | 2.00 |
| Google AI mode | Firmas de consultoría y un video de YouTube | 1.00 |
| Brave Search | Fuente primaria | 3.00 |
En el papel, Brave parecía perfecto, Perplexity era decente y Google se quedaba atrás.
El fallo oculto: enlaces rotos
El mapa de niveles solo analiza el nombre del dominio; no verifica si la página enlazada realmente carga. Seguí cada URL. La cita "primaria" de Brave devolvió un cuerpo vacío: el enlace estaba roto. El motor afirmaba apuntar a la ley, pero no entregó nada.
Perplexity utilizó dominios gubernamentales oficiales.
Google utilizó consultoras y un video de YouTube.
Surgieron dos problemas distintos:
- Un dominio de alta calidad no garantiza una página accesible.
- Un resumen bien elaborado puede estar respaldado por fuentes de baja credibilidad.
La interfaz de usuario oculta ambos problemas. Las tres herramientas presentan el mismo párrafo seguro y una fila uniforme de chips de fuentes, sin ninguna señal visual de que un chip enlace a una página muerta o que otro apunte a un tutorial de YouTube en lugar del texto legal.
Por qué la procedencia es importante para los desarrolladores
Los desarrolladores pueden convertir la procedencia en una métrica comprobable:
- Puntuar cada respuesta utilizando una ponderación por niveles similar a la anterior.
- Validar la salud de los enlaces automáticamente; marcar respuestas vacías o errores HTTP.
- Activar alertas cuando la puntuación de procedencia de una respuesta caiga por debajo de un umbral configurable.
Este enfoque es más concreto que perseguir "alucinaciones": el modelo puede generar una frase plausible, pero la comprobación de procedencia le indica exactamente qué cita (o la falta de ella) causó el problema, permitiendo una corrección específica.
Conclusión
Una breve prueba de procedencia muestra que los motores de búsqueda con IA pueden parecer autoritarios mientras citan fuentes muertas o de baja calidad. Los desarrolladores que confían en estos motores deben tratar la calidad de las citas como una propiedad medible, no como una garantía asumida, e integrar comprobaciones automáticas en sus pipelines. Verificar que una fuente "primaria" realmente cargue puede ser la diferencia entre una respuesta confiable y una trampa silenciosa de desinformación.
