Dinoer

Accesibilidad web

Lo que una campaña de investigación realmente encontró como accesible mediante descubrimiento sin autenticación, y lo que se dejó de encontrar, se contabilizó en función del corpus recopilado originalmente, no basándose en suposiciones extraídas del informe.

Un registro detallado de lo que realmente sucede cuando el propio proceso de descubrimiento de Dinoer se ejecuta: qué encuentra, qué omite y con qué fundamentos. Basado en una campaña real, no en estimaciones; publicado para que futuras ejecuciones puedan compararse en lugar de especular, y para que cualquier persona pueda contradecirlo con sus propias mediciones.

2026-08-14 — Campaña de investigación sobre la reputación, descubrimiento de SearXNG frente a una búsqueda poco preparada

Contexto: un sujeto real de investigación de reputación (con su propio consentimiento — sin cuestión de privacidad de terceros), tres objetivos query impulsados por SearXNG, campagne.py, corpus bloqueado por opencode.jsonc. 28 páginas retenidas en el nivel ligero; 0 de 1 escalada al nivel pesado tuvo éxito.

La comparación que importaba: una única consulta, sin preparación previa, realizada a un asistente de búsqueda generalista y autenticado sobre el mismo tema reveló tres páginas: un perfil en una red profesional, una página de proyecto y un crédito de fotografía de archivo, ausentes de las 28 páginas recopiladas, verificados directamente contra collecte.jsonl, no derivados del informe automático.

Causa raíz, identificada y no adivinada: las tres consultas de SearXNG utilizadas estaban dirigidas a directorios de empresas; es decir, se realizó el tipo incorrecto de búsqueda para páginas de ese tipo. Esto representa una brecha entre el descubrimiento y la formulación de la consulta, y no un defecto de clasificación o truncamiento en etapas posteriores.

El segundo hallazgo independiente en el mismo corpus

Dos de las 28 páginas, un perfil para alojar código y un canal de una plataforma de video, fueron descargadas correctamente por la versión básica, pero el texto que se obtuvo solo contenía información del banner de cookies y mensajes de solicitud de inicio de sesión. La versión básica no puede ejecutar su JavaScript, y nunca se activó la escalación a la versión avanzada para ninguna de las páginas: el criterio de escalación se basa en «texto vacío», y ambas páginas técnicamente devolvieron algún texto.

Lo que esto es, precisamente: una brecha arquitectónica distinta de la brecha de descubrimiento mencionada anteriormente; reformular las consultas de SearXNG no habría solucionado el problema, porque ambas páginas ya habían sido encontradas y recuperadas. Ambos hallazgos, y lo que cambiaron con respecto a la propia afirmación del proyecto →

Lo que se verificó, no solo lo que se informó

El paso de síntesis para esta misma campaña fue verificado independientemente antes de que se escribiera cualquiera de las afirmaciones anteriores: una llamada directa al flujo completo de eventos JSON del modelo delegado, y no al helper de resumen que descarta los eventos de uso de herramientas, confirmó exactamente tres eventos para toda la ejecución (step_start, text, step_finish) y cero eventos tool_use. Nada salió del corpus mientras se escribía el informe, en la misma ejecución que mostró que el propio corpus tenía lagunas reales. Dos preguntas separadas, ambas respondidas por medición en lugar de confianza.