Accessibilité web
Ce qu'une véritable campagne de recherche a réellement permis de découvrir par le biais d'une exploration non authentifiée, et ce qu'elle a manqué — cela doit être pris en compte par rapport au corpus brut collecté, et non pas basé sur des suppositions tirées du rapport.
Un enregistrement précis de ce qui se passe réellement lorsque l’étape de découverte propre à Dinoer est exécutée : ce qu’elle trouve, ce qu’elle manque, et sur quelles bases. Les données proviennent d’une campagne réelle, et non d’estimations — elles sont publiées afin qu’une future exécution puisse les comparer plutôt que de deviner, et afin que chacun puisse les contredire avec ses propres mesures.
2026-08-14 — Campagne de recherche sur la réputation, découverte de SearXNG par rapport à une recherche mal préparée
Contexte : un vrai sujet de recherche de réputation (consentant lui-même — aucune question de vie privée d’un tiers), trois cibles query pilotées par SearXNG, campagne.py, corpus verrouillé par opencode.jsonc. 28 pages retenues au palier léger ; 0 escalade sur 1 vers le palier lourd a réussi.
La comparaison qui comptait : une seule requête, non préparée, adressée à un assistant de recherche généraliste et authentifié sur le même sujet a permis d’afficher trois pages : un profil de réseau professionnel, une page de projet, une mention de crédit pour une photo d’illustration — absentes de toutes les 28 pages collectées, vérifiées directement par rapport à collecte.jsonl, et non déduites du rapport automatique.
Cause profonde, identifiée plutôt qu’estimée : les trois requêtes SearXNG utilisées visaient des annuaires d’entreprises — le mauvais type de recherche pour ce type de pages, un écart entre la découverte et la formulation, et non un défaut de classement ou de troncature en aval.
La deuxième découverte indépendante dans le même corpus
Deux des 28 pages — un profil d’hébergement de code et une chaîne de plateforme vidéo — ont été récupérées avec succès par la version “light”, mais le texte collecté ne contenait que du contenu lié aux bannières de cookies et aux murs de connexion. La version “light” ne peut pas exécuter leur JavaScript, et l’escalade vers la version “heavy” n’a jamais été déclenchée pour aucune des deux pages : la logique d’escalade est basée sur le critère de « texte vide », et les deux pages ont techniquement renvoyé du texte.
Ce que c’est, précisément : une lacune d’architecture distincte de la lacune de découverte ci-dessus — reformuler les requêtes SearXNG ne l’aurait pas corrigée, puisque les deux pages avaient déjà été trouvées et récupérées. Les deux constats, et ce qu’ils ont changé à l’affirmation du projet sur lui-même →
Ce qui a été vérifié, et non simplement rapporté
La phase de synthèse pour cette même campagne a été vérifiée indépendamment avant que l’une ou l’autre des affirmations ci-dessus ne soit consignée : un appel direct au flux JSON complet de l’événement du modèle délégué — et non à la fonction d’aide qui résume les informations et qui élimine les événements liés à l’utilisation d’outils — a confirmé exactement trois événements pour toute la séquence (step_start, text, step_finish) et zéro événement de type tool_use. Rien n’a été supprimé du corpus pendant que le rapport était rédigé, lors de la même exécution qui a montré que le corpus lui-même comportait des lacunes. Deux questions distinctes, toutes deux répondues par mesure plutôt que par confiance.