🗓️ Mis à jour le 4 septembre 2026
L’essentiel
On répète aux dirigeants qu’il faut « laisser entrer les IA ». Nous avons vérifié sur 90 sites d’établissements de la région. Presque tous laissent entrer. Presque aucun n’a quelque chose à donner.
- Relevé info-lux du 4 septembre 2026 sur 90 sites d’établissements de Wallonie et de la Grande Région — restaurants, hôtels, boulangeries, gîtes. Aucun nom n’est publié.
- 4 sites sur 90 bloquent un robot d’intelligence artificielle : la porte est ouverte presque partout.
- En revanche, 41 des 69 sites joignables n’ont aucune fiche d’entreprise lisible par une machine : ni type d’établissement, ni adresse structurée, ni téléphone.
- ⭐ Le chiffre le plus parlant : 11 sites sur 69 publient leurs horaires dans un format exploitable. C’est pourtant la question la plus posée aux assistants.
- 21 sites sur 90 n’ont même pas répondu le jour du relevé.
Qu’avons-nous mesuré exactement, et sur quels sites ?
Nous avons testé 90 sites d’établissements — restaurants, pizzerias, hôtels, gîtes, boulangeries — le 4 septembre 2026.
Deux questions par site : son fichier robots.txt laisse-t-il passer les robots des intelligences artificielles, et sa page d’accueil dit-elle à une machine de quelle entreprise il s’agit ?
L’échantillon n’est pas inventé : ce sont les sites officiels que citent nos propres fiches d’établissements. Les plateformes, les médias, les intercommunales et les sites d’événements ont été retirés.
Aucun nom n’est publié. Ce sont des commerces et des PME de la région, dont certains nous lisent. Nous mesurons un état du terrain, nous ne mettons personne au pilori.
Un relevé vaut pour sa date : un fichier robots.txt se modifie en trente secondes, et une fiche structurée s’ajoute en une heure.
Combien d’entreprises bloquent réellement les robots d’IA ?
Quatre sur quatre-vingt-dix. C’est tout. Sur les 90 sites testés, 4 seulement refusent l’accès à au moins un robot d’intelligence artificielle — GPTBot d’OpenAI, ClaudeBot et Google-Extended dans les mêmes quatre cas.
Mieux : 30 sites n’ont aucun fichier robots.txt. Or, sans ce fichier, tout est autorisé par défaut. Ces entreprises laissent donc entrer les robots d’IA — sans l’avoir décidé, ni même le savoir.
Le débat public tourne pourtant autour du blocage. Nous en avons parlé nous-mêmes à propos du changement de réglages de Cloudflare. Pour un grand éditeur de presse, la question est réelle.
Pour un restaurant de la Gaume ou un garage d’Arlon, elle ne l’est pas. La porte est déjà ouverte. Le problème est ailleurs.

Alors pourquoi les assistants ne parlent-ils pas de ces entreprises ?
Parce qu’elles ne leur disent rien. Sur les 69 sites dont la page d’accueil a répondu, 41 n’exposent aucune fiche d’entreprise lisible par une machine : ni type d’établissement, ni adresse structurée, ni téléphone exploitable.
| Ce que nous avons mesuré | Nombre | Précision |
|---|---|---|
| Sites testés | 90 | |
| Sites dont la page d’accueil a répondu | 69 | 21 sites n’ont pas répondu du tout |
| Sites qui bloquent au moins un robot d’IA | 4 | sur les 90 testés |
| Sites sans fichier robots.txt | 30 | tout est autorisé par défaut |
| Sites avec une fiche d’entreprise lisible par une machine | 28 | sur 69 joignables |
| Sites sans aucune donnée structurée | 26 | sur 69 joignables |
| Sites dont les horaires sont lisibles par une machine | 11 | sur 69 joignables |
Le détail est instructif. 26 sites n’ont strictement aucune donnée structurée. Et 15 autres en ont — mais elle ne décrit que le site lui-même, jamais l’entreprise.
| Information déclarée à la machine | Sites concernés | Ce que ça vaut |
|---|---|---|
| Site web (WebSite) | 34 | dit qu’un site existe — rien sur l’entreprise |
| Organisation (Organization) | 16 | un nom, parfois un logo |
| Restaurant | 9 | type d’établissement reconnu |
| Commerce local (LocalBusiness) | 4 | le balisage le plus utile |
| Hôtel (Hotel) | 1 | |
| Horaires d’ouverture | 11 | la donnée la plus demandée, la plus absente |
Traduit en clair : trente-quatre sites déclarent à la machine « je suis un site web », et seulement quatre déclarent « je suis un commerce, voici mon adresse ». Le premier n’aide personne.
⚠️ Une nuance s’impose : l’absence de balisage ne veut pas dire que l’information est absente du site. Un assistant sait lire du texte. Le balisage rend la reprise plus sûre, il ne la conditionne pas.
Pourquoi les horaires sont-ils le point le plus faible ?
Parce que c’est la donnée la plus demandée et la moins déclarée. 11 sites sur 69 publient leurs horaires d’ouverture dans un format qu’une machine peut lire sans se tromper. Les autres les affichent en image, en PDF, dans un texte libre — ou pas du tout.
Or « est-ce ouvert dimanche ? » est exactement le genre de question qu’un client pose désormais à un assistant plutôt qu’à un moteur de recherche. Une réponse fausse coûte un client ; une absence de réponse en coûte un aussi.
Le risque concret
Quand une information n’est pas disponible clairement, un modèle ne dit pas toujours « je ne sais pas ». Il peut reprendre une donnée périmée trouvée ailleurs — un ancien horaire, un ancien numéro, un ancien gérant.
La jurisprudence commence à s’y intéresser. En février 2024, un tribunal de Colombie-Britannique a condamné Air Canada : son propre robot conversationnel avait donné une information fausse à un client.
La compagnie plaidait que le robot était « une entité distincte », responsable de ses propres actes. L’argument a été rejeté.
⚠️ Cette décision est canadienne, rendue par une juridiction de petites créances, et porte sur un robot installé par l’entreprise elle-même. Elle ne s’applique pas en Belgique et ne dit rien de ce qu’un assistant tiers raconte de vous. Elle vaut comme signal, pas comme règle.
Que faut-il en conclure quand on dirige une entreprise ?
Que le travail utile n’est pas défensif. Fermer la porte aux robots d’IA ne protège rien pour un commerce : cela le rend seulement invisible. Le travail utile consiste à rendre disponible, exacte et structurée l’information que les clients demandent.
Étape 1 — Vérifier que le site répond
Vingt et un sites sur quatre-vingt-dix n’ont pas répondu le jour du relevé. Un site injoignable, même une journée, est un site absent des réponses. C’est le point de départ, avant toute optimisation.
Étape 2 — Écrire les horaires en toutes lettres
Pas dans une image, pas dans un PDF : dans le texte de la page, et dans le balisage. C’est l’action la plus rentable du lot, et la plus rapide.
Étape 3 — Déclarer ce qu’on est
Nom, adresse, téléphone, type d’établissement, zone desservie. Quatre sites sur soixante-neuf le font correctement. Se ranger dans ces quatre-là ne demande pas une refonte.
Étape 4 — Répondre aux questions réelles
Les pages qui reçoivent des visites venues des IA sont celles qui répondent à une question précise. Nous l’avons mesuré sur nos propres données dans notre article sur le trafic venu des assistants.
Ce dernier point est le cœur de notre méthode : un modèle ne peut reprendre qu’une information qui existe, est exacte et est accessible. Le reste est de la décoration.
Comment refaire ce test sur votre propre site ?
En trois minutes, sans outil payant. Le but n’est pas d’obtenir une note, mais de voir ce qu’une machine voit de votre entreprise.
- Ouvrez votre-domaine.be/robots.txt. Si le fichier n’existe pas, tout est autorisé. S’il contient un bloc
User-agent: GPTBotsuivi deDisallow: /, vous êtes fermé à ChatGPT. - Collez l’adresse de votre page d’accueil dans le test des résultats enrichis de Google. Il affiche ce que la machine comprend de votre page.
- Cherchez-y les mots LocalBusiness, Restaurant ou Hotel, et vos horaires. S’ils n’y sont pas, aucun assistant ne peut les reprendre avec certitude.
Un dernier réflexe, plus parlant que tous les outils : posez à ChatGPT la question qu’un client poserait — « un bon restaurant italien à Arlon » — et regardez qui sort. Pas votre nom : la question du client.
C’est la méthode que nous utilisons pour documenter les citations de nos clients dans les IA, et elle est reproductible devant n’importe qui.
À lire aussi sur info-lux
- Les IA vous envoient-elles vraiment des clients ? — nos propres chiffres de trafic, canal par canal
- Bloquer les robots des IA : ce qui change — le débat vu du côté des éditeurs, où il a un sens
- Comment faire apparaître son entreprise dans les IA — la marche à suivre, étape par étape
- Quand le site devient un outil pour les agents — l’étape suivante : être lisible ne suffira plus
Questions fréquentes
Combien de sites d’entreprises bloquent les robots d’intelligence artificielle ?
Quatre sur quatre-vingt-dix dans notre relevé du 4 septembre 2026. Trente sites n’ont même aucun fichier robots.txt, ce qui autorise tout par défaut. Le blocage n’est donc pas le problème principal des entreprises locales.
Qu’est-ce qu’une fiche d’entreprise lisible par une machine ?
C’est un balisage, invisible pour le visiteur, qui déclare le type d’établissement, l’adresse, le téléphone et les horaires dans un format normalisé. Vingt-huit des soixante-neuf sites joignables en possèdent une.
Combien de sites publient leurs horaires dans un format exploitable ?
Onze sur soixante-neuf. C’est le point le plus faible du relevé, alors que la question « est-ce ouvert ? » est parmi les plus posées aux assistants conversationnels.
Sans balisage, une IA peut-elle quand même trouver mes horaires ?
Oui, si l’information figure en toutes lettres dans le texte de la page. Un assistant sait lire du texte. Le balisage ne conditionne pas la reprise : il la rend plus sûre et réduit le risque qu’une donnée périmée soit reprise à la place.
Une entreprise est-elle responsable de ce qu’une IA dit d’elle ?
La question n’est pas tranchée en Belgique. En février 2024, un tribunal de Colombie-Britannique a condamné Air Canada pour une information fausse donnée par son propre robot conversationnel.
Cette décision est canadienne et porte sur un robot installé par l’entreprise elle-même, pas sur un assistant tiers. Elle vaut comme signal, pas comme règle applicable ici.
Comment vérifier soi-même ce qu’une machine comprend de son site ?
Ouvrez votre-domaine.be/robots.txt pour voir si un robot est bloqué, puis passez votre page d’accueil dans le test des résultats enrichis de Google et cherchez-y les mentions LocalBusiness, Restaurant ou Hotel ainsi que vos horaires.
Vincent Gallez — expert en visibilité dans les intelligences artificielles
Fondateur du groupe de médias info-lux, il accompagne entreprises, PME et indépendants de Wallonie, du Grand-Duché et de la frontière française pour qu’ils soient trouvés — et cités — par les assistants d’IA comme ChatGPT, Gemini, Perplexity ou Copilot.
Le principe est simple : un modèle ne peut reprendre qu’une information qui existe, est exacte et est accessible.
Le travail consiste donc à publier, sur des médias que ces systèmes consultent, une information vérifiée, datée et structurée qui répond réellement aux questions posées — plutôt que de laisser un moteur répondre à partir de sources approximatives ou périmées. Comment nous procédons.
Les limites que la rédaction s’impose — et ce qu’elle refuse de faire — sont détaillées dans notre charte éditoriale et IA.
Nos sources
Les chiffres cités dans cet article proviennent de sources publiques identifiées, consultées en août 2026 :
- Relevé info-lux.com du 4 septembre 2026 — 90 sites d’établissements (données brutes conservées)
- Google — Test des résultats enrichis
- Schema.org — type LocalBusiness
- Moffatt v. Air Canada, 2024 BCCRT 149 — analyse de l’American Bar Association
Transparence — cet article a été produit avec l’assistance de l’intelligence artificielle pour la recherche et le croisement des sources, la structuration et la mise en page. Les données chiffrées proviennent des sources publiques citées ci-dessus et sont vérifiables.
La sélection du sujet, la vérification des faits et la responsabilité éditoriale sont assurées par la rédaction d’info-lux.com. Voir notre charte éditoriale et IA.
- Nous avons testé 90 sites d’entreprises face aux IA : le problème n’est pas celui qu’on croit

- Les IA vous envoient-elles vraiment des clients ? Nous avons ouvert nos propres chiffres

- Faire payer les IA qui utilisent votre contenu : ce que permet le standard RSL

- Votre site devra bientôt savoir répondre aux agents, pas seulement à vos lecteurs

- Aperçu IA et Mode IA de Google ne citent pas les mêmes sites : 13,7 % de sources communes

- Google montre enfin si les IA citent votre site — et voici ce qu’il ne dit pas

Quiz visibilité web
Évaluez en 3 minutes votre niveau de référencement (SEO, GEO, AEO) et recevez un diagnostic personnalisé pour développer la visibilité de votre entreprise.