- Blog
- Alibaba a supprimé les pages. Les plateformes IA ont continué à les citer.
Alibaba a supprimé les pages. Les plateformes IA ont continué à les citer.

Le 27 mars 2026, notre crawler a commencé à télécharger des pages anormalement légères depuis le répertoire /product-insights/ d’Alibaba. Un article y pesait d’ordinaire environ 84 Ko. Les nouvelles réponses tournaient plutôt autour de 3,3 Ko et affichaient une page d’erreur générique « 404-Error », alors même que le serveur renvoyait toujours un HTTP 200. Les articles étaient devenus des soft-404.
Cette première suppression n’a pas clos l’expérience. Un contenu de la taille d’un article est brièvement réapparu du 3 au 8 juin, avant de disparaître de nouveau à partir du 9 juin. Le 22 juillet, les pages échantillonnées étaient redevenues des soft-404, mais les plateformes IA continuaient de les citer.
Du 15 au 21 juillet, Meikai a enregistré 30 315 citations d’URL Alibaba Product Insights, soit une moyenne de 4 331 par jour. Perplexity a généré 85 % de ce volume.
La mise à jour de juillet change la lecture des faits. Le déclin des citations ne suit pas une demi-vie unique et nette. La disponibilité a changé deux fois, et les cinq plateformes de notre panel ont évolué à des rythmes très différents. Google AI Mode a vu son niveau divisé par deux en une semaine après le retrait. ChatGPT a mis treize semaines. Perplexity n’a jamais atteint la moitié.
Le retrait est devenu une expérience en deux épisodes
Meikai exécutait déjà chaque jour les mêmes prompts de monitoring de marque sur ChatGPT, Perplexity, Google AI Mode, Grok et Microsoft Copilot. La première suppression est survenue au milieu de ce panel, créant des observations avant et après la disparition des pages. Notre manière de construire un jeu de mesure représentatif est décrite dans Pourquoi la modélisation des prompts est le socle de la visibilité IA.
| Période | Disponibilité observée |
|---|---|
| Jusqu’au 26 mars | Contenu des articles présent |
| À partir du 27 mars | Premier épisode de soft-404 |
| 9 juin-22 juillet | Second épisode de soft-404, 835 URL normalisées confirmées |
Le retour du contenu en juin compte, car il a pu permettre un nouveau crawl ou une nouvelle récupération. Le recul observé après le 9 juin se comprend donc mieux comme un déclin consécutif à une seconde suppression, et non comme une courbe ininterrompue de 116 jours démarrant en mars.
Près d’un million de lignes de citation
Du 1er mars au 21 juillet, la fenêtre d’observation contient 997 614 lignes de citation pointant vers 93 917 URL Product Insights exactes et distinctes. Ces citations apparaissent dans 469 250 réponses IA et concernent 246 marques suivies.
| Mesure | Total du 1er mars au 21 juillet |
|---|---|
| Lignes de citation | 997 614 |
| URL exactes distinctes | 93 917 |
| Réponses citantes | 469 250 |
| Marques citantes | 246 |
Ces totaux cumulés décrivent l’ensemble du périmètre suivi, qui s’est élargi au fil du temps. Ils ne doivent pas se lire comme une tendance à cohorte constante. Pour une comparaison à périmètre égal, l’analyse s’appuie séparément sur la cohorte initiale de 126 marques.
La persistance est devenue propre à chaque plateforme
La dernière fenêtre complète de sept jours rend la divergence évidente. Perplexity a produit 25 766 citations, contre 3 656 pour ChatGPT et 892 pour Copilot. Google AI Mode n’en a produit aucune, malgré 169 640 réponses mesurées sur le panel actuel. Grok ne disposait pas d’une couverture de réponses comparable : son niveau actuel est donc inconnu, et non nul.

| Plateforme | Citations du 15 au 21 juillet | Part |
|---|---|---|
| Perplexity | 25 766 | 85,0 % |
| ChatGPT | 3 656 | 12,1 % |
| Copilot | 892 | 2,9 % |
| Google AI Overview | 1 | <0,1 % |
| Google AI Mode | 0 | 0,0 % |
| Grok | Non disponible | Pas de couverture actuelle |
Une plateforme est restée au-dessus de son niveau de référence
Les totaux bruts bougent dès que le nombre de prompts suivis ou de réponses des plateformes change. Pour séparer la persistance du volume de réponses, nous avons comparé les citations pour 1 000 réponses sur les 126 marques initiales. La référence porte sur le 20-23 mars et la dernière fenêtre sur le 15-21 juillet.

| Plateforme | Citations pour 1 000 réponses, de la référence au dernier relevé | Rétention |
|---|---|---|
| Perplexity | 139,0 → 152,2 | 109,5 % |
| Copilot | 21,7 → 5,7 | 26,3 % |
| ChatGPT | 166,1 → 20,2 | 12,2 % |
| Grok | 94,5 → 5,6 (15-21 mai) | 5,9 %, dernier relevé connu |
| Google AI Mode | Taux de référence non comparable → 0 | 0,0 % |
Google AI Mode enregistrait 4 671 citations par jour pendant la période de référence de mars, et aucune citation sur la dernière fenêtre. Le dénominateur de réponses de mars ne figure pas dans cet extrait : le tableau ne présente donc pas ce volume quotidien sous forme de taux pour 1 000 réponses. Grok n’a plus de couverture de réponses après le 22 mai, si bien que son dernier chiffre porte sur la semaine du 15 au 21 mai et non sur juillet.
Perplexity fait exception : son taux de citation normalisé par les réponses est resté au-dessus de la référence de mars. ChatGPT et Copilot ont nettement décliné, tandis que Google AI Mode a atteint un zéro observable. Une moyenne composite masquerait ces trois comportements.
Les points extrêmes masquent quatre vitesses différentes
Deux mesures espacées de quatre mois ne permettent pas de distinguer une falaise d’une lente glissade. Les deux produisent le même chiffre de rétention. Nous avons donc recalculé la même métrique pour chaque semaine complète du 2 mars au 19 juillet : citations pour 1 000 réponses, sur les mêmes 126 marques. Puis nous avons posé une seule question à chaque plateforme. Combien de temps lui a-t-il fallu pour tomber sous la moitié de ce qu’elle citait avant la disparition des pages ?

| Plateforme | Taux avant retrait, semaine du 16 mars | Semaines avant de passer sous la moitié | Dernière semaine mesurée |
|---|---|---|---|
| Google AI Mode | 341,8 | 1 | 0,0 (13 juillet) |
| Grok | 80,7 | 5, avant la fin de la couverture | 3,8 (18 mai) |
| ChatGPT | 205,9 | 13 | 21,9 (13 juillet) |
| Copilot | 18,1 | 13 | 5,1 (13 juillet) |
| Perplexity | 113,8 | Jamais | 143,1 (13 juillet) |
La référence est la semaine du 16 mars, la dernière semaine pleine avant le retrait. C’est une fenêtre différente de la référence du 20-23 mars utilisée dans le tableau de rétention ci-dessus. Une plateforme est considérée comme passée sous la moitié à la première semaine observée qui se situe sous cette ligne et y reste.
Google AI Mode n’a pas décliné au sens habituel. Il s’est arrêté. À partir du 28 mars, le lendemain du passage des pages en soft-404, il n’a plus enregistré aucune citation Product Insights jusqu’au 4 avril. Sur ces mêmes journées, il citait encore environ 161 000 autres URL par jour. Ce blackout est un comportement, pas une défaillance de collecte. Les citations ont repris le 5 avril, à environ 45 % du taux d’avant retrait. Elles ont ensuite décru tout au long d’avril et avaient pratiquement disparu au 9 mai.
ChatGPT représente le cas lent. Il s’est maintenu entre 63 % et 83 % de son taux d’avant retrait pendant tout le mois d’avril. Il a effleuré la moitié une première fois à la mi-mai, avant de remonter après le retour du contenu en juin. Il ne s’est installé sous la moitié qu’à partir de la semaine du 22 juin, deux semaines après la seconde suppression. Copilot a d’abord fait le mouvement inverse. Il a culminé à 48,3 citations pour 1 000 réponses la semaine du 25 mai, soit près de trois fois son taux d’avant retrait, avant de s’effondrer selon le même calendrier. Pour ces deux plateformes, c’est la seconde suppression qui a fait le travail que la première n’avait pas fait.
Perplexity n’a jamais franchi la ligne. Sa semaine la plus faible après le retrait représentait encore 85 % du taux d’avant retrait. Elle termine la fenêtre à 126 %.
De nouvelles URL ont continué d’apparaître
Meikai a observé pour la première fois 36 672 URL Product Insights exactes après le 27 mars, en remontant l’historique des citations jusqu’au 1er décembre 2025. Ces URL ont accumulé 261 830 citations postérieures au retrait et représentent 35,9 % de toutes les citations enregistrées après la première suppression.
« Observée pour la première fois » ne veut pas dire « publiée pour la première fois ». Certaines URL existaient peut-être auparavant sans apparaître dans notre flux de citations. Le schéma montre en revanche que les plateformes faisaient plus que répéter un ensemble figé d’URL déjà visibles avant le retrait. Les mécanismes possibles vont de la découverte différée aux index conservés, en passant par des extraits recyclés ou une récupération depuis des copies en aval. La seule télémétrie des citations ne permet pas de dire lequel s’applique.
Ce qu’un décompte de citations laisse de côté
Une ligne de citation enregistre une URL présente dans une réponse IA. Elle ne prouve pas que la plateforme a récupéré la page en direct, que la page contient encore l’information citée, ni que cette information reste à jour.
La disponibilité des pages a donc besoin de son propre statut. Un test de disponibilité basique passerait à côté de la coquille d’erreur d’Alibaba, puisque le serveur renvoie un HTTP 200. Un audit de crawlabilité IA doit inspecter le contenu renvoyé et distinguer pages vivantes, redirections, 404 réelles et soft-404.
La couverture change elle aussi la lecture. Zéro citation sur un large ensemble de réponses mesurées est une preuve. Aucune réponse mesurée, comme pour Grok sur la dernière fenêtre, est un état inconnu. Les deux ne doivent jamais être présentés comme équivalents.
Ce que cela implique pour la mesure GEO
- Séparez la visibilité de la disponibilité. Indiquez si le contenu cité est en ligne, redirigé ou absent.
- Utilisez des courbes de déclin propres à chaque plateforme. Un score composite dissimule l’écart entre Perplexity, ChatGPT, Copilot et Google AI Mode.
- Mesurez la trajectoire, pas deux points extrêmes. Une chute en une semaine et une glissade de treize semaines produisent le même chiffre avant-après.
- Normalisez par le volume de réponses. Suivez les citations pour 1 000 réponses en parallèle des décomptes bruts.
- Traitez chaque épisode de disponibilité comme une remise à zéro. Une fenêtre de republication peut créer une nouvelle occasion de récupération et une nouvelle date de retrait.
- Rendez les trous de couverture explicites. Distinguez un zéro observé d’une couverture de plateforme manquante.
Le volume de citations reste informatif, mais uniquement s’il est étiqueté avec précision. Sans contrôle de la disponibilité, du volume de réponses et de la couverture, un score unique de visibilité IA peut mélanger visibilité actuelle et visibilité résiduelle.
Cela écarte aussi un raccourci tentant du côté payant. Si la seule modification d’une page tierce peut multiplier par huit les citations sur une plateforme et n’avoir aucun effet sur une autre, ce score ne peut pas servir de groupe témoin à une campagne publicitaire diffusée sur les mêmes semaines. Notre guide des meilleures plateformes GEA expose ce qu’il faut mesurer à la place.
Note méthodologique
Cette analyse combine la télémétrie de citations de Meikai, les dénominateurs de réponses par plateforme, des relevés de scraping et des vérifications en direct. Les métriques de citation couvrent la période du 1er mars au 21 juillet 2026. Nous excluons le 22 juillet, journée incomplète. Une ligne de citation représente une URL Alibaba Product Insights exacte citée dans une réponse IA, chaînes de requête et fragments retirés pour l’analyse des URL observées pour la première fois.
Les totaux cumulés et de dernière semaine portent sur toutes les marques suivies, dont 246 ont cité le contenu pendant la fenêtre d’observation. La rétention à périmètre égal s’appuie sur la cohorte initiale de 126 marques, en comparant la référence du 20-23 mars au 15-21 juillet. Les constats de disponibilité reposent sur des relevés de scraping échantillonnés, des signaux de taille d’article et de titre de page, le statut HTTP et des vérifications en direct.
La série hebdomadaire utilise la même cohorte de 126 marques et la même métrique de citations pour 1 000 réponses, agrégée en semaines complètes du lundi, du 2 mars au 19 juillet. La semaine du 16 mars sert de référence avant retrait. Les journées où la collecte globale de citations d’une plateforme était dégradée, c’est-à-dire inférieure à 40 % de sa propre moyenne mobile sur 29 jours tous domaines confondus, sont exclues du numérateur comme du dénominateur. Un trou de collecte ne peut donc pas se lire comme un déclin. Une semaine est publiée dès qu’au moins 20 000 réponses passent ce filtre. Cela suffit à estimer un taux, même pour les semaines comptant moins de sept jours retenus. Grok est la seule série qui s’interrompt tôt. Elle n’a plus de couverture de réponses après le 22 mai. Cette absence est laissée en blanc plutôt que tracée comme un zéro.
Limites : Une citation ne prouve pas qu’un modèle a récupéré une URL en direct. Observée pour la première fois n’équivaut pas à publiée pour la première fois. La couverture de scraping est échantillonnée, et non un recensement exhaustif de chaque URL historique. Le panel suivi s’est élargi : totaux cumulés et rétention à cohorte fixe répondent donc à des questions différentes. L’état actuel de Grok est inconnu, faute de couverture de réponses.
Sources et lectures complémentaires
- Meikai, Alibaba Product Insights LLM Citation Persistence - July 2026 Update (données jusqu’au 21 juillet 2026).
- robots.txt d’Alibaba (consulté le 22 juillet 2026).
- The Great Un-Indexing: Alibaba Product Insights case study.
- Google Search Central: Page indexing report.