Le Web perd sa mémoire et la recherche IA l'accélère
Un essai dans The Walrus montre comment les résumés de l’IA, la pourriture des liens et la pression juridique sur les Internet Archive réduisent discrètement les documents que nous pouvons encore rechercher.
Cela a commencé avec les couchers de soleil. Les gens ont remarqué que les résumés de l’IA de Google avaient commencé à inventer les heures de coucher du soleil, en disant à un homme de Colorado Springs que le soleil s’était déjà couché alors qu’il l’attendait dehors. Une petite erreur amusante. Dans un essai pour The Walrus publié cette semaine, Vass Bednar l’utilise comme porte d’entrée vers une question beaucoup moins drôle : et si la raison pour laquelle les choses sont plus difficiles à trouver en ligne n’était pas que nous avons moins bien fait dans la recherche, mais que la chose que nous cherchons est en train de s’effondrer tranquillement ?
Ses exemples s’empilent rapidement. FiveThirtyEight, le site de journalisme de données, a été fermé par Disney et l’intégralité de ses archives a simplement été supprimée. Certaines parties de la Constitution des États-Unis ont brièvement disparu du site de la Bibliothèque du Congrès en raison d’une erreur de codage. La pourriture des liens supprime des pages chaque jour sans que personne ne s’en aperçoive. Et 404 Media a signalé que des entreprises inséraient du contenu sur Reddit spécifiquement pour orienter ce que disent les outils de recherche d’IA, ce qui pollue les archives que ces outils résument ensuite.
Deux institutions porteuses sont particulièrement mises à rude épreuve. Le trafic de Wikipédia diminue parce que les systèmes d’IA ingèrent son contenu et répondent directement, de sorte que les lecteurs n’arrivent jamais et que l’attention et les dons ne reviennent plus. Internet Archive, dont Wayback Machine contient des centaines de milliards d’instantanés du Web, est confronté à des cyberattaques, à des litiges coûteux et à un nouveau problème : après que des éditeurs l’ont poursuivi en justice pour prêt numérique, les agences de presse ont commencé à bloquer ses robots d’exploration, craignant que les copies archivées ne donnent aux sociétés d’IA une voie indirecte vers du matériel protégé par le droit d’auteur. Chaque bloc réduit la sauvegarde.
Qu’est-ce qu’il y a derrière
Le point le plus net de l’essai est la comparaison. Les livres interdits ont des méchants, des réunions de conseils scolaires et des gros titres. L’effacement numérique n’a rien de tout cela. Un livre interdit peut encore être trouvé quelque part. Une page supprimée peut disparaître si complètement que personne ne se rend compte qu’elle a jamais été là.
La proposition de Bednar est que la recherche devrait être traitée comme une infrastructure publique plutôt que comme un service gratuit pour les consommateurs, et elle souligne que les gouvernements européens ont déjà pris cette voie : le Parlement français et le ministère des Forces armées sont passés au moteur de recherche Qwant, et les fonctionnaires utilisent désormais une application de messagerie locale au lieu de WhatsApp. Elle cite également la décision d’un tribunal allemand qui a tenu Google pour responsable des fausses déclarations produites par son aperçu de l’IA, au motif que la réécriture des informations dans vos propres mots fait de vous un auteur et non un canal neutre. Google fait appel.
Ce que cela signifie pour vous: En pratique, deux habitudes valent la peine d’être adoptées. Si une page est importante pour vous, enregistrez-la vous-même plutôt que de croire qu’elle sera là, et envisagez de l’archiver sur Wayback Machine, qui prend un seul clic. Lorsqu’un résumé de l’IA vous donne un fait sur lequel vous envisagez d’agir, ouvrez la source. Le point le plus large est plus lent et mérite d’être étudié : la mémoire d’Internet est entretenue par une poignée d’organisations sous-financées, et elle n’est pas garantie.
Sources
Si vous utilisez Manus, vous disposez de onze jours pour sauvegarder vos données
Manus se sépare de Meta et revient à l'indépendance. Certains comptes verront toutes les données créées depuis le 29 décembre 2025 supprimées le 23 août, avec une fenêtre de sauvegarde ouverte maintenant.