![]()
Sommaire
- En bref
- Un code déjà offert en un clic, aspiré page par page
- Le tri à la volée : deux tiers rejetés, un tiers qui passe
- La course aux armements, palier par palier
- Le téléviseur du voisin recrute pour l'aspiration
- Ce que le péage coûte au visiteur légitime
- Pourquoi la donnée pré-IA vaut de l'or
- Questions courantes
Décryptage
Quatorze cœurs de calcul sur les serveurs du noyau Linux tournent en permanence pour une seule tâche : nourrir des robots d’intelligence artificielle. Konstantin Ryabitsev, qui administre cette infrastructure, a publié ce bilan le 29 août 2026 : sur cinq serveurs répartis dans le monde, les robots préfèrent aspirer le code page par page plutôt que de le télécharger en un clic, et cette préférence coûte cher.
En bref
- Six millions de requêtes visent chaque jour git.kernel.org, la plateforme qui distribue le code du noyau Linux.
- 66 % sont rejetées d’entrée par le pare-feu Anubis, 33 % résolvent son défi de calcul.
- Le trafic réellement humain ne pèserait qu’environ 2 % du total, selon l’estimation de l’administrateur.
- Le défi Anubis, contourné, est passé de la difficulté 4 à la difficulté 5 en quelques mois.
- Les robots recrutent désormais des box et des téléviseurs connectés pour se fondre dans le trafic résidentiel.
Un code déjà offert en un clic, aspiré page par page
Le code du noyau Linux n’a rien de secret. N’importe qui peut le récupérer d’une seule commande git clone, ou télécharger une archive complète en un clic. C’est précisément le paradoxe que décrit Konstantin Ryabitsev : la méthode la plus coûteuse existe, et c’est elle que choisissent les robots.

Plutôt qu’un seul téléchargement, chaque robot génère une requête par commit, affiché sous forme de page HTML. L’historique de linux.git compte environ 1,48 million de commits, multipliés par 922 forks hébergés sur la même plateforme. Rapporté à cet historique, les six millions de requêtes quotidiennes représentent environ quatre requêtes par commit chaque jour, alors qu’un seul clone suffirait à tout récupérer.
Le tri à la volée : deux tiers rejetés, un tiers qui passe
Face à ce déluge, git.kernel.org fait tourner Anubis, un système qui impose un calcul de preuve de travail avant de laisser passer une requête. Le principe : ralentir un navigateur automatisé le temps qu’il résout un petit problème mathématique, sans gêner un humain qui clique une seule fois.
Concrètement, le principe emprunte au minage de cryptomonnaies : le navigateur doit trouver, par tâtonnements, une valeur qui satisfait une contrainte de calcul, une opération triviale pour un seul ordinateur mais ruineuse répétée à l’échelle de millions de requêtes automatisées. Un humain qui clique une fois ne le remarque pas. Un robot qui doit recommencer l’opération des milliers de fois par minute, si.

Reprendre ce graphique ou citer ce chiffre
Citez ce chiffre en mentionnant Actu Alt Plus :
Ou réutilisez ce graphique librement sur votre site, attribution incluse :
Le tri donne une répartition nette. Sur les six millions de requêtes quotidiennes, 66 % sont rejetées d’entrée, 33 % résolvent le défi et poursuivent leur route, souvent en boucle sur d’autres commits. Selon nos calculs, cela représente 120 000 requêtes humaines par jour sur les 6 millions que reçoit chaque jour git.kernel.org, la plateforme du noyau Linux, soit 2 % du total, un bilan publié par l’administrateur infrastructure le 29 août 2026.
| Indicateur | Valeur |
|---|---|
| Requêtes quotidiennes reçues | 6 000 000 |
| Rejetées d’entrée par Anubis | 66 % |
| Résolvent le défi de calcul | 33 % |
| Trafic estimé réellement légitime | 2 % (environ 120 000/jour) |
| Cœurs mobilisés en permanence pour les robots | 14 à 16 sur 90 (environ 20 %) |
| Commits dans l’historique de linux.git | environ 1,48 million |
| Forks de linux.git sur la plateforme | environ 922 |
La course aux armements, palier par palier
Le premier réflexe a été de bannir des adresses IP, puis des sous-réseaux entiers. Sans effet durable : les robots changent d’adresse plus vite qu’on ne les bloque. Anubis, un utilitaire conçu, selon son propre dépôt, pour protéger le petit internet de la tempête sans fin de requêtes venues des entreprises d’IA, a d’abord tenu à la difficulté 4. Puis les robots ont appris à résoudre le calcul, et l’équipe est passée à la difficulté 5.
Ce relèvement se paie aussi côté visiteur légitime : à difficulté 5, des lecteurs signalent un téléphone qui chauffe le temps de résoudre le défi, avant même d’accéder à la page demandée. Le dépôt du projet revendique aujourd’hui 21 200 étoiles sur GitHub : ce n’est plus un bricolage isolé, c’est devenu l’un des remparts standards du web indépendant.
Le téléviseur du voisin recrute pour l’aspiration
La parade la plus difficile à contrer n’est pas technique, elle est humaine. Les robots identifiables par leur user-agent ont laissé place à de faux navigateurs ordinaires, puis à des connexions dispersées sur des millions d’adresses IP résidentielles ou mobiles. Konstantin Ryabitsev décrit une monétisation de proxy SDK : des kits logiciels intégrés à des applications gratuites transforment l’appareil qui les héberge, box internet ou téléviseur connecté, en relais d’aspiration à l’insu de son propriétaire.

Bloquer une IP résidentielle revient alors à bloquer un foyer entier, peut-être le vôtre un autre jour. C’est ce déplacement qui rend la chasse à l’adresse inefficace : le robot n’a plus de visage fixe.
Ce que le péage coûte au visiteur légitime
Le constat de Konstantin Ryabitsev est net : « nous consacrons plus de cycles de calcul à afficher des commits pour les robots qu’à tout le reste des accès légitimes réunis, y compris les clonages Git ». La tâche censée rester secondaire est devenue la plus coûteuse de toutes.
Un défi de preuve de travail n’est jamais gratuit pour personne. Il ralentit chaque visite d’une poignée de secondes et consomme un peu de batterie, même pour un développeur qui cherche simplement un correctif. Vingt pour cent de la capacité totale de calcul de l’infrastructure, en continu, c’est aussi vingt pour cent de moins pour servir les vrais clones, les vraies recherches, les vrais contributeurs.
Pourquoi la donnée pré-IA vaut de l’or
Le code source du noyau Linux a une valeur particulière pour l’entraînement des modèles : il a été écrit par des humains, commenté par des humains, avant que le web ne se remplisse de texte généré par IA. Cette rareté grandissante pousse les entreprises d’entraînement à aspirer chaque version, chaque commit, chaque fork, plutôt qu’à se contenter d’un seul clone à jour. Le même mouvement touche l’ensemble du logiciel libre : 98 % des logiciels commerciaux embarquent du code open source, un socle que ses mainteneurs entretiennent souvent bénévolement, et qui absorbe désormais une facture d’infrastructure qu’ils n’ont pas demandée.
Série AAP
Nous suivions déjà ce signal le 18 juillet 2026, avec un serveur-appât filmé en direct : le flux d’attaques automatisées ne s’arrêtait jamais, sans qu’aucun chiffre ne le mesure encore. Sur git.kernel.org, ce bruit de fond a désormais un chiffre précis : 6 millions de requêtes par jour, dont 20 % de la capacité de calcul mobilisée en continu.
Questions courantes
Pourquoi le code du noyau Linux, déjà public, attire-t-il autant de robots ?
Parce qu’il est intégralement téléchargeable en une commande, mais que les robots préfèrent aspirer chaque commit affiché en page HTML, ce qui multiplie les requêtes grâce aux 1,48 million de commits et 922 forks disponibles.
Qu’est-ce qu’Anubis, le système qui filtre ces robots ?
Un utilitaire qui impose un petit calcul de preuve de travail avant de laisser passer une requête, assez lourd pour ralentir un robot, assez léger pour rester invisible à un humain qui clique une seule fois.
Comment les robots contournent-ils ce filtre ?
En passant par des adresses IP résidentielles ou mobiles, parfois via des kits logiciels intégrés à des applications qui transforment box et téléviseurs connectés en relais, à l’insu de leurs propriétaires.
La difficulté du défi Anubis a déjà été relevée deux fois depuis son adoption sur git.kernel.org. Rien n’indique qu’elle restera à ce niveau : c’est ce prochain palier, pas une victoire définitive, qu’il faudra surveiller.
Votre réaction :
Article créé en collaboration avec l’IA.
Les plus lus
- 1
Taratata 600 : la date d’enregistrement et celle de diffusion - 2
Mondiaux de cyclisme : le maillot arc-en-ciel rapporte 8 000 euros, moins qu’une étape du Tour - 3
Prix du roman Fnac 2026 : « C’était ça ou mourir » lauréat - 4
Résultats des évaluations nationales 2026, dès le 21 septembre - 5
Résultat du Super Loto du 18 septembre : 13 millions gagnés
Nos dossiers
- France395
- Science272
- Culture193
- Consommation173
- Patrimoine165
- Santé publique164
- IA162
- Sport159
Recevez notre sélection dans votre boîte mail
Le meilleur d’Actu Alt Plus : décryptages, chiffres et panoramas. Désinscription en 1 clic, zéro spam.

