El incidente describe una degradación continua del servicio en git.kernel.org debido a una sobrecarga persistente generada por crawlers de modelos de lenguaje grandes (LLM). La causa raíz es el consumo ineficiente y masivo de recursos por parte de estos crawlers, que optan por renderizar commits como HTML y parsearlos, en lugar de clonar los repositorios de manera eficiente. Esta elección genera miles de millones de URLs válidas y un tráfico de solicitudes extremadamente alto, con un 98% del tráfico total atribuido a scrapers.

Las salvaguardas iniciales, como el bloqueo por User-Agent e IP, fallaron debido a la sofisticación de los bots, que comenzaron a emular navegadores legítimos y a distribuir sus solicitudes a través de millones de IPs residenciales y móviles (proxy SDK monetization). La implementación de un sistema Proof-of-Work (Anubis) fue inicialmente efectiva, pero los bots evolucionaron para resolver los desafíos de dificultad creciente, lo que llevó a un ciclo de escalada de dificultad que impactó negativamente la experiencia de usuario legítima.

La cascada de fallos se manifiesta en una constante 'radiación de fondo' de carga del sistema, consumiendo hasta el 20% de la capacidad total de CPU (14-16 de 90 cores) en los nodos geo-distribuidos. Aunque el sistema no ha colapsado completamente por los crawlers (sino por CI mal diseñados), esta carga sostenida representa un costo operativo significativo y una reducción de la capacidad disponible para usuarios legítimos. La falta de una solución simple y la naturaleza económica de la monetización de proxy SDK complican aún más la mitigación.