{
  "format": "scrubnet-page",
  "version": 1,
  "language": "fr-FR",
  "title": "Flux publics pour robots d’exploration | Observatoire Scrubnet",
  "description": "Explorez les flux publics lisibles par machine de l’Observatoire Scrubnet et observez la découverte, la réexploration et la répartition par format des requêtes vérifiées des robots de recherche et d’IA.",
  "source": "https://scrubnet.org/fr/flux-publics.html",
  "representations": {
    "html": "https://scrubnet.org/fr/flux-publics.html",
    "markdown": "https://scrubnet.org/fr/flux-publics.md",
    "text": "https://scrubnet.org/fr/flux-publics.txt",
    "json": "https://scrubnet.org/fr/flux-publics.json"
  },
  "languageAlternates": {
    "en-GB": "https://scrubnet.org/llms.html",
    "fr-FR": "https://scrubnet.org/fr/flux-publics.html"
  },
  "content": [
    {
      "type": "section",
      "label": "Flux publics de Scrubnet pour les robots d’exploration",
      "content": [
        {
          "type": "heading",
          "level": 1,
          "content": [
            {
              "type": "text",
              "text": "Flux publics pour robots d’exploration"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Une surface de données publique au sein de l’Observatoire des robots d’exploration de Scrubnet"
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Pourquoi l’Observatoire publie ces flux"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Scrubnet publie des flux HTML, JSON, TXT et Markdown issus de sources autorisées afin que le comportement des robots d’exploration puisse être observé sur une surface publique cohérente. Des structures stables, des liens vers les sources et des horodatages facilitent la description de la découverte, de la réexploration et de la répartition des requêtes entre les robots de recherche, d’IA et d’archivage."
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Ces flux font partie de l’Observatoire des robots d’exploration de Scrubnet : une capacité de recherche spécialisée intégrée à un ensemble plus vaste d’outils et de connaissances destiné aux spécialistes du SEO technique et aux développeurs web."
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Les questions que nous observons"
            }
          ]
        },
        {
          "type": "list",
          "ordered": false,
          "items": [
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "text",
                      "text": "Quels robots découvrent les flux sans soumission directe ?"
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "text",
                      "text": "Dans quel délai les robots reviennent-ils après la modification d’un flux ou d’une page source ?"
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "text",
                      "text": "Comment les requêtes vérifiées se répartissent-elles entre HTML, JSON, TXT et Markdown ?"
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "text",
                      "text": "En quoi les requêtes de robots vérifiées diffèrent-elles des requêtes non vérifiées ?"
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "text",
                      "text": "Comment les schémas de récupération observables peuvent-ils éclairer les analyses de SEO technique et de GEO ?"
                    }
                  ]
                }
              ]
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Explorer les données"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Commencez par "
            },
            {
              "type": "code",
              "text": "/feed/sitemap.xml"
            },
            {
              "type": "text",
              "text": " pour découvrir les flux actifs et leurs valeurs "
            },
            {
              "type": "code",
              "text": "<lastmod>"
            },
            {
              "type": "text",
              "text": ". Utilisez ensuite le "
            },
            {
              "type": "link",
              "url": "https://scrubnet.org/dashboard.php",
              "content": [
                {
                  "type": "text",
                  "text": "tableau de bord des journaux en direct"
                }
              ]
            },
            {
              "type": "text",
              "text": " pour filtrer les requêtes par chemin, robot, état de vérification et date, ou pour les comparer par robot et par format."
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "link",
              "url": "https://scrubnet.org/feed/sitemap.xml",
              "content": [
                {
                  "type": "text",
                  "text": "Ouvrir l’index des flux"
                }
              ]
            },
            {
              "type": "text",
              "text": " "
            },
            {
              "type": "link",
              "url": "https://scrubnet.org/dashboard.php",
              "content": [
                {
                  "type": "text",
                  "text": "Voir les journaux en direct"
                }
              ]
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Accès technique"
            }
          ]
        },
        {
          "type": "list",
          "ordered": false,
          "items": [
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "strong",
                      "content": [
                        {
                          "type": "text",
                          "text": "Découverte :"
                        }
                      ]
                    },
                    {
                      "type": "text",
                      "text": " récupérez "
                    },
                    {
                      "type": "code",
                      "text": "https://scrubnet.org/feed/sitemap.xml"
                    },
                    {
                      "type": "text",
                      "text": "."
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "strong",
                      "content": [
                        {
                          "type": "text",
                          "text": "Fraîcheur :"
                        }
                      ]
                    },
                    {
                      "type": "text",
                      "text": " comparez les valeurs "
                    },
                    {
                      "type": "code",
                      "text": "<lastmod>"
                    },
                    {
                      "type": "text",
                      "text": " et ne récupérez de nouveau que les flux modifiés."
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "strong",
                      "content": [
                        {
                          "type": "text",
                          "text": "Requêtes conditionnelles :"
                        }
                      ]
                    },
                    {
                      "type": "text",
                      "text": " envoyez "
                    },
                    {
                      "type": "code",
                      "text": "If-Modified-Since"
                    },
                    {
                      "type": "text",
                      "text": " ou "
                    },
                    {
                      "type": "code",
                      "text": "If-None-Match"
                    },
                    {
                      "type": "text",
                      "text": " lorsque ces en-têtes sont pris en charge."
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "strong",
                      "content": [
                        {
                          "type": "text",
                          "text": "Formats :"
                        }
                      ]
                    },
                    {
                      "type": "text",
                      "text": " utilisez la représentation HTML, JSON, TXT ou Markdown liée dont votre analyse a besoin."
                    }
                  ]
                }
              ]
            },
            {
              "content": [
                {
                  "type": "paragraph",
                  "content": [
                    {
                      "type": "strong",
                      "content": [
                        {
                          "type": "text",
                          "text": "Provenance :"
                        }
                      ]
                    },
                    {
                      "type": "text",
                      "text": " conservez l’URL source et les horodatages lorsque vous analysez ou citez des enregistrements."
                    }
                  ]
                }
              ]
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Limites méthodologiques"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Les journaux d’accès confirment qu’une requête a atteint un flux Scrubnet. Ils ne prouvent pas que le contenu a été indexé, classé, utilisé pour entraîner un modèle, récupéré dans une réponse ou cité à un utilisateur. Les résultats sont des observations descriptives issues de l’environnement de Scrubnet et ne permettent pas d’établir pourquoi un robot s’est comporté d’une certaine manière."
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "ScrubberDuck"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "strong",
              "content": [
                {
                  "type": "text",
                  "text": "ScrubberDuck/1.0"
                }
              ]
            },
            {
              "type": "text",
              "text": " est le compilateur de flux à faible cadence, respectueux des règles destinées aux robots, qui crée et actualise les flux autorisés des sites participants. Il fournit la surface d’observation ; ce n’est ni un moteur de recherche ni un robot de classement."
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "image",
              "url": "https://scrubnet.org/scrubberduck-200.webp",
              "alt": "ScrubberDuck, le robot de recherche de Scrubnet"
            }
          ]
        }
      ]
    },
    {
      "type": "section",
      "content": [
        {
          "type": "heading",
          "level": 2,
          "content": [
            {
              "type": "text",
              "text": "Équipes de recherche et d’exploration"
            }
          ]
        },
        {
          "type": "paragraph",
          "content": [
            {
              "type": "text",
              "text": "Pour proposer un site, suggérer une question d’observation ou discuter de l’accès aux données complémentaires, écrivez à "
            },
            {
              "type": "link",
              "url": "mailto:contact@scrubnet.org",
              "content": [
                {
                  "type": "text",
                  "text": "contact@scrubnet.org"
                }
              ]
            },
            {
              "type": "text",
              "text": "."
            }
          ]
        }
      ]
    }
  ],
  "structuredData": [
    {
      "@context": "https://schema.org",
      "@type": "BreadcrumbList",
      "@id": "https://scrubnet.org/fr/flux-publics.html#breadcrumbs",
      "inLanguage": "fr-FR",
      "itemListElement": [
        {
          "@type": "ListItem",
          "position": 1,
          "name": "Accueil",
          "item": "https://scrubnet.org/fr/"
        },
        {
          "@type": "ListItem",
          "position": 2,
          "name": "Observatoire",
          "item": "https://scrubnet.org/fr/observatoire.html"
        },
        {
          "@type": "ListItem",
          "position": 3,
          "name": "Flux publics pour robots d’exploration",
          "item": "https://scrubnet.org/fr/flux-publics.html"
        }
      ]
    }
  ]
}
