Analyse de site et ingestion sélective
Découvrez les pages d'un site entier, prévisualisez les titres et les indices de qualité, puis ingérez uniquement ce dont vous avez besoin — sans miroir en direct du site.
Avant de commencer
- Connecté avec un carnet Mind ouvert.
- L'URL racine doit être https (ou http) avec uniquement des liens de même origine.
Étapes
- 1
Mind → Carnet → Sources (Hub) ou Ajouter des sources → Sites web (ordinateur/mobile).
- 2
Saisissez l'URL racine du site (ex. https://docs.example.com) → Analyser le site.
- 3
Le serveur lit robots.txt, sitemap.xml s'ils existent, puis explore en BFS les pages de même origine jusqu'à la limite du plan.
- 4
L'aperçu liste le titre, le type de page et un indice de qualité — activez ou désactivez les pages.
- 5
Ingérer la sélection envoie uniquement les URL choisies ; chacune devient une source web normale (skip_analyze sur le serveur).
- 6
Ajouter un site unique ingère toujours une URL immédiatement sans l'étape d'analyse.
- 7
Les URL en échec apparaissent dans le statut de la source — Reprocessez depuis la ligne de la source.
Erreurs courantes
- L'essai découvre jusqu'à ~25 pages et en ingère ~10 par lot ; Pro permet une découverte et une ingestion plus importantes.
- Préférez l'analyse pour les sites de documentation ; utilisez le collage de liste de sites pour une sélection manuelle d'URL.
- Les citations dans le chat utilisent le texte indexé — nous ne prétendons pas avoir un miroir en direct du site.