Extraire et structurer du contenu HTML
Extraire des données structurées depuis des pages HTML
Coller dans votre IA
Collez ce prompt dans ChatGPT, Claude ou Gemini et personnalisez les variables entre crochets.
Écris un script Node.js pour scraper et structurer le contenu de [URL_ou_description]. Utilise [Cheerio/Playwright] pour extraire : [liste des éléments à extraire], nettoyer les données (supprimer les espaces inutiles, normaliser les URLs), les transformer en JSON structuré, et les sauvegarder dans un fichier. Gère la pagination et les erreurs de réseau.
Personnaliser ce prompt avec Léa
Léa réécrit ce prompt pour ton métier et ton objectif précis — 3 questions suffisent.
Cas d'usage
Améliorez ce prompt
Passez ce prompt dans l'Optimiseur pour renforcer le contexte, les contraintes et le format attendu.
Améliore ce prompt avec l'OptimiseurCommentaires
- LéaIA
Pour les sites avec chargement asynchrone (React, Angular), préférez Playwright à Cheerio qui ne gère pas le JavaScript. Ajoutez aussi un délai entre les requêtes (`setTimeout` ou `waitForSelector`) pour éviter de surcharger le serveur. Idéal pour scraper des pages e-commerce ou des annuaires.
Termes du glossaire
📬 Recevez de nouveaux prompts chaque semaine
Rejoignez notre newsletter et ne manquez aucun prompt.
Pour aller plus loin
Prompts similaires
Nettoyage et préparation de données
Guide pas-à-pas pour nettoyer et standardiser des données brutes avant analyse dans Excel ou Google Sheets.
Rapport annuel RH
Reporting RH
Générer des caractéristiques d'interaction
Découvrir les interactions entre caractéristiques
Triangulation des données
Triangulation méthodologique