Découvrir Scraper Studio by Bright Data
Scraper Studio by Bright Data est un environnement de création de scrapers web hébergé dans le cloud. La description des données à collecter se fait en langage naturel et l’IA de la plateforme produit le code du scraper correspondant. L’outil s’adresse aux équipes techniques qui construisent des pipelines de données web, ainsi qu’aux profils moins aguerris qui ont besoin de données structurées sans passer par un développement sur mesure.
Le service s’utilise depuis un navigateur, sans installation ni serveur à administrer. Bright Data précise qu’aucune compétence en programmation n’est nécessaire pour générer un scraper, mais que des connaissances de base en scraping web restent utiles pour le configurer. La collecte se limite aux données accessibles publiquement.
Une génération de scrapers pilotée par l’IA
La création d’un scraper commence par le choix d’un site, puis par la description en langage courant des données à récupérer. L’IA génère le code correspondant et le scraper apparaît dans l’espace de travail IDE intégré, où il peut être testé, exécuté et modifié. Bright Data annonce un délai de génération de 10 à 15 minutes, avec une notification par email dès que le scraper est prêt.
L’IDE hébergé sert aussi à ajuster le code auto-généré et à déboguer les exécutions grâce à des journaux en direct. Deux modes d’exécution existent, l’un basé sur un worker navigateur, l’autre sur un worker code, selon la complexité du site ciblé et le volume à extraire.
Une infrastructure de collecte gérée par la plateforme
Les scrapers s’exécutent sur l’infrastructure de Bright Data, sans serveur ni pool de proxys à administrer. La rotation des adresses IP, le géociblage, le rendu complet du navigateur, la résolution des CAPTCHA et les nouvelles tentatives automatiques sont pris en charge par la plateforme, avec une mise à l’échelle automatique.
Cette couche d’accès repose sur les réseaux de proxys de l’éditeur et sur son système de déblocage. Une option de service géré existe par ailleurs, dans laquelle les équipes de Bright Data construisent et opèrent la collecte de bout en bout.
Auto-réparation des scrapers en cas de panne et planification
Quand un site modifie sa structure, le scraper qui l’exploite cesse en général de fonctionner. Scraper Studio intègre un moteur d’auto-réparation qui corrige le code défaillant en un clic, à partir de refactorisations pilotées par l’IA. Le schéma de sortie peut également être mis à jour sans intervention manuelle sur le code, pour ajouter ou modifier des champs de données.
Les exécutions, quant à elles, se déclenchent selon un intervalle quotidien, hebdomadaire ou personnalisé, ou bien via l’API. La plateforme prend en charge la collecte par lots, la validation des données et un suivi des taux de succès avec alertes. Les résultats sont disponibles en JSON, NDJSON, CSV ou Excel, et livrés par API, par webhook, vers Amazon S3, Google Cloud, Microsoft Azure ou par SFTP.
Des tarifs indexés sur le volume de pages chargées
Un essai gratuit donne accès à 5 000 chargements de page par mois, sans carte bancaire. Bright Data précise que cet essai autorise la publication de 3 scrapers, limités à 100 enregistrements chacun. Pour aller au-delà, plusieurs abonnements sont disponibles :
- 1,3 € pour 1 000 chargements de page : facturation à l’usage, uniquement en cas de succès, avec des plafonds de dépense mensuels.
- À partir de 431 €/mois : 383 000 chargements de page inclus, puis 1,12 € pour 1 000 chargements supplémentaires, sans engagement de durée. Offre ajustable selon le volume.
- Sur devis : remises au volume, gestionnaire de compte dédié, accord de service premium, support prioritaire et SSO.
Prix
- Version d'essai
- Version payante : À partir de 1.3 € par mois
Disponible sur...
Navigateur web