Browse AI
Valeur ajoutée gratuite
Agent intelligent IA AI Agent

Browse AI

Outil automatisé pour récupérer les données de page sans code et surveiller les changements de page

Étiquettes :

Qu’est-ce que Browse AI ?

Browse AI est une plateforme sans code pour le scraping de données web et la surveillance de sites. Après avoir installé le enregistreur de navigateur, l’utilisateur effectue sur la page cible des actions telles que des clics, des saisies, des défilements et des sélection de champs ; la plateforme entraîne ensuite ces opérations pour créer un robot pouvant être exécuté de manière répétée, et génère en cloud des tableaux structurés ou des captures d’écran.

Il convient pour transformer des sites web ne disposant pas d’une API publique en sources de données mises à jour en continu, telles que les prix des produits, les stocks, les listes immobilières, les offres d’emploi, les annuaires d’entreprises, les résultats de recherche et les pages de concurrents. En plus du crawl ponctuel, il permet également de surveiller périodiquement les changements dans les champs, de connecter plusieurs robots pour effectuer des crawls approfondis, et d’intégrer ces données dans les systèmes métier via API, Webhook et tableaux.

Enregistrement par robot et extraction sans code

Robot est l’unité automatisée de Browse AI. Lors de l’enregistrement, l’utilisateur ouvre d’abord la page cible, puis sélectionne le texte, les liens, les images, les listes ou les captures d’écran à enregistrer ; il peut également simuler des actions telles que se connecter, rechercher, filtrer, cliquer sur « Suivant » et charger dynamiquement.

Après l’entraînement, chaque exécution de Robot crée une tâche.

Le même robot peut recevoir différentes pages de départ, mots-clés ou autres paramètres d’entrée, il n’est donc pas nécessaire de le réenregistrer pour chaque adresse web. Le nombre de robots est illimité dans tous les plans actuels, mais le nombre de noms de domaines de sites disponibles est limité par le forfait.

Extraction approfondie des listes et des pages de détails

Le robot de liste peut d’abord extraire plusieurs enregistrements ainsi que leurs liens détaillés, puis utiliser un Workflow pour transmettre ces liens au robot de détails afin qu’il complète les champs page par page. Ce type de Deep Scraping convient pour récupérer les noms de produits et les liens depuis les pages de catalogue, avant d’accéder à chaque page de détail pour obtenir la description, les spécifications, les coordonnées ou les stocks.

Le coût du scraping en profondeur ne peut pas être estimé uniquement en fonction du nombre total de lignes du tableau final. L’extraction de la page de liste et l’exécution sur chaque page de détail consomment respectivement des Credits.

50 listes supplémentaires pour récupérer 50 pages de détails entraînent généralement des coûts de tâches de détail d’au moins 50 fois en plus des crédits de la liste.

Surveillance des changements sur le site web

Monitor permet au Robot de s’exécuter de manière répétée toutes les heures, tous les jours, toutes les semaines ou à une fréquence personnalisée, et de comparer les résultats anciens et nouveaux. Le système peut avertir l’utilisateur lorsque le prix, les stocks, le texte, les enregistrements de liste ou les captures d’écran changent, et peut également déclencher un Webhook ou une automatisation en aval uniquement lorsqu’un changement est détecté.

Idéal pour le suivi des prix, les pages de concurrents, les annonces de politique, la publication d’offres d’emploi et la mise à jour de contenu. Plus la fréquence de surveillance est élevée et plus le nombre de pages est grand, plus Task et Credits sont consommés rapidement.

Le package self-service standard peut être réglé avec une fréquence minimale de 5 minutes, tandis que la fréquence minimale de surveillance pour Free est d’une fois par heure.

Exécution en lot

Bulk Run permet de charger un grand nombre de paramètres d’entrée pour le même Robot, en exécutant plusieurs adresses web ou conditions de recherche à la fois. La console peut lancer des lots via CSV, tandis que la documentation API prend en charge les tâches en masse ; selon les instructions officielles, une seule commande peut organiser jusqu’à 500 000 tâches.

La plateforme elle-même ne fixe pas de limite journalière fixe en fonction du nombre de tâches, mais le site cible peut limiter la vitesse ou activer des mesures anti-robot. Les tâches à grande échelle doivent être exécutées par lots, avec un contrôle de la concurrence, en utilisant des Webhook pour recevoir les événements de finition, et des règles de tentative et de suppression des doublons doivent être mises en place pour les échecs, les doublons et les résultats vides.

Comment calculer les crédits ?

Une tâche représente la visite d’un site web par le robot afin d’effectuer un extraction de données, une surveillance ou un prélèvement d’écran. Chaque tâche sur un site standard consomme au minimum 1 crédit.

Chaque crédit permet de récupérer jusqu’à 10 lignes de données ou d’effectuer une capture d’écran.

Extraire une liste de 50 lignes coûte généralement 5 Crédits.

Certaines sites nécessitent un agent résidentiel, le traitement de codes de vérification ou le chargement de nombreux fichiers ; ils sont donc marqués comme des Sites Premium. Le coût minimal par tâche est de 2 à 10 Crédits. La consommation réelle dépend du nombre de lignes extraites, du nombre d’captures d’écran, du type de page et du fait qu’il s’agisse ou non d’un site Premium.

À la fin d’un cycle mensuel ou annuel, les Credits non utilisés sont réinitialisés et ne sont généralement pas reportés. Si vous effectuez une mise à niveau avant la fin du cycle, le solde restant de l’ancien forfait est ajouté au nouveau forfait et peut être utilisé pendant le nouveau cycle.

Des crédits supplémentaires et des noms de domaine peuvent être achetés dans le cadre d’un forfait.

Plan gratuit

Free est un plan gratuit permanent, sans besoin de carte de crédit. Il comprend 50 Crédits par mois, 2 noms de domaine, 3 utilisateurs, un nombre illimité de Robots, ainsi que des fonctionnalités de plateforme telles que le scraping, la surveillance, les workflows et l’intégration. Les 50 Crédits permettent d’extraire environ 500 lignes selon la liste standard, mais les pages détaillées, les captures d’écran et les Sites Premium augmentent le coût réel.

Free convient pour apprendre à utiliser un enregistreur et tester de petits ensembles de données, mais il n’est pas adapté au suivi en temps réel ou aux nombreuses pages détaillées. Le quota gratuit est renouvelé chaque mois, et le solde inutilisé n’est pas reporté.

Comparaison des prix et des versions

Forfait ou versionPrix, plafonds et avantages clés
Prix personnelLe forfait Personal est de 48 dollars par mois, incluant 2 000 Crédits par mois ; en paiement annuel, il revient à 19 dollars par mois, avec une attribution unique de 12 000 Crédits. Ce forfait comprend 5 noms de domaine web, 3 utilisateurs, des Robots illimités, toutes les fonctionnalités des plateformes et un support email de base. Pour des sites supplémentaires en paiement annuel, le coût est de 4 dollars par mois avec facturation annuelle, et pour des sites supplémentaires en paiement mensuel, il est de 5 dollars par mois. Les Crédits supplémentaires en paiement annuel coûtent actuellement 0,024 dollar chacun, et en paiement mensuel 0,030 dollar chacun, avec un minimum de 1 000 Crédits à recharger. Bien que le prix annuel soit affiché par mois, le montant total de l’année doit être payé d’un seul coup.
Prix professionnelLe forfait professionnel mensuel coûte 87 dollars par mois et inclut 5 000 crédits par mois ; le paiement annuel équivaut à 69 dollars par mois, avec un versement unique de 60 000 crédits. Il comprend 10 noms de domaine, 10 utilisateurs, des robots illimités, toutes les fonctionnalités et un support par e-mail prioritaire. Pour des sites supplémentaires en paiement annuel, le coût est de 2,4 dollars par mois, calculé sur une base annuelle, tandis qu’en paiement mensuel, il est de 3 dollars par mois. Le prix des crédits supplémentaires varie en fonction du nombre ; le tableau de comparaison sur le site officiel indique une fourchette annuelle d’environ 0,017 à 0,013 dollar par crédit, et le paiement mensuel commence généralement à 0,030 dollar par crédit.

Prix personnel

Le forfait Personal est de 48 dollars par mois, avec 2 000 Crédits par mois ; en paiement annuel, il revient à 19 dollars par mois, avec 12 000 Crédits versés d’un seul coup.

Le forfait comprend 5 noms de domaine, 3 utilisateurs, des robots illimités, toutes les fonctionnalités des plateformes et un support email de base.

Le site supplémentaire payé annuellement coûte 4 dollars par mois et est facturé sur une base annuelle, tandis que le site supplémentaire payé mensuellement coûte 5 dollars par mois. Les crédits supplémentaires payés annuellement coûtent actuellement 0,024 dollar chacun, et ceux payés mensuellement 0,030 dollar chacun, avec un minimum de 1 000 crédits à recharger.

Bien que le prix annuel soit affiché mensuellement, il faut payer la totalité du montant pour l’année en une seule fois.

Prix professionnel

Le forfait professionnel mensuel est de 87 dollars par mois, incluant 5 000 Crédits par mois ; le paiement annuel équivaut à 69 dollars par mois, avec une allocation unique de 60 000 Crédits.

Inclut 10 noms de domaines, 10 utilisateurs, des robots illimités, toutes les fonctionnalités et un support par e-mail prioritaire.

Le prix pour un site supplémentaire payé annuellement est de 2,4 dollars par mois, avec un paiement annuel, tandis que pour un paiement mensuel, il s’élève à 3 dollars par mois. Le prix des crédits supplémentaires varie en fonction de la quantité ; la fourchette indiquée sur le site officiel pour un paiement annuel est d’environ 0,017 à 0,013 dollar par unité, et les tarifs mensuels commencent généralement à 0,030 dollar par unité.

Solution de hébergement Premium

Premium est un forfait annuel, à 500 dollars par mois. Le site web, les utilisateurs et les crédits sont personnalisés selon les besoins, et des services tels que la mise en place par des experts, une gestion continue des données, la conversion de données, des réductions pour les grandes quantités, des configurations sur mesure et un manager client dédié sont proposés.

Il convient aux entreprises dont le site cible dispose de protections fortes contre l’automatisation, qui gèrent de grandes quantités de données, ont des exigences élevées en termes de qualité des champs, ou dont l’équipe ne souhaite pas assurer elle-même la maintenance du Robot. Avant de fournir un devis, il convient de préciser la fréquence de livraison, le taux de réussite, le format des données, le délai de correction, le coût des proxies Premium et la conservation des données historiques.

Comment calculer le nombre de sites web ?

Le terme « Website » dans le forfait désigne le nombre de noms de domaines des seuls sites web utilisés actuellement pour l’entraînement du Robot, et non le nombre de Robots ou de pages. Un même nom de domaine peut donner naissance à un nombre infini de Robots ;

Les différentes sous-pages sont généralement considérées comme faisant partie du même site, mais un changement vers un autre nom de domaine consomme une nouvelle place.

Lors d’une downgrade, si le nombre de noms de domaines actifs dépasse les limites du nouveau forfait, il est nécessaire de supprimer les robots en excès ou de libérer des espaces pour le site avant de pouvoir procéder. Lors de la planification, il convient de choisir la solution en fonction du nombre réel de noms de domaines sources, et non uniquement en se basant sur le nombre de robots.

API et Webhook

La Browse AI REST API est accessible à tous les forfaits sans frais supplémentaires d’accès API ; elle permet de créer et d’exécuter des tâches, de gérer des robots, de lire des résultats structurés, de configurer des moniteurs, de lancer des exécutions en masse ainsi que de gérer des Webhook. La collecte de données générée par les appels reste facturée selon le système normal de crédits.

Le Webhook peut envoyer des événements lorsqu’une tâche est terminée avec succès, qu’il y a un changement dans les données extraites, qu’une surveillance a abouti ou qu’une exportation de tableau est achevée ; il est donc plus adapté aux pipelines de production que la consultation continue. Les développeurs doivent valider les événements, gérer les notifications redondantes et éviter de placer la clé API secrète dans l’interface utilisateur ou dans un dépôt public.

Transformer une page web en API

Une fois le Robot entraîné et approuvé, il est possible de transformer des pages qui ne disposaient pas à l’origine d’une API en points d’accès stables pour les appels. L’application transmet une adresse URL ou des mots-clés ; Browse AI exécute le Robot dans le cloud, puis récupère les résultats via l’API ou attend un rappel Webhook.

« Conversion de page web en API » dépend toujours de la structure de la page cible et n’est pas équivalente à l’API officielle du site. Les mises à jour de la page, l’expiration de la connexion, les codes de vérification et les différences régionales peuvent modifier les champs ou faire échouer le robot ; les systèmes en production nécessitent une validation des champs, un cache et des sources de données de secours.

Intégration et export de données

La plateforme peut synchroniser les résultats avec Google Sheets, Airtable et Amazon S3, et se connecter à plus de 7 000 applications via Zapier, Make, Pabbly Connect. Il est également possible d’exporter en CSV, ou de se connecter à des bases de données, des outils BI, des CRM et des systèmes internes au moyen de Webhooks et d’API REST.

Avant la synchronisation automatique, il convient de définir une clé unique et une stratégie de mise à jour pour distinguer les enregistrements nouvellement ajoutés, ceux modifiés et ceux supprimés. En l’absence de règles de suppression des doublons et de surécriture, un suivi périodique risque d’ajouter continuellement les mêmes données ou de remplacer les modifications manuelles.

Agent immobilier et code de vérification

Browse AI utilise la localisation géographique de proxies résidentiels et le traitement automatique des codes de vérification en fonction des caractéristiques du site, afin d’améliorer le taux de réussite des tâches dans le cloud. Les sites nécessitant une infrastructure plus coûteuse sont classés en Premium et voient leur montant minimum de Credits augmenter.

Ces capacités ne garantissent pas un accès stable à tous les sites web, ni ne confèrent aux utilisateurs l’autorisation de contourner les conditions du site ou les contrôles d’accès. Les comptes, les contenus abonnés, les informations personnelles et les données protégées par le droit d’auteur nécessitent en particulier une validation des fondements légaux.

Conservation des données et sécurité

Pour les plans Free, Personal et Professional, la durée de conservation des données est actuellement de 90 jours, tandis que celle du plan Premium est personnalisable. Le site officiel indique SOC 2 Type II, GDPR et CCPA, et fournit des informations sur la sécurité via le Trust Center.

Le mot de passe saisi lors de l’enregistrement est chiffré avec AES-256, et n’est déchiffré du côté du serveur que lors de l’exécution de la tâche ; les membres de l’équipe et le personnel d’assistance ordinaire ne peuvent pas voir les valeurs déchiffrées dans la console.

Le service est hébergé dans les data centers AWS aux États-Unis et utilise TLS 1.2 autant que possible.

Néanmoins, les entreprises doivent utiliser des comptes dédiés à faibles privilèges et ne pas enregistrer le mot de passe principal de l’administrateur.

GitHub et l’état open source

L’organisation GitHub officielle de Browse AI s’appelle BrowseAI-Official et met à disposition des bibliothèques d’outils ainsi que des branches de projets sources, tels que xpath-to-css, formulajs et des dépôts liés à la construction. Ces éléments ne comprennent pas le enregistreur Robot, le navigateur cloud, le système de surveillance ni le code source complet de la plateforme.

Par conséquent, le produit phare de Browse AI n’est pas un outil de crawling web open source, et ne permet pas une auto-hébergement complet à partir de dépôts publics. Lorsqu’un réseau privé, des proxies dédiés ou une isolation des données personnalisée sont nécessaires, il convient de consulter le service Premium.

Tutoriel d'utilisation de Browse AI

Terminer une tâche de base

  1. Définir les tâches de codage à effectuer dans Browse AI, la portée du répertoire et les critères d’acceptation ;
  2. Connectez ou importez le projet de test, et faites d’abord une sauvegarde de la branche actuelle ;
  3. Utilisez d’abord Robot pour enregistrer et générer un plan de capture sans code, puis confirmez les fichiers modifiés ;
  4. Utiliser des listes et des pages de détails pour effectuer des modifications à petite échelle via un scraping en profondeur ;
  5. Exécuter des tests, des vérifications statiques et la compilation ; ne pas accepter directement de code non vérifié.
  6. Vérifier manuellement les droits, les clés, les dépendances et gérer les exceptions avant de fusionner ;

Créer des flux de travail professionnels réutilisables

  1. Choisir un projet réel à faible risque comme modèle ;
  2. Fixer l’ordre d’utilisation de l’enregistrement par robot fixe, du scraping sans code, du scraping approfondi des listes et des pages détaillées, ainsi que du suivi des changements sur le site ;
  3. Enregistrer l’environnement, le modèle, les indications et les conditions d’échec ;
  4. Définir une approbation manuelle pour les actions d’écriture, de déploiement et de suppression ;
  5. Comparer la vitesse, le coût, le taux de réussite des tests et le volume de rétravail ;
  6. Vérifiez la stabilité avant de l’étendre à l’équipe ou à l’environnement de production ;

À qui s’adresse-t-il ?

  • Équipes e-commerce et de marché chargées de surveiller les prix des produits, les stocks et les pages des concurrents ;
  • Des chercheurs qui collectent des données publiques à partir de catalogues, de cartes, d’annonces immobilières, de offres d’emploi et de pages de recherche ;
  • Les opérateurs qui souhaitent créer des pipelines de données pour des sites web sans code ;
  • Développeurs qui doivent intégrer des données de site web dans des tableurs, des CRM, des outils BI ou des bases de données ;
  • Les entreprises qui ont besoin d’une maintenance continue par des experts pour leurs tâches de collecte à grande échelle.

Avantages du produit

  • Entraînez le Robot en lui montrant comment cliquer et sélectionner des champs, sans avoir à écrire de code de sélecteur.
  • La capture, la surveillance, la capture en profondeur et l’exécution en lot couvrent l’ensemble ;
  • Tous les scénarios peuvent utiliser REST API et Webhook ;
  • Il est possible de connecter de nombreuses applications via Google Sheets, Airtable et des plateformes d’automatisation ;
  • Fournir des services d’agent immobilier, de traitement de codes de vérification et d’hébergement de données ;
  • Le nombre de robots n’est pas limité ; les forfaits sont principalement différenciés en fonction du nom de domaine et des crédits.

Restrictions et précautions

  • Chaque page de détails est généralement une tâche indépendante, et les crédits nécessaires pour une extraction approfondie et un suivi fréquent peuvent être bien supérieurs au nombre de lignes de la liste.
  • PremiumSite a un coût minimum plus élevé, les Credits non utilisés ne sont pas reportés à la fin de la période, et le forfait annuel indique un prix mensuel moyen mais nécessite un paiement anticipé pour l’année entière ;
  • Les robots dépendent de la structure du site web, et il est nécessaire de les reformerater ou de les ajuster après une mise à jour.
  • Le téléchargement ne confère pas automatiquement le droit d’utiliser les données ;
  • Il convient de se conformer aux conditions d’utilisation du site, aux règles robots, aux droits d’auteur, à la confidentialité et aux exigences relatives à la fréquence d’accès, et de prévoir des plans en cas de suspension de compte, de modifications des champs et d’expiration des données historiques ;

Questions fréquentes

Est-ce que Browse AI est gratuit ?

Il existe un forfait gratuit permanent : 50 Crédits par mois, permettant de gérer 2 sites web, 3 utilisateurs et un nombre illimité de Robots. Selon la liste standard, un Crédit ne permet d’extraire au maximum que 10 lignes.

Combien coûte Browse AI ?

Personal : 48 dollars par mois, soit 19 dollars par mois en abonnement annuel ; Professional : 87 dollars par mois, soit 69 dollars par mois en abonnement annuel.

Premium se paie 500 dollars par an, soit 50 dollars par mois.

Browse AI prend-il en charge l’API ?

Soutien assuré, et l’API REST est accessible à toutes les solutions. Il est possible d’exécuter des robots, de lire des données, de configurer la surveillance, de gérer des tâches en batch et d’utiliser des Webhook ; cependant, le téléchargement effectif de données consomme encore des Credits.

Browse AI peut-il récupérer n’importe quel site web ?

La plupart des pages web publiques peuvent être entraînées, mais le taux de réussite est affecté par les connexions, les codes de vérification, les mesures anti-automatisation, la région, le chargement dynamique et les mises à jour des pages. Certaines sites facturent selon un tarif Premium.

Est-ce que Browse AI est open source ?

Le produit principal n’est pas open source. Le GitHub officiel ne contient que certaines bibliothèques d’outils et des branches, ce qui ne permet pas d’utiliser une plateforme Browse AI entièrement auto-hébergée.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à Browse AI