Dans ce tutoriel, vous apprendrez :
- Ce qu’est AstrBot et ce qu’il offre en tant que plateforme d’agent IA open-source.
- Pourquoi l’ajout d’un accès web en direct rend AstrBot plus efficace pour les tâches du monde réel.
- Comment Bright Data équipe AstrBot d’outils de recherche web, de scraping, de découverte et d’automatisation de navigateur de qualité professionnelle.
- Comment intégrer le Web MCP Bright Data avec AstrBot.
- Comment améliorer AstrBot avec l’expertise des produits Bright Data grâce aux skills Bright Data.
- Les résultats de la combinaison d’AstrBot avec le Web MCP et les skills Bright Data.
Plongeons dans le vif du sujet !
Qu’est-ce qu’AstrBot ?

AstrBot est un framework d’agent IA open-source et multiplateforme. Il intègre des assistants alimentés par des LLM directement dans les applications de messagerie populaires telles que Telegram, Slack, Discord, WeChat et bien d’autres.
Il va au-delà des chatbots traditionnels en prenant en charge les workflows d’agents, les appels d’outils, le MCP, les skills et les bases de connaissances. Il est également accompagné d’extensions pour l’automatisation, le support client, la gestion des connaissances d’entreprise et les assistants IA personnels.
AstrBot a obtenu plus de 36 500 étoiles GitHub, compte plus de 1 000 plugins communautaires et plus de 200 000 utilisateurs actifs par semaine.
Fonctionnalités clés
Les principales capacités prises en charge par AstrBot :
- Support multiplateforme : Communiquez avec votre agent via Telegram, Slack, Discord, QQ, WeChat, Lark, DingTalk et de nombreuses autres plateformes de messagerie.
- Support MCP natif : Intégrez des outils et services externes via le Model Context Protocol.
- Intégration de skills : Étendez les agents avec des skills réutilisables offrant des capacités et des workflows spécialisés.
- Écosystème de plus de 1 000 plugins : Ajoutez de nouvelles fonctionnalités et intégrations via un riche marketplace de plugins maintenu par la communauté.
- Base de connaissances : Créez des assistants IA qui répondent aux questions à partir de fichiers PDF, DOCX, Markdown et d’autres documents.
- Support LLM multi-fournisseurs : Compatible avec OpenAI, Anthropic, Google Gemini, Ollama et de nombreux fournisseurs compatibles OpenAI.
- Sandbox d’agent : Exécutez du code et des commandes shell en toute sécurité dans des environnements d’exécution isolés.
- WebUI puissante : Configurez les modèles, plugins, serveurs MCP, journaux et débogage depuis une interface centralisée.
- Déploiement flexible : Déployez avec
uv, Docker, des applications de bureau, des lanceurs ou des environnements cloud. - Automatisation des workflows : Planifiez des tâches, orchestrez des outils et créez des agents IA autonomes pour des workflows du monde réel.
Pour en savoir plus, consultez la documentation officielle.
Pourquoi AstrBot a besoin d’un accès au web
AstrBot est sans aucun doute un framework IA solide doté de fonctionnalités avancées. Cependant, comme toutes les applications alimentées par des LLM, il hérite de ces limitations fondamentales :
- Connaissances obsolètes : Les LLM sont entraînés sur des jeux de données statiques qui s’arrêtent à un moment précis dans le temps.
- Accès limité au web : Par eux-mêmes, ils ne peuvent pas interagir de manière fiable avec les pages web.
AstrBot aide à surmonter en partie ce défi grâce à un outil de recherche web intégré. Cependant, cet outil peut rencontrer des difficultés à grande échelle ou lors de l’accès à des sites protégés par des technologies anti-bot telles que les CAPTCHAs, les limites de débit et le fingerprinting.
C’est là qu’intervient Bright Data. En connectant AstrBot aux solutions Bright Data, l’agent accède à des outils de qualité professionnelle pour la recherche web en direct, l’extraction de données, la découverte de sites, l’automatisation de navigateur et la récupération de jeux de données.
Ce qui distingue Bright Data, c’est son infrastructure mondiale de données web, alimentée par plus de 400 millions d’IPs résidentielles. Cette architecture offre la scalabilité et la fiabilité nécessaires aux charges de travail en production, avec une concurrence illimitée, une disponibilité garantie par un SLA de 99,99 % et un taux de succès des requêtes de 99,95 %.
Comment Bright Data soutient AstrBot avec la recherche web, le scraping, la découverte et l’interaction
Bright Data peut se connecter à AstrBot via deux intégrations :
- Web MCP Bright Data : Un serveur MCP qui expose plus de 70 outils pour la recherche web, le scraping, l’extraction de données structurées et l’automatisation de navigateur.
- Skills Bright Data : Une collection de skills d’agent qui fournissent à AstrBot des connaissances spécialisées sur les produits Bright Data, les workflows recommandés et les meilleures pratiques. La plupart de ces skills s’appuient sur la CLI Bright Data.
Remarque : Les deux approches sont complémentaires. Par exemple, un skill Bright Data spécifique aide AstrBot à comprendre quand et comment utiliser efficacement les outils Web MCP.
Ensemble, le Web MCP et les skills Bright Data transforment AstrBot en un agent IA plus capable. Grâce à eux, il peut effectuer des recherches web en temps réel, de l’automatisation de navigateur et de l’extraction de données structurées.
Web MCP Bright Data
Le Web MCP Bright Data équipe AstrBot d’un large ensemble d’outils alimentés par les API Bright Data.
En mode Rapid (le niveau gratuit avec 5 000 requêtes gratuites par mois), AstrBot peut utiliser des outils essentiels pour la recherche web et l’extraction de données. Ceux-ci comprennent :
| Outil(s) | Description |
|---|---|
search_engine (et search_engine_batch pour la recherche en parallèle) |
Récupère des résultats de recherche structurés depuis Google, Bing, Yandex et d’autres moteurs. |
scrape_as_markdown (et scrape_batch pour le scraping en parallèle) |
Extrait du Markdown propre depuis des pages web en gérant automatiquement les protections anti-bot. |
discover |
Effectue une découverte web alimentée par l’IA avec classement par pertinence et filtrage basé sur l’intention. |
En activant le mode Pro, AstrBot accède à des outils pour extraire des données structurées depuis LinkedIn, Amazon, Instagram, Walmart, YouTube, Google Maps, Zillow, TikTok et plus de 40 autres plateformes. Il débloque également plusieurs outils d’automatisation de navigateur basés sur l’API Browser de Bright Data.
Skills Bright Data
Les skills Bright Data étendent AstrBot avec des connaissances et des workflows spécialisés. Ils aident l’agent à choisir les bons services Bright Data et à suivre les meilleures pratiques recommandées.
Parmi les skills disponibles, on trouve :
| Skill | Description |
|---|---|
agent-onboarding |
Guide les nouveaux agents à travers la configuration de Bright Data et recommande les workflows MCP, CLI, API et d’authentification. |
search |
Effectue des recherches Google en direct et retourne des résultats de recherche structurés. |
scrape |
Explique comment extraire le contenu propre d’une page web avec gestion automatique des protections anti-bot. |
scraper-builder |
Aide à créer des Scrapers prêts pour la production en analysant les sites web et en générant la logique d’extraction. |
scraper-studio |
Crée et exécute des Scrapers générés par l’IA via la CLI Bright Data. |
brightdata-cli |
Enseigne à l’agent comment utiliser la CLI Bright Data pour le scraping, la recherche, les jeux de données, les Proxys et la gestion de compte. |
bright-data-mcp |
Fournit des conseils pour orchestrer les plus de 70 outils Web MCP. |
brightdata-proxy |
Génère du code d’intégration de Proxy pour Python, Node.js, Playwright, Puppeteer, Selenium et d’autres environnements. |
seo-audit |
Effectue une analyse SEO en utilisant des données de sites web en direct et des signaux de recherche. |
competitive-intel |
Prend en charge la surveillance des concurrents, l’analyse des prix, le suivi des avis et l’Etude de marché. |
price-comparison |
Compare les prix et la disponibilité des produits chez les principaux détaillants en ligne. |
live-research |
Crée des rapports de recherche en combinant la découverte web, l’extraction et la synthèse par IA. |
brand-listening |
Analyse les mentions de marque, le sentiment et les discussions en ligne à travers plusieurs sources. |
rag-pipeline |
Aide à créer des pipelines de génération augmentée par récupération (RAG) en utilisant des données web en direct. |
bright-data-best-practices |
Recommande les meilleures pratiques pour les API Bright Data et les workflows de données web. |
Configuration d’AstrBot : guide étape par étape
Dans cette section, vous verrez comment configurer AstrBot et le connecter à Telegram.
Remarque : Vous pouvez facilement adapter les instructions ci-dessous à toute autre plateforme de messagerie prise en charge par la bibliothèque.
Prérequis
Assurez-vous d’avoir :
uvinstallé sur votre machine locale.- Une clé API d’un des fournisseurs LLM pris en charge par AstrBot. Ici, nous utiliserons une clé API OpenAI.
- Un compte Telegram avec un bot prêt à être connecté à AstrBot. Suivez le guide officiel pour créer un bot Telegram et obtenir son token.
Étape #1 : Installer et lancer AstrBot
Commencez par installer AstrBot en exécutant la commande suivante :
uv tool install astrbot, python 3.12
Ensuite, naviguez vers votre dossier de projet et initialisez la configuration AstrBot :
astrbot init
Une invite vous demandera si vous souhaitez installer AstrBot dans le répertoire actuel. Entrez « Y » pour continuer :

Une fois la configuration terminée, démarrez AstrBot avec :
astrbot run
Vous devriez voir une sortie similaire à celle-ci :

La WebUI AstrBot sera désormais disponible à l’adresse http://localhost:6185. Ouvrez cette URL dans votre navigateur et connectez-vous avec les identifiants fournis dans les journaux du terminal :

Après vous être connecté, définissez un nouveau mot de passe pour accéder au tableau de bord dans la WebUI AstrBot. Bravo !
Étape #2 : Ajouter l’intégration LLM
Sur la page « Bienvenue » de la WebUI AstrBot, cliquez sur le bouton « Configurer » dans la section « Configurer le modèle IA » pour commencer :

Ici, nous allons connecter AstrBot à OpenAI (mais le processus est similaire pour tout autre fournisseur LLM pris en charge). Sélectionnez Ajouter et choisissez l’option « Compatible OpenAI ». La fenêtre de configuration « openai » s’ouvrira. Collez votre clé API OpenAI dans le champ correspondant :

Cliquez sur « Enregistrer et récupérer les modèles » pour récupérer dynamiquement les modèles OpenAI disponibles. Ensuite, sélectionnez le modèle que vous souhaitez utiliser. Dans cet exemple, nous utiliserons OpenAI GPT-5.4 Mini :

Enfin, appuyez sur « Enregistrer » pour appliquer la configuration et revenir à la page « Bienvenue ». Votre agent AstrBot est maintenant alimenté par un LLM OpenAI. Fantastique !
Étape #3 : Configurer la connexion Telegram
Sur la page « Bienvenue » de la WebUI AstrBot, cliquez sur le bouton « Configurer » sous « Configurer le bot de plateforme ». Dans le modèle « Ajouter un adaptateur de plateforme », sélectionnez « Telegram » et collez votre token de bot Telegram dans le champ correspondant :

Appuyez sur « Enregistrer » puis ouvrez votre bot Telegram (nommé « AstrBot Agent » dans cet exemple). Vous devriez recevoir un message contenant le texte suivant :
Hello, I'm AstrBot!

Pour vérifier que l’intégration LLM fonctionne correctement, envoyez un message de test tel que :
Hey, how's it going?
Vous devriez recevoir une réponse comme celle-ci :

Cette réponse a été générée par GPT-5.4 Mini et envoyée via AstrBot.
Configuration terminée ! Le framework est maintenant entièrement configuré et vous pouvez interagir avec lui via Telegram.
Connecter AstrBot au Web MCP Bright Data
Dans ce chapitre, vous apprendrez comment configurer le Web MCP Bright Data dans AstrBot.
Prérequis
Pour une expérience plus fluide dans cette section, vérifiez que vous avez :
- Une compréhension de base du fonctionnement du MCP.
- Une familiarité avec les outils fournis par le Web MCP Bright Data.
Vous devez également disposer d’un compte Bright Data avec une clé API configurée. Consultez le guide officiel pour générer votre clé API Bright Data.
Étape #1 : Se familiariser avec le Web MCP Bright Data
Avant de commencer, gardez à l’esprit qu’AstrBot recommande de se connecter à des serveurs MCP distants. Pour cette raison, au lieu de configurer un serveur Web MCP Bright Data local avec le package @brightdata/mcp, nous intégrerons le serveur Web MCP distant.
Remarque : Le Web MCP Bright Data distant est conçu pour les déploiements à l’échelle de l’entreprise. Il prend en charge une scalabilité et des connexions simultanées illimitées, tout comme tous les autres services Bright Data.
Pour commencer, familiarisez-vous avec l’URL de connexion Web MCP standard :
https://mcp.brightdata.com/mcp?token=<YOUR_BRIGHT_DATA_API_KEY>&pro=1
Remplacez <YOUR_BRIGHT_DATA_API_KEY> par votre clé API Bright Data. Le paramètre token authentifie vos requêtes et les associe à votre compte Bright Data.
Le paramètre &pro=1 est optionnel :
- Avec
&pro=1: Accès au catalogue complet de plus de 70 outils et aux capacités avancées. Les tarifs standard Bright Data s’appliquent. - Sans
&pro=1: Accès uniquement aux outils gratuits disponibles en mode Rapid (jusqu’à 5 000 requêtes par mois).
Supposons maintenant que vous souhaitiez un contrôle plus précis sur les outils exposés. Par exemple, vous souhaitez configurer l’accès uniquement à des outils ou groupes d’outils spécifiques. Dans ce cas, vous pouvez générer une URL de connexion Web MCP personnalisée depuis le tableau de bord Bright Data.
Connectez-vous à votre compte Bright Data et accédez à la page « Passerelles IA > MCP ». Suivez l’assistant de configuration pour configurer votre serveur MCP et générer une URL de connexion personnalisée :

Copiez l’URL de connexion « HTTP streamable » générée, ou construisez-en une en utilisant le format indiqué ci-dessus. Vous utiliserez cette URL à l’étape suivante pour connecter AstrBot au Web MCP Bright Data. Super !
Étape #2 : Ajouter la connexion Web MCP Bright Data dans AstrBot
AstrBot vous permet de configurer les connexions MCP directement depuis sa WebUI.
Pour ajouter un nouveau serveur MCP, ouvrez le menu déroulant « Extensions » à gauche et sélectionnez l’option « Serveurs MCP ». Sur la page « MCP », cliquez sur le bouton « + » dans le coin inférieur droit :

Donnez un nom à votre serveur MCP (par exemple, « Bright Data Web MCP ») et collez la configuration suivante :
{
"transport": "streamable_http",
"url": "<YOUR_WEB_MCP_CONNECTION_URL>"
}
Remplacez <YOUR_WEB_MCP_CONNECTION_URL> par l’URL de connexion Web MCP Bright Data récupérée précédemment.

Appuyez sur « Tester la connexion » pour vérifier que le serveur MCP est correctement configuré. Si la connexion réussit, AstrBot affichera un message de confirmation suivi d’une liste des outils disponibles :

En utilisant le mode Pro (&pro=1), vous verrez l’ensemble des plus de 70 outils Web MCP Bright Data.
Terminez l’intégration en cliquant sur « Enregistrer ». Le fichier de configuration AstrBot ./data/mcp_server.json inclura :
{
"mcpServers": {
"Bright Data Web MCP": {
"active": true,
"transport": "streamable_http",
"url": "<YOUR_WEB_MCP_CONNECTION_URL>"
}
}
}
Vous pouvez également obtenir le même résultat en modifiant manuellement ce fichier de configuration.
Après l’enregistrement, la page « MCP » affichera la nouvelle entrée « Bright Data Web MCP », qui devrait être activée par défaut :

Excellent ! AstrBot est maintenant connecté au Web MCP Bright Data et peut appeler ses outils d’interaction web.
Plus loin dans ce guide, vous verrez une configuration AstrBot avec le Web MCP combiné aux skills Bright Data.
Ajouter des connaissances sur Bright Data à AstrBot grâce aux skills officiels
Ci-dessous, vous serez guidé à travers le processus d’ajout des skills Bright Data à AstrBot en utilisant l’outil CLI skills de Vercel.
Remarque : Si vous ne souhaitez pas utiliser skills, vous pouvez télécharger les skills directement depuis le dépôt officiel. Naviguez vers le dossier skills/, créez une archive ZIP avec son contenu et téléchargez-la manuellement depuis la page « Extensions > Skills » dans AstrBot.
Prérequis
Avant de parcourir cette section, vérifiez que vous avez :
- Un environnement UNIX (Linux, macOS ou WSL).
- Node.js 22+ installé localement.
- La CLI Bright Data installée et configurée localement. C’est la principale exigence pour utiliser les skills Bright Data. Pour une configuration rapide, consultez le guide « CLI Bright Data : Installation et configuration ». Vous pouvez également consulter l’article de blog dédié pour plus de détails.
- Une compréhension de base de ce que fournissent les skills Bright Data. Pour plus d’informations, lisez l’article sur les skills Bright Data sur notre blog.
Une certaine familiarité avec l’outil CLI standard skills d’Agent Skills est également recommandée, mais pas obligatoire.
Étape #1 : Installer les skills Bright Data
Pour ajouter les skills Bright Data à AstrBot en utilisant l’outil CLI skills, exécutez :
npx skills add brightdata/skills -a astrbot
Cette commande installe le package npm skills et démarre le processus de configuration. Cela va :
- Télécharger les skills Bright Data depuis le répertoire Agent Skills.
- Les configurer pour une utilisation globale ou dans votre projet local.
Vous serez ensuite invité à sélectionner les skills à installer :

Pour installer tous les skills disponibles, utilisez la barre d’espace pour sélectionner chacun d’eux, puis appuyez sur Entrée pour continuer.
Ensuite, choisissez la portée d’installation. Puisque l’intégration Web MCP a été configurée localement, vous devriez également installer les skills Bright Data localement. Ainsi, sélectionnez l’option « Projet » et appuyez sur Entrée :

Appuyez à nouveau sur Entrée pour confirmer l’installation. Une fois terminé, vous verrez un message de confirmation :

Les skills Bright Data sont maintenant disponibles dans le répertoire ./data/skills d’AstrBot. Parfait !
Étape #2 : Confirmer que les skills sont disponibles
Retournez à la WebUI AstrBot et ouvrez la page « Extensions > Skills » :

Vous verrez une liste contenant tous les skills Bright Data que vous venez d’installer.
Remarque : Si les skills n’apparaissent pas, essayez de rafraîchir la page.
Optionnellement, si vous n’avez pas encore configuré la CLI Bright Data, exécutez le skill d’intégration. Dans Telegram, écrivez :
/agent-onboarding
Cela charge le skill d’intégration Bright Data dédié, qui vous guide à travers le processus de configuration requis par les autres skills Bright Data. Pour l’exécuter, vous devez également accorder à AstrBot la permission d’exécuter des commandes shell.
Mission accomplie ! Dans le prochain chapitre, vous apprendrez comment utiliser le Web MCP Bright Data et les skills ensemble dans AstrBot.
AstrBot + Web MCP Bright Data et Skills : exemple complet
Votre agent AstrBot dispose maintenant d’outils et de connaissances de qualité professionnelle pour interagir avec le web. Cela lui permet de gérer un large éventail de cas d’usage réels nécessitant des données web en direct, l’automatisation de navigateur et l’extraction de données structurées.
Par exemple, supposons que vous souhaitiez utiliser AstrBot comme assistant shopping. Les sites e-commerce modernes sont souvent protégés par des technologies anti-bot avancées, ce qui rend difficile l’interaction des agents IA avec eux. Pour plus d’informations, consultez notre guide sur le scraping e-commerce.
En intégrant Bright Data, AstrBot peut contourner ces limitations tout en effectuant des recherches web, en interagissant avec des pages web et en extrayant les informations nécessaires pour répondre à vos demandes.
Imaginez maintenant que vous souhaitiez utiliser AstrBot via Telegram pour vous aider à trouver un produit sur le site Zara. Suivez les étapes ci-dessous !
Étape #1 : Lancer les prompts
Commencez avec un prompt comme celui-ci :
Search Google for the Zara men's polo shirts sale page. Visit the page in a browser and return a full-page screenshot.
Vous devriez recevoir une réponse similaire à :

Remarquez comment l’agent a accompli la tâche. En coulisses, il a :
- Appelé l’outil
search_engine(alimenté par l’API SERP de Bright Data) pour rechercher sur Google la requête « Zara men’s polo shirts sale page ». - Analysé le SERP retourné en JSON pour identifier la page correcte.
- Ouvert la page dans une instance de navigateur cloud en utilisant l’outil
scraping_browser_navigate(alimenté par l’API Browser de Bright Data). - Capturé une capture d’écran pleine page avec l’outil
scraping_browser_screenshot. - Retourné à la fois la capture d’écran et l’URL de la page.
Si vous ouvrez la WebUI AstrBot et naviguez vers « Plateformes > Journaux de plateforme », vous pouvez inspecter chaque outil Web MCP et skill Bright Data utilisés par l’agent :

Supposons que vous ouvriez la capture d’écran, que vous aimiez le troisième produit et que vous souhaitiez qu’AstrBot récupère toutes les informations à son sujet. Vous pouvez envoyer un prompt tel que :
I like the third product, the Zip Polo Sweatshirt. Get the URL of its product page, then scrape it to extract the main product information. Return the results in a structured text message.
La réponse devrait ressembler à ceci :

En coulisses, AstrBot appelle plusieurs outils Bright Data pour identifier la page produit et en extraire les informations. Selon le workflow, il peut récupérer les données en utilisant scrape_as_markdown ou un outil spécialisé tel que web_data_zara_products (qui est basé sur l’API Web Data Zara de Bright Data).
Étape #2 : Analyser les résultats
Notez que les informations retournées dans le dernier message correspondent à ce qui est disponible sur la page produit officielle de Zara :

Une page produit peut nécessiter plusieurs interactions manuelles pour révéler toutes ses informations (par exemple, développer la section « MESURES DU PRODUIT »). Malgré cela, AstrBot a pu retourner les détails complets du produit grâce aux outils spécialisés exposés par le Web MCP de Bright Data.
À partir de là, vous pouvez continuer la conversation naturellement. Par exemple, vous pourriez demander à AstrBot si le produit vaut la peine d’être acheté, le comparer avec des alternatives similaires ou recommander d’autres produits dans la même gamme de prix.
Et voilà ! Cet exemple simple illustre à quel point AstrBot devient plus performant lorsqu’il est intégré à Bright Data. Sans le Web MCP et les skills Bright Data, il ne serait pas en mesure de réaliser de manière fiable des workflows dépendant de la recherche web en direct, de la découverte de sites, de l’extraction de données et des interactions automatisées avec le navigateur.
Conclusion
Dans cet article de blog, vous avez appris ce qu’est AstrBot et ce qu’il apporte. En particulier, vous avez vu comment étendre ses fonctionnalités en intégrant Bright Data via le Web MCP et les skills Bright Data.
Avec Bright Data, AstrBot peut exploiter des outils pour la recherche web en direct, le scraping et la découverte de sources. Cela lui permet de générer des réponses plus fondées, basées sur des informations précises, contextuelles et vérifiables. Il peut également utiliser des outils d’interaction avec le navigateur cloud, vous permettant de déléguer des workflows web complexes directement à l’agent.
Pour des scénarios encore plus avancés, explorez la gamme complète des solutions de données web prêtes pour l’IA disponibles via l’écosystème Bright Data.
Inscrivez-vous gratuitement à Bright Data dès aujourd’hui et commencez à explorer nos solutions de données web !