API de données en temps réel
pour tous les besoins des entreprises

Accédez à des données structurées, filtrées et en temps réel provenant de plus de 120 domaines grâce à de puissantes API. Filtrez les Jeux de données à l’aide de l’IA, automatisez la livraison des données et intégrez-les de manière transparente dans vos flux de travail.

Web scraper api
  • Filtrage alimenté par l'IA avec
    langage naturel
  • Transmission des données en temps réel via l'API
  • Ne payez que pour les données
    dont vous avez besoin
  • Exemples de code prêts à l'emploi
    dans plus de 7 langues
ALIMENTÉ PAR L'IA

Filtrez des jeux de données volumineux à l'aide d'une seule invite.

Décrivez exactement ce dont vous avez besoin dans un anglais simple et laissez l’IA appliquer automatiquement les filtres parfaits. Réduisez les coûts en récupérant uniquement les données pertinentes.

  • Filtrage du langage naturel - aucun codage requis
  • L'IA applique automatiquement des filtres précis.
  • Réduisez des milliards d'enregistrements à ce qui compte vraiment
  • Filtrer par n'importe quel champ : lieu, secteur d'activité, intitulé du poste, date
  • Exportez les données filtrées au format JSON, CSV ou Parquet.
BIBLIOTHÈQUE D'API DE DONNÉES

API de données en temps réel pour tous les secteurs

Accédez à des données structurées et validées provenant de plus de 120 domaines grâce à de puissantes API de filtrage. Obtenez uniquement les données dont vous avez besoin, fournies en temps réel à votre application.

  • Plus de 120 domaines
  • Plus de 190 API de jeux de données
  • Des milliards d'enregistrements

Data Feeds Pricing

Taux de rafraîchissement
100K
500K
1M
5M
20M
Complete Dataset
3TB
  • Propre et validé
  • Actualisé chaque mois
  • JSON/CSV/Parquet

Flexible delivery to fit your workflow

Recevez des données filtrées via une réponse API, Webhook, S3, Snowflake, Azure ou un téléchargement direct.

delivery methods
                              curl --request POST 
--url https://api.brightdata.com/Jeux de données/filter 
--header 'Authorization: Bearer ' 
--header 'Content-Type: application/json' 
--data '{
  "dataset_id": "gd_l1viktl72bvl7bjuj0",
  "records_limit": 100,
  "filter": {
    "name": "job_title",
    "operator": "=",
    "value": "Software Engineer"
  }
}'
                              
                            
                              import requests

url = "https://api.brightdata.com/Jeux de données/filter"
headers = {"Authorization": "Bearer "}
payload = {
    "dataset_id": "gd_l1viktl72bvl7bjuj0",
    "records_limit": 100,
    « filter » : {
    « name » : « job_title »,
    « operator » : « = »,
    « value » : « Software Engineer »
}
}

response = requests.post(url, json=payload, headers=headers)
print(response.json())
                              
                            
                              const url = 'https://api.brightdata.com/datasets/filter';
const options = {
  method: 'POST',
  headers: {
    'Authorization': 'Bearer ',
    'Content-Type': 'application/json'
  },
  body: JSON.stringify({
  dataset_id: 'gd_l1viktl72bvl7bjuj0',
  records_limit: 100,
  filter: {
    name: 'job_title',
    operator: '=',
    value: 'Software Engineer'
  }
})
};

try {
  const response = await fetch(url, options);
  const data = await response.json();
  console.log(data);
} catch (error) {
  console.error(error);
}
                              
                            
                              HttpResponse response = Unirest.post("https://api.brightdata.com/Jeux de données/filter")
.header("Authorization", "Bearer ")
.header("Content-Type", "application/json")
  .body("{"dataset_id":"gd_l1viktl72bvl7bjuj0","records_limit":100,"filter":{"name":"job_title","operator":"=","value":"Software Engineer"}}")
  .asString();
                              
                            
EXEMPLES DE CODE

Filtrer et récupérer des données à l'aide d'appels API simples

Pourquoi des API de flux de données ?

La solution unifiée pour accéder, filtrer et fournir des données web à grande échelle

Filtrage alimenté par l'IA

Créez des filtres précis à l'aide d'opérateurs JSON simples. Aucune logique de scraping complexe n'est requise.

Accès API en temps réel

Récupérez les données filtrées directement dans votre application via l'API RESTful avec des temps de réponse instantanés.

structured data

Données structurées et propres

Données prévalidées, dédupliquées et dotées de schémas cohérents, prêtes à être utilisées immédiatement dans vos applications.

Options de livraison flexibles

Téléchargez via API, Webhook, S3, Snowflake ou téléchargement direct aux formats JSON, CSV ou Parquet.

Convivialité pour les développeurs

Documentation API complète avec des exemples de code en Python, Node.js, cURL, PHP, Go, Java et Ruby.

Ne payez que ce que vous utilisez

Filtrez des milliards d'enregistrements pour trouver exactement ce dont vous avez besoin. Ne payez pas pour des données non pertinentes.

AVANTAGES TARIFAIRES

Optimisez la valeur grâce à des économies stratégiques

Managed Data Collection_box

Paiement à l'enregistrement

Ne payez que pour les enregistrements exacts que vous récupérez. Filtrez des milliards d'enregistrements pour n'en garder que quelques milliers : ne payez que pour ce que vous utilisez.

dataset bundles

Mises à jour intelligentes des données

Abonnez-vous uniquement aux « Nouveaux enregistrements » ou aux « Enregistrements mis à jour » — évitez de télécharger à nouveau des données inchangées.

discounts

Remises sur volume

Adaptez votre accès aux données et réalisez des économies significatives sur les demandes et les abonnements à volume élevé.

enriched datasets

Efficacité de l'API

Récupérez directement les données préfiltrées, sans avoir à télécharger et traiter localement des fichiers volumineux.

Découvrez comment les API de données peuvent vous être utiles

Boostez votre pipeline de ventes grâce à des données ciblées

Filtrez les profils LinkedIn par intitulé de poste, entreprise, lieu et compétences. Créez des listes de prospects précises et automatisez la notation des prospects.

Gardez une longueur d'avance grâce à des informations concurrentielles en temps réel

Surveillance des prix pratiqués par la concurrence, suivez les lancements de produits, analysez les avis et les sentiments sur les plateformes de commerce électronique et les réseaux sociaux.

Alimentez vos modèles avec des données structurées de haute qualité.

Accédez à des millions d'enregistrements de texte, d'images et de données structurées pour former des modèles d'IA, alimenter des LLM et créer des applications intelligentes.

Prenez des décisions d'investissement fondées sur des données

Suivez les indicateurs de croissance de l'entreprise, les cycles de financement, les changements de direction et les signaux du marché afin d'identifier les opportunités d'investissement.

Découvrez des opportunités immobilières grâce aux données du marché

Surveillez les annonces, les tendances des prix, les tarifs de location et les caractéristiques des propriétés sur plusieurs marchés afin d'identifier les opportunités.

Prêt à dynamiser votre entreprise grâce aux API de données ?

Accédez à plus de 190 API de données en temps réel avec un filtrage alimenté par l’IA et une livraison flexible.

FAQ sur les API de flux de données

Les API de flux de données sont des API RESTful qui vous permettent de filtrer des jeux de données et de créer des instantanés contenant uniquement les données dont vous avez besoin. Le point de terminaison de l'API Filter Dataset lance une tâche asynchrone qui filtre l'ensemble de données sélectionné et crée un instantané basé sur vos critères, que vous pouvez ensuite télécharger ou consulter par programmation.

Lorsque vous appelez l'API Filter Dataset, celle-ci crée une tâche asynchrone qui applique vos filtres et génère un instantané. Le processus a un délai d'expiration maximal de 5 minutes. Une fois terminé, vous recevez un snapshot_id que vous pouvez utiliser pour accéder à vos données filtrées. Vous n'êtes facturé que pour la taille de l'instantané, sur la base du prix de l'enregistrement.

L'API prend en charge un large éventail d'opérateurs : = (égal), != (différent), < et > (inférieur/supérieur à), <= et >= (inférieur/supérieur ou égal), « in » et « not_in » (correspondance de valeur), « includes » et « not_includes » (sous-chaîne/tableau contient), « array_includes » et « not_array_includes » (correspondance exacte de tableau), et « is_null » / « is_not_null » pour vérifier les valeurs vides. Différents opérateurs s'appliquent à différents types de champs (texte, nombre, date, tableau).

Oui. Vous pouvez combiner plusieurs filtres à l'aide des opérateurs logiques « and » ou « or » dans les groupes de filtres. L'API prend en charge une profondeur d'imbrication maximale de 3 niveaux. Pour les tableaux d'objets, vous pouvez utiliser le paramètre « combine_nested_fields » afin de vous assurer que tous les filtres correspondent au sein d'un seul objet plutôt que dans l'ensemble du tableau.

L'API prend en charge deux modes : le mode JSON pour le filtrage standard et le mode Multipart/Form-Data pour le téléchargement de fichiers CSV ou JSON contenant des valeurs de filtre. En mode Multipart, envoyez dataset_id et records_limit en tant que paramètres de requête, puis incluez votre définition de filtre et vos fichiers dans le corps du formulaire. Ce mode est idéal pour filtrer des centaines ou des milliers de valeurs.

Vous n'avez besoin que de deux éléments : votre identifiant de jeu de données (qui se trouve sur la page de détails du jeu de données) et votre clé API Bright Data. Incluez votre clé API en tant que jeton Bearer dans l'en-tête d'autorisation. Aucune zone Proxy, aucun mot de passe ni aucune information d'identification supplémentaire ne sont nécessaires pour filtrer les jeux de données.

Les instantanés filtrés sont disponibles aux formats JSON, NDJSON, CSV et Parquet. Vous pouvez spécifier votre format préféré lors du téléchargement de l'instantané ou de la configuration de votre méthode de livraison.

Une fois que l'API a renvoyé un snapshot_id, vous pouvez récupérer vos données filtrées via un téléchargement direct, une réponse API, des rappels Webhook, Amazon S3, Google Cloud Storage, Snowflake, Azure, SFTP ou par e-mail. Choisissez la méthode de livraison qui correspond le mieux à votre flux de travail.

L'API renverra une erreur 422 avec le message « Le filtre fourni ne correspond à aucun enregistrement ». Vérifiez la syntaxe et les valeurs de votre filtre pour vous assurer qu'elles correspondent aux données du jeu de données. Vous pouvez prévisualiser les champs du jeu de données et des exemples de données dans le panneau de configuration avant de filtrer.

Oui. Chaque jeu de données a une limite maximale de 100 tâches parallèles. Si vous dépassez cette limite, vous recevrez une erreur 429. Attendez que les tâches existantes soient terminées avant d'en commencer de nouvelles, ou contactez-nous pour les cas d'utilisation à volume élevé nécessitant des limites accrues.

Si le solde de votre compte est insuffisant pour traiter l'instantané filtré, vous recevrez une erreur 402 indiquant le montant nécessaire. Ajoutez des fonds à votre compte ou ajustez votre filtre pour réduire le nombre d'enregistrements avant de réessayer.

Des exemples de code complets sont disponibles dans la documentation API pour cURL, Python, JavaScript et Java. Chaque exemple montre comment s'authentifier, structurer votre demande de filtre et traiter la réponse. Vous pouvez également générer une syntaxe de filtre directement à partir du panneau de configuration en appliquant des filtres dans l'interface utilisateur et en cliquant sur « Filter API » (API de filtre).

Commencez dès aujourd'hui à accéder à des données en temps réel

Filtrez, récupérez et intégrez des données web via de puissantes API.