Jeux de données GitHub
Les jeux de données GitHub constituent une source dynamique de données qui alimente l’innovation, permettant aux entreprises et aux chercheurs d’extraire des informations précieuses
- Des centaines de milliers d’enregistrements disponibles
- Exploitez tous les principaux points de données sur Github
- Exemples de données Github à télécharger gratuitement
Available datasets
Access fresh validated GitHub datasets. Ensure hassle-free data access by using ready-made scrapers.
- Demo data in JSON/CSV
- Fresh records
- Customize, enrich, and format the data
LinkedIn people profiles
Amazon products
LinkedIn company information
Crunchbase companies information
Instagram - Profiles
Linkedin job listings information
Zillow properties listing information
Google Maps businesses
Instagram - Posts
LinkedIn posts
X (formerly Twitter) - Posts
Shopee - products
Walmart - products
TikTok - Profiles
B2B Contacts and Companies' Data - 3rd party dataset
Facebook - Pages Posts by Profile URL
Amazon Reviews
Employees business enriched dataset
Indeed job listings information
TikTok - Posts
IMDB media
YouTube - Profiles
Airbnb Properties Information
Companies information enriched dataset
Youtube - Videos posts
Glassdoor companies overview information
Yahoo Finance business information
X (formerly Twitter) - Profiles
Otodom Poland
Shein- Products
Facebook - Comments
Instagram - Reels
Glassdoor job listings information
Instagram - Comments
Amazon products global dataset
Yelp businesses overview
Booking Hotel Listings
Google News
LinkedIn profiles Jobs Listings
TikTok Shop
Zoominfo companies information
Google maps reviews
Glassdoor companies reviews
eBay
G2 software product overview
Reddit- Posts
Amazon best seller products
pitchbook companies information
Australia real estate properties
Google Shopping
Github repository
Amazon sellers info
Amazon Walmart
Facebook - Posts by group URL
Zara - Products
Goodreads books
Google Play Store
G2 software - product reviews
Home Depot US
Booking Listings Search
Facebook Marketplace
TikTok - Comments
Etsy
Amazon products search
Facebook - Posts by post URL
Lazada - Products
Ikea - Products
Best Buy products
Yelp businesses reviews
World population
Zillow price history
Target
NBA players' stats
Zoopla properties listing information
Myntra products
Trustpilot business reviews
Reuters news
Sephora products
Indeed companies info
Ozon.ru products
Reddit - Comments
BBC news
Pinterest - Posts
Wikipedia articles
Owler companies information
carsales.com.au - Cars Listings
Youtube - Comments
H&M - Products
US lawyers directory
Realtor international properties listings
Slintel 6sense company information
Webmotors Brasil - Cars Listings
Facebook - Reels by profile URL
Facebook Company Reviews
Creative Commons Images
Tokopedia Products
Lowes.com
OLX Brazil - marketplace ads
Pitchbook People Profiles
CNN news
Xing social network
Wildberries.ru products
Digikey - Products
Facebook Events
Mouser - Products
Wayfair products
Zalando products
Lego - Products
Asos - Products
Apple App Store
Creative Commons 3D Models
Pinterest - Profiles
Google Play Store reviews
Manta businesses
Google Shopping products search US
Bluesky - Posts
Chanel Products
Lazada - Reviews
Chileautos Chile - Cars Listings
Nordstrom products
Inmuebles24 Mexico - Properties Listings
Metrocuadrado - Properties Listings
VentureRadar company information
Dior - Products
Quora posts
Top 500 Bluesky Profiles
Zonaprop Argentina - Properties Listing
AE.com - Complete Products
Carsales Cars Listings search page information
Vimeo - Videos posts
Trustradius product reviews
Home Depot CA
Hermes- Products
Twitch - streams dataset
Apple App Store reviews
Toctoc - Properties Listings
World zipcodes
Yapo Chile - marketplace ads
Agoda Properties Listings
Toysrus - Products
Ashleyfurniture - Products
Lazada products search (GMV)
Balenciaga.com - Products
Mediamarkt.de products
Mango Products
Walmart sellers info
Infocasas Uruguay - Properties Listings
Fendi Products
Zara Home Products
Properati Argentina and Colombia - Properties Listings
Ysl.com - Products
Walmart - products zipcodes
Carters.com - Products
Crateandbarrel - Products
Prada.com - Products
Fanatics.com - Products
Bottegaveneta.com - Products
Loewe.com - Products
Massimo Dutti - Products
Sleepnumber.com - Products
Berluti.com - Products
Moynat.com - Products
Delvaux - Products
Celine.com - Products
Mybobs.com - Products
Zillow Full Properties Information
llbean.com - Products
Montblanc - Products
Raymourflanigan.com - Products
ChatGPT Search
Mattressfirm - Products
La-z-boy.com - Products
Zillow properties search page
LinkedIn people search
Walmart products search
Perplexity Search
TikTok - Posts by URL Fast API
Bing Copilot Search
TikTok - Posts by Search URL Fast API
TikTok - Posts by Profile Fast API
Échantillon de l’ensemble de données GitHub
L’ensemble de données du dépôt GitHub fournit des informations essentielles sur le monde du logiciel libre. Avec des informations complètes sur les langages de codage, la taille des dépôts et les contributions des utilisateurs, cet ensemble de données permet aux utilisateurs de se plonger dans les subtilités du développement logiciel.
Tarifs des ensembles de données
- Propres et validés
- Actualisés tous les mois
- JSON/CSV/Parquet
Jeux de données GitHub adaptés à vos besoins
Abonnement aux données
Abonnez-vous pour accéder à des ensembles de données à un coût considérablement réduit.
Formats de sortie de fichiers
JSON, NDJSON, JSON Lines, CSV, Parquet. Compression .gz optionnelle.
Livraison flexible
Snowflake, compartiment Amazon S3, Google Cloud, Azure et SFTP.
Données évolutives
Développez vos capacités sans vous soucier de l’infrastructure, des serveurs proxys ou des blocs.
Réduction des coûts
Personnalisez n’importe quel ensemble de données à l’aide de filtres et d’options de formatage.
Maintenabilité du code
Les ensembles de données sont gérés en fonction des modifications apportées à la structure du site Web.
Intégrations simplifiées
Bénéficiez d’intégrations avec Snowflake et AWS.
Assistance 24h/24, 7j/7
Notre équipe de spécialistes du traitement et de l’analyse des données est là pour vous aider.
Leaders en conformité
Données obtenues de manière éthique, conformes à toutes les lois de protection des données personnelles.
Obtenez des données GitHub structurées et fiables
Nous fournissons les données et vous vous occupez du reste
Gros volume de données Web
Grâce à nos capacités de déblocage et à la rotation permanente des adresses IP, nous garantissons l’accès à tous les points de données d’un site Web.
Données immédiatement exploitables
Chaque aspect du processus de collecte des données est soumis à un processus rigoureux de validation des données.
Flux de données automatisé
Planifiez la livraison automatique des données et voyez comment elles seront facilement acheminées vers votre espace de stockage.
Comment les entreprises utilisent le jeu de données GitHub
Activité des développeurs
Implication de la communauté
Améliorer l’engagement
FAQ sur les jeux de données GitHub
Quelles sont les données incluses dans l’ensemble de données GitHub ?
L’ensemble de données GitHub comprend différents points de données qui répondent à vos besoins. Voici quelques-uns de ces points de données : URL, ID, code, langage de programmation, nombre de lignes, nom d’utilisateur, URL d’utilisateur, taille, unité de taille, nombre de taille, nombre de projets, nombre de forks, nombre d’étoiles, et bien plus encore.
Puis-je obtenir des mises à jour pour l’ensemble de données GitHub que j’ai acheté ?
Oui, vous pouvez obtenir des mises à jour de votre ensemble de données GitHub chaque jour, chaque semaine, chaque mois, ou bien sur une période personnalisée.
Puis-je acheter un sous-ensemble de l’ensemble de données GitHub ?
Oui, vous pouvez acheter un sous-ensemble GitHub qui n’inclura que les points de données dont vous avez besoin. L’achat d’un sous-ensemble permet de réduire considérablement les coûts.
Dans quel format vais-je recevoir le jeu de données GitHub ?
Les formats des jeux de données sont JSON, NDJSON, JSON Lines, CSV ou Parquet. En option, les fichiers peuvent être compressés au format .gz.
Puis-je scraper moi-même les données publiques de GitHub ?
Si vous ne souhaitez pas acheter un jeu de données, vous pouvez commencer à scraper les données de GitHub en utilisant notre API GitHub Scraper.
Puis-je obtenir un échantillon de données ?
Oui, vous pouvez demander un échantillon de données pour évaluer la qualité et la pertinence des informations fournies. C’est un excellent moyen de s’assurer qu’elles répondent à vos besoins avant de vous engager dans un ensemble complet de données.
Puis-je demander des points de données spécifiques de l’ensemble de données GitHub ?
Oui, vous pouvez demander des points de données spécifiques de l’ensemble de données GitHub en fonction de vos besoins particuliers, ce qui vous permet de recevoir précisément les informations dont vous avez besoin pour vos projets.
Est-il possible d’intégrer l’ensemble de données GitHub directement dans mes systèmes existants ?
Absolument, notre API transparente permet d’intégrer sans effort notre ensemble de données GitHub dans votre CRM, vos outils d’analyse ou tout autre système que vous utilisez, rationalisant ainsi vos opérations.