Wikipedia Scraper : articles, résumés et métadonnées, 0,50$ pour 1 000 articles

Extrayez des articles Wikipedia par titre, URL ou ID Wikidata via l'API officielle MediaWiki. Retourne titre de l'article, résumé (premier paragraphe), contenu complet en texte brut, miniature, image principale, toutes les catégories, coordonnées géographiques quand applicable, ID Wikidata Q, pageviews des 30 derniers jours et références aux autres langues. Supporte 12+ langues incluant anglais, allemand, français, espagnol, chinois et japonais. Idéal pour données d'entraînement IA, enrichissement de graphe de connaissances, ingestion RAG et bases de référence.

Ouvrir sur Apify → Essayez maintenant
Tarif
0,0005$/article
RAM
128MB
Couverture
12+ langues
Champs de sortie
20+
Proxy
Apify datacenter
Tech
API MediaWiki

Ce que vous obtenez

Cas d'usage principaux

Exemple d'API

# Lancer une exécution via l'API Apify
curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/runs?token=YOUR_TOKEN" \
 -H "Content-Type: application/json" \
 -d '{
 "queries": [
 "Stripe (entreprise)",
 "OpenAI",
 "Tour Eiffel",
 "Albert Einstein",
 "Transformer (modèle d\u0027apprentissage automatique)"
 ],
 "language": "fr",
 "extractFullContent": true,
 "includePageviews": true
 }'

# Ou utiliser avec des agents IA via MCP :
# https://mcp.apify.com?tools=santamaria-automations/wikipedia-scraper

Intégrations

Champs de sortie

ChampTypeExemple
titlestringTour Eiffel
page_idinteger9202
wikidata_idstringQ243
summarystringLa tour Eiffel est une tour de fer puddlé...
contentstringLa tour Eiffel est une tour de fer puddlé de 330 mètres...
thumbnail_urlstringhttps://upload.wikimedia.org/wikipedia/commons/...
categoriesarray["Tour Eiffel","Tours de Paris"]
coordinatesobject{"lat":48,8584,"lon":2,2945}
pageviews_30dinteger512 847
canonical_urlstringhttps://fr.wikipedia.org/wiki/Tour_Eiffel

Acteurs associés

Exécutez cet actor directement sur Apify (sans code)

Cliquez sur Ouvrir sur Apify ci-dessus pour lancer wikipedia-scraper dans votre navigateur – sans code, sans installation. Dans la console Apify, vous obtenez :

Obtenez votre jeton API Apify

Pour lancer cet actor depuis votre propre code, il vous faut un jeton API Apify. Environ une minute :

  1. Inscrivez-vous gratuitement à Apify (Google, GitHub ou e-mail).
  2. Allez dans Paramètres → Intégrations → Jetons API.
  3. Cliquez sur Créer un nouveau jeton API. Copiez et gardez-le secret.

Quota gratuit : Apify crédite votre compte de 5$ d'usage plateforme par mois, sans carte bancaire. Assez pour tester n'importe quel actor — à 0,001$ par résultat, c'est environ 5 000 résultats gratuits chaque mois.

Appeler depuis votre code

Lancez cet actor depuis n'importe quel langage via l'API REST Apify. Remplacez YOUR_TOKEN par votre jeton API et adaptez le JSON d'entrée.

curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{}'
// npm install apify-client
import { ApifyClient } from 'apify-client';

const client = new ApifyClient({ token: 'YOUR_TOKEN' });
const run = await client.actor('santamaria-automations/wikipedia-scraper').call({});
const { items } = await client.dataset(run.defaultDatasetId).listItems();
console.log(items);
# pip install apify-client
from apify_client import ApifyClient

client = ApifyClient('YOUR_TOKEN')
run = client.actor('santamaria-automations/wikipedia-scraper').call(run_input={})
items = list(client.dataset(run['defaultDatasetId']).iterate_items())
print(items)
// dotnet add package Apify.Client
using Apify.Client;

var client = new ApifyClient("YOUR_TOKEN");
var run = await client.Actor("santamaria-automations/wikipedia-scraper").CallAsync(new { });
var items = await client.Dataset(run.DefaultDatasetId).ListItemsAsync();
// Maven: com.apify:apify-client
import com.apify.client.ApifyClient;

ApifyClient client = new ApifyClient("YOUR_TOKEN");
ActorRun run = client.actor("santamaria-automations/wikipedia-scraper").call(Map.of());
List<Map<String,Object>> items = client.dataset(run.getDefaultDatasetId()).listItems();

Utiliser avec des agents IA (MCP)

Cet actor est disponible sur le serveur MCP Apify, vous pouvez donc le piloter depuis n'importe quel client IA compatible MCP – Claude Desktop, Claude.ai, Cursor, VS Code, LangChain, LlamaIndex ou un agent maison – sans écrire de code.

https://mcp.apify.com?tools=santamaria-automations/wikipedia-scraper

Exemple de prompt une fois connecté :

"Utilise wikipedia-scraper pour lancer un scrape et donne-moi les résultats sous forme de tableau."

Les clients avec découverte dynamique des outils (Claude.ai, VS Code) reçoivent le schéma d'entrée complet automatiquement via add-actor.

Utiliser avec des plateformes no-code

Déclenchez cet actor depuis votre outil d'automatisation. Toutes les plateformes ci-dessous peuvent appeler l'API Apify en quelques clics — sans code.

  1. Ajoutez le node Apify pour n8n (installé par défaut sur n8n Cloud ; en self-hosted installez @apify/n8n-nodes-apify).
  2. Définissez Actor sur santamaria-automations/wikipedia-scraper.
  3. Choisissez l'opération Run Actor and get dataset, collez votre JSON d'entrée, et connectez un node aval (Google Sheets, Postgres, webhook, …).
  1. Créez un nouveau Zap avec n'importe quel déclencheur.
  2. Ajoutez une action Webhooks by Zapier POST vers https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN.
  3. Body : votre JSON d'entrée. Content-Type : application/json.
  1. Créez un nouveau scénario.
  2. Ajoutez un module HTTP : URL https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN, méthode POST, body raw JSON.
  3. Parsez la réponse avec un module JSON pour itérer les items en aval.
  1. Créez un nouveau workflow.
  2. Ajoutez une étape HTTP Request : POST vers https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN.
  3. Accédez à steps.http.$return_value dans les étapes suivantes.
  1. Installez le plugin API Connector.
  2. Ajoutez une nouvelle API : POST https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN, body type JSON.
  3. Initialisez l'appel avec votre input, puis référencez le tableau de réponse dans les actions de workflow.
Ouvrir sur Apify → Essayez maintenant (version gratuite disponible)