Wikipedia-Artikel per Titel, URL oder Wikidata-ID über die offizielle MediaWiki-API extrahieren. Liefert Artikeltitel, Summary (erster Absatz), Plaintext-Volltext, Thumbnail, Lead-Image, alle Kategorien, geografische Koordinaten wenn anwendbar, die Wikidata-Q-ID, Pageviews der letzten 30 Tage und Referenzen zu anderen Sprachen. Unterstützt 12+ Sprachen inklusive Englisch, Deutsch, Französisch, Spanisch, Chinesisch und Japanisch. Ideal für KI-Trainingsdaten, Knowledge-Graph-Anreicherung, RAG-Ingestion und Referenzdatenbanken.
# Einen Lauf über die Apify-API starten curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/runs?token=YOUR_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "queries": [ "Stripe (Unternehmen)", "OpenAI", "Eiffelturm", "Albert Einstein", "Transformer (Machine-Learning-Modell)" ], "language": "de", "extractFullContent": true, "includePageviews": true }' # Oder mit KI-Agenten via MCP verwenden: # https://mcp.apify.com?tools=santamaria-automations/wikipedia-scraper
| Feld | Typ | Beispiel |
|---|---|---|
| title | string | Eiffelturm |
| page_id | integer | 9202 |
| wikidata_id | string | Q243 |
| summary | string | Der Eiffelturm ist ein Stahlfachwerkturm... |
| content | string | Der Eiffelturm (französisch La Tour Eiffel)... |
| thumbnail_url | string | https://upload.wikimedia.org/wikipedia/commons/... |
| categories | array | ["Eiffelturm","Türme in Paris"] |
| coordinates | object | {"lat":48,8584,"lon":2,2945} |
| pageviews_30d | integer | 512.847 |
| canonical_url | string | https://de.wikipedia.org/wiki/Eiffelturm |
Klicken Sie oben auf Auf Apify öffnen, um wikipedia-scraper im Browser auszuführen – kein Code, keine Installation. In der Apify-Konsole erhalten Sie:
Um diesen Actor aus Ihrem eigenen Code auszuführen, benötigen Sie einen Apify API-Token. In etwa einer Minute erledigt:
Gratiskontingent: Apify schreibt Ihrem Konto 5$ Plattformnutzung pro Monat gut, keine Kreditkarte erforderlich. Genug, um jeden Actor sinnvoll zu testen — bei 0,001$ pro Ergebnis sind das etwa 5.000 Ergebnisse gratis pro Monat.
Führen Sie diesen Actor aus jeder Sprache über die Apify-REST-API aus. Ersetzen Sie YOUR_TOKEN durch Ihren API-Token und passen Sie das JSON-Input an.
curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN" \
-H "Content-Type: application/json" \
-d '{}'// npm install apify-client
import { ApifyClient } from 'apify-client';
const client = new ApifyClient({ token: 'YOUR_TOKEN' });
const run = await client.actor('santamaria-automations/wikipedia-scraper').call({});
const { items } = await client.dataset(run.defaultDatasetId).listItems();
console.log(items);# pip install apify-client
from apify_client import ApifyClient
client = ApifyClient('YOUR_TOKEN')
run = client.actor('santamaria-automations/wikipedia-scraper').call(run_input={})
items = list(client.dataset(run['defaultDatasetId']).iterate_items())
print(items)// dotnet add package Apify.Client
using Apify.Client;
var client = new ApifyClient("YOUR_TOKEN");
var run = await client.Actor("santamaria-automations/wikipedia-scraper").CallAsync(new { });
var items = await client.Dataset(run.DefaultDatasetId).ListItemsAsync();// Maven: com.apify:apify-client
import com.apify.client.ApifyClient;
ApifyClient client = new ApifyClient("YOUR_TOKEN");
ActorRun run = client.actor("santamaria-automations/wikipedia-scraper").call(Map.of());
List<Map<String,Object>> items = client.dataset(run.getDefaultDatasetId()).listItems();Dieser Actor ist auf dem Apify MCP-Server verfügbar, sodass Sie ihn von jedem MCP-kompatiblen KI-Client aus steuern können – Claude Desktop, Claude.ai, Cursor, VS Code, LangChain, LlamaIndex oder einem eigenen Agent – ohne Code zu schreiben.
https://mcp.apify.com?tools=santamaria-automations/wikipedia-scraperBeispiel-Prompt nach Verbindung:
"Verwende wikipedia-scraper, um einen Scrape durchzuführen, und liefere mir die Ergebnisse als Tabelle."
Clients mit dynamischer Tool-Discovery (Claude.ai, VS Code) erhalten das vollständige Input-Schema automatisch via add-actor.
Triggern Sie diesen Actor aus Ihrem Automatisierungstool. Alle unten aufgeführten Plattformen können die Apify-API in wenigen Klicks aufrufen — kein Code erforderlich.
@apify/n8n-nodes-apify installieren).santamaria-automations/wikipedia-scraper.https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN hinzu.application/json.https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN, Methode POST, Body raw JSON.https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN.steps.http.$return_value zu.https://api.apify.com/v2/acts/santamaria-automations~wikipedia-scraper/run-sync-get-dataset-items?token=YOUR_TOKEN, Body type JSON.