Sauberes Markdown und Klartext aus jeder Website extrahieren, optimiert für KI-Aufnahme, RAG-Pipelines und LLM-Kontextfenster. Readability-Style Hauptinhaltsextraktion entfernt Navigation, Footer, Sidebar und Anzeigen, sodass Ihre KI nur den relevanten Inhalt erhält. Flat Fetch (Tiefe=0) für URL-Listen oder ganze Sites bis Tiefe 5 crawlen. Bis zu 20 parallele Worker.
# Liste an Dokumentationsseiten direkt abrufen (kein Crawling) curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/runs?token=YOUR_TOKEN" \ -H "Content-Type: application/json" \ -d '{ "startUrls": [ "https://docs.example.com/api/overview", "https://docs.example.com/api/authentication" ], "maxDepth": 0, "extractMainContent": true }' # Oder mit KI-Agenten via MCP nutzen: # https://mcp.apify.com?tools=santamaria-automations/website-content-crawler
| Feld | Typ | Beschreibung |
|---|---|---|
| url | string | URL der gecrawlten Seite |
| title | string | Seitentitel (og:title oder HTML-Titel) |
| description | string | Meta-Description |
| markdown | string | Sauberes Markdown, bis 50.000 Zeichen |
| text | string | Klartext, bis 10.000 Zeichen |
| word_count | integer | Wortanzahl des Klartextes |
| content_type | string | article, blog, documentation, generic |
| depth | integer | Crawl-Tiefe (0 = Start-URL) |
| status_code | integer | HTTP-Statuscode |
| scraped_at | string | ISO 8601 UTC-Zeitstempel |
Klicken Sie oben auf Auf Apify öffnen, um website-content-crawler im Browser auszuführen – kein Code, keine Installation. In der Apify-Konsole erhalten Sie:
Um diesen Actor aus Ihrem eigenen Code auszuführen, benötigen Sie einen Apify API-Token. In etwa einer Minute erledigt:
Gratiskontingent: Apify schreibt Ihrem Konto 5$ Plattformnutzung pro Monat gut, keine Kreditkarte erforderlich. Genug, um jeden Actor sinnvoll zu testen — bei 0,001$ pro Ergebnis sind das etwa 5.000 Ergebnisse gratis pro Monat.
Führen Sie diesen Actor aus jeder Sprache über die Apify-REST-API aus. Ersetzen Sie YOUR_TOKEN durch Ihren API-Token und passen Sie das JSON-Input an.
curl -X POST "https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/run-sync-get-dataset-items?token=YOUR_TOKEN" \
-H "Content-Type: application/json" \
-d '{}'// npm install apify-client
import { ApifyClient } from 'apify-client';
const client = new ApifyClient({ token: 'YOUR_TOKEN' });
const run = await client.actor('santamaria-automations/website-content-crawler').call({});
const { items } = await client.dataset(run.defaultDatasetId).listItems();
console.log(items);# pip install apify-client
from apify_client import ApifyClient
client = ApifyClient('YOUR_TOKEN')
run = client.actor('santamaria-automations/website-content-crawler').call(run_input={})
items = list(client.dataset(run['defaultDatasetId']).iterate_items())
print(items)// dotnet add package Apify.Client
using Apify.Client;
var client = new ApifyClient("YOUR_TOKEN");
var run = await client.Actor("santamaria-automations/website-content-crawler").CallAsync(new { });
var items = await client.Dataset(run.DefaultDatasetId).ListItemsAsync();// Maven: com.apify:apify-client
import com.apify.client.ApifyClient;
ApifyClient client = new ApifyClient("YOUR_TOKEN");
ActorRun run = client.actor("santamaria-automations/website-content-crawler").call(Map.of());
List<Map<String,Object>> items = client.dataset(run.getDefaultDatasetId()).listItems();Dieser Actor ist auf dem Apify MCP-Server verfügbar, sodass Sie ihn von jedem MCP-kompatiblen KI-Client aus steuern können – Claude Desktop, Claude.ai, Cursor, VS Code, LangChain, LlamaIndex oder einem eigenen Agent – ohne Code zu schreiben.
https://mcp.apify.com?tools=santamaria-automations/website-content-crawlerBeispiel-Prompt nach Verbindung:
"Verwende website-content-crawler, um einen Scrape durchzuführen, und liefere mir die Ergebnisse als Tabelle."
Clients mit dynamischer Tool-Discovery (Claude.ai, VS Code) erhalten das vollständige Input-Schema automatisch via add-actor.
Triggern Sie diesen Actor aus Ihrem Automatisierungstool. Alle unten aufgeführten Plattformen können die Apify-API in wenigen Klicks aufrufen — kein Code erforderlich.
@apify/n8n-nodes-apify installieren).santamaria-automations/website-content-crawler.https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/run-sync-get-dataset-items?token=YOUR_TOKEN hinzu.application/json.https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/run-sync-get-dataset-items?token=YOUR_TOKEN, Methode POST, Body raw JSON.https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/run-sync-get-dataset-items?token=YOUR_TOKEN.steps.http.$return_value zu.https://api.apify.com/v2/acts/santamaria-automations~website-content-crawler/run-sync-get-dataset-items?token=YOUR_TOKEN, Body type JSON.