← Alle Beiträge

FourA taucht in Dawn auf, und das ist der Anfang von etwas

Dawn hat diese Woche eine FourA-Integration ausgeliefert. Hinter jeder Agenten-Antwort, die das Live-Web berührt, steht jetzt ein Extraction-Call. Hier ist die Struktur, die sich abzeichnet.

Ein Entwickler öffnet Dawn und fragt: "Scrape https://topstartups.io/ und gib mir die ersten 10 Start-ups inklusive Namen, Beschreibungen, Hauptsitz, Gründungsjahr, URLs und Social-Media-Seiten, formatiert als Tabelle."

Der Agent überlegt kurz, ruft die Seite ab, parst die Einträge, folgt dem Profil jedes Start-ups und liefert die Tabelle zurück. Zehn Zeilen. Jede Spalte ausgefüllt. Pogo, Auctor, Scalify, Omnea, Rivan, Listen Labs, Doppel, Blossom, Avoca, Traba. Hauptsitze in Brooklyn, New York, London, San Francisco, Remote. LinkedIn für die meisten. Gründungsjahre von 2020 bis 2026.

Diese Tabelle war das Ergebnis einer Handvoll FourA Calls.

Diese Woche hat Dawn FourA als erstklassiges Tool direkt in seiner Agent-Plattform integriert. Es befindet sich in deren Integrationsübersicht neben Notion, GitHub und Google Drive. Agenten mit FourA Zugriff können öffentliche Webseiten oder HTTP-Endpoints abrufen, die Response (inklusive JSON) parsen, Formulare absenden, die Erreichbarkeit prüfen und spezifischen Text oder Links aus den Ergebnissen extrahieren. Jeder Agent hat entweder expliziten Zugriff oder nicht. Governance pro Agent, ohne das Risiko, dass jeder Agent unkontrollierten Internetzugriff erhält.

FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello FourA in Dawn's integrations grid, alongside OneDrive, MailJet, Linear, Jira, and Trello

Interessant ist nicht, dass ein Agent eine URL aufrufen kann. Websuche gibt es auf Agenten-Plattformen schon seit einem Jahr. Interessant ist vielmehr die Form des Werkzeugs, die sich gerade herauskristallisiert.

Websuche und URL-Extraktion sind zwei grundverschiedene Aufgaben. Suche dient der Frage: "Was sagt das Internet über X?" Weit gefasst, generativ, auf Zusammenfassungsebene. Extraktion dient der Aufgabe: "Hier ist die URL oder der Endpoint, rufe ihn ab und liefere die strukturierte Antwort." Unterschiedliche Anforderungen an die Zuverlässigkeit, unterschiedliche Kostenprofile, unterschiedliche Fehlerbilder. Beides in ein einziges Werkzeug zu packen, liefert für beides nur mittelmässige Ergebnisse.

Die Integration von Dawn behandelt sie getrennt. Sie bieten ein /web-research-Feature für die breite Suche. FourA dient der zielgerichteten Aufgabe. Ein Agent wählt das passende Werkzeug basierend auf dem, was er tatsächlich benötigt. Genau dieses Reifungsmuster sehen wir 2026 plattformübergreifend: Extraktion entwickelt sich vom einfachen Such-Add-on zu einem eigenständigen Primitive.

Für Plattform-Engineers

Dawn bindet FourA als acht dedizierte Tools ein, die jeweils einem typischen Extraktionsmuster entsprechen:

  • foura_fetch_page für HTML- und Textseiten
  • foura_extract_text für bereinigten, lesbaren Inhalt
  • foura_extract_links für Navigation, Formulare, Scripts und Styles
  • foura_fetch_json für API-Endpoints
  • foura_head_url für Header, Status, Redirects
  • foura_probe_site für schnelle Erreichbarkeitsprüfungen
  • foura_submit_form für Formularübermittlungen ohne Login
  • foura_single_request für beliebige HTTP-Requests

Der Agent wählt anhand der Anforderungen der Anfrage aus. Die obige topstartups-Abfrage nutzte drei davon nacheinander: Fetch, Extract, Follow-up.

Die Integration ist unkompliziert und an einem Tag erledigt. Dahinter liegen zwei Request-Varianten: ein direkter Modus mit browsergleicher Request-Signatur für Seiten ohne aggressives Gating und ein Proxy-gerouteter Modus für den Rest. Beide teilen denselben Request-Aufbau: URL, optionale Header und Body, optionales Response-Parsing. Der Agent entscheidet anhand der Anforderungen der Zielseite.

Der Vertrag, den eine Plattform ihren Agenten anbietet, sieht meist so aus:

  • Eine kleine Auswahl an Funktionen (Fetch / Extract / Probe / Submit), jeweils mit präziser Tool-Definition für den Agenten
  • Standardmässig Proxy-Modus, Fallback auf Direktverbindung bei Latenz- oder Kostenfokus
  • Berechtigungen pro Agent, damit die Plattformkunden die Kontrolle behalten
  • Strukturiertes Response-Parsing als Tool-Parameter, nicht versteckt im System-Prompt

Was die meisten Plattform-Engineers unterschätzen, sind die Edge Cases. Die 80%-Fälle (ein Fetch klappt in 200 ms, liefert sauberes HTML) sind der einfache Teil. Die anderen 20% (Seiten, die nach Request-Signaturen filtern, JS-Challenges vorschalten oder Cloud-IP-Blöcke per 403 sperren) entscheiden darüber, ob dein Agent eine korrekte Antwort liefert oder halluziniert. Wir haben unseren Request-Pfad exakt für diese Randfälle neu aufgebaut. Der Unterschied zwischen "wirkt zuverlässig" und "ist tatsächlich zuverlässig" macht den Grossteil der Arbeit aus.

Wenn du also eine Agenten-Plattform betreibst und deine Kunden ständig fragen, wie ihre Agenten "einfach diese URL prüfen" können: Das ist das Pattern. Die Dokumentation findest du unter /docs. Wir führen dich gerne durch die Details.

Für alle anderen

Du wirst von alldem nichts sehen. Du wirst nur merken, dass ein KI-Assistent, den du nach aktuellen Inhalten einer echten Webseite fragst, korrekt antwortet, statt zu raten oder sich zu entschuldigen.

Das ist das sichtbare Ergebnis eines Extraktions-Primitivs, das zuverlässig genug ist, um neben GitHub und Google Drive in einem Integrations-Grid zu stehen. Es ist kein Forschungsprojekt mehr. Es wird zu solider Infrastruktur.

Warum das wichtig ist

Vor sechs Monaten war ein Agent, der Webseiten lesen musste, noch eine Eigenentwicklung. Individuelle Prompts, fragile Scraper, selbstgebaute Retries und eine Erfolgsrate von 60% an guten Tagen. Die Architektur passte nicht, weil der Layer noch fehlte. Zudem veränderten sich die Zielseiten ständig. Die Bot-Erkennung verlagerte sich von statischen Signalen hin zu Verhaltensanalysen. Zusammengeschusterte Scraper gingen schneller kaputt, als Teams sie patchen konnten.

Jetzt entsteht dieser Layer. Dawn hat ihn integriert und ausgeliefert. Wir erwarten, dass dieses Jahr weitere Agenten-Plattformen folgen und die Schnittstellen konvergieren: ein dediziertes Tool für Suche, ein dediziertes Tool für Extraktion, Governance pro Agent und planbare Kosten.

Wir stehen am Anfang. Aber genau so sieht der Durchbruch aus. Eine Funktion hört auf, ein Projekt zu sein, und wird zum Standardbaustein.

Wenn du eine Agenten-Plattform baust und dieselbe Architektur umsetzen willst, melde dich bei uns. Wenn du Agenten auf Dawn baust, ist FourA bereits integriert. Aktiviere es einfach.