
Manifest
Manifest wandelt jede URL in eine strukturierte JSON-Karte von aktionsfähigen UI-Elementen – Schaltflächen, Formularen und Eingaben – um, sodass KI-Agenten zuverlässig klicken, ausfüllen und absenden können, ohne fragile Selektoren oder Screenshots zu verwenden.
https://omfang.io/?ref=producthunt&utm_source=aipure

Produktinformationen
Aktualisiert:Jul 23, 2026
Was ist Manifest
Manifest (von omfang) ist eine „Aktionsschicht“-API für KI-Agenten, die eine Webseite in eine saubere, agentenlesbare Darstellung dessen umwandelt, was auf dieser Seite getan werden kann. Anstatt einem Agenten nur zu zeigen, wie eine Seite aussieht (Browser-Tools) oder was sie sagt (Scraper/Inhalts-Extraktoren), identifiziert Manifest die interaktiven Steuerelemente – wie Eingaben, Schaltflächen und Navigationslinks – und beschreibt sie mit dem Kontext, den ein Agent benötigt, um korrekt zu handeln, einschließlich dessen, was erforderlich ist, bevor er fortfahren kann.
Hauptfunktionen von Manifest
Manifest ist eine API, die jede Webseiten-URL in eine strukturierte JSON-„Aktionskarte“ umwandelt, die ein KI-Agent zuverlässig verstehen und ausführen kann. Sie analysiert den Zugänglichkeitsbaum der Seite (wie ein Screenreader) und gleicht ihn mit dem zugrunde liegenden DOM ab, um umsetzbare UI-Elemente – Schaltflächen, Formulare, Eingaben – und die Details zu erfassen, die Agenten zum Erfolg benötigen (Pflichtfelder, Eingabetypen, Platzhalter, deaktivierte Zustände). Dabei werden anfällige CSS-Selektoren und Screenshot-Raten vermieden, während die Widerstandsfähigkeit gegenüber UI-Neugestaltungen erhalten bleibt.
URL → JSON-Aktionsmanifest: Ein API-Aufruf wandelt eine Webseite in eine saubere, strukturierte Liste von Aktionen (Klicken/Ausfüllen/Senden) plus Navigationslinks um, wodurch Seiten für Agenten programmatisch bedienbar werden.
Verständnis durch den Zugänglichkeitsbaum: Liest den Zugänglichkeitsbaum so, wie es unterstützende Technologien tun, und erstellt stabile, semantische Beschreibungen interaktiver Elemente anstelle von anfälligen visuellen oder selektorbasierten Heuristiken.
DOM-Querverweise für fehlende Details: Ergänzt Zugänglichkeitsdaten mit DOM-abgeleiteten Spezifika wie Pflichtfeldern, Eingabetypen, Platzhaltern und deaktivierten Zuständen – entscheidend für das korrekte Ausfüllen von Formularen.
Agenten-verständliche Ausgabe (nicht rohes HTML): Gibt Aktionen mit Beschriftungen, Typen, Beschreibungen und Anforderungsflags zurück, damit Agenten Schritte planen können (z. B. was vor dem Absenden ausgefüllt werden muss), ohne benutzerdefinierte Analyse.
Widerstandsfähig gegenüber UI-Neugestaltungen: Vermeidet manuell gepflegte Selektoren und anfällige CSS-Pfade, die bei Seitenänderungen brechen, und verbessert die langfristige Zuverlässigkeit der Automatisierung.
Caching für Geschwindigkeit und vorhersehbare Kosten: Gecachte Antworten sind schnell und sollen wiederholte Kosten für Agenten reduzieren, die dieselben URLs häufig besuchen.
Anwendungsfälle von Manifest
Web-Aufgabenautomatisierung für KI-Agenten: Ermöglicht Agenten, mehrstufige Website-Aufgaben (Formulare ausfüllen, Schaltflächen anklicken, Abläufe absenden) zuverlässig mithilfe einer strukturierten Aktionsebene anstelle von Screenshots oder anfälligen Selektoren zu erledigen.
Kundensupport und Self-Service-Workflows: Unterstützt Support-Agenten/Bots, die Kontoportale navigieren, Anfragen einreichen und Benutzer durch Webformulare führen können, indem sie verstehen, welche Aktionen verfügbar und erforderlich sind.
Vertriebs- und Lead-Erfassungsautomatisierung: Automatisiert Outreach-Operationen wie das Absenden von Kontaktformularen, das Anfordern von Demos oder das Ausfüllen von Partner-Onboarding-Formularen unter korrekter Handhabung von Pflichtfeldern und Eingabetypen.
QA- und Regressionstests für Webanwendungen: Erzeugt ein stabiles Inventar interaktiver Elemente für die Testautomatisierung, das weniger empfindlich auf UI-Refactorings reagiert, wodurch die Wartbarkeit von End-to-End-Tests verbessert wird.
RPA-Modernisierung für Unternehmen: Ersetzt selektorlastige RPA-Skripte durch eine semantische Aktionsmanifest-Ebene, um Ausfälle bei internen Tools und externen Websystemen zu reduzieren.
Barrierefreiheitsbewusste Automatisierung: Nutzt den Zugänglichkeitsbaum, um Automatisierungen voranzutreiben, die mit barrierefreien Semantiken übereinstimmen, und hilft so sicherzustellen, dass Agenten robust und screenreader-ähnlich mit Seiten interagieren.
Vorteile
Robuster als handgeschriebene Selektoren durch die Nutzung von Zugänglichkeitssemantiken und DOM-Validierung.
Agentenfreundliche strukturierte JSON-Ausgabe, die verfügbare Aktionen und Anforderungen explizit auflistet.
Vermeidet Screenshot-basiertes Raten, was deterministischere Automatisierungsabläufe ermöglicht.
Caching kann die Leistung verbessern und wiederholte Interaktionen kostengünstiger machen.
Nachteile
Die Effektivität kann von der Qualität des Zugänglichkeitsbaums und der DOM-Struktur einer Website abhängen (schlecht beschriftete Seiten können weniger nützliche Manifeste ergeben).
Beschreibt primär, was auf einer Seite getan werden kann; die Ausführung von Aktionen erfordert immer noch eine Agenten-Laufzeit/ein Browser-Tool.
Dynamische oder stark geskriptete UIs erfordern möglicherweise zusätzliche Handhabung über die statische Elementerkennung hinaus.
Wie verwendet man Manifest
1) Zugang zu Manifest erhalten: Gehen Sie zu https://omfang.io/ und klicken Sie auf „Get your API key“ (oder besuchen Sie https://app.manifest.omfang.io/login), um sich anzumelden und einen API-Schlüssel für die Manifest API zu erhalten.
2) Entscheiden Sie, welche Seite (URL) Sie in Aktionen umwandeln möchten: Wählen Sie die genaue URL aus, auf der Ihr Agent arbeiten muss (z. B. eine Anmeldeseite, eine Kassenseite, ein Kontaktformular). Manifest funktioniert, indem es eine URL besucht und eine strukturierte Aktionskarte für diese Seite erstellt.
3) Rufen Sie den Manifest-Endpunkt auf, um ein Aktionsmanifest zu generieren: Senden Sie eine Anfrage an den in den Docs gezeigten Manifest API-Endpunkt: POST /manifest mit einem JSON-Body wie { "url": "https://example.com" }. Dies veranlasst Manifest, die Seite zu besuchen, den Zugänglichkeitsbaum zu lesen, das DOM abzugleichen und ein strukturiertes JSON-Manifest der verfügbaren Aktionen zurückzugeben.
4) Lesen Sie die zurückgegebene Seitenübersicht (current_page_state): Verwenden Sie in der Antwort-JSON das Feld "current_page_state", um zu verstehen, auf welcher Seite Sie sich befinden (z. B. „Kontaktseite mit einem Nachrichtenformular“). Dies hilft einem Agenten, den Kontext zu bestätigen, bevor er Aktionen ausführt.
5) Verfügbare Aktionen aufzählen (Schaltflächen, Formulare, Eingaben): Überprüfen Sie das "actions"-Array in der Antwort. Jede Aktion enthält Felder wie ID, Beschriftung, Typ, Beschreibung und ob sie erforderlich ist. Dies ist die Kernausgabe: eine strukturierte Liste dessen, was ein Agent anklicken, ausfüllen oder absenden kann.
6) Erforderliche Felder und Einschränkungen vor dem Handeln identifizieren: Verwenden Sie die Metadaten jeder Aktion (z. B. "required": true/false), um festzulegen, was vor dem Absenden ausgefüllt werden muss. Manifest wurde entwickelt, um Details zu enthalten, die Zugänglichkeitsbäume oft übersehen, wie z. B. erforderliche Felder, Eingabetypen, Platzhalter und deaktivierte Zustände.
7) Navigationslinks verwenden, um bei Bedarf zwischen Seiten zu wechseln: Überprüfen Sie das "navigation"-Array (z. B. { "label": "Home", "url": "/" }), um stabile Navigationsziele zu finden. Verwenden Sie diese URLs, um den Agenten zur nächsten Seite zu führen, und führen Sie dann POST /manifest auf der neuen URL erneut aus, um die Aktionskarte der nächsten Seite zu erhalten.
8) Iterieren: Manifest nach jeder Seitenänderung erneut ausführen: Immer wenn der Agent zu einer anderen Seite navigiert oder sich der UI-Zustand ändert, rufen Sie POST /manifest erneut für die aktuelle URL auf. Dies hält die Aktionskarte des Agenten mit dem Live-Seitenstatus in Einklang, ohne auf fragile Selektoren oder Screenshots angewiesen zu sein.
9) Vor der Integration live ausprobieren: Nutzen Sie die Live-Demo unter https://demo.manifest.omfang.io/demo, um das Konzept End-to-End zu sehen: URL rein → strukturiertes JSON-Aktionsmanifest raus.
10) Nutzung und Kosten mit Caching und einem Plan verwalten: Wählen Sie einen Plan von https://omfang.io/#pricing basierend auf dem erwarteten Anrufvolumen (Free/Starter/Pro/Enterprise). Beachten Sie, dass gecachte Antworten als schnell beschrieben werden und normalerweise nicht auf die gleiche Weise wie kalte Anfragen auf Ratenbegrenzungen angerechnet werden, was dazu beiträgt, wiederholte Agenten-Workflows vorhersehbar zu halten.
Manifest FAQs
Manifest ist eine „Action Layer“-API, die jede URL in eine strukturierte JSON-Karte umwandelt, die beschreibt, was ein KI-Agent auf einer Webseite tun kann – Schaltflächen, Formulare und Eingaben – sowie was erforderlich ist, bevor ein Agent fortfahren kann.
Manifest Video
Beliebte Artikel

Atoms: Eine Multi-Agenten-KI-Plattform, die Ideen in startbereite Produkte verwandelt
May 22, 2026

Nano Banana SBTI: Was es ist, wie es funktioniert und wie man es im Jahr 2026 einsetzt
Apr 15, 2026

Atoms Review – Der KI-Produkt-Builder, der die digitale Erstellung im Jahr 2026 neu definiert
Apr 10, 2026

Kilo Claw: Wie man einen echten "Do-It-For-You" KI-Agenten bereitstellt und verwendet (2026 Update)
Apr 3, 2026







