Ingest-Engine · parse · Pilot

Unstrukturiert hinein. Strukturierte Daten heraus.

Orves ORIS verwandelt komplexe Dokumente mit einem einzigen authentifizierten API-Aufruf in strukturierte, quellverknüpfte Daten. Asynchron von Grund auf: Dokument einreichen, Job abfragen, Ergebnis abholen. Eigenständige API, im privaten Pilot; die erste Schicht, nicht das Endziel.

PDF · im Pilotasynchrone JobsStruktur erhaltenreproduzierbar
POST /v1/oris
# submit a document (multipart)
POST /v1/oris  file=@contract_2024.pdf

# 202 Accepted
{ "id": "prs_9f2c41…", "object": "oris",
  "status": "queued" }

# poll until completed
GET /v1/oriss/prs_9f2c41…
{ "status": "completed",
  "result": { "json_url": "…/result" } }
Das Problem

Beim Parsing fangen KI-Systeme an zu lügen.

Die meisten Parser plätten Dokumente zu einer Zeichenkette. Struktur, Geometrie, Tabellen und Provenienz werden zerstört, bevor irgendein Modell den Inhalt sieht — und kein späterer Schritt holt zurück, was das Parsing verloren hat.

geplättete Tabellenverlorene Lesereihenfolgeverwaiste Fußnotenkeine Quell-Spansstille Lesefehler
der NormalfallDokument„eine lange Zeichenkette“LLMselbstsicher, und falsch
mit ORISDokumentArtefakte + SpansLLMverankert, prüfbar
Was es erzeugt

Struktur, keine Suppe.

Strukturierte Ausgabe

  • Überschriften
  • Tabellen
  • Lesereihenfolge

Was der Pilot heute zurückgibt: die Struktur des Dokuments als sauberes Markdown erhalten.

Asynchrone Jobs

  • Job-ID
  • Polling
  • Idempotenz

202 beim Einreichen, Job abfragen, Ergebnis abholen. Ein fehlgeschlagenes Parsing wird nie berechnet.

Quellverknüpft von Grund auf

  • Provenienz
  • versioniert
  • Roadmap

Die Ausgabe bleibt an das Dokument gebunden, das sie erzeugt hat. Typisierte Elemente, Koordinaten und Zertifikate sind die veröffentlichte Richtung — angekündigt erst bei Auslieferung.

So funktioniert es

Von der Eingabe zur geregelten Ausgabe.

PDF hineinORISJobErgebnisstrukturierte Ausgabe
Zeig es mir

Eine Antwort, genau so, wie die API sie zurückgibt.

Links: die Seite. Rechts: was Sie erhalten — die Struktur des Dokuments als sauberes, strukturiertes Markdown erhalten.

Tabelle · erkannt Struktur erhalten p. 12
GET /v1/oriss/{id}/result
# 200 OK
{ "markdown": "# Q2 Report\n\n## Revenue by segment\n\n| Segment | Q2 |\n| --- | --- |\n| Cloud | 104.2 |\n| Devices | 61.8 |\n\nRenewal is scheduled for…" }

Antwort aus dem laufenden Pilot-Vertrag. Typisierte Strukturatome mit Geometrie und Koordinaten sind die veröffentlichte Richtung — angekündigt bei Auslieferung, nie vorher.

Benchmarks

Gemessen, bevor behauptet.

Was wir messen: Lesereihenfolge, Tabellenstruktur, Textgenauigkeit, Formularfelder und Treue bei langen Dokumenten — und Diagramme, wo das Parsing sich enthält, statt zu raten.

Öffentliche Ergebnisse werden erst nach vorab registrierter Auswertung freigegeben — bis dahin erscheint auf dieser Seite keine Zahl. Wie wir benchmarken →

Eine Eigenschaft, kein Produkt

Jedes Artefakt ist überprüfbar.

Zertifizierung durchzieht alles, was Orves erzeugt. Die Überprüfung ist so angelegt, dass sie öffentlich, reproduzierbar und unabhängig von einem Orves-Konto ist.

✓ Provenienz✓ IntegritätVersionBelegAuflösungszustandÜberprüfungtrust →
API zuerst

In Minuten integriert.

Alles wird über die verwaltete API bereitgestellt — keine zusätzliche Infrastruktur zu betreiben.

REST APIPythonTypeScriptGoJavaOpenAPIBeispiele

Machen Sie Ihr erstes Dokument zu strukturierten Daten.

15.000 Gratis-Credits · keine Kreditkarte · privater Pilot.