AWS Textract vs. Apryse 2026
Amazon Textract ist eine Cloud-API, die gescannte und digitale Dokumente in Text, Tabellen, Formularfelder und Antworten auf Abfragen umwandelt. Apryse ist ein integrierbares Dokumenten-SDK. Seine Module für intelligente Datenextraktion, OCR und Handschrifterkennung (ICR) bieten vergleichbare Funktionen innerhalb Ihrer eigenen Infrastruktur – auch in Ihrem eigenen AWS-Konto. Darüber hinaus umfasst es Funktionen zur Anzeige, Bearbeitung, Konvertierung und Einhaltung von Vorschriften. Diese Seite vergleicht die Überschneidungen beider Lösungen und zeigt klar auf, worin sie sich unterscheiden. So können Sie entscheiden, welche Lösung für Sie geeignet ist.
Schnellvergleich
Schließen Sie sich mehr als 20.000 innovativen Start-ups, Behörden und Fortune-500-Unternehmen an, die auf Apryse vertrauen – darunter 85 der Fortune 100.
Amazon Textract ist ein Dienst, den Sie aufrufen. Apryse ist eine Komponente, die Sie mit Ihrer Anwendung ausliefern.
Für viele Entwickler ist Textract die verlässliche Standardlösung für OCR in der Cloud. Die Extraktion von Rohtext ist kostengünstig, die Tabellenextraktion schneidet in unabhängigen Tests gut ab und die Lösung lässt sich direkt in S3, Lambda, IAM und weitere AWS-Dienste integrieren, ohne dass ein neuer Anbieter eingebunden werden muss. AnalyzeExpense liefert typisierte Rechnungsfelder ganz ohne Konfiguration. Wenn Ihre Pipeline bereits auf AWS basiert und Ihre Dokumente in englischer Sprache gedruckt vorliegen, ist Textract eine gute Standardwahl.
Der Unterschied liegt darin, was Sie erwerben. Textract ist ein Service: Jeder synchrone Aufruf verarbeitet eine Seite, längere Dokumente werden über einen S3-basierten asynchronen Job verarbeitet, und jede zusätzlich aktivierte Funktion wird separat abgerechnet. Die Erkennung unterstützt sechs westeuropäische Sprachen. Sofern Ihre Organisation dem nicht widerspricht, darf AWS die von Ihnen übermittelten Daten standardmäßig zur Verbesserung seiner KI-Services verwenden. Apryse ist eine Bibliothek: Smart Data Extraction, OCR und ICR werden direkt im Prozess auf Ihren Windows- oder Linux-Servern beziehungsweise in Ihren eigenen Lambda-Funktionen und ECS-Tasks ausgeführt. Dadurch entfallen Netzwerk-Roundtrips, die seitenbasierte Abrechnung und Seitenlimits, die nicht durch Ihre Hardware bedingt sind. Zudem unterstützt die OCR mehr als 80 Sprachen. Dasselbe SDK umfasst außerdem Viewer, Editor, Konverter und eine Schwärzungs-Engine – also die Komponenten, die ein Dokumentenprodukt zusätzlich zur Extraktion benötigt und die Textract nicht bietet.
Ob das relevant ist, hängt von Ihrem Anwendungsfall ab. Für eine AWS-native Pipeline mit moderatem Volumen und englischsprachigen Dokumenten ist eine nutzungsabhängig abgerechnete API einfacher. Bei einem Produkt, das Sie an Kunden ausliefern, in regulierten Umgebungen oder ohne Netzwerkanbindung, bei mehrsprachigen Dokumenten oder bei einem Volumen, ab dem die funktionsabhängige Abrechnung nicht mehr wirtschaftlich ist, bietet eine selbst betriebene Komponente andere Vorteile.
Das sagen unsere Kunden

„Sie integrieren Neuerungen schneller als die Konkurrenz, und ihre Produkt-Roadmap überzeugt – sie haben in die richtigen Bereiche investiert.“
Marcus O'Brien
Globaler Leiter des Produktmanagements, AutoCAD

„Die Integrität von Dokumenten ist entscheidend. Apryse hat dieses Problem für uns vollständig gelöst.“
Uma Natarajan
CTO, Juume AI

„Die hohe Rendering-Performance und die schnelle Unterstützung durch das Engineering-Team von Apryse haben die Qualität unseres Produkts spürbar verbessert.“
Amanda Lansman
Senior Product Manager, Dropbox
Funktionsvergleich: So schneidet Apryse ab
Diese Tabelle berücksichtigt nur Funktionen, die beide Anbieter bereitstellen. Funktionen, die ausschließlich Apryse bietet, sind im nächsten Abschnitt aufgeführt.
OCR-Engine und Sprachen
Standard-OCR-Modul (SDK 12.0 und höher): Deep-Learning-Engine mit Modellen für Englisch sowie mehrsprachigen Modellen für über 80 Sprachen mit lateinischer, kyrillischer, CJK-, Devanagari- und arabischer Schrift. Optionales IRIS-iDRS-Modul für komplexe Layouts (10 Sprachen, darunter Chinesisch, Japanisch und Koreanisch); ressourcenschonendes alternatives Modul mit sechs Sprachen für Hardware mit begrenzter Leistung.
Detect Document Text und Analyze Document erkennen gedruckten Text in sechs Sprachen: Englisch, Französisch, Deutsch, Italienisch, Portugiesisch und Spanisch. Dieser Umfang ist seit November 2020 unverändert. Unterstützt wird ausschließlich der lateinische Zeichensatz, kein vertikaler Text; die erkannte Sprache wird nicht zurückgegeben. Alle Drehungen innerhalb der Bildebene sowie hoch- und tiefgestellte Zeichen werden unterstützt (Update vom Juni 2025). Damit ist die Sprachabdeckung deutlich geringer als bei Apryse.
Handschrifterkennung (ICR)
Handschrift-ICR-Modul (veröffentlicht im April 2026): Erkennt handschriftlichen Text in PDFs und Bildern On-Premises und gibt eine durchsuchbare Textebene sowie JSON mit Seitenzahlen und Wortkoordinaten aus. Nur Englisch.
Handschrift wird im Rahmen derselben OCR-Aufrufe erkannt, jedoch nur auf Englisch.
OCR-Ausgabe
Durchsuchbare PDF-Dateien oder JSON/XML mit einer hierarchischen Struktur aus Seiten, Absätzen, Zeilen und Wörtern einschließlich Koordinaten, Schriftgröße und Ausrichtung. Die OCR-Ausgabe enthält keine Konfidenzwerte für einzelne Wörter. Externe OCR-Daten im JSON-Format können wieder auf eine PDF-Datei angewendet werden.
Eine JSON-Liste mit Blöcken (PAGE, LINE, WORD), jeweils mit einem Konfidenzwert von 0 bis 100, einem normalisierten Begrenzungsrahmen und Polygon, einem Drehwinkel sowie einer Seitennummer. Die API gibt ausschließlich JSON zurück. Durch die Open-Source-Bibliothek Textractor oder eigenen Code lassen sich daraus durchsuchbare PDFs sowie CSV-, Excel-, Markdown- und HTML-Dateien erstellen.
Layout und Dokumentstruktur
Die Document Structure Engine gibt Absätze, Überschriften (H1–H6), Listen, Inhaltsverzeichnisse, Tabellen und Bilder als JSON aus. Jedes Element enthält ein umschließendes Rechteck und eine Seitenzahl. Dabei unterscheidet die Engine zwischen Spalten in Dokumentabschnitten und Tabellenspalten. Structured Output konvertiert PDFs außerdem in neu umbrochene DOCX-, XLSX-, PPTX- und HTML-Dateien. Derzeit sind weder eine Chunking-API noch eine Markdown-Ausgabe verfügbar.
Die Layout-Funktion gibt zehn Elementtypen (Titel, Abschnittsüberschrift, Kopfzeile, Fußzeile, Seitenzahl, Liste, Abbildung, Tabelle, Schlüssel-Wert-Paar und Text) in der angenommenen Lesereihenfolge zurück. Bei mehrspaltigen Seiten erfolgt die Ausgabe spaltenweise. Jedes Element enthält einen Begrenzungsrahmen und einen Konfidenzwert. Die Linearisierung in Markdown und HTML für LLM-Pipelines erfolgt über die Textractor-Bibliothek, nicht über die API.
Tabellenextraktion
Die Tabular Data Engine verarbeitet verbundene Zellen und mehrzeilige Tabellenüberschriften. Sie gibt Tabellen-, Zeilen- und Zellinformationen als JSON aus – einschließlich Zeilen- und Spaltenbereichen, Begrenzungsrahmen, Seitenzahlen sowie einer Gruppen-ID, die über mehrere Seiten fortgesetzte Tabellen verknüpft. Alternativ exportiert sie die Daten direkt in das XLSX-Format. Deep Learning Assist verbessert die Tabellenerkennung in der Document Structure Engine. Es wird kein Konfidenzwert pro Zelle ausgegeben.
Die Tabellenfunktion gibt Tabellen-, Zellen- und merged_cell-Blöcke mit Zeilen- und Spaltenbereichen, Spaltenüberschriften, Tabellentiteln, Fußzeilen, Abschnittsüberschriften und Zusammenfassungszellen zurück. Diese werden als strukturiert oder semistrukturiert klassifiziert und jeweils mit Geometrie- und Konfidenzdaten versehen. Die Kosten betragen 15 US-Dollar pro 1.000 Seiten. Eine auf der nächsten Seite fortgesetzte Tabelle wird als separate Tabelle ausgegeben, während Apryse solche Fortsetzungen erkennt.
Formulare und Schlüssel-Wert-Paare
Die Formularfelderkennung identifiziert Textfelder und Kontrollkästchen in gescannten oder statischen PDFs (Optionsfelder sind angekündigt) und kann ausfüllbare Felder in die PDF-Datei einfügen. Form Field Key-Value ordnet Beschriftungen den zugehörigen Werten zu. Generic Key-Value Extraction funktioniert vorlagenfrei für verschiedene Dokumenttypen und gibt für jedes Paar Schlüssel, Wert, Begrenzungsrahmen auf Wortebene sowie einen Konfidenzwert von 0,0 bis 1,0 zurück. Darüber hinaus werden Metadaten aus CAD-Schriftfeldern in technischen Zeichnungen extrahiert.
Die Formularfunktion verknüpft Schlüssel- und Werteblöcke und erkennt Kontrollkästchen sowie Optionsfelder als Auswahlelemente mit dem Status selected oder not_selected. Für jedes Element werden Geometrie- und Konfidenzwerte ausgegeben. Mit 50 US-Dollar pro 1.000 Seiten ist sie die teuerste Einzelfunktion und meist der Grund dafür, dass kombinierte Aufrufe 65 bis 80 US-Dollar pro 1.000 Seiten kosten. Formularmodelle können nicht trainiert werden.
Abfragen und benutzerdefinierte Extraktion
Nicht verfügbar. Das SDK unterstützt weder Abfragen in natürlicher Sprache noch benutzerdefinierte Schemas und Felder oder das Fine-Tuning von Modellen. Laut Dokumentation werden die JSON-Daten aus Smart Data Extraction zur Schemazuordnung an ein LLM Ihrer Wahl übergeben. Für benutzerdefinierte Vorlagenbereiche steht ein separates .NET-Produkt zur vorlagenbasierten Extraktion zur Verfügung.
Queries beantwortet natürlichsprachliche Fragen seitenweise (15 synchron, 30 asynchron; nur auf Englisch; vollständige Tabellen, Zeilen oder Spalten können nicht zurückgegeben werden) und liefert jeweils die Antwort, deren Position und einen Konfidenzwert. Mit benutzerdefinierten Queries-Adaptern lässt sich Queries anhand von 5 bis 2.500 gekennzeichneten Dokumenten optimieren.
Signaturerkennung
Die Formularfelderkennung identifiziert Signaturfelder und gibt sie zusammen mit Koordinaten und Konfidenzwerten als Teil der Formularfelddaten aus. Das umfassendere SDK wendet digitale Signaturen an und validiert sie (siehe nächster Abschnitt).
Die Signaturerkennung ermittelt Position und Konfidenzwert von handschriftlichen und elektronischen Signaturen sowie Initialen. Optional lassen sich diese einem Schlüssel-Wert-Paar oder einer Tabellenzelle zuordnen. In Kombination mit einer anderen Funktion ist sie kostenlos, als eigenständige Funktion kostet sie 3,50 $ pro 1.000 Seiten. Sie dient ausschließlich der Erkennung und kann Dokumente weder signieren noch Signaturen validieren.
Klassifizierung und Aufteilung
Klassifizierung auf Seitenebene in 24 vordefinierte Kategorien (ab SDK 11.12): Rechnungen, Belege, Ausweise, Reisepässe, Formulare, Briefe, Rechtsdokumente, Finanzberichte, technische Zeichnungen und mehr. Für jede Kategorie wird ein Konfidenzwert von 0,0 bis 1,0 ausgegeben; der Schwellenwert ist konfigurierbar. Benutzerdefinierte Bezeichnungen werden nicht unterstützt. Die Aufteilung erfolgt nicht durch ein Modell, sondern über die APIs des SDK zur Seitenbearbeitung.
Kein universell einsetzbarer Klassifikator oder Dokumentteiler. Die einzige Klassifizierungsfunktion ist der feste Satz von 35 Hypothekendokumenttypen in AnalyzeLending. Vorlagenbasierte Klassifizierung und semantische Aufteilung von Dateien mit bis zu 3.000 Seiten sind über Amazon Bedrock Data Automation verfügbar, einen separaten Service.
Koordinaten, Seitenverweise, Konfidenz
Typisiertes JSON für jede Engine. Jedes Element enthält ein Rechteck und eine bei 1 beginnende Seitennummer. Formularfelder, Schlüssel-Wert-Paare und Klassifizierungsergebnisse enthalten Konfidenzwerte; Tabellen- und Strukturelemente enthalten Koordinaten, jedoch keine Konfidenzwerte.
Jeder Block enthält einen Konfidenzwert von 0 bis 100, einen normalisierten Begrenzungsrahmen mit Polygon sowie eine Seitenzahl. Ausgenommen sind AnalyzeID-Felder: Sie enthalten zwar einen Konfidenzwert, aber keine Geometriedaten. Die Koordinaten sind vergleichbar; Textract bewertet zusätzlich jedes Wort und jede Zelle.
Reproduzierbarkeit und Versionskontrolle
Die Struktur wird deterministisch wiederhergestellt, bevor Modelle sie interpretieren. Sie legen die SDK-Version fest: Dasselbe Dokument liefert mit demselben Release bei jedem Durchlauf dieselben Überschriften, Tabellen und Felder.
Es werden vortrainierte statt generativer Modelle verwendet. Laut Entwicklern liefert ein bestimmtes Modell stabile Ergebnisse. Modellaktualisierungen werden von AWS serverseitig eingespielt. Antworten enthalten zwar eine AnalyzeDocumentModelVersion, es gibt jedoch keinen Anfrageparameter, mit dem sich eine bestimmte Version auswählen lässt. Daher können sich die Ergebnisse ändern, wenn AWS das Modell aktualisiert. Nur bei Custom Queries-Adaptern können Versionen ausgewählt werden.
Seiten- und Größenbeschränkungen
Bei lizenzierter Nutzung ist keine Obergrenze pro Dokument dokumentiert. Lange Dokumente werden vollständig verarbeitet, und das lizenzierte Modul hat keine Seitenbegrenzung.
Synchrone Vorgänge unterstützen eine Seite und maximal 10 MB. Bei einer mehrseitigen PDF-Datei wird eine UnsupportedDocumentException zurückgegeben. Mehrseitige PDF- und TIFF-Dateien müssen in S3 hochgeladen und mit den asynchronen Start- und Get-Vorgängen verarbeitet werden (bis zu 500 MB und 3.000 Seiten). Der Abschluss wird über SNS signalisiert; die Ergebnisse können sieben Tage lang abgerufen werden.
Preise
Paketlizenz: Smart Data Extraction, OCR, IRIS und Handschrift-ICR sind Zusatzmodule für das Server SDK. Die Lizenzierung erfolgt nicht nach Seiten oder Vorgängen; das Dokumentenvolumen fließt lediglich in die Angebotserstellung ein und wird nicht zur Laufzeit erfasst.
Abrechnung pro Seite und Funktion. DetectDocumentText: 1,50 $ pro 1.000 Seiten (0,60 $ bei mehr als 1 Mio. Seiten pro Monat). AnalyzeDocument: Tables 15 $, Queries 15 $, Forms 50 $; Forms und Tables 65 $; Forms, Tables und Queries 70 $; Forms, Custom Queries und Tables 80 $. Layout kostet 4 $, ist in Verbindung mit Forms, Tables oder Queries jedoch kostenlos. Signatures kostet 3,50 $, ist in Verbindung mit jeder anderen Funktion jedoch kostenlos. Custom Queries kostet 25 $ (Adaptertraining kostenlos, kein kostenloses Kontingent). AnalyzeExpense: 10 $; AnalyzeID: 25 $ (10 $ bei mehr als 100.000 Seiten); AnalyzeLending: 70 $. Kostenloses Kontingent für drei Monate: monatlich 1.000 OCR-Seiten sowie 100 Seiten für Forms, Tables oder Queries. Gebühren für S3, SNS und Lambda im asynchronen Workflow fallen zusätzlich an.
Support und SLA
Wartung und Support von Montag bis Freitag (pazifische Zeitzone) mit garantierter Antwort innerhalb von zwei Werktagen; Konditionen für Enterprise-Tarife werden individuell vereinbart. Da die Software in Ihrer Umgebung ausgeführt wird, gilt keine SLA für die Verfügbarkeit.
Servicegutschriften, wenn die monatliche Verfügbarkeit unter 99,9 % (10 %), 99 % (25 %) oder 95 % (100 %) fällt. Technischer Support über AWS-Supportpläne (im Dezember 2025 neu strukturiert): Basic kostenlos; Business Support+ ab 29 US-Dollar pro Monat oder 9 % der monatlichen AWS-Gebühren, mit einer Reaktionszeit von 30 Minuten bei kritischen Vorfällen; Enterprise ab 5.000 US-Dollar pro Monat oder 10 % der Gebühren, mit einer Reaktionszeit von 15 Minuten.
Mehr als nur die gemeinsamen Funktionen – das bietet das Apryse SDK außerdem
Amazon Textract ist eine API zur Datenextraktion. Apryse ist ein Dokumenten-SDK, bei dem die Datenextraktion eines von mehreren Modulen ist. Die unten aufgeführten Funktionen sind in derselben Apryse Lizenz und Codebasis enthalten, gehören jedoch nicht zum Funktionsumfang von Textract. AWS deckt einige angrenzende Anforderungen mit anderen Services ab (Bedrock Data Automation, Amazon Comprehend, Amazon Q), jedoch nicht innerhalb von Textract.
Anzeige und Rendering
WebViewer: Clientseitiges WebAssembly-Rendering von über 30 Formaten (PDF, Office, CAD, Bilder, E-Mails) mit einer React-UI, deren Quellcode einsehbar ist. Dokumentinhalte verlassen zu keinem Zeitpunkt den Browser. Native Viewer für iOS und Android.
Nicht in Textract enthalten.
Anmerkungen und Zusammenarbeit
Anmerkungen und Zusammenarbeit Über 35 Anmerkungstypen, Zusammenarbeit mehrerer Benutzer in Echtzeit, Messwerkzeuge, Dokumentenvergleich und XFDF-Roundtrip.
Nicht Bestandteil von Textract.
Formulare, Signaturen, Schwärzung
AcroForm- und XFA-Formulare, Erstellen und Ausfüllen von Formularen, elektronische und digitale Signaturen mit Zeitstempeln und Langzeitvalidierung, sichere Schwärzung mit Mustersuche, PDF-Bereinigung.
Nicht Bestandteil von Textract. (Textract erkennt, wo sich eine Unterschrift befindet, signiert, validiert oder schwärzt sie jedoch nicht.)
Bearbeitung
Bearbeitung von Text und Bildern in PDFs, Seitenbearbeitung, native DOCX-Bearbeitung im Browser mit Änderungsverfolgung und Kommentaren sowie Bearbeitung von Tabellenkalkulationen im Browser.
Nicht Bestandteil von Textract.
Konvertierung
Office-Dateien ohne Microsoft Office in PDF konvertieren, PDF in DOCX/XLSX/PPTX/HTML mit strukturierter Ausgabe konvertieren, HTML in PDF konvertieren, CAD-Dateien in PDF konvertieren (DWG, DXF, DGN, DWF; RVT unter Windows als Beta-Version), E-Mails (EML, MSG) in PDF konvertieren sowie DICOM- und HEIC-Bildformate verarbeiten.
Nicht Bestandteil von Textract. Textract liest ausschließlich JPEG-, PNG-, PDF- und TIFF-Dateien und bietet weder Konvertierung noch Rendering.
Compliance-Formate
PDF/A-Konvertierung und -Validierung für alle Teile und Konformitätsstufen, PDF/UA mit automatischer Tag-Kennzeichnung, Verschlüsselung und Berechtigungen sowie ein WCAG-2.2-AA-konformer Viewer.
Nicht Bestandteil von Textract.
Erstellung, Scannen, elektronische Signatur
Flexible vorlagenbasierte Dokumentenerstellung, Scanbot SDK zum Scannen von Dokumenten und Barcodes auf Mobilgeräten, Xodo Sign für elektronische Signaturen sowie iText (ein Unternehmen von Apryse) für die PDF-Programmierung mit Java und .NET.
Nicht Bestandteil von Textract.
Wann Sie AWS Textract wählen sollten
IHRE PIPELINE LÄUFT BEREITS IN AWS
Wenn Dokumente in S3 eingehen und der restliche Workflow auf Lambda, Step Functions und IAM basiert, lässt sich Textract mit einer einzigen Berechtigung und einem API-Aufruf einbinden – ohne einen neuen Anbieter integrieren zu müssen. Daten bleiben meist dort, wo sie bereits liegen, und eine Verlagerung lohnt sich nur selten.
RECHNUNGEN, BELEGE, US-AUSWEISDOKUMENTE ODER HYPOTHEKENUNTERLAGEN DIREKT EINSATZBEREIT
AnalyzeExpense, AnalyzeID und AnalyzeLending geben ohne vorherige Einrichtung typisierte, normalisierte Felder zurück. Apryse extrahiert diese als generische Schlüssel-Wert-Paare und ein Klassifizierungslabel statt als Schemas für die einzelnen Typen.
FRAGEN, DIE SIE AUF ENGLISCH FORMULIEREN KÖNNEN
Mit Queries können Sie Fragen wie „Wie lautet die Versicherungsnummer?“ stellen und erhalten eine Antwort mit Fundstelle und Konfidenzwert. Custom Queries-Adapter optimieren die Antworten anhand einiger Ihrer eigenen Dokumente. Apryse bietet keine vergleichbare Funktion. Die strukturierten Ausgabedaten müssten Sie mit Ihrem eigenen LLM verarbeiten.
GERINGES ODER SCHWANKENDES AUFKOMMEN ENGLISCHSPRACHIGER DOKUMENTE
Bei Kosten von 1,50 $ pro 1.000 Seiten für reine OCR, einem dreimonatigen kostenlosen Tarif und ohne erforderlichen Lizenzkauf lassen sich Prototypen oder Workflows mit geringem Volumen für gedruckte englische Dokumente nahezu kostenlos starten. Bei einem geringen oder schwer vorhersehbaren Volumen ist die Abrechnung pro Seite wirtschaftlich sinnvoll.
FEDRAMP HIGH IM RAHMEN EINER AWS-AUTORISIERUNG
Wenn Ihre Beschaffung eine FedRAMP-autorisierte Servicegrenze anstelle von Software innerhalb Ihrer eigenen Umgebung voraussetzt, verfügt Textract in kommerziellen US-Regionen über eine FedRAMP-Moderate- und in GovCloud über eine FedRAMP-High-Autorisierung. Zudem verpflichtet sich AWS, Ihre Inhalte dort nicht zur Verbesserung des Dienstes zu verwenden.
Wann Sie sich für Apryse entscheiden sollten
DOKUMENTE DÜRFEN IHRE UMGEBUNG NICHT VERLASSEN
Für regulierte, souveräne oder vom Internet getrennte Umgebungen, in denen ein gemeinsam genutzter Cloud-Service nicht infrage kommt oder Sie sich nicht mit Richtlinien wie „Ihre Eingaben dürfen gespeichert und verwendet werden, sofern Sie dem nicht widersprechen“ auseinandersetzen möchten. Intelligente Datenextraktion, OCR, und ICR werden direkt als Teil des Prozesses auf Ihren Servern ausgeführt – auch in Ihrem eigenen AWS-Konto. Dabei werden keinerlei Daten an Apryse gesendet.
SIE ENTWICKELN EIN PRODUKT, KEINE PIPELINE
Wenn die Extraktion eine Funktion Ihrer Software ist, benötigen Sie eine Komponente, die Sie in Ihr Produkt integrieren, versionieren und zusammen mit diesem lizenzieren können. Textract ist ein Dienst, den Ihr Produkt aufruft; Apryse ist eine Bibliothek, die direkt in Ihrem Produkt enthalten ist.
DOKUMENTE IN MEHR ALS SECHS WESTEUROPÄISCHEN SPRACHEN
Textract erkennt Englisch, Französisch, Deutsch, Italienisch, Portugiesisch und Spanisch. Das OCR-Modul von Apryse erkennt mehr als 80 Sprachen und Schriftsysteme, darunter Chinesisch, Japanisch, Koreanisch, Arabisch, Kyrillisch und Devanagari. Für komplexe CJK-Layouts steht das IRIS-Modul zur Verfügung.
PLANBARE KOSTEN BEI HOHEM VOLUMEN
Bei Textract wird jede zusätzliche Funktion separat abgerechnet: Forms allein kostet 50 $ pro 1.000 Seiten, Forms mit Tables und Queries 70 $ – zuzüglich der Kosten für S3, SNS und Lambda. Die Kosten einer Paketlizenz steigen dagegen weder mit der Seitenzahl noch mit dem Funktionsumfang. Kalkulieren Sie Ihr jährliches Volumen und die benötigten Funktionen: Ab einem bestimmten Schwellenwert ist eine Lizenz günstiger und bietet mehr Planungssicherheit.
LANGE ODER GESCHÜTZTE DOKUMENTE OHNE ORCHESTRIERUNG
Ein 300-seitiger Vertrag, Zeichnungssatz oder Schriftsatz wird vollständig in einem einzigen Aufruf verarbeitet – auch als passwortgeschützte PDF-Datei. Keine synchrone Beschränkung auf eine Seite, kein Upload zu S3, keine SNS-Benachrichtigung und kein erneutes Zusammensetzen der Ergebnisse eines asynchronen Auftrags.
SIE BENÖTIGEN AUCH DIE ÜBRIGEN FUNKTIONEN ZUR DOKUMENTENVERARBEITUNG
Viewer, Anmerkungen, Formulare, Schwärzung, Signaturen, Bearbeitung, Konvertierung, Compliance und eine Benutzeroberfläche zur Prüfung, in der extrahierte Felder direkt auf der Quellseite eingeblendet werden können – alles aus demselben SDK wie die Datenextraktion. Textract bietet keine dieser Funktionen.

"The rendering performance, combined with how responsive the Apryse engineering team has been, has made a meaningful difference in our product quality."
Amanda Lansman, Sr Product Manager, Dropbox

Unterstützt von einem Expertenteam
FAQ
Textract ist eine Cloud-API: Sie senden Seiten an den von AWS betriebenen Dienst und zahlen für jede aktivierte Funktion pro Seite. Apryse ist ein SDK: Intelligente Datenextraktion, OCR und ICR werden innerhalb Ihrer eigenen Anwendung und Infrastruktur mit einer Paketlizenz ausgeführt. Dasselbe SDK bietet außerdem Funktionen für Anzeige, Bearbeitung, Konvertierung und Compliance, die Textract nicht bereitstellt.
Textract bietet keine Option für On-Premises-, Container- oder Outposts-Bereitstellungen und ist nur in 16 AWS-Regionen verfügbar. Apryse kann On-Premises, in einer Private Cloud oder vollständig vom Netzwerk isoliert sowie in Ihrem eigenen AWS-Konto ausgeführt werden. Dazu stehen offizielle Anleitungen für Lambda mit Node.js und Python sowie eine CloudFormation-Bereitstellung für WebViewer Server auf ECS und Fargate bereit. Der entscheidende Unterschied: Apryse wird in Ihrer eigenen Compute-Umgebung ausgeführt, nicht in einem gemeinsam genutzten Dienst.
Nein. Intelligente Datenextraktion kommt ohne Vorlagen aus und unterstützt sofort die allgemeine Schlüssel-Wert-Extraktion, Tabellenextraktion, Formularfelderkennung und Klassifizierung in 24 vordefinierte Kategorien. Queries, Adapter oder benutzerdefinierte Schemas sind nicht erforderlich. Teams, die ein bestimmtes Schema benötigen, übergeben das strukturierte JSON an ein LLM ihrer Wahl.
Die synchronen Operationen von Textract unterstützen eine Seite und maximal 10 MB. Mehrseitige PDFs müssen über S3 und die asynchronen Start- und Get-Operationen verarbeitet werden. Diese unterstützen bis zu 500 MB und 3.000 Seiten; die Ergebnisse werden sieben Tage lang gespeichert. Für die lizenzierte Nutzung von Apryse ist keine Obergrenze pro Dokument dokumentiert. Die Verarbeitung erfolgt lokal und ist nur durch Ihre Hardware begrenzt.
Standardmäßig ist dies unter Umständen der Fall. Laut AWS darf Textract „die vom Service verarbeiteten Dokument- und Bildeingaben ausschließlich zur Bereitstellung und Aufrechterhaltung des Service sowie zur Verbesserung und Weiterentwicklung der Qualität von Amazon Textract und anderen Machine-Learning-/KI-Technologien von Amazon speichern und verwenden“. Einige Inhalte können dabei in einer anderen Region gespeichert werden. Sie können dem über eine Opt-out-Richtlinie für KI-Services in AWS Organizations widersprechen. GovCloud-Regionen sind davon ausgenommen, und Trainingsdaten für Custom Queries werden nach dem Training gelöscht. Apryse erhält Ihre Dokumente zu keinem Zeitpunkt.
Bei geringem oder schwankendem Volumen oder für die reine OCR englischsprachiger Dokumente ist das der Fall: 1,50 $ pro 1.000 Seiten, mit einem dreimonatigen kostenlosen Kontingent und ohne Lizenzkauf. Mit zusätzlichen Funktionen steigen die Kosten jedoch: Forms kostet 50 $ pro 1.000 Seiten, Forms mit Tables 65 $ und Forms, Tables und Queries 70 $ – zuzüglich der Kosten für S3, SNS und Lambda im asynchronen Workflow. Apryse wird als Lizenzpaket angeboten, dessen Kosten weder von der Seitenzahl noch vom Funktionsumfang abhängen. Preise für die Extraktions- und OCR-Module erhalten Sie auf Anfrage. Kalkulieren Sie daher vor Ihrer Entscheidung Ihr jährliches Volumen und die benötigten Funktionen.
Bedrock Data Automation ist der generative Dokumentendienst von AWS und seit März 2025 allgemein verfügbar. Er gibt Markdown, HTML und CSV in Lesereihenfolge aus, extrahiert anhand von Blueprints definierte benutzerdefinierte Felder einschließlich Konfidenzwerten und Seitenzahlen, erstellt Zusammenfassungen und teilt Dateien mit bis zu 3.000 Seiten semantisch auf. Die Kosten betragen 0,010 US-Dollar pro Seite für die Standardausgabe und 0,040 US-Dollar pro Seite für die benutzerdefinierte Ausgabe. Der Dienst ist in acht Regionen verfügbar, unterstützt dieselben sechs Sprachen wie Textract und kann ausschließlich in der Cloud genutzt werden. Bedrock Knowledge Bases bietet Bedrock Data Automation – nicht Textract – als Parser an. Wenn Sie AWS für die generative Datenextraktion evaluieren, vergleichen Sie Apryse und Bedrock Data Automation anhand derselben Kriterien für Bereitstellung, Sprachunterstützung und deterministisches Verhalten. Auf dieser Seite wird hingegen Textract verglichen.
Ja. Das ist der umfangreichere Teil des SDK. Die Anzeige und Kommentierung von mehr als 30 Formaten, Formulare, Schwärzung, digitale Signaturen, die Bearbeitung von PDF- und DOCX-Dateien im Browser, die Konvertierung zwischen PDF, Office, HTML, CAD und E-Mail, die Einhaltung von PDF/A und PDF/UA, die Dokumentenerstellung mit Fluent sowie mobiles Scannen mit dem Scanbot SDK sind alle in derselben Apryse-Lizenz enthalten. Textract ist auf OCR, Layouts, Tabellen, Formulare, Abfragen und Signaturen sowie drei spezialisierte Parser beschränkt.


