Zehntausend Dateien per Texterkennung durchsuchbar machen: Mit diesem Beispiel beschreibt das Projekt Stirling PDF, wofür seine neue Version gedacht ist.
Erst kostenlos reinschnuppern, dann entscheiden
Bevor du dich für eine Weiterbildung entscheidest, sieh dir kostenlos an, wie sie läuft, fünf Lektionen plus Live-Demo, ohne Verpflichtung. Passt es, ist der Digitalisierungsmanager bei bewilligtem Bildungsgutschein für dich kostenlos.
Kostenlos reinschnuppernDer Schnupperkurs ist gratis. Ob die Weiterbildung über den Bildungsgutschein gefördert wird, entscheidet die Agentur für Arbeit im Einzelfall.
Vom Werkzeugkasten zum laufenden Auftrag
Stirling PDF ist laut heise ein PDF-Werkzeug für Einzelanwender und Teams. Es läuft im Browser auf einem eigenen Server oder als Desktop-Anwendung und dient zum Zusammenführen, Konvertieren und Bearbeiten von Dokumenten. Version 2.0 erschien nach heise „vor einem knappen Jahr“. Die Version 3.0.0 hat das Projekt laut GitHub am 24. September 2026 veröffentlicht, heise berichtete am 25. September 2026 darüber.
Das Neue daran heißt PDF Processor.
Er nimmt die Werkzeuge, die Stirling ohnehin mitbringt, und wendet sie auf große Mengen von Dateien an. Als Quellen nennen die Release Notes Ordner, FTP und S3, dazu Netzwerkquellen über SFTP, FTP und SMB. Die Beispiele des Projekts sind handfest, etwa 10.000 Dateien per OCR durchsuchbar machen oder einen ganzen Ordner komprimieren; auch das Konvertieren einer kompletten Dokumentenbibliothek wird genannt. Einmal eingerichtet, kann der Processor weiterlaufen. Neu eintreffende Dateien verarbeitet er dann automatisch. Ausgelöst wird ein Durchlauf laut Dokumentation nach Zeitplan, bei einer Änderung im Ordner, beim Eingang eines Webhooks oder wenn jemand im Editor eine Datei hochlädt oder exportiert. Das Beispiel der Doku klingt nach gewöhnlichem Büroalltag: Eine Pipeline überwacht einen Rechnungsordner, komprimiert jedes neue PDF und legt es in einem Archiv ab.
Fertige Pipelines, Zugang nur im Browser
Für den Einstieg bringt der Processor laut Dokumentation fertige Pipelines mit, gegliedert in Ingestion, Security, Classification, Compliance und Routing. Die Doku beschreibt ihn außerdem als Mittel, Richtlinien durchzusetzen, damit jedes ein- oder ausgehende Dokument einen festgelegten Ablauf durchläuft. Das ist die Darstellung des Projekts über sein eigenes Werkzeug, eine unabhängige Prüfung nennen die gelesenen Quellen nicht.
Beim Zugang gibt es Grenzen. Geöffnet wird der Processor im Browser, in der Desktop-App ist er derzeit nicht erreichbar. Standardmäßig haben Administratoren und Teamleiter Zugriff. Umgebungen ohne Anmeldung kommen an den Processor gar nicht heran, wer Stirling ohne Benutzerkonten betreibt, braucht für die neue Funktion also zuerst eine Anmeldung.
Neben dem Processor enthält 3.0 laut Release Notes eine Reihe kleinerer Neuerungen. OAuth-SSO ist für alle kostenlos, der neue Texteditor hat die Alpha-Phase verlassen, und Dokumente lassen sich per QR-Code vom Smartphone aus unterschreiben. Beim Schwärzen gibt es größere Verbesserungen. Die Konvertierung nach PDF/UA ist nach Angabe des Projekts noch in Arbeit. heise hebt aus den Release Notes eine Begrenzung beim Entpacken nicht vertrauenswürdiger Archive hervor.
Was frei bleibt und wo die KI rechnet
KI ist in Stirling PDF 3.0 optional und ab Werk ausgeschaltet. Wer sie einschaltet, kann Dokumente laut Release Notes verstehen, klassifizieren und Informationen daraus extrahieren lassen, auch mit lokal oder selbst betriebenen Modellen.
Für die automatisierte Verarbeitung über Processor, API und KI-Funktionen sind 1.000 PDFs pro Monat kostenlos enthalten. Wer seinen Server mit stirling.com verknüpft, bekommt 500 weitere PDFs pro Monat und Zugriff auf die vom Anbieter gehostete KI. Zusammengerechnet ergibt das mit Verknüpfung 1.500 automatisiert verarbeitete PDFs im Monat, eine einfache Addition der beiden Angaben. Das Kontingent betrifft ausschließlich die Automatisierung. Die normale Nutzung des PDF-Editors bleibt laut Projekt kostenlos und unbegrenzt.
Eine Frage beantworten die gelesenen Quellen nicht. Gehostete KI bedeutet, dass Dokumente außerhalb des eigenen Servers verarbeitet werden, und wo und unter welchen Bedingungen das beim Anbieter geschieht, steht weder in den Release Notes noch in der Dokumentation noch bei heise. Diese Frage gehört geklärt, bevor Rechnungen oder Verträge diesen Weg nehmen.
Die Release Notes nennen 3.0 selbst die erste große Version des Processors. In den nächsten Wochen sollen Updates etwa wöchentlich folgen.
Unsere Einschätzung
Bemerkenswert an dieser Version ist die Reihenfolge, die sie nahelegt. Zuerst kommt der wiederkehrende Ablauf, und erst danach stellt sich die Frage nach KI. Man denke an einen Ordner, in den der Scanner die Eingangsrechnungen legt. Eine Pipeline, die jedes neue PDF per OCR lesbar macht, verkleinert und ins Archiv schiebt, bringt aus unserer Sicht mehr als jede automatische Klassifizierung. Sie ist auch leichter zu kontrollieren. Wer damit anfängt, sieht nach wenigen Wochen, ob der Ablauf trägt, und hat für die Belege an den Steuerberater bereits sauber durchsuchbare Dateien; wie sich diese Vorbereitung weiter mit KI unterstützen lässt, steht im Artikel Belege für den Steuerberater mit KI vorbereiten.
Die ausgeschaltete KI als Voreinstellung passt zu dieser Reihenfolge.
Wer sie später zuschaltet, trifft eine bewusste Entscheidung zwischen einem lokalen Modell und der gehosteten KI des Anbieters. Wir würden diese Entscheidung erst treffen, wenn die Frage nach dem Verarbeitungsort beantwortet ist. Und weil der Processor nach Angabe des Projekts in seiner ersten Version vorliegt, würden wir ihn für Rechnungen oder Personalakten zunächst mit Kopien testen, nie mit dem einzigen Exemplar.
Quellen
Die genannten Angaben stützen sich auf folgende öffentlich zugängliche Quellen (Stand der Recherche: 25. September 2026):
- GitHub (Stirling-Tools): 3.0.0 PDF Processor, Brand new text editor, Free OAuth and tons of new features
- Stirling PDF: Stirling Processor
- heise online: 10.000 PDFs? Stirling PDF macht daraus einen Job
Häufige Fragen
Was ist der PDF Processor in Stirling PDF 3.0?
Der PDF Processor wendet die vorhandenen Stirling-Werkzeuge auf große Mengen von Dateien an, etwa um 10.000 Dateien per OCR durchsuchbar zu machen. Als Quellen nennen die Release Notes Ordner, FTP und S3 sowie SFTP- und SMB-Netzwerkquellen. Er kann laufen bleiben und neu eintreffende Dateien automatisch verarbeiten.
Wann startet der Processor eine Verarbeitung?
Laut Dokumentation nach Zeitplan, wenn sich ein Ordner ändert, bei Eingang eines Webhooks oder wenn jemand im Editor eine Datei hochlädt oder exportiert. Die Doku nennt als Beispiel eine Pipeline, die einen Rechnungsordner überwacht, jedes neue PDF komprimiert und in einem Archiv ablegt.
Wie viele PDFs lassen sich kostenlos automatisch verarbeiten?
Für die automatisierte Verarbeitung über Processor, API und KI-Funktionen sind laut Projekt 1.000 PDFs pro Monat kostenlos enthalten. Wer seinen Server mit stirling.com verknüpft, erhält 500 weitere PDFs pro Monat und Zugriff auf die vom Anbieter gehostete KI. Die normale Nutzung des PDF-Editors bleibt laut Projekt kostenlos und unbegrenzt.
Was sollte ein Betrieb vor dem Einsatz regeln?
Die Release Notes nennen 3.0 die erste große Version des Processors, deshalb empfiehlt sich ein Test mit Kopien, bevor Rechnungen oder Personalakten durchlaufen. Die KI ist standardmäßig ausgeschaltet. Wer die gehostete KI zuschalten will, sollte vorher klären, wo und unter welchen Bedingungen der Anbieter die Dokumente verarbeitet, denn das sagen die gelesenen Quellen nicht.
Welcher Ordner im Betrieb füllt sich jede Woche mit PDFs, die niemand durchsuchen kann?
Im kostenlosen KI-Schnupperkurs zeigen wir in fünf Lektionen, wie kleine und mittlere Firmen KI im Alltag einsetzen. Tiefer und praxisnah geht es im Vollkurs Digitalisierungsmanager, DEKRA-zertifiziert und förderfähig über den Bildungsgutschein.
Zuletzt aktualisiert: 25. September 2026. Stand der Recherche: 25. September 2026.