Text aus gescannten PDFs und Bildern kopieren – offline
Gescanntes PDF, abfotografierte Seite, Screenshot, Fehlermeldung im Dialogfenster: Bereich auswählen, und der Text liegt in deiner Zwischenablage. Die Erkennung läuft auf deinem Rechner — das Dokument wird nirgendwo hochgeladen.
Texterkennung ist ab Pro enthalten
Läuft ab Windows 10 · Keine Adminrechte nötig · Kein Konto
Text, den man sieht, aber nicht anfassen kann
Ein eingescanntes Dokument ist für den Rechner ein Bild. Der Text darin ist keine Schrift, sondern ein Muster aus Pixeln. Markieren geht nicht, Suchen geht nicht, Kopieren geht nicht.
Dasselbe gilt für Screenshots, für Fehlermeldungen, aus denen sich der Wortlaut nicht herauskopieren lässt, und für abfotografierte Seiten.
Die Alternative ist abtippen. Bei drei Zeilen ärgerlich, bei drei Seiten Arbeitszeit.
So holst du den Text heraus
Strg + Alt + T startet die Texterkennung aus jeder Anwendung. Der Hotkey ist frei belegbar.
Ein Rahmen über den Bildausschnitt — auch über mehrere Monitore hinweg und in jeder Auflösung.
Der erkannte Text liegt sofort in der Zwischenablage. Strg + V, weiterarbeiten.
Die Bildaufbereitung — der eigentliche Unterschied
Schlechte Vorlagen sind der Normalfall: schief eingescannt, grau, zu dunkel, verrauscht, niedrig aufgelöst. Celerando bereitet das Bild auf, bevor die Erkennung startet — daran scheitern Werkzeuge, die das Bild unverändert durchreichen.
Bildschirm für Screenshots und Code, Foto für abfotografierte Seiten mit ungleichem Licht, Scan für PDF-Seiten und Papier. Jedes Profil schaltet genau die Stufen, die dem Material helfen.
Im manuellen Modus steuerst du Skalierung, Graustufen, Kontrast, Binarisierung, Schärfung und Rauschunterdrückung selbst — samt Schwellwerten.
Winzige Schrift in Screenshots wird vor der Erkennung vergrößert. Ohne diesen Schritt liefert jede Engine bei kleiner Schrift Buchstabensalat.
Warum das Profil zählt: Binarisierung hilft einem sauberen Scan und zerstört bei einem Foto mit Schatten die halben Buchstaben. Schärfung hilft dem Foto und erzeugt beim Screenshot Artefakte. Deshalb drei Voreinstellungen statt eines „Verbessern“-Knopfs.
14 Sprachen, auch gemischt im selben Dokument
Celerando erkennt mit Tesseract 5 (LSTM). Acht Sprachen bringt die Installation mit, sechs weitere lädst du bei Bedarf in den Einstellungen nach:
Deutsch, Englisch, Französisch, Spanisch, Italienisch, Niederländisch, Polnisch, Portugiesisch.
Dänisch, Schwedisch, Finnisch, Norwegisch, Griechisch, Russisch — je Sprache ein Modell von wenigen Megabyte.
Ein deutsch-englischer Vertrag wird in einem Durchgang erkannt; die Standardauswahl ist Deutsch + Englisch.
- Deutsch
- Englisch
- Französisch
- Spanisch
- Italienisch
- Niederländisch
- Polnisch
- Portugiesisch
- Dänisch
- Schwedisch
- Finnisch
- Norwegisch
- Griechisch
- Russisch
Die Sprachmodelle liegen in deinem Benutzerprofil, nicht im Installationsverzeichnis — so überleben nachgeladene Sprachen jedes App-Update.
Was sonst noch dazugehört
Jeder Bild-Screenshot landet im Editor: Stift, Marker, Radierer, Pfeil, Rechteck, Text und Pipette.
Strg + Alt + S für den Bild-Screenshot, Strg + Alt + T für die Texterkennung — beide frei belegbar.
Nach jedem Screenshot zeigt Windows das Ergebnis mit Vorschau und Schaltflächen zum Bearbeiten oder Kopieren.
Das Dokument bleibt bei dir
Online-Texterkennung bedeutet, dass du dein Dokument hochlädst. Bei einem eingescannten Vertrag, einem Personalbogen oder einem Arztbrief ist das keine Kleinigkeit.
Celerando erkennt auf deinem Rechner. Weder das Bild noch der erkannte Text verlassen ihn. Was die App überhaupt kontaktiert: den Download jeder Sprache, die du zusätzlich wählst, die Update-Prüfung und beim allerersten Start einen einmaligen Installations-Ping — zufällige Installations-ID, gekürzter Hash der Geräte-Kennung, App- und Windows-Version; kein Konto, kein Name, keine Inhalte. Die IP-Adresse wird nicht im Klartext gespeichert: Ein Hash davon wird nach 48 Stunden gelöscht, die daraus abgeleitete ungefähre Herkunft (Land, Region, Stadt) bleibt mit dem Eintrag 24 Monate erhalten.
Mit den acht mitgelieferten Sprachen arbeitet die Texterkennung ohne jede Verbindung — das lässt sich im Flugmodus ausprobieren.
Celerando, PowerToys und das Snipping Tool im Vergleich
Windows 11 bringt Bildschirm-Texterkennung inzwischen selbst mit, und PowerToys hat sie schon länger. Beide arbeiten lokal — der Unterschied liegt nicht im Datenschutz, sondern darin, was bei schwierigen Vorlagen herauskommt.
| Celerando | PowerToys Text Extractor | Snipping Tool | |
|---|---|---|---|
| Wo erkannt wird | Auf deinem PC | Auf deinem PC | Auf deinem PC |
| Bildaufbereitung | Sechs Stufen, drei Profile, Hochskalierung | — | — |
| Sprachen | 14, mehrere gleichzeitig | Windows-Sprachpakete | Windows-Sprachpakete |
| Multi-Monitor | Ja, auch übergreifend | Je Bildschirm | Je Bildschirm |
| Screenshot-Editor | Stift, Marker, Pfeil, Text, Pipette | — | Ja |
| Preis | Teil von Pro, 29,99 € einmalig | Kostenlos | In Windows 11 enthalten |
Stand September 2026. Für einen sauberen Screenshot tut es das Bordmittel — bei einem schief eingescannten Vertrag, einem Foto mit Schatten oder winziger Schrift entscheidet die Aufbereitung über das Ergebnis.
Enthalten in Pro
Texterkennung ist Teil von Celerando Pro — 29,99 € einmalig. Zusammen mit Personal Dictionary, QuickShare komplett und dem erweiterten Diktat.
Die kostenlose Version kannst du vorher in Ruhe ausprobieren.
Häufige Fragen zur Texterkennung
Funktioniert die Texterkennung offline?
Ja. Mit den acht mitgelieferten Sprachen braucht sie keine Verbindung — Bild und erkannter Text bleiben auf deinem Rechner. Nur wenn du eine der sechs zusätzlichen Sprachen aktivierst, wird deren Modell einmalig heruntergeladen.
Welche Sprachen werden erkannt?
Vierzehn: Deutsch, Englisch, Französisch, Spanisch, Italienisch, Niederländisch, Polnisch und Portugiesisch sind sofort dabei; Dänisch, Schwedisch, Finnisch, Norwegisch, Griechisch und Russisch lädst du bei Bedarf nach. Mehrere Sprachen lassen sich gleichzeitig aktivieren, sodass ein deutsch-englisches Dokument in einem Durchgang erkannt wird.
Funktioniert das bei schlecht gescannten Vorlagen?
Dafür ist die Bildaufbereitung da: Skalierung, Graustufen, Kontrast, Binarisierung, Schärfung und Rauschunterdrückung, gebündelt in den Profilen Bildschirm, Foto und Scan. Bei sehr schlechten Vorlagen stößt allerdings jede Erkennung an Grenzen — ein Blatt, das auch ein Mensch kaum entziffert, wird auch hier nicht zu sauberem Text.
Was kann Celerando, das PowerToys oder das Snipping Tool nicht können?
Die Bildaufbereitung vor der Erkennung (drei Profile, sechs einzeln steuerbare Stufen, Hochskalierung bis 3×), die freie Sprachauswahl mit mehreren Sprachen gleichzeitig und die monitorübergreifende Auswahl. Für einen sauberen Screenshot in der Systemsprache sind die Bordmittel völlig ausreichend — die Unterschiede zeigen sich bei Scans, Fotos und kleiner Schrift.
Welche Engine steckt dahinter?
Tesseract 5 mit LSTM-Erkennung, ein etabliertes Open-Source-Projekt. Die Sprachmodelle sind die offiziellen Tesseract-Daten; Celerando liefert die Bildaufbereitung, die Bereichsauswahl und die Einbindung in Windows.
Funktioniert es mit mehreren Monitoren?
Ja, auch monitorübergreifend und in jeder Auflösung — ein Rahmen darf über die Bildschirmgrenze hinausgehen.
Kann ich auch Text aus einem PDF holen, ohne es zu öffnen?
Die Texterkennung arbeitet auf dem, was auf dem Bildschirm zu sehen ist. Ein PDF muss also geöffnet sein — dann ziehst du den Rahmen über die Seite. Für gescannte PDFs ist genau das der Weg, weil sich ihr Text ohnehin nicht markieren lässt.
Wo liegen die Sprachmodelle?
In deinem Windows-Benutzerprofil unter %LOCALAPPDATA%\Menterium\Celerando, nicht im Installationsverzeichnis. Das ist Absicht: Ein App-Update ersetzt das Installationsverzeichnis, eine dorthin geladene Sprache wäre danach spurlos verschwunden.
In welcher Edition ist die Texterkennung enthalten?
Ab Pro. Die kostenlose Version enthält sie nicht — Dashboard, Spracheingabe in der Systemsprache und QuickShare für Text lassen sich aber ohne Zeitlimit ausprobieren.
Brauche ich Adminrechte?
Nein. Celerando installiert sich in dein Benutzerprofil, die Sprachmodelle ebenfalls.