Anwendung
Text aus Screenshot am PC extrahieren: Desktop-Workflow im Überblick
Wie man auf Windows und macOS Text aus Screenshots, Bildschirmfotos und Programmoberflächen per OCR extrahiert. Vergleich verschiedener Desktop-Workflows.
Inhalt
Screenshots sind aus dem Computeralltag nicht wegzudenken. Ob zur Dokumentation, als Fehlerbericht oder um interessante Informationen festzuhalten: Ein Tastendruck reicht, und der Bildschirminhalt ist gespeichert. Was aber, wenn man den Text aus einem Screenshot weiterverarbeiten möchte, zum Beispiel in ein Dokument übernehmen oder in einer Suche verwenden? Genau dann kommt OCR ins Spiel.
Wann OCR für Screenshots notwendig ist
Nicht jeder Text auf dem Bildschirm lässt sich einfach per Kopieren und Einfügen übernehmen. In folgenden Situationen ist OCR der einzige Weg:
Bilder in PDF-Dokumenten enthalten oft Text, der nicht selektierbar ist, weil das PDF diesen Inhalt als Rasterbild speichert. Das gleiche gilt für gescannte Dokumente, die als PDF gespeichert wurden.
Webseiten und Programme können Text als Bild ausliefern, zum Beispiel aus Designgründen oder um Kopieren zu erschweren. Wasserzeichen auf Fotos und Text in Bildunterschriften sind ebenfalls häufige Fälle.
Fehlerdialoge und Systemhinweise mancher älterer Programme lassen keine Textauswahl zu. Wer eine Fehlermeldung genau dokumentieren möchte, ist auf einen Screenshot und anschließende Texterkennung angewiesen.
Untertitel in Videos können über OCR aus Standbildern extrahiert werden, wenn kein separates Untertitel-File vorhanden ist.
Möglichkeiten unter Windows
Windows selbst bietet keine direkt eingebaute OCR-Funktion für Screenshots, aber es gibt mehrere praktische Lösungen.
Die Microsoft PowerToys-App enthält seit Version 0.50 ein Werkzeug namens “Text Extrahierer” (im englischen Original: “Text Extractor”). Mit einer frei wählbaren Tastenkombination öffnet sich ein Auswahlrahmen, mit dem ein beliebiger Bereich des Bildschirms markiert werden kann. Der erkannte Text landet automatisch in der Zwischenablage. Diese Lösung ist schnell, erfordert keine Zwischenspeicherung des Screenshots als Datei und funktioniert direkt auf dem laufenden Bildschirm.
Die Windows-eigene “Snipping Tool”-App kann ebenfalls Screenshots aufnehmen und enthält in neueren Versionen eine Text-Extraktionsfunktion. Diese ist allerdings nicht auf allen Windows-Versionen und -Editionen verfügbar.
Drittanbieter-Apps wie ShareX bieten ebenfalls OCR-Funktionen und können Screenshots automatisch per Texterkennung verarbeiten. ShareX ist kostenlos und Open Source.
Möglichkeiten unter macOS
macOS hat seit Version 13 (Ventura) eine eingebaute Funktion namens Live Text, die Text in Bildern automatisch erkennt. In der Vorschau-App, in Photos und in einigen anderen Programmen kann man Text in Bildern direkt selektieren und kopieren, ohne einen separaten OCR-Schritt.
Für Screenshots, die direkt auf dem Desktop landen, funktioniert das ebenfalls: Einfach die Screenshot-Datei in der Vorschau öffnen und den Text auswählen.
Wer häufig Text aus beliebigen Bildschirmbereichen extrahieren möchte, kann über Automator oder Kurzbefehl-Skripte (Shortcuts) einen schnellen Workflow einrichten, der einen Bereich auswählt, einen Screenshot aufnimmt, diesen per Live Text verarbeitet und den erkannten Text in die Zwischenablage kopiert.
Browser-basierte OCR als universelle Lösung
Wer auf keine betriebssystemspezifischen Funktionen zurückgreifen kann oder möchte, zum Beispiel auf einem fremden Rechner oder unter Linux, kann Screenshots direkt in ein Browser-Tool hochladen. Das Tool verarbeitet den Screenshot und gibt den erkannten Text zurück.
Dieser Ansatz hat den Vorteil, dass er auf jedem Betriebssystem funktioniert und keine Installation erfordert. Der Workflow ist unkompliziert: Screenshot aufnehmen, Datei speichern, in den Browser laden, Text kopieren.
Qualitätsfaktoren bei Screenshot-OCR
Screenshots unterscheiden sich in einem wichtigen Punkt von gescannten Dokumenten: Die Auflösung ist durch die Bildschirmauflösung bestimmt, nicht durch einen Scanner. Moderne Bildschirme mit hoher Pixeldichte (Retina-Displays, 4K-Monitore) liefern schärfere Screenshots als ältere Monitore mit geringerer Auflösung.
Bei kleinen Schriftgrößen auf dem Bildschirm kann die Erkennungsqualität nachlassen. Wer Text aus einer Anwendung mit sehr kleiner Schrift extrahieren muss, kann vor dem Screenshot die Schrift in der Anwendung vergrößern oder die Anzeige zoomen.
Antialiasing, also die weiche Darstellung von Schriftkanten auf dem Bildschirm, kann OCR-Systeme gelegentlich verwirren, da es Kanten geringfügig unscharf macht. Moderne OCR-Systeme kommen damit in der Regel gut zurecht.
Datenschutz bei Screenshots
Screenshots können sensible Informationen enthalten: Bankdaten, persönliche Nachrichten, Passwörter oder vertrauliche Geschäftsdaten. Wer solche Screenshots per OCR verarbeiten möchte, sollte prüfen, ob das verwendete Werkzeug Daten auf externe Server überträgt.
Desktop-Lösungen wie PowerToys oder Live Text verarbeiten alles lokal auf dem eigenen Gerät. Browser-basierte Tools, die clientseitige Verarbeitung im Browser selbst durchführen, bieten ebenfalls guten Datenschutz, da keine Daten den Browser verlassen.
Fazit
Text aus Screenshots zu extrahieren ist auf modernen Systemen einfacher denn je. Ob über betriebssystemeigene Funktionen wie Live Text oder PowerToys oder über das Tool im Browser: Der Weg vom Screenshot zum copierbaren Text dauert nur wenige Sekunden und spart das mühsame Abtippen von Text.
Häufige Fragen
Kann ich Text aus einem Screenshot extrahieren, ohne zusätzliche Software zu installieren?
Ja. Unter Windows gibt es seit Windows 11 die PowerToys-App mit der Text-Extrahierungs-Funktion, unter macOS seit Ventura Live Text. Wer keine Software installieren möchte oder kann, kann Screenshots direkt in ein Browser-basiertes Tool hochladen und dort den Text erkennen lassen.
Warum funktioniert Copy-Paste aus manchen Programmen nicht, obwohl der Text auf dem Bildschirm sichtbar ist?
Viele Programme stellen Text grafisch dar, ohne ihn als copierbaren Text im Speicher zu halten. Das gilt für Bilder in PDFs, eingescannte Dokumente, manche PDF-Viewer, Spiele-Oberflächen und einige DRM-geschützte Anwendungen. In diesen Fällen hilft nur OCR, da der Text aus dem Bildschirminhalt erst rekonstruiert werden muss.
Wie gehe ich vor, wenn ich den Text aus einem Bereich eines laufenden Videos extrahieren möchte?
Video pausieren, einen Screenshot des gewünschten Moments aufnehmen und diesen Screenshot dann per OCR verarbeiten. Je nach Videoqualität und Schriftgröße variiert die Erkennungsqualität.
Quellen
Über die Autorenschaft
Jan-Tristan Rudat
Redakteur bild-zu-text-ocr.de
Themengebiet: Generationen, Kulturgeschichte, Sternzeichen, Pop-Phänomene rund ums Alter
Mehr über Jan-Tristan Rudat →Verwandte Artikel
Grundlagen
Was ist OCR? Grundlagen der Texterkennung einfach erklärt
OCR steht für Optical Character Recognition und wandelt gedruckten oder getippten Text in digitale Zeichen um. Dieser Ratgeber erklärt, wie die Technologie funktioniert und wo sie eingesetzt wird.
Lesezeit 6 Min.
Anleitung
Text aus Bild extrahieren: Schritt für Schritt erklärt
Wie man Text aus einem Foto, Screenshot oder gescannten Dokument herausholt, erklärt dieser Ratgeber anhand konkreter Schritte, inklusive Tipps zur Bildvorbereitung.
Lesezeit 5 Min.
Praxis
OCR-Genauigkeit verbessern: Bildqualität und Kontrast optimieren
Mit einfachen Maßnahmen lässt sich die Erkennungsrate von OCR-Software deutlich steigern. Dieser Ratgeber zeigt, welche Faktoren die Genauigkeit beeinflussen und wie man Bilder optimal vorbereitet.
Lesezeit 6 Min.