Eine PDF-Seite ist ein festes Rechteck, was lange Dokumente auf dem Smartphone umständlich und für viele Webwerkzeuge undurchsichtig macht. PDF in HTML wandelt das Dokument in eine eigenständige Webseite um: Seiten mit Textebene werden zu echtem HTML-Text, der sich an den Bildschirm anpasst, durchsuchbar ist und vorgelesen werden kann, während gescannte Seiten als Bilder erhalten bleiben, damit nichts verloren geht.
So verwenden Sie PDF in HTML
- Fügen Sie die PDF hinzu.
- Wählen Sie In HTML umwandeln.
- Laden Sie die HTML-Datei herunter.
- Öffnen Sie sie in einem Browser oder veröffentlichen Sie sie auf Ihrer Website.
Textseiten werden zu echtem Text
Für jede Seite mit Textebene extrahiert VelloDoc den Text als HTML zusammen mit den Bildern dieser Seite, die direkt in die Datei eingebettet werden. Der Text passt sich an den Bildschirm des Lesers an, lässt sich markieren und durchsuchen und steht Screenreadern und Suchmaschinen zur Verfügung, was bei einem als Seitenbilder veröffentlichten Dokument nicht der Fall ist. Jede Seite steht in einem eigenen Abschnitt, sodass die ursprüngliche Seitenreihenfolge erhalten bleibt.
Gescannte Seiten und Layout
Seiten ohne Textebene, etwa Scans, werden als Seitenbilder mit 110 DPI und einer beschreibenden Beschriftung übernommen, damit das Dokument vollständig bleibt; führen Sie zuerst OCR PDF aus, wenn Sie auch diese Seiten als Text möchten. Das HTML konzentriert sich auf lesbaren Inhalt statt auf die exakte Wiedergabe des Seitendesigns, daher werden Spalten, genaue Positionierung, Hintergründe und Schriften vereinfacht. Für pixelgenaue Seitenbilder ist PDF in PNG die bessere Wahl.
Dokumente im Web veröffentlichen
Eine HTML-Fassung macht ein Dokument auf Smartphones leichter lesbar und leichter auffindbar, weil Suchmaschinen den Text direkt indexieren. Prüfen Sie vor der Veröffentlichung Überschriften und Lesereihenfolge, geben Sie der Seite in der Vorlage Ihrer Website einen passenden Titel und halten Sie die PDF für alle bereit, die drucken möchten. Für Markdown-basierte Websites passt PDF in Markdown besser. Der Leitfaden zu Formaten erklärt, wann Webseiten und wann PDFs Lesern besser dienen.
Wann PDF in HTML hilft
Smartphone-freundliche Dokumente
Bieten Sie Lesern auf dem Smartphone ein Dokument, das sich an den Bildschirm anpasst, statt einer PDF, in der sie ständig zoomen müssen.
Berichte auf einer Website veröffentlichen
Stellen Sie den Text eines Berichts auf Ihre Website, wo Suchmaschinen ihn indexieren können, mit der PDF als Download.
Barrierefreies Lesen
Bieten Sie eine Fassung an, die Screenreader, Browser-Zoom und Lesemodi weit besser verarbeiten als eine PDF.
Grenzen des Tools
PDF in HTML vereinfacht Layout, Spalten und Schriften zugunsten von sich anpassendem Text, und mehrspaltige Seiten können umsortiert werden. Gescannte Seiten werden als Bilder mit 110 DPI ohne Text eingebettet, sofern nicht zuvor OCR angewendet wurde, und eingebettete Bilder vergrößern die Datei.
PDF in HTML: häufige Fragen
Ist der Text im HTML markierbar?
Ja, bei Seiten, die in der PDF eine Textebene haben. Gescannte Seiten werden als Bilder übernommen, sofern Sie nicht zuerst OCR PDF ausführen.
Sieht das HTML genau wie die PDF aus?
Nein. Es setzt auf lesbaren, sich anpassenden Text, daher werden genaue Positionierung, Spalten und Schriften vereinfacht.
Bleiben Bilder erhalten?
Ja. Bilder auf Textseiten werden in die HTML-Datei eingebettet, und gescannte Seiten werden als Seitenbilder eingebettet, sodass die Datei für sich allein funktioniert.
Warum ist die HTML-Datei so groß?
Bilder werden in die Datei eingebettet, damit sie keine externen Abhängigkeiten hat. Dokumente mit vielen Fotos oder gescannten Seiten ergeben größere Dateien.