PDF → HTML
PDF metnini başlık, paragraf ve liste yapısıyla HTML, Markdown ya da düz metne dönüştürün.
PDF → HTML nedir, ne işe yarar?
PDF'teki bir yazıyı web sitesinde, blogda ya da bir not uygulamasında kullanmak istediğinizde düz metin kopyalamak başlıkları ve listeleri kaybettirir. Bu araç yazı boyutlarından başlıkları, satır aralıklarından paragrafları tahmin eder ve sonucu HTML, Markdown ya da düz metin olarak verir.
Çıktıyı indirmeden önce önizleyebilir, isterseniz panoya kopyalayabilirsiniz. Sayfa aralığı seçerek yalnızca ihtiyacınız olan bölümü dönüştürebilirsiniz.
Nasıl kullanılır?
- PDF dosyanızı kutuya bırakın.
- Çıktı biçimini (HTML, Markdown, metin) ve sayfa aralığını seçin.
- Dönüştürün, önizleyin, indirin ya da kopyalayın.
Ne zaman işinize yarar?
- PDF makaleleri bloga ya da web sitesine taşımak
- Notion, Obsidian gibi uygulamalara Markdown olarak aktarmak
- E-posta bültenine PDF'teki metni eklemek
- Erişilebilirlik için PDF içeriğini web sayfasına çevirmek
İpuçları
- Markdown çıktısı not uygulamalarında en temiz sonucu verir.
- Tablo ağırlıklı içerik için PDF → Excel daha uygundur.
Sık sorulan sorular
- Taranmış (fotoğraf gibi) PDF'lerden metin çıkar mı?
- Hayır. Bunun için OCR gerekir; şimdilik yalnızca metin katmanı olan PDF'ler desteklenir.
- Tablolar ve çok sütunlu sayfalar korunuyor mu?
- Çıktı akışlı bir düzendedir; tablolar ve sütunlar okuma sırasına göre satırlara dönüşür.
- Metin çıkarma işlemi nerede çalışır?
- pdf.js ayrıştırması bir Web Worker içinde yapılır; büyük PDF'lerde bile arayüz tepkimeye devam eder.
- Görseller çıktıya dahil mi?
- Hayır, çıktı metin odaklıdır. Görselleri ayrıca almak için PDF Ayıklayıcı aracını kullanabilirsiniz.