IT
OmnvertGörsel • Belge • Ağ

Belge Araçları

PDF ve Office dönüştürme

Açıklama

Belge dönüştürme araçları genelde formatı bozabilir veya limitleri gizleyebilir. Omnvert, net önizleme, tutarlı çıktı ve hızlı indirme akışına odaklanır: PDF ↔ Office dönüşümlerinde sürpriz yaşamazsın.

Düzenlenebilir çıktı istiyorsan dijital oluşturulmuş PDF’ler daha iyi dönüştürülür. PDF taranmışsa sayfaları görsele aktarabilir veya önce OCR ile metin çıkarıp sonra DOCX’e çevirebilirsin.

Akışı standartlaştır: paylaşmadan önce sıkıştır, e‑posta/başvuru için sayfa aralıklarını böl, teslimden önce birleştir, sayfa önizleme gerektiğinde PDF’yi görsele çevir.

Sık Sorulan Sorular

Filigran ekliyor musunuz?
Hayır. İndirilen dosyalara filigran eklenmez.
Biçimlendirme korunur mu?
Mümkün olduğunda yapıyı koruruz; ancak karmaşık PDF’lerde veya taramalarda düzen bozulabilir.
Taranmış PDF destekleniyor mu?
Taranmış PDF sayfaları görsel olarak dışa aktarılabilir; düzenlenebilir metin için OCR gerekir (bu sayfada yok).
İşleme gizli mi?
Yüklemeler kısa ömürlü alanlarda işlenir ve linkler geçicidir. Kayıt gerekmez.

PDF bir belge biçimi değil, bir sayfa tarifi biçimidir. Her glifin sayfada nerede durduğunu, hangi fontla çizildiğini ve rengini kaydeder; ama bu gliflerin bir cümle, bir paragraf ya da bir tablo hücresi oluşturduğunu mutlaka kaydetmez. PDF’lerle çalışırken karşılaşılan bütün zorluklar bu tek tasarım kararından doğar.

Bu kategorideki araçlar ikiye ayrılır. Yapısal işlemler — birleştirme, bölme, döndürme, sayfa sırası değiştirme, filigran, sayfa çıkarma — dosyanın nesne ağacını yeniden yazar, sayfa içeriğine dokunmaz; bu yüzden pratikte kayıpsız ve tekrarlanabilirdir. Yorumlayıcı işlemler — PDF’den Word’e, PDF’den Excel’e, OCR — ise hiç kaydedilmemiş bir anlamı yeniden kurmak zorundadır ve düzenlenebilirlik uğruna her zaman bir miktar sadakat verir.

Birleştirme, bölme, döndürme ve sıralama tarayıcınızda gerçekleşir; o dosyalar sekmeden dışarı çıkmaz. OCR, Office dönüşümleri ve ağır sıkıştırma modları gerçek bir işleme motoruna ihtiyaç duyduğu için sunucumuzda çalışır; bu yüklemeler kısa ömürlü geçici depolamada işlenir, iş bitince silinir ve hiçbir hesapla ilişkilendirilmez.

PDF’den Word’e dönüşüm neden kusursuz olmuyor

Dönüştürücünün paragraf sınırlarını dikey boşluklardan, okuma sırasını konumdan, tablo yapısını da cetvel çizgilerinden veya hizalanmış boşluklardan tahmin etmesi gerekir. Tek sütunlu, düz gövde metinli raporlar temiz dönüşür. İki sütunlu akademik düzenler, kenar kutuları, dipnotlar ve çerçevesiz tablolar ise tahminin göründüğü yerlerdir: metin yanlış sırayla düşer, tablo bir metin kutusu ızgarasına dönüşür, satır sonundaki tireler Word dosyasına kadar taşınır.

Taranmış PDF’ler tamamen ayrı bir sorundur, çünkü içlerinde hiç metin yoktur; yalnızca sayfanın görüntüsü vardır. Bunları normal bir dönüştürücüden geçirmek boş bir belge üretir. Önce OCR’dan geçirin, sonra dönüştürün.

Sıkıştırmada gerçekten küçülen ne

Büyük PDF’lerin neredeyse tamamında dosya boyutunun asıl sahibi gömülü görsellerdir. Dolayısıyla sıkıştırma, bu görselleri düşük çözünürlüğe indirip yeniden kodlamak demektir: ekranda okumak için genelde 150 DPI, baskıya gidecek işler için 300 DPI, üstüne bir miktar JPEG kalite düşüşü. İkincil kazanç, gömülü fontları yalnızca kullanılan gliflere daraltmaktan ve sayfa küçük resimleriyle kullanılmayan nesneleri atmaktan gelir.

İnsanları şaşırtan durum da bununla açıklanır: yalnızca metinden oluşan 40 sayfalık bir PDF neredeyse hiç küçülmez. İçerik akışları zaten Flate ile sıkıştırılmıştır ve indirilecek görsel yoktur. Bir dosya çoğunlukla metinken hâlâ devasaysa suçlu genelde tam gömülmüş bir CJK fontu ya da defalarca tekrarlanan kaynaklardır.

OCR’ı ilk seferde doğru yapmak

OCR doğruluğu, dosya tanıyıcıya ulaşmadan önce belirlenir. 300 DPI tarayın veya dışa aktarın; büyük ve temiz punto için 200 idare eder, 150’nin altı hiçbir motorun telafi edemeyeceği bir kayıp getirir. Sayfayı düzeltin: iki derecelik bir eğiklik bile küçük puntoda hata oranını ölçülebilir biçimde artırır. Düz belgelerde gri tonlama genelde renkliden iyi sonuç verir ve harf kenarlarındaki ağır JPEG bozulmaları, biraz daha büyük bir dosyadan çok daha fazla zarar verir.

Dili açıkça seçin. İngilizce modunda çalışan bir motor Türkçe’deki ı, ğ, ş ve harflerin üstündeki işaretleri en yakın ASCII karşılığına çevirmekte hiç tereddüt etmez; karışık dilli belgelerde bütün dilleri baştan işaretlemek gerekir. Çıktı aranabilir bir PDF’tir: özgün sayfa görüntüsü görünür kalır, arkasına görünmez bir metin katmanı yerleşir. Belge birebir aynı görünür ama artık aranabilir, kopyalanabilir ve indekslenebilir.

Karartma, siyah dikdörtgen çizmek değildir

Bir ismin üstüne dolu kutu çizmek onu yalnızca görsel olarak gizler, altındaki hiçbir şeyi değiştirmez. Metin içerik akışında durmaya devam eder; sayfayı seçerek, bir metin çıkarıcı çalıştırarak ya da dosyayı bir düzenleyicide açarak herkes geri alabilir. Mahkeme dosyaları ve resmî yayınlarda yaşanan uzun bir rezalet listesi tam olarak bu yüzden vardır.

Gerçek karartma, alttaki içeriği siler ve ardından sayfayı düzleştirerek geri döndürülmesini imkânsız kılar. Üst veri de aynı ilgiyi hak eder: yazar adı, dosyayı üreten yazılım, revizyon zaman damgaları ve XMP kayıtları çoğu iş akışından el değmeden çıkar; birkaç kaynaktan derlenmiş bir belge çoğu zaman hepsinin üst verisini birden taşır. Önce karartın, sonra düzleştirin, göndermeden önce belge özelliklerine bakın.

Sıkça merak edilenler

Belgelerim yükleniyor mu?
Araca göre değişir. Birleştirme, bölme, döndürme, sıralama ve sayfa çıkarma tamamen tarayıcınızda çalışır; o dosyalar makinenizde kalır. OCR, PDF’den Word veya Excel’e dönüşüm ve ağır sıkıştırma modları sunucu tarafında işleme ihtiyaç duyar; bu dosyalar yalnızca iş süresince geçici depolamada tutulur ve ardından silinir.
Birleştirdiğim PDF neden parçalarının toplamından büyük?
Birleştirme kaynakları arka arkaya ekler; her dosyada bir kez bulunan ortak fontlar veya görseller sonuçta birden fazla kez gömülü kalabilir. Birleştirdikten sonra dosyayı sıkıştırmadan geçirmek farkı genelde geri kazandırır. En kötü örnekler, font ailelerinin tamamını gömen tasarım programlarından çıkan dosyalardır.
PDF içindeki metni doğrudan düzenleyebilir miyim?
Anlamlı biçimde hayır, çünkü düzenlenecek akışkan bir metin modeli yok. Word’e dönüştürün, değişikliği orada yapın ve tekrar PDF olarak dışa aktarın. Özgün dosya yoğun tasarlanmışsa bir miktar mizanpajı yeniden kurmayı göze alın.
Parola korumalı dosyalar işleniyor mu?
Yalnızca yazdırmaya veya kopyalamaya karşı korumalı dosyalar genelde işlenebilir; ama açmak için parola isteyen dosyalar işlenemez, çünkü içerik şifreli ve çözülmeden okunamaz. Açma parolasını önce kendi PDF okuyucunuzda kaldırın, sonra yükleyin. Şifrelemeyi aşmaya çalışmıyoruz.
PDF’den Excel’e dönüşüm ne kadar doğru?
Cetvel çizgileri görünen ve sütun hizası tutarlı olan tablolar iyi dönüşür. Birleştirilmiş hücreler, çok satırlı başlıklar, hücre içindeki dipnotlar ve metin olarak saklanmış sayılar işin bozulduğu yerlerdir. Sonuca güvenmeden önce toplamları özgün belgeyle mutlaka karşılaştırın.
Dijital imza düzenlemeden sonra geçerli kalır mı?
Hayır. İmza dosyanın belirli bir bayt aralığını kapsar; kayıpsız bir sayfa döndürme dahil her değişiklik imzayı geçersiz kılar. Birleştirme, bölme ve sıkıştırmayı önce yapın, imzayı en sona bırakın. İmzalı bir dosyanın değişmesi gerekiyorsa yeniden imzalanması da gerekir.
Sıkıştırma ile çözünürlük düşürme arasındaki fark ne?
Çözünürlük düşürme bir görselin piksel boyutlarını azaltır, örneğin 600 DPI’dan 150 DPI’ya iner. Sıkıştırma ise o pikselleri daha düşük kalite ayarıyla yeniden kodlar. İkisi de dosyayı küçültür ve hazır ayarların çoğu ikisini birlikte uygular; agresif bir ayarda taranmış metnin yumuşayıp bulanıklaşmasının sebebi budur.