Sayfa yükleniyor…
Sayfa yükleniyor…
Metin tabanlı PDF'leri tarayıcınızda temiz Markdown'a dönüştürün. Sayfaları milisaniyeler içinde sınıflandırır, tabloları ve okuma sırasını korur — yükleme yok, yerel PDF'lerde OCR vergisi yok.
Firecrawl'ın açık kaynak pdf-inspector'ı (Rust → WebAssembly) tarafından desteklenir. Metin PDF'leri milisaniyeler içinde dönüşür — saniyeler süren OCR değil.
PDF'iniz cihazdan asla çıkmaz. Sınıflandırma ve Markdown dönüştürme tamamen tarayıcıda çalışır.
Dikdörtgen ve sezgisel tablo algılama, çok sütunlu düzenler ve temiz Markdown için yapılandırılmış başlıklar.
Metin tabanlı ve taranmış ile karma arasında ~20ms içinde ayrım yapar ve OCR gerektirecek sayfaları tam olarak listeler.
RAG, ajanlar ve dokümantasyon iş akışları için başlıklar, listeler, kod blokları, kalın/italik ve bağlantılar korunur.
Hesap, filigran veya günlük sınır yok. İhtiyacınız kadar yerel PDF dönüştürün.
Bir PDF sürükleyip bırakın veya cihazınızdan göz atın. Dosyalar yerel kalır — hiçbir şey yüklenmez.
Motor her sayfayı sınıflandırır ve yerel metni tablolar ve okuma sırasıyla yapılandırılmış Markdown'a dönüştürür.
Sonucu önizleyin, Markdown'ı kopyalayın veya dokümanlar, bloglar veya yapay zeka iş akışları için bir .md dosyası indirin.
Çoğu çevrimiçi dönüştürücü ya her sayfada OCR yapar (yavaş ve pahalı) ya da bozuk sırayla ham PDF metni döker. Bu araç, her PDF'i yaklaşık 20ms içinde sınıflandırmak için Firecrawl'ın pdf-inspector motorunu kullanır — metin tabanlı, taranmış, görüntü tabanlı veya karma — ve ardından yalnızca yerel metinden yapılandırılmış Markdown çıkarır. Gerçek dünyadaki PDF'lerin yaklaşık yarısı hiç OCR gerektirmez.
Başlıklar (yazı tipi kademelerine göre H1–H4), madde işaretli ve numaralı listeler, sabit aralıklı kod blokları, kalın/italik, URL bağlantıları, çok sütunlu okuma sırası ve çift modlu tablolar (dikdörtgen çizimi + hizalama sezgiselleri). İsteğe bağlı kompakt mod, ajan iş akışlarında daha düşük token sayıları için dolguyu sıkıştırır.
Ayrıştırma, WebAssembly aracılığıyla tamamen tarayıcınızda çalışır. Şifrelenmiş PDF'ler, sekmeden asla çıkmayan bir parolayla açılabilir. Taranmış sayfalar dürüstçe etiketlenir; böylece ayrı bir OCR adımının ne zaman gerektiğini bilirsiniz — görüntülerden metin uyduruyormuş gibi davranmayız.
Raporları ve makaleleri, her sayfayı OCR'den geçirmeden temiz Markdown token'larına dönüştürün.
Akademik PDF'lerden okunabilir yapı çıkarın ve Zettelkasten veya wikiler için Markdown olarak kaydedin.
Finansal PDF'lerdeki tablo ızgaralarını elektronik tablolar, denetimler ve muhasebe iş akışları için koruyun.
Dışa aktarılan kılavuzları ve el kitaplarını statik siteler ve bilgi tabanları için düzenlenebilir Markdown'a dönüştürün.