Files

2.7 KiB
Raw Permalink Blame History

OCR Projesi - Otomatik Metin Çıkarma Aracı 🖼️➡️📝

Bu proje, resimlerden Türkçe ve İngilizce metin çıkarma için geliştirilmiş bir OCR (Optical Character Recognition) aracıdır. GPU desteği ile hızlı işlem yapar ve hem TXT hem de koordinatlı PDF çıktıları verir.

✨ Özellikler

  • 🖼️ Çoklu Format Desteği: PNG, JPG, JPEG, BMP, TIFF formatları
  • 🇹🇷🇬🇧 Türkçe ve İngilizce metin tanıma
  • ⚡ GPU Hızlandırması (CUDA desteği)
  • 📄 Çift Format Çıktı: TXT ve PDF (koordinatlı)
  • 🔧 Otomatik Python Kurulum: İnternet üzerinden otomatik indirme
  • 📁 Toplu İşlem: Klasördeki tüm resimleri tek seferde işler

💻 Sistem Gereksinimleri

  • İşletim Sistemi: Windows 10/11
  • RAM: Minimum 4GB (8GB önerilen)
  • Disk Alanı: 2GB boş alan
  • İnternet: İlk kurulum için gerekli
  • GPU: İsteğe bağlı (NVIDIA CUDA destekli GPU hızlandırma sağlar)

Kurulum

  1. Proje klasörünü bilgisayarınıza kopyalayın
  2. kurulum.bat dosyasını çift tıklayarak çalıştırın
  3. Kurulum otomatik olarak tamamlanacak

Kullanım

  1. İşlemek istediğiniz resimleri images klasörüne koyun
  2. ocr_calistir.bat dosyasını çift tıklayarak çalıştırın
  3. İşlem tamamlandığında:
    • Metin dosyaları: out-txt klasöründe
    • PDF dosyaları: out-pdf klasöründe

Desteklenen Formatlar

  • Giriş: PNG, JPG, JPEG, BMP, TIFF
  • Çıkış: TXT, PDF

İlk Çalıştırma

İlk çalıştırmada OCR modelleri (yaklaşık 100MB) indirilecektir. Bu işlem internet hızınıza bağlı olarak 5-15 dakika sürebilir.

Sorun Giderme

Python bulunamadı hatası

GPU kullanılmıyor

  • NVIDIA GPU'nuz varsa CUDA kurulu olmalı
  • Kod otomatik olarak GPU'yu algılar ve kullanır

OCR sonuçları kötü

  • Resim kalitesini artırın (en az 300 DPI önerilir)
  • Metinlerin net ve okunaklı olduğundan emin olun
  • Kontrast yüksek resimleri tercih edin

Klasör Yapısı

ocr-projesi/
├── images/          # Giriş resimleri buraya
├── out-txt/         # Çıkış metin dosyaları
├── out-pdf/         # Çıkış PDF dosyaları
├── venv/            # Sanal ortam (otomatik oluşur)
├── main.py          # Ana program
├── requirements.txt # Gerekli paketler
├── kurulum.bat      # Kurulum scripti
├── ocr_calistir.bat # Çalıştırma scripti
└── README.md        # Bu dosya

Teknik Detaylar

  • OCR Engine: EasyOCR
  • Görüntü İşleme: OpenCV, Pillow
  • PDF Oluşturma: ReportLab
  • GPU Desteği: PyTorch CUDA