mirror of
https://github.com/barkeser2002/ocr-img.git
synced 2026-09-25 00:09:57 +03:00
main
OCR Projesi - Otomatik Metin Çıkarma Aracı 🖼️➡️📝
Bu proje, resimlerden Türkçe ve İngilizce metin çıkarma için geliştirilmiş bir OCR (Optical Character Recognition) aracıdır. GPU desteği ile hızlı işlem yapar ve hem TXT hem de koordinatlı PDF çıktıları verir.
✨ Özellikler
- 🖼️ Çoklu Format Desteği: PNG, JPG, JPEG, BMP, TIFF formatları
- 🇹🇷🇬🇧 Türkçe ve İngilizce metin tanıma
- ⚡ GPU Hızlandırması (CUDA desteği)
- 📄 Çift Format Çıktı: TXT ve PDF (koordinatlı)
- 🔧 Otomatik Python Kurulum: İnternet üzerinden otomatik indirme
- 📁 Toplu İşlem: Klasördeki tüm resimleri tek seferde işler
💻 Sistem Gereksinimleri
- İşletim Sistemi: Windows 10/11
- RAM: Minimum 4GB (8GB önerilen)
- Disk Alanı: 2GB boş alan
- İnternet: İlk kurulum için gerekli
- GPU: İsteğe bağlı (NVIDIA CUDA destekli GPU hızlandırma sağlar)
Kurulum
- Proje klasörünü bilgisayarınıza kopyalayın
kurulum.batdosyasını çift tıklayarak çalıştırın- Kurulum otomatik olarak tamamlanacak
Kullanım
- İşlemek istediğiniz resimleri
imagesklasörüne koyun ocr_calistir.batdosyasını çift tıklayarak çalıştırın- İşlem tamamlandığında:
- Metin dosyaları:
out-txtklasöründe - PDF dosyaları:
out-pdfklasöründe
- Metin dosyaları:
Desteklenen Formatlar
- Giriş: PNG, JPG, JPEG, BMP, TIFF
- Çıkış: TXT, PDF
İlk Çalıştırma
İlk çalıştırmada OCR modelleri (yaklaşık 100MB) indirilecektir. Bu işlem internet hızınıza bağlı olarak 5-15 dakika sürebilir.
Sorun Giderme
Python bulunamadı hatası
- Python'u https://www.python.org/downloads/ adresinden indirin
- Kurulum sırasında "Add Python to PATH" seçeneğini işaretleyin
GPU kullanılmıyor
- NVIDIA GPU'nuz varsa CUDA kurulu olmalı
- Kod otomatik olarak GPU'yu algılar ve kullanır
OCR sonuçları kötü
- Resim kalitesini artırın (en az 300 DPI önerilir)
- Metinlerin net ve okunaklı olduğundan emin olun
- Kontrast yüksek resimleri tercih edin
Klasör Yapısı
ocr-projesi/
├── images/ # Giriş resimleri buraya
├── out-txt/ # Çıkış metin dosyaları
├── out-pdf/ # Çıkış PDF dosyaları
├── venv/ # Sanal ortam (otomatik oluşur)
├── main.py # Ana program
├── requirements.txt # Gerekli paketler
├── kurulum.bat # Kurulum scripti
├── ocr_calistir.bat # Çalıştırma scripti
└── README.md # Bu dosya
Teknik Detaylar
- OCR Engine: EasyOCR
- Görüntü İşleme: OpenCV, Pillow
- PDF Oluşturma: ReportLab
- GPU Desteği: PyTorch CUDA
Languages
Python
64.5%
Batchfile
35.5%