Files

81 lines
2.7 KiB
Markdown
Raw Permalink Blame History

This file contains ambiguous Unicode characters
This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.
# OCR Projesi - Otomatik Metin Çıkarma Aracı 🖼️➡️📝
Bu proje, resimlerden Türkçe ve İngilizce metin çıkarma için geliştirilmiş bir OCR (Optical Character Recognition) aracıdır. GPU desteği ile hızlı işlem yapar ve hem TXT hem de koordinatlı PDF çıktıları verir.
## ✨ Özellikler
- 🖼️ **Çoklu Format Desteği**: PNG, JPG, JPEG, BMP, TIFF formatları
- 🇹🇷🇬🇧 **Türkçe ve İngilizce** metin tanıma
- ⚡ **GPU Hızlandırması** (CUDA desteği)
- 📄 **Çift Format Çıktı**: TXT ve PDF (koordinatlı)
- 🔧 **Otomatik Python Kurulum**: İnternet üzerinden otomatik indirme
- 📁 **Toplu İşlem**: Klasördeki tüm resimleri tek seferde işler
## 💻 Sistem Gereksinimleri
- **İşletim Sistemi**: Windows 10/11
- **RAM**: Minimum 4GB (8GB önerilen)
- **Disk Alanı**: 2GB boş alan
- **İnternet**: İlk kurulum için gerekli
- **GPU**: İsteğe bağlı (NVIDIA CUDA destekli GPU hızlandırma sağlar)
## Kurulum
1. Proje klasörünü bilgisayarınıza kopyalayın
2. `kurulum.bat` dosyasını çift tıklayarak çalıştırın
3. Kurulum otomatik olarak tamamlanacak
## Kullanım
1. İşlemek istediğiniz resimleri `images` klasörüne koyun
2. `ocr_calistir.bat` dosyasını çift tıklayarak çalıştırın
3. İşlem tamamlandığında:
- Metin dosyaları: `out-txt` klasöründe
- PDF dosyaları: `out-pdf` klasöründe
## Desteklenen Formatlar
- **Giriş**: PNG, JPG, JPEG, BMP, TIFF
- **Çıkış**: TXT, PDF
## İlk Çalıştırma
İlk çalıştırmada OCR modelleri (yaklaşık 100MB) indirilecektir. Bu işlem internet hızınıza bağlı olarak 5-15 dakika sürebilir.
## Sorun Giderme
### Python bulunamadı hatası
- Python'u https://www.python.org/downloads/ adresinden indirin
- Kurulum sırasında "Add Python to PATH" seçeneğini işaretleyin
### GPU kullanılmıyor
- NVIDIA GPU'nuz varsa CUDA kurulu olmalı
- Kod otomatik olarak GPU'yu algılar ve kullanır
### OCR sonuçları kötü
- Resim kalitesini artırın (en az 300 DPI önerilir)
- Metinlerin net ve okunaklı olduğundan emin olun
- Kontrast yüksek resimleri tercih edin
## Klasör Yapısı
```
ocr-projesi/
├── images/ # Giriş resimleri buraya
├── out-txt/ # Çıkış metin dosyaları
├── out-pdf/ # Çıkış PDF dosyaları
├── venv/ # Sanal ortam (otomatik oluşur)
├── main.py # Ana program
├── requirements.txt # Gerekli paketler
├── kurulum.bat # Kurulum scripti
├── ocr_calistir.bat # Çalıştırma scripti
└── README.md # Bu dosya
```
## Teknik Detaylar
- **OCR Engine**: EasyOCR
- **Görüntü İşleme**: OpenCV, Pillow
- **PDF Oluşturma**: ReportLab
- **GPU Desteği**: PyTorch CUDA