mirror of
https://github.com/barkeser2002/ocr-img.git
synced 2026-09-25 03:09:54 +03:00
81 lines
2.7 KiB
Markdown
81 lines
2.7 KiB
Markdown
# OCR Projesi - Otomatik Metin Çıkarma Aracı 🖼️➡️📝
|
||
|
||
Bu proje, resimlerden Türkçe ve İngilizce metin çıkarma için geliştirilmiş bir OCR (Optical Character Recognition) aracıdır. GPU desteği ile hızlı işlem yapar ve hem TXT hem de koordinatlı PDF çıktıları verir.
|
||
|
||
## ✨ Özellikler
|
||
|
||
- 🖼️ **Çoklu Format Desteği**: PNG, JPG, JPEG, BMP, TIFF formatları
|
||
- 🇹🇷🇬🇧 **Türkçe ve İngilizce** metin tanıma
|
||
- ⚡ **GPU Hızlandırması** (CUDA desteği)
|
||
- 📄 **Çift Format Çıktı**: TXT ve PDF (koordinatlı)
|
||
- 🔧 **Otomatik Python Kurulum**: İnternet üzerinden otomatik indirme
|
||
- 📁 **Toplu İşlem**: Klasördeki tüm resimleri tek seferde işler
|
||
|
||
## 💻 Sistem Gereksinimleri
|
||
|
||
- **İşletim Sistemi**: Windows 10/11
|
||
- **RAM**: Minimum 4GB (8GB önerilen)
|
||
- **Disk Alanı**: 2GB boş alan
|
||
- **İnternet**: İlk kurulum için gerekli
|
||
- **GPU**: İsteğe bağlı (NVIDIA CUDA destekli GPU hızlandırma sağlar)
|
||
|
||
## Kurulum
|
||
|
||
1. Proje klasörünü bilgisayarınıza kopyalayın
|
||
2. `kurulum.bat` dosyasını çift tıklayarak çalıştırın
|
||
3. Kurulum otomatik olarak tamamlanacak
|
||
|
||
## Kullanım
|
||
|
||
1. İşlemek istediğiniz resimleri `images` klasörüne koyun
|
||
2. `ocr_calistir.bat` dosyasını çift tıklayarak çalıştırın
|
||
3. İşlem tamamlandığında:
|
||
- Metin dosyaları: `out-txt` klasöründe
|
||
- PDF dosyaları: `out-pdf` klasöründe
|
||
|
||
## Desteklenen Formatlar
|
||
|
||
- **Giriş**: PNG, JPG, JPEG, BMP, TIFF
|
||
- **Çıkış**: TXT, PDF
|
||
|
||
## İlk Çalıştırma
|
||
|
||
İlk çalıştırmada OCR modelleri (yaklaşık 100MB) indirilecektir. Bu işlem internet hızınıza bağlı olarak 5-15 dakika sürebilir.
|
||
|
||
## Sorun Giderme
|
||
|
||
### Python bulunamadı hatası
|
||
- Python'u https://www.python.org/downloads/ adresinden indirin
|
||
- Kurulum sırasında "Add Python to PATH" seçeneğini işaretleyin
|
||
|
||
### GPU kullanılmıyor
|
||
- NVIDIA GPU'nuz varsa CUDA kurulu olmalı
|
||
- Kod otomatik olarak GPU'yu algılar ve kullanır
|
||
|
||
### OCR sonuçları kötü
|
||
- Resim kalitesini artırın (en az 300 DPI önerilir)
|
||
- Metinlerin net ve okunaklı olduğundan emin olun
|
||
- Kontrast yüksek resimleri tercih edin
|
||
|
||
## Klasör Yapısı
|
||
|
||
```
|
||
ocr-projesi/
|
||
├── images/ # Giriş resimleri buraya
|
||
├── out-txt/ # Çıkış metin dosyaları
|
||
├── out-pdf/ # Çıkış PDF dosyaları
|
||
├── venv/ # Sanal ortam (otomatik oluşur)
|
||
├── main.py # Ana program
|
||
├── requirements.txt # Gerekli paketler
|
||
├── kurulum.bat # Kurulum scripti
|
||
├── ocr_calistir.bat # Çalıştırma scripti
|
||
└── README.md # Bu dosya
|
||
```
|
||
|
||
## Teknik Detaylar
|
||
|
||
- **OCR Engine**: EasyOCR
|
||
- **Görüntü İşleme**: OpenCV, Pillow
|
||
- **PDF Oluşturma**: ReportLab
|
||
- **GPU Desteği**: PyTorch CUDA
|