OCR Picture To Text Recognition
Using Phyton Google Colab
OCR Picture To Text Recognition
Using Phyton Google Colab
Langkah 1: Jalankan Instalasi (Jika belum)
Pastikan Anda sudah menjalankan perintah ini di cell paling atas notebook Colab Anda:
!apt-get install -y tesseract-ocr poppler-utils
!pip install pytesseract pdf2image
Langkah 2: Salin dan Jalankan Kode OCR Interaktif Ini
Buat cell baru, lalu masukkan kode di bawah ini. Ketika dijalankan, tombol “Choose Files” akan otomatis muncul.
import os
from PIL import Image
import pytesseract
from pdf2image import convert_from_path
from google.colab import files # Library khusus Colab untuk upload file
def ocr_gambar(jalur_gambar):
try:
img = Image.open(jalur_gambar)
teks = pytesseract.image_to_string(img, lang='eng+ind')
return teks
except Exception as e:
return f"Gagal memproses gambar: {str(e)}"
def ocr_pdf(jalur_pdf):
try:
halaman_gambar = convert_from_path(jalur_pdf)
teks_penuh = ""
for i, halaman in enumerate(halaman_gambar):
print(f"Memproses halaman {i+1}...")
teks_halaman = pytesseract.image_to_string(halaman, lang='eng+ind')
teks_penuh += f"\n--- HALAMAN {i+1} ---\n" + teks_halaman
return teks_penuh
except Exception as e:
return f"Gagal memproses PDF: {str(e)}"
def mulai_aplikasi_ocr():
print("Silahkan klik tombol di bawah untuk mengunggah file (JPG, JPEG, PNG, atau PDF):")
# Memunculkan tombol upload interaktif
uploaded = files.upload()
if not uploaded:
print("Upload dibatalkan.")
return
# Mengambil nama file yang baru saja di-upload
jalur_file = list(uploaded.keys())[0]
ekstensi = os.path.splitext(jalur_file)[1].lower()
print("\nSedang memproses dokumen, mohon tunggu...")
if ekstensi in ['.jpg', '.jpeg', '.png', '.bmp']:
hasil = ocr_gambar(jalur_file)
elif ekstensi == '.pdf':
hasil = ocr_pdf(jalur_file)
else:
print("Format file tidak didukung! Gunakan hanya JPG, PNG, atau PDF.")
return
# Menampilkan Hasil OCR
print("\n" + "="*40)
print(" HASIL EKSTRAKSI TEKS")
print("="*40)
print(hasil)
print("="*40)
# Menyimpan hasil ke file teks (.txt)
nama_output = f"hasil_ocr_{os.path.splitext(jalur_file)[0]}.txt"
with open(nama_output, "w", encoding="utf-8") as f:
f.write(hasil)
print(f"\n✓ Sukses! Teks disimpan dengan nama: {nama_output}")
# Otomatis download file .txt hasilnya ke komputer Anda
print("Mengunduh hasil teks ke komputer Anda...")
files.download(nama_output)
# Menjalankan program
mulai_aplikasi_ocr()
Cara Kerjanya Sekarang:
- Jalankan kode di atas.
- Klik tombol
**Choose Files** yang muncul di bawah cell. - Pilih file gambar (JPG/PNG) atau dokumen PDF dari komputer Anda.
- Program akan otomatis mendeteksi jenis filenya, membaca teksnya, menampilkan hasilnya di layar, dan langsung mengunduh file
.txtberisi teks tersebut kembali ke komputer Anda.
메타데이터
- post_id
- 40b595dd94d1
- slug
- ocr-picture-to-text-recognition-40b595dd94d1
- url
- https://medium.com/@rvaldi26/ocr-picture-to-text-recognition-40b595dd94d1
- canonical_url
- https://medium.com/@rvaldi26/ocr-picture-to-text-recognition-40b595dd94d1
- author_url
- https://medium.com/@rvaldi26
- status
- ok
- fetched_at
- 2026-06-09 15:37:30