← Back to list

OCR Picture To Text Recognition

Using Phyton Google Colab

Rivaldi valdi · 2026-05-20 07:29 · 0 claps · 1.3 min read
#ocr #pictures #text
Open on Medium ↗

OCR Picture To Text Recognition

Using Phyton Google Colab

Langkah 1: Jalankan Instalasi (Jika belum)

Pastikan Anda sudah menjalankan perintah ini di cell paling atas notebook Colab Anda:

!apt-get install -y tesseract-ocr poppler-utils
!pip install pytesseract pdf2image

Langkah 2: Salin dan Jalankan Kode OCR Interaktif Ini

Buat cell baru, lalu masukkan kode di bawah ini. Ketika dijalankan, tombol “Choose Files” akan otomatis muncul.

import os
from PIL import Image
import pytesseract
from pdf2image import convert_from_path
from google.colab import files  # Library khusus Colab untuk upload file

def ocr_gambar(jalur_gambar):
    try:
        img = Image.open(jalur_gambar)
        teks = pytesseract.image_to_string(img, lang='eng+ind') 
        return teks
    except Exception as e:
        return f"Gagal memproses gambar: {str(e)}"

def ocr_pdf(jalur_pdf):
    try:
        halaman_gambar = convert_from_path(jalur_pdf)
        teks_penuh = ""
        for i, halaman in enumerate(halaman_gambar):
            print(f"Memproses halaman {i+1}...")
            teks_halaman = pytesseract.image_to_string(halaman, lang='eng+ind')
            teks_penuh += f"\n--- HALAMAN {i+1} ---\n" + teks_halaman
        return teks_penuh
    except Exception as e:
        return f"Gagal memproses PDF: {str(e)}"

def mulai_aplikasi_ocr():
    print("Silahkan klik tombol di bawah untuk mengunggah file (JPG, JPEG, PNG, atau PDF):")

    # Memunculkan tombol upload interaktif
    uploaded = files.upload()

    if not uploaded:
        print("Upload dibatalkan.")
        return

    # Mengambil nama file yang baru saja di-upload
    jalur_file = list(uploaded.keys())[0]
    ekstensi = os.path.splitext(jalur_file)[1].lower()

    print("\nSedang memproses dokumen, mohon tunggu...")

    if ekstensi in ['.jpg', '.jpeg', '.png', '.bmp']:
        hasil = ocr_gambar(jalur_file)
    elif ekstensi == '.pdf':
        hasil = ocr_pdf(jalur_file)
    else:
        print("Format file tidak didukung! Gunakan hanya JPG, PNG, atau PDF.")
        return

    # Menampilkan Hasil OCR
    print("\n" + "="*40)
    print("         HASIL EKSTRAKSI TEKS")
    print("="*40)
    print(hasil)
    print("="*40)

    # Menyimpan hasil ke file teks (.txt)
    nama_output = f"hasil_ocr_{os.path.splitext(jalur_file)[0]}.txt"
    with open(nama_output, "w", encoding="utf-8") as f:
        f.write(hasil)

    print(f"\n✓ Sukses! Teks disimpan dengan nama: {nama_output}")

    # Otomatis download file .txt hasilnya ke komputer Anda
    print("Mengunduh hasil teks ke komputer Anda...")
    files.download(nama_output)

# Menjalankan program
mulai_aplikasi_ocr()

Cara Kerjanya Sekarang:

  1. Jalankan kode di atas.
  2. Klik tombol **Choose Files** yang muncul di bawah cell.
  3. Pilih file gambar (JPG/PNG) atau dokumen PDF dari komputer Anda.
  4. Program akan otomatis mendeteksi jenis filenya, membaca teksnya, menampilkan hasilnya di layar, dan langsung mengunduh file .txt berisi teks tersebut kembali ke komputer Anda.

메타데이터
post_id
40b595dd94d1
slug
ocr-picture-to-text-recognition-40b595dd94d1
url
https://medium.com/@rvaldi26/ocr-picture-to-text-recognition-40b595dd94d1
canonical_url
https://medium.com/@rvaldi26/ocr-picture-to-text-recognition-40b595dd94d1
author_url
https://medium.com/@rvaldi26
status
ok
fetched_at
2026-06-09 15:37:30