Engine OCR kinh điển, chín muồi nhất, hỗ trợ 100+ ngôn ngữ — nền tảng của vô số công cụ đọc chữ.
Tesseract là engine OCR mã nguồn mở lâu đời và trưởng thành nhất, do Google bảo trợ. Nó nhận dạng chữ in trong ảnh/tài liệu cho hơn 100 ngôn ngữ và xuất ra text, hOCR, PDF có lớp chữ. Vô số ứng dụng đọc tài liệu đứng trên nền Tesseract.
Tạo, chỉnh, phục hồi & tách vật thể trong ảnh — cả phòng thiết kế trong một máy.
Các bước cơ bản để bắt đầu.
Cài Tesseract theo hệ điều hành + gói ngôn ngữChạy `tesseract anh.png out -l vie`Hoặc dùng `pytesseract` trong PythonGiao diện web đầy đủ nhất để tạo ảnh bằng Stable Diffusion: txt2img, img2img, inpaint, LoRA.
Thư viện thị giác máy tính số 1 — xử lý ảnh/video, phát hiện vật thể, nền tảng cho mọi tool hình ảnh.