Chuyển đến nội dung
SPCXTools

Chuyển ảnh thành văn bản (OCR)

Copy chữ từ bất kỳ hình ảnh, ảnh chụp màn hình hay bản scan nào — nhận dạng trực tiếp trên trình duyệt, hỗ trợ 16 ngôn ngữ.

Chạy cục bộ — tệp không bao giờ rời khỏi thiết bị của bạn

Đang tải công cụ…

Cách sử dụng Chuyển ảnh thành văn bản (OCR)

  1. 1Chọn ngôn ngữ của văn bản trong ảnh.
  2. 2Chọn ảnh, kéo thả vào trang hoặc dán ảnh chụp màn hình bằng Ctrl+V (⌘+V trên Mac).
  3. 3Nhấn Trích xuất văn bản. Ở lần đầu tiên, công cụ nhận dạng và mô hình ngôn ngữ sẽ được tải xuống.
  4. 4Chỉnh sửa lỗi (nếu có) trong khung văn bản, sau đó sao chép hoặc tải xuống.

Chuyển ảnh chứa chữ thành văn bản có thể chỉnh sửa

Việc gõ lại văn bản từ hình ảnh rất mất thời gian và dễ sai sót. Dù là ảnh chụp màn hình tin nhắn, ảnh chụp bảng trắng, tài liệu scan, biên lai, trang sách, slide thuyết trình hay biển báo tiếng nước ngoài cần dịch, công cụ OCR này sẽ nhận dạng chữ và chuyển thành văn bản thuần túy để bạn dễ dàng sao chép, chỉnh sửa và tìm kiếm.

Tính năng

  • 16 ngôn ngữ, bao gồm tiếng Anh, tiếng Tây Ban Nha, tiếng Pháp, tiếng Đức, tiếng Nga, tiếng Trung (Giản thể và Phồn thể), tiếng Nhật, tiếng Hàn, tiếng Ả Rập và tiếng Hindi.
  • Trang đa ngôn ngữ với lớp tiếng Anh bổ sung.
  • Dán ảnh chụp màn hình trực tiếp từ clipboard.
  • Kết quả có thể chỉnh sửa, cho phép sao chép và tải xuống dưới dạng .txt.
  • Bảo mật: hình ảnh được xử lý ngay trên thiết bị của bạn.

Mẹo để nhận dạng chính xác nhất

Hình ảnh Kết quả dự kiến
Ảnh chụp màn hình tài liệu hoặc trang web Xuất sắc
Bản scan phẳng ở 300 DPI Xuất sắc
Ảnh điện thoại chụp trang in, ánh sáng tốt Rất tốt
Ảnh chụp biển báo hoặc nhãn bị nghiêng Trung bình — nên cắt và chỉnh thẳng trước
Chữ viết tay Kém

Hãy cắt ảnh vừa với vùng chứa chữ bằng công cụ Cắt ảnh và xoay thẳng ảnh bằng công cụ Xoay ảnh trước khi chạy OCR để có kết quả tốt nhất.

Công cụ liên quan

Trích xuất lớp văn bản từ tệp PDF kỹ thuật số bằng công cụ Chuyển PDF sang Text, đọc mã QR bằng Quét mã QR, hoặc đếm số từ của văn bản vừa trích xuất bằng công cụ Đếm từ.

Câu hỏi thường gặp

Ảnh của tôi có bị tải lên máy chủ không?
Không. Quá trình nhận dạng văn bản hoạt động trực tiếp trên trình duyệt của bạn bằng Tesseract, một công cụ OCR mã nguồn mở. Trình duyệt chỉ tải xuống công cụ và mô hình ngôn ngữ từ một CDN công cộng; ảnh của bạn không bao giờ bị gửi ra khỏi thiết bị.
Độ chính xác của OCR như thế nào?
Các văn bản in rõ nét trong ảnh chụp màn hình và bản scan thường được nhận dạng gần như hoàn hảo. Độ chính xác sẽ giảm đối với chữ nhỏ hoặc mờ, độ tương phản thấp, phông chữ lạ, chữ viết tay, trang giấy bị cong và nền có nhiều chi tiết. Luôn kiểm tra lại các văn bản quan trọng.
Làm sao để có kết quả tốt hơn?
Hãy dùng ảnh sắc nét và có độ phân giải cao nhất, cắt ảnh vừa vặn với phần văn bản, đảm bảo ảnh ngay ngắn, đủ sáng và chọn đúng ngôn ngữ. Đối với trang có hai ngôn ngữ, hãy giữ dấu tích ở mục "also English".
Công cụ có nhận dạng chữ viết tay không?
Chỉ nhận dạng được chữ viết tay nắn nót, rõ ràng như chữ in nhưng độ chính xác không cao. Công cụ này được thiết kế chủ yếu cho văn bản in và đánh máy.
Tại sao lần nhận dạng đầu tiên lại lâu hơn?
Trong lần đầu tiên, trình duyệt cần tải xuống công cụ OCR và mô hình ngôn ngữ (khoảng 2–15 MB tùy ngôn ngữ) và lưu vào bộ nhớ đệm (cache). Các lần nhận dạng sau sẽ diễn ra rất nhanh.