Optical Character Recognition
AssessKỹ thuật
Công nghệ trích xuất văn bản từ hình ảnh hoặc tài liệu quét.
Vì sao ở đây
Xếp vào Assess: 5 bài bằng chứng từ 2 nguồn, chủ yếu là tin nghiên cứu, 1 bài trong 30 ngày qua. Độ tin cậy 50%.
Bằng chứng (5)
- 4Hacker News·16/7/2026product_launchDecoy Font che nội dung khỏi AI
Decoy Font là một phông chữ TTF dùng kỹ thuật tần số không gian kiểu ảnh lai để hiển thị nội dung khác nhau cho con người và các hệ thống AI/OCR tùy theo khoảng cách quan sát. Dự án được định vị như một công cụ chống thu thập dữ liệu và chống OCR, nhưng không phải là biện pháp bảo vệ tuyệt đối trước các tác nhân mạnh hơn.
- 4Hacker News·11/7/2026researchGhost Font ẩn thông điệp khỏi các mô hình AI
Ghost Font là một định dạng trình bày thông điệp thử nghiệm, kết hợp chuyển động, video, nhiễu và yếu tố đánh lừa để con người đọc được nhưng các mô hình AI khó giải mã. Dự án đối chiếu cách tiếp cận này với các font chống OCR cũ như ZXX và cho rằng ảnh chụp tĩnh sẽ không lộ được thông điệp ẩn.
- 2Hacker News·8/7/2026product_launchGiải mã đoạn Bash bị che giấu trên áo thun Uniqlo
Bài viết trên Hacker News mô tả việc phát hiện một đoạn Bash tự thực thi và bị làm rối được in ở mặt sau áo thun Uniqlo do Akamai thiết kế. Đây là một chi tiết ẩn mang tính “Easter egg”, dùng Base64 để giải mã nội dung và hiển thị thông điệp chúc mừng, được tìm ra sau khi OCR và chỉnh sửa thủ công văn bản in trên áo.
- 6Hacker News·3/7/2026open_sourcePxpipe giảm 60% chi phí cho Fable bằng cách chuyển mã thành hình ảnh để OCR
Dự án pxpipe cho biết đã giúp Fable cắt 60% chi phí bằng cách chuyển mã nguồn thành hình ảnh rồi để mô hình đọc lại bằng OCR. Cách tiếp cận này được nêu như một tối ưu thực dụng nhằm giảm chi phí xử lý mô hình mà vẫn giữ nguyên bài toán lập trình cốt lõi.
- 7Hugging Face Blog·3/6/2026researchDPO giảm hiện tượng suy giảm văn bản trong mô hình OCR ngoài chatbot
Bài viết trên Hugging Face Blog mô tả cách Dharma-AI sử dụng Direct Preference Optimization (DPO) sau khi fine-tune có giám sát để giảm hiện tượng lặp suy giảm trong các mô hình OCR có cấu trúc. Trên tất cả các họ mô hình được thử nghiệm, tỷ lệ suy giảm đều giảm, trung bình 59,4% và mức tốt nhất là 87,6%. Bài viết cho rằng DPO có thể tận dụng chính các đầu ra lỗi của mô hình làm cặp bị từ chối, mở rộng tối ưu hóa theo sở thích ra ngoài bài toán căn chỉnh chatbot.