Chuyển tới nội dung chính

Cách Rephlo đọc tệp của bạn

Bạn có thể đưa tệp cho Rephlo theo nhiều cách — đính kèm vào một tin nhắn trò chuyện, thêm vào một Knowledge Space, hoặc dán ảnh chụp màn hình. Điều xảy ra tiếp theo phụ thuộc vào tệp đó thuộc loại nàobạn đặt nó ở đâu — hai câu hỏi rất dễ bị lẫn lộn.

Trang này trả lời đúng một điều: tôi đã đưa một tệp cho Rephlo — thực sự thì nó đã làm gì với tệp đó?

Tóm tắt nhanh

Mọi tệp bạn đưa cho Rephlo đều đi theo một trong ba con đường:

Con đườngKhi nào áp dụngRephlo làm gì
Văn bảnTệp vốn đã chứa văn bản — PDF thông thường, tài liệu Word, Markdown, CSV, mã nguồnĐọc thẳng văn bản từ tệp
OCRTệp là hình ảnh của văn bản — PDF quét, ảnh chụp một trang giấy, bản faxNhận dạng văn bản ngay trên máy của bạn, rồi xử lý như con đường Văn bản
Thị giácTệp là hình ảnh thật — biểu đồ, ảnh chụp màn hình, ảnh chụpGửi chính bức ảnh tới mô hình có khả năng nhìn

Khác biệt giữa hai con đường đầu quan trọng hơn vẻ ngoài của nó. Một tệp PDF từ máy quét trông y hệt một tệp PDF xuất từ Word khi bạn mở ra, nhưng với phần mềm thì một bên là văn bản, còn bên kia là bức ảnh chụp văn bản. Trước khi Rephlo làm được OCR, PDF quét chỉ đơn giản là một bức ảnh không đọc được — không có gì để tìm kiếm và không có gì để trích dẫn.

Câu hỏi thứ hai: đính kèm hay Space?

Con đường quyết định tệp được đọc như thế nào. Nơi bạn đặt tệp quyết định nó tồn tại bao lâu và được dùng ra sao.

Đính kèm vào tin nhắnThêm vào Knowledge Space
Thời gian tồn tạiChỉ trong cuộc trò chuyện nàyĐược lưu cho tới khi bạn xóa
Tái sử dụngPhải đính kèm lại mỗi lầnSẵn có cho mọi cuộc trò chuyện và lệnh dùng Space đó
Cách sử dụngĐưa vào prompt của tin nhắn đóChia thành các đoạn và lập chỉ mục, để Rephlo chỉ lấy ra phần liên quan
Phù hợp vớiMột câu hỏi dùng một lần về một tài liệuTài liệu tham chiếu bạn quay lại nhiều lần — sổ tay, bộ hợp đồng, ghi chú nghiên cứu

Cả hai đều đi theo cùng ba con đường. Một tệp PDF quét đều được OCR dù bạn đính kèm hay thêm vào Space; khác biệt nằm ở chuyện gì xảy ra với văn bản sau đó.

Vì sao Space không gửi thẳng cả tài liệu. Một tài liệu lớn không vừa với cửa sổ ngữ cảnh của mô hình, và nhồi hết vào sẽ vừa chậm vừa tốn kém. Space lập chỉ mục văn bản để Rephlo chỉ rút ra vài đoạn thực sự trả lời câu hỏi của bạn. Xem Truy xuất RAG & tinh chỉnh.

Ghép cả hai câu hỏi lại

Bạn đưa gì cho RephloBạn đặt ở đâuĐiều gì xảy ra
PDF có lớp văn bản, Word, Markdown, CSV, mã nguồnĐính kèm vào tin nhắnVăn bản được đọc và đưa vào tin nhắn đó
Cùng tệp đóThêm vào SpaceVăn bản được đọc, chia đoạn và lập chỉ mục để truy xuất
PDF quét (không có lớp văn bản)Đính kèm vào tin nhắnVăn bản được nhận dạng trên máy bạn, rồi mới đưa vào
PDF quétThêm vào SpaceVăn bản được nhận dạng trên máy bạn, rồi chia đoạn và lập chỉ mục
Ảnh màn hình, biểu đồ, ảnh chụpĐính kèm vào tin nhắnBức ảnh được gửi tới mô hình có khả năng nhìn
Ảnh màn hình, biểu đồ, ảnh chụpThêm vào SpaceVăn bản tìm thấy trong ảnh được lập chỉ mục; bản thân bức ảnh không truy xuất được

Đọc tài liệu quét (OCR)

OCR — nhận dạng ký tự quang học — là công nghệ biến hình ảnh của văn bản trở lại thành văn bản. Rephlo làm việc này hoàn toàn trên máy tính của bạn. Tài liệu không bao giờ được tải lên đâu để nhận dạng.

Bật và tắt

Vào Settings ▸ Privacy ▸ Read scanned documents on this device.

Tùy chọn này được bật sẵn. Khi tắt, Rephlo bỏ qua bước nhận dạng và gửi thẳng tệp tới mô hình AI — một lựa chọn hợp lý nếu bạn đang dùng mô hình vốn đọc tài liệu tốt và không muốn tốn thời gian xử lý cục bộ.

Lần tải về duy nhất

Lần đầu chạy OCR, Rephlo tải về một mô hình nhận dạng văn bản nhỏ — khoảng 15 MB — và báo cho bạn khi đã sẵn sàng. Việc này diễn ra một lần, ở chế độ nền. Nếu tải thất bại (thường do kết nối), Rephlo sẽ báo; tài liệu quét sẽ chưa được đọc cho tới khi tải thành công.

Chọn ngôn ngữ tài liệu

Ngay dưới thiết lập đó là Scanned document language. Mặc định là Auto, đi theo ngôn ngữ ứng dụng, nên hầu hết mọi người không bao giờ cần đổi.

Hãy đổi khi tài liệu bạn quét được viết bằng ngôn ngữ khác với giao diện ứng dụng. Điều này quan trọng hơn vẻ ngoài của nó: nhận dạng trang tiếng Nhật hay tiếng Hàn bằng bộ nhận dạng chữ Latinh sẽ cho ra văn bản không dùng được, chứ không phải chỉ kém đi đôi chút.

Việc nhận dạng được tối ưu cho các ngôn ngữ sau:

Ngôn ngữ
Tiếng Anh, Pháp, Tây Ban Nha, Đức, Bồ Đào NhaDùng chung bộ nhận dạng Latinh
Tiếng Nhật, tiếng Trung (giản thể)
Tiếng Hàn
Tiếng Việt

Các ngôn ngữ khác vẫn hoạt động ở mức nỗ lực tốt nhất, nhưng độ chính xác không được bảo đảm.

Tài liệu rất dài: nhãn “Partial OCR”

Nhận dạng mỗi trang tốn công sức thật sự của máy bạn, nên việc lập chỉ mục được giới hạn ở 200 trang mỗi tài liệu. Nếu một tài liệu quét vượt quá giới hạn đó, Rephlo lập chỉ mục phần văn bản mà tệp vốn đã có và gắn nhãn Partial OCR trong Space.

Nhãn này tồn tại để bạn không bị hiểu nhầm. Khi thấy nó, nghĩa là một số trang của tài liệu đó không có trong kết quả tìm kiếm — bạn đang xem một phần, chứ không phải âm thầm bỏ sót phần còn lại. Với tài liệu quét rất dài, cách xử lý thực tế là tách nó thành các tệp nhỏ hơn.

Hình ảnh

Hình ảnh hoạt động khác tài liệu, vì một bức ảnh có thể mang ý nghĩa mà không cách trích xuất văn bản nào nắm bắt được — hình dạng của biểu đồ, bố cục của sơ đồ, chủ thể của bức ảnh.

Nếu mô hình của bạn nhìn được

Mô hình có khả năng nhìn sẽ nhận chính bức ảnh. Rephlo không chạy OCR trên đó và không thay nó bằng văn bản. Đây là chủ ý: trích xuất văn bản sẽ vứt bỏ đúng phần hiểu biết thị giác mà vì nó bạn mới đính kèm ảnh.

Nếu mô hình của bạn không nhìn được

Không phải mô hình nào cũng xử lý được hình ảnh — mô hình chạy trên máy thì không, và nhiều mô hình đám mây chỉ xử lý văn bản cũng vậy. Trước đây, đính kèm ảnh vào những mô hình này nghĩa là bức ảnh bị bỏ đi lặng lẽ, còn bạn nhận một câu trả lời đầy tự tin từ mô hình chưa từng thấy bức ảnh của mình.

Giờ đây, khi mô hình không nhìn được, Rephlo sẽ đọc mọi văn bản trong ảnh ngay trên máy bạn và chuyển phần đó đi thay thế. Nếu ảnh hoàn toàn không có văn bản đọc được — chẳng hạn ảnh chụp một người — bạn sẽ nhận được thông báo rõ ràng thay vì sự im lặng, để mô hình có thể nói rằng nó không nhìn thấy ảnh thay vì bịa ra một bức ảnh.

Đây là phương án dự phòng, không phải nâng cấp. Văn bản nhận dạng từ một biểu đồ không giống với việc hiểu biểu đồ đó. Nếu chi tiết hình ảnh là quan trọng, hãy dùng mô hình có khả năng nhìn.

Hình ảnh và việc che thông tin

Nếu bạn đã bật Remove personal info before cloud requests, hình ảnh cũng được bao gồm.

Rephlo quét ảnh đính kèm bằng OCR trên máy trước khi nó đi tới mô hình đám mây. Nếu tìm thấy thông tin cá nhân, ảnh sẽ được thay bằng phần văn bản đã che. Nếu không có gì cần che, ảnh được gửi nguyên trạng.

Hãy hiểu rõ giới hạn của việc này. OCR đọc văn bản; nó không thể bắt được khuôn mặt, chữ ký hay chữ viết tay mà nó không đọc nổi. Với những ảnh mà bạn không chấp nhận rủi ro đó, hãy bật Block send if redaction uncertain — Rephlo sẽ giữ lại những ảnh nó không đọc được thay vì gửi đi.

Xem Quyền riêng tư & dữ liệu để biết đầy đủ các thiết lập che thông tin.

Giải đáp nhanh

Câu hỏiTrả lời
Tôi đã thêm PDF quét mà tìm kiếm không ra gìKiểm tra Settings ▸ Privacy — “Read scanned documents on this device” đã bật chưa, và lần tải mô hình duy nhất đã xong chưa?
Văn bản nhận dạng bị loạn ký tựNhiều khả năng ngôn ngữ không khớp. Hãy đặt Scanned document language một cách rõ ràng.
Tài liệu của tôi hiện nhãn “Partial OCR”Nó dài hơn giới hạn lập chỉ mục 200 trang. Hãy tách thành các tệp nhỏ hơn.
Tôi đính kèm ảnh mà mô hình bỏ quaMô hình đó nhiều khả năng không nhìn được ảnh. Rephlo giờ chuyển tiếp phần văn bản tìm được; để hiểu hình ảnh, hãy chuyển sang mô hình có khả năng nhìn.
Tài liệu quét của tôi có bị tải lên để OCR không?Không. Việc nhận dạng diễn ra trên máy tính của bạn.
Tôi dùng OCR với mô hình chạy trên máy được không?Được. OCR độc lập với mô hình bạn dùng — dù thế nào nó cũng chạy cục bộ.

Trang liên quan