HivePDF
Tiếng Việt
← Tất cả công cụ

Xóa trang trắng khỏi PDF

Tự động phát hiện và bỏ các trang trắng trong một PDF — một việc dọn dẹp thường gặp sau khi scan một xấp giấy. Miễn phí, không đăng ký, không tải gì lên.

Thả một file PDF vào đây hoặc bấm để chọn

File không rời khỏi máy bạn.Cách hoạt động

Cách xóa trang trắng

  1. 1Thả file PDF vào ô trên (hoặc bấm để chọn).
  2. 2Bấm Xóa trang trắng.
  3. 3Tải file PDF đã dọn sạch về.

Câu hỏi thường gặp

Nó quyết định một trang là trắng như thế nào?
Mỗi trang được render và kiểm tra độ phủ mực. Các trang gần như không có nội dung bị xóa; các đốm nhiễu scan nhạt và mép mờ được dung sai để giữ lại trang thật.
File của tôi có bị tải lên không?
Không. Các trang được phân tích hoàn toàn trong trình duyệt — không có gì rời khỏi máy bạn.
Các trang giữ lại có bị giảm chất lượng không?
Không. Việc phát hiện dùng một bản render độ phân giải thấp nhanh, nhưng các trang được giữ lại được chép qua nguyên vẹn, vẫn sắc nét và chọn được chữ.

Dọn sạch bản scan chỉ trong một cú nhấp

Quét một chồng giấy in hai mặt thường để lại một trang trống phía sau mỗi tờ có mặt sau không in gì. Remove Blank Pages quét toàn bộ tài liệu, tìm ra những trang trống đó, và loại bỏ chúng — để lại một file gọn gàng, hoàn toàn ngay trong trình duyệt của bạn.

Nhận diện cẩn trọng

Mỗi trang được render ở độ phân giải thấp và đo mức độ phủ mực, với một ngưỡng dung sai cho các vết lốm đốm và cạnh mờ từ máy quét để những trang có nội dung thực sự (nhưng thưa thớt) không bị nhầm là trang trống. Các trang được giữ lại sẽ được sao chép nguyên vẹn, vì vậy chúng vẫn sắc nét và văn bản vẫn có thể chọn được.

Lưu ý và giới hạn

Nếu không có trang nào trông giống trang trống, file của bạn sẽ được trả lại nguyên vẹn và bạn sẽ được thông báo như vậy. Mọi thứ chạy cục bộ, vì vậy ngay cả các bản scan nhạy cảm cũng không bao giờ rời khỏi thiết bị của bạn.

Cách nhận diện thực sự hoạt động

Mỗi trang được render thành một ảnh bitmap nhỏ, độ phân giải thấp, và được đo xem bao nhiêu phần của nó được phủ bởi mực so với khoảng trắng thuần túy. Một trang trả về gần như hoàn toàn trống — không văn bản, không dữ liệu hình ảnh, không có gì vượt ngưỡng dung sai — sẽ được đánh dấu là trang trống. Ngưỡng dung sai tồn tại chính vì các máy quét thực tế thường để lại vết trên những tờ giấy trống thực sự: một đường mờ do mặt kính bám bụi, một vết lốm đốm ngẫu nhiên gần mép, hoặc một sắc xám nhẹ phủ khắp trang. Những vết đó được cho phép đi qua để một bản scan về mặt kỹ thuật là trống nhưng không hoàn hảo không bị nhầm với nội dung thật, và để một trang gần như trống nhưng có số trang hay một dòng văn bản vẫn được giữ lại đúng cách.

Những nơi việc nhận diện có thể bị đánh lừa

Một trang trống ngoại trừ tiêu đề đầu trang, chân trang, hoặc số trang lặp lại thường vẫn được ghi nhận là có nội dung, vì đó là mực thật trên trang — nó sẽ không bị loại bỏ dù một người có thể gọi nó là "trống". Luôn lướt qua kết quả trước khi coi đó là bản cuối cùng, đặc biệt với một tài liệu mà việc loại bỏ nhầm một trang sẽ gây hậu quả.

Khi nào điều này xảy ra

Trường hợp kinh điển là một bản scan hai mặt chạy qua một máy quét chỉ hỗ trợ một mặt, hoặc một chồng giấy mà cứ mỗi tờ gốc lại chỉ in một mặt — máy quét vẫn tạo ra một trang cho mặt sau trống, và bạn có được những trang trống rải đều khắp file. Đây cũng là bước dọn dẹp hữu ích sau bất kỳ công việc quét hàng loạt nào trước khi lưu trữ hoặc chia sẻ. Sau khi các trang trống đã được loại bỏ, Compress là bước tiếp theo tự nhiên, vì lúc này file đã nhỏ hơn và thường còn nhiều dư địa để thu nhỏ thêm nữa.

Công cụ liên quan

Hướng dẫn