چرا همه پیوندها را از یک PDF استخراج کنیم؟
یک PDF اغلب دهها اشارهگر به بیرون را پنهان میکند: ارجاعها، منابع، صفحات ردیابی یا دکمههای کنش. توانایی استخراج پیوندها از یک PDF در یک گذر شما را از پویش دستی هر صفحه بینیاز میکند و یک نمای فوری از هر آنچه فایل به آن اشاره میکند میدهد. این بنیانِ یک ممیزی درست است: در یک نگاه میبینید یک گزارش واقعاً خوانندگانش را به کجا میفرستد.
گرد آوردن پیوندهای PDF همچنین برای ساختن یک فهرست مرجع قابلبازاستفاده، برای بررسی اینکه هیچ نشانی به یک دامنه ناخواسته نمیرسد، یا برای آماده کردن یک انتقال محتوا به سکوی دیگر سودمند است. بیرون کشیدن تمیز هر نشانی، همراه با صفحهای که در آن قرار دارد، یک فایل ایستا را به دادهای قابلاستفاده برای راستیآزماییها یا آرشیوهای شما بدل میکند.
چه چیزی تشخیص داده میشود، و حریم خصوصی
این ابزار حاشیهنویسیهای پیوندِ قابلکلیک را که یک URL دارند مییابد: هر پیوند با نشانیای که به آن میرسد و شماره صفحهای که در آن ظاهر میشود فهرست میشود، همه بهصورت یک فهرست متنی ساده که بازبینی یا کپی آن آسان است صادر میگردد. برای صادق بودن درباره محدودیت: نشانیای که صرفاً بهصورت متن در بدنه تایپ شده و هیچ پیوند قابلکلیکی به آن پیوست نیست، گنجانده نمیشود، زیرا یک حاشیهنویسی پیوند نیست.
برای فراتر رفتن، metadata اطلاعات نامرئی فایل را آشکار میکند، extract-attachments پیوستهای جاسازیشده را بازیابی میکند و extract-pages صفحاتی را که برایتان مهماند جدا میکند. در pdfOutils، حریم خصوصی در اولویت است: هیچ ثبتنامی لازم نیست و فایلهای شما پس از پردازش بهطور خودکار حذف میشوند، هرگز ذخیره یا بازاستفاده نمیشوند.