PDF

PDF مستقل حذف

حقیقی حذف — متن نکالا اور پھر جانچا جاتا ہے۔

کیا کوئی فائل ہاتھ میں نہیں ہے؟

نشان زد صفحات چپٹی تصاویر کے طور پر دوبارہ بنتے ہیں — نیچے کا متن فائل سے ہٹتا ہے، صرف چھپتا نہیں۔ ڈاؤن لوڈ ظاہر ہونے سے پہلے ٹول اپنا آؤٹ پٹ دوبارہ کھول کر ثابت کرتا ہے کہ ہر ترمیم شدہ صفحے پر صفر متن باقی ہے۔ دستاویز metadata (عنوان، مصنف…) بھی صاف ہوتا ہے۔

redaction جو متن حقیقتاً ہٹائے

عام PDF ایڈیٹر میں متن پر سیاہ مستطیل بنانے سے کچھ نہیں چھپتا: الفاظ فائل میں رہتے اور کاپی پیسٹ یا سرچ انڈیکس سے واپس آ جاتے ہیں۔ یہ ٹول ہر نشان زد صفحہ چپٹی تصویر کے طور پر دوبارہ بناتا ہے، اس لیے نیچے کے متن آبجیکٹس ختم ہو جاتے ہیں — پھر نتیجہ دوبارہ کھول کر ہر ترمیم شدہ صفحے سے متن نکالتا ہے تاکہ ڈاؤن لوڈ سے پہلے تعداد صفر ثابت ہو۔

جن صفحات کو نشان نہیں لگایا وہ بغیر تبدیلی نقل ہوتے ہیں، اور سب کچھ براؤزر میں چلتا ہے: جس دستاویز میں حساس مواد مٹا رہے ہیں وہی فائل کہیں اپ لوڈ نہیں ہونی چاہیے۔

زیادہ تر "redaction" جعلی ہے: متن پر سیاہ مستطیل پکسل چھپاتا ہے، ڈیٹا نہیں۔ ڈھکا حصہ منتخب، کاپی، پیسٹ کریں — راز واپس۔ عدالتی فائلیں اور سرکاری اعلانات اسی طرح لیک ہوئے۔ حقیقی redaction کو فائل سے متن ہٹانا ہوتا ہے، اور یہ ٹول یہی کرتا ہے: ہر نشان زد صفحہ چپٹی تصویر کے طور پر دوبارہ رینڈر ہوتا ہے، اس لیے نیچے کے الفاظ آؤٹ پٹ میں رہتے ہی نہیں۔

پھر ٹول ثبوت دیتا ہے۔ ترمیم شدہ PDF بنا کر اپنا آؤٹ پٹ دوبارہ کھولتا اور ہر ترمیم شدہ صفحے سے متن نکالتا ہے — ڈاؤن لوڈ بٹن صرف عین صفر حروف پر آتا ہے۔ اسی عمل میں metadata (عنوان، مصنف، موضوع، کلیدی الفاظ، creator) صاف ہوتا ہے، کیونکہ فائل خصوصیات بھی نام اور ادارے لیک کرتی ہیں۔

جس دستاویز میں حساس مواد مٹانا ہو، اسے تقریباً تعریفاً کسی نامعلوم ویب سائٹ پر اپ لوڈ نہیں کرنا چاہیے۔ یہاں رینڈرنگ، سیاہ کرنا، دوبارہ بنانا اور خود جانچ سب آپ کے براؤزر میں مقامی طور پر ہوتے ہیں۔ جن صفحات کو نشان زد نہیں کیا وہ بغیر تبدیلی نقل ہوتے ہیں اور ان کا متن منتخب رہتا ہے۔

عمومی سوالات

صرف سیاہ خانے بنانے کے بجائے صفحات rasterize کیوں ہوتے ہیں؟

کیونکہ متن پر سیاہ خانہ رکھنا صرف ظاہری پردہ ہے: متن کے آبجیکٹ فائل میں رہتے ہیں اور کاپی پیسٹ، متن نکالنے یا سرچ انڈیکس سے واپس مل سکتے ہیں۔ نشان زد صفحے کو چپٹی تصویر بنا کر دوبارہ بنانے سے متن کی تہہ مکمل ہٹ جاتی ہے — نکالنے کو کچھ نہیں بچتا۔ اسی لیے ترمیم شدہ صفحات کا متن اب منتخب نہیں رہتا۔

خود جانچ عین کیا توثیق کرتی ہے؟

آؤٹ پٹ بنانے کے بعد ٹول اسے دوبارہ کھول کر ہر ترمیم شدہ صفحے سے متن نکالتا ہے۔ ڈاؤن لوڈ بٹن صرف تب ظاہر ہوتا ہے جب متن کا کوئی حرف واپس نہ آئے اور صفحات کی تعداد اصل سے ملے۔ اگر کچھ بھی نکالا جا سکے تو فائل پیش نہیں کی جاتی۔

کیا غیر نشان زد صفحات بدلتے ہیں؟

نہیں۔ بغیر خانوں والے صفحات اصل مواد کے ساتھ نقل ہوتے ہیں: متن منتخب اور لنکس فعال رہتے ہیں۔ صرف نشان زد صفحات تصاویر کے طور پر دوبارہ بنتے ہیں۔

PDF metadata کا کیا ہوتا ہے؟

آؤٹ پٹ میں عنوان، مصنف، موضوع، کلیدی الفاظ، creator اور producer صاف ہوتے ہیں — دستاویز خصوصیات اکثر نام، آجر اور سافٹ ویئر ورژن لیک کرتی ہیں۔ فائل نام اب بھی آپ چنتے ہیں۔

کیا میری دستاویز اپ لوڈ ہوتی ہے؟

نہیں۔ رینڈرنگ، redaction، دوبارہ بنانا اور خود جانچ سب براؤزر میں ہوتے ہیں۔ جس دستاویز میں حساس مواد مٹانا ہو وہی فائل تیسرے فریق کے سرور تک نہیں پہنچنی چاہیے۔

کیا یہ اسکین شدہ PDFs پر کام کرتا ہے؟

ہاں — اسکین صفحات پہلے ہی تصاویر ہیں، اس لیے حساس حصے پر خانہ اور دوبارہ بنانا اسی طرح کام کرتا ہے۔ ٹول نظر آنے والا مواد مٹاتا ہے؛ OCR نہیں چلاتا۔

میری فائل بڑی یا چھوٹی کیوں ہوئی؟

ترمیم شدہ صفحات منتخب ریزولوشن (96/144/216 dpi) پر JPEG تصاویر میں دوبارہ انکوڈ ہوتے ہیں۔ متن والے صفحات عموماً کچھ بڑھتے؛ تصویر والے اکثر سکڑتے ہیں۔ غیر نشان زد صفحات متاثر نہیں۔