مواد پر جائیں

PDF کو Word میں تبدیل کریں

کسی بھی PDF کو قابلِ ترمیم Word دستاویز میں بدلیں — تصاویر سمیت، اصل صفحات جیسا ہو بہو شکل موڈ کے ساتھ، اور اسکین کے لیے بلٹ اِن OCR کے ساتھ۔ کچھ بھی محفوظ نہیں کیا جاتا؛ آپ کی فائل کبھی نہیں رکھی جاتی۔

  • کبھی محفوظ نہیں کی جاتی
  • نہ قطار، نہ انتظار
  • نہ سائن اپ، نہ واٹر مارک

یہ کیسے کام کرتا ہے

1

اپنی PDF شامل کریں

PDF کو صفحے پر ڈراپ کریں۔ ٹول اسے خود چیک کرتا ہے اور اسکین پہچاننے پر OCR آن کر دیتا ہے۔

2

موڈ چنیں

قابلِ ایڈٹ ٹیکسٹ، جو ڈیفالٹ ہے، آپ کو صفحہ بہ صفحہ PDF جیسی ایک عام Word دستاویز دیتا ہے: پیراگراف، ہیڈنگز، بولڈ اور اٹالک، لنکس اور تصاویر، ہر صفحہ اپنے اصل سائز اور اپنے مارجنز اور لائن اسپیسنگ کے ساتھ، اس لیے PDF کا صفحہ 12 دستاویز کا بھی صفحہ 12 ہوتا ہے — اور فائل کا سائز تقریباً PDF جتنا۔ ہو بہو شکل ہر لائن کو صفحے کی تصویر کے اوپر بالکل اسی جگہ رکھتا ہے جہاں وہ تھی — یہ پرنٹنگ کے لیے PDF کا عکس ہے، لیکن اسے ایڈٹ کرنا مشکل ہے اور یہ کئی گنا بڑی ہوتی ہے۔ اسکین کے لیے OCR خود آن ہو جاتا ہے، پہلے صفحے سے زبان پہچانتا ہے، اور ٹیڑھے اسکین ہوئے صفحات سیدھے کر دیتا ہے۔

3

تبدیل اور ڈاؤن لوڈ کریں

Word میں تبدیل کریں پر کلک کریں اور ہیڈنگز اور پیراگراف کے ساتھ ایڈٹ کے لیے تیار صاف .docx ڈاؤن لوڈ کریں۔

کیا صاف تبدیل ہوتا ہے، اور کیا نہیں

PDF گلفس کو کوآرڈینیٹس پر درج کرتی ہے۔ اس میں پیراگراف نہیں ہوتے اور، جب تک کسی نے جان بوجھ کر اسے ٹیگ نہ کیا ہو، ہیڈنگز بھی نہیں — اس لیے دونوں پڑھے نہیں جاتے بلکہ اندازے سے نکالے جاتے ہیں۔ ایک ہی بیس لائن پر موجود الفاظ ایک لائن بنتے ہیں، بڑھتا ہوا عمودی فاصلہ نیا پیراگراف شروع کرتا ہے، اور جو چھوٹی لائن دستاویز کے عام ٹیکسٹ کے درمیانی سائز سے تقریباً 1.6 گنا بڑی ہو وہ Heading 1 بنتی ہے، 1.3 گنا والی Heading 2۔ ایڈٹ شروع کرنے سے پہلے یہ آخری اصول جاننا مفید ہے: جس دستاویز کی ہیڈنگز بولڈ ہوں لیکن عام ٹیکسٹ سے بڑی نہ ہوں وہ عام ٹیکسٹ کے طور پر آتی ہے، اور Word کا نیویگیشن پین خالی ہو گا۔

لنکس برقرار رہتے ہیں، جس پر لوگ حیران ہوتے ہیں۔ کسی ٹیکسٹ کے اوپر لنک اینوٹیشن ایک اصل Word ہائپر لنک بن جاتی ہے، اور فہرستِ مضامین کا کوئی اندراج یا کراس ریفرنس جو صفحہ بارہ پر لے جاتا تھا، اس صفحے کے شروع میں لگائے گئے بک مارک کا اندرونی لنک بن جاتا ہے — اس لیے کنورژن کے بعد بھی فہرستِ مضامین کام کرتی ہے۔

دو چیزیں بالکل نہیں پڑھی جاتیں۔ بھرے ہوئے PDF فارم کے جوابات صفحے میں نہیں بلکہ فیلڈ آبجیکٹس میں ہوتے ہیں، اس لیے قابلِ ایڈٹ ٹیکسٹ میں وہ بس موجود نہیں ہوتے؛ ہو بہو شکل انہیں دکھاتا ہے، کیونکہ وہ صفحے کی تصویر کا حصہ ہیں، لیکن ایسے ٹیکسٹ کے طور پر نہیں جسے آپ ایڈٹ کر سکیں۔ کمنٹس اور اسٹیمپس بھی اسی قسم کے آبجیکٹ ہیں اور ان کا بھی یہی حال ہوتا ہے۔ اور ہو بہو شکل میں آرٹ ورک ایک بار 144 DPI پر رینڈر ہوتا ہے اور اصل ٹیکسٹ اس کے اوپر رکھا جاتا ہے، اس لیے جو لوگو یا چارٹ PDF میں ویکٹر تھا وہ .docx میں تصویر ہوتا ہے، اور بڑا کرنے پر یہ صاف نظر آتا ہے۔

جب آپ کو کچھ اور چاہیے

جب آپ کو Word دستاویز کے بجائے صرف الفاظ چاہییں تو Poppler کا pdftotext -layout file.pdf زیادہ تیز اور زیادہ قابلِ پیش گوئی ہے، کالمز کو اسپیسز سے الگ رکھتا ہے، اور PDF کو کسی اور چیز میں ڈالنے کا عام طریقہ یہی ہے۔ اور اگر PDF شروع ہی میں کسی Word فائل سے بنی تھی تو جس نے بنائی اس سے .docx مانگ لیں: ہر واپسی کنورژن کوآرڈینیٹس سے دوبارہ بنائی گئی چیز ہوتی ہے، اور صرف اصل ہی ایسی کاپی ہے جو ایسی نہیں۔

ٹیبلز ہر PDF-to-anything کنورٹر کی کمزوری ہیں، یہ بھی شامل۔ اگر دستاویز زیادہ تر ٹیبلز پر مشتمل ہو اور نمبرز اہم ہوں تو Tabula اور Camelot مفت ہیں، اسی ایک مسئلے کے لیے بنے ہیں، اور اس کام میں کسی عام کنورٹر سے بہتر رہیں گے۔

اکثر پوچھے جانے والے سوالات

کیا تبدیل کرتے وقت میری PDF محفوظ کی جاتی ہے؟

نہیں۔ دونوں کنورژن موڈز کچھ بھی محفوظ نہیں کرتے — آپ کی فائل کبھی نہیں رکھی جاتی۔ OCR کے ساتھ، ریڈر اور لینگویج پیک پہلی بار اسی سائٹ سے آتے ہیں؛ آپ کی دستاویز خود کبھی کہیں نہیں بھیجی جاتی۔

کیا یہ اسکین شدہ PDF اور دستاویزات کی تصاویر تبدیل کر سکتا ہے؟

جی ہاں۔ OCR آن کریں (اسکین پہچاننے پر ٹول خود اس کی تجویز دیتا ہے) اور ٹیکسٹ صفحے کی تصاویر سے پڑھا جاتا ہے۔ زبان صفحے سے پہچانی جاتی ہے — 120 سے زیادہ زبانیں سپورٹ ہیں، جن میں انگریزی، بنگالی، ہندی، اردو، عربی، ہسپانوی اور چینی شامل ہیں — اور اگر اندازہ غلط ہو تو آپ خود بھی چن سکتے ہیں۔ لکیروں والے فارم قابلِ ایڈٹ ٹیکسٹ موڈ میں اصل Word ٹیبلز بن کر آتے ہیں۔

OCR کتنا درست ہے؟

چھپے ہوئے ٹیکسٹ کے صاف اسکینز پر درستگی بہت زیادہ ہوتی ہے۔ دھندلی تصاویر، ہاتھ کی لکھائی یا غیر معمولی فونٹس کے ساتھ کوالٹی کم ہو جاتی ہے۔ صاف، سیدھے اور اچھی روشنی والے اسکینز بہترین نتیجہ دیتے ہیں۔

کیا میری فارمیٹنگ اور تصاویر برقرار رہیں گی؟

جی ہاں۔ ہو بہو شکل ہر صفحے کو اس کے اصل سائز پر رکھتا ہے اور اسے دو تہوں میں دوبارہ بناتا ہے: ہر تصویر، لوگو، رنگین پٹی اور ویکٹر آرٹ ورک کا ہر حصہ بالکل ویسا بنتا ہے جیسا PDF اسے بناتی ہے، اور اصل ٹیکسٹ اوپر اپنی اصل جگہ پر، اصل رنگوں، بولڈ اور ہیڈنگز کے ساتھ ہوتا ہے۔ اس کے بجائے قابلِ ایڈٹ ٹیکسٹ صاف پیراگراف اور ہیڈنگز دوبارہ بناتا ہے اور تصاویر پڑھنے کی ترتیب میں رکھتا ہے، صفحہ بہ صفحہ PDF کے مطابق — جب آپ کو بہت زیادہ ایڈٹ کرنا ہو تو یہ بہتر انتخاب ہے۔

مجھے کون سا Word فارمیٹ ملتا ہے؟

ایک معیاری .docx فائل جو Microsoft Word، Google Docs، LibreOffice اور ہر جدید ایڈیٹر میں کھلتی ہے۔

کیا صفحات یا فائل کی کوئی حد ہے؟

کوئی مقررہ حد نہیں۔ OCR میں فی صفحہ چند سیکنڈ لگتے ہیں کیونکہ پڑھنے کا کام آپ کا اپنا ڈیوائس کرتا ہے، اس لیے بہت لمبے اسکینز میں بس زیادہ وقت لگتا ہے — پروگریس انڈیکیٹر بالکل دکھاتا ہے کہ کام کہاں تک پہنچا۔

جاننا مفید ہے: فونٹس کی جگہ ملتے جلتے فونٹس لگائے جاتے ہیں، کیونکہ PDF اپنے فونٹس ایمبیڈ کرتی ہے اور Word انہیں استعمال نہیں کر سکتا — اس لیے ہو بہو شکل تقریباً ایک جیسی ہوتی ہے، پکسل بہ پکسل ایک جیسی نہیں، اور کوئی لائن اصل سے تھوڑی چوڑی یا تنگ ہو سکتی ہے۔ ٹیکسٹ والی PDF کے ٹیبلز Word ٹیبلز کے بجائے مخصوص جگہوں پر رکھے ٹیکسٹ کی صورت میں تبدیل ہوتے ہیں؛ اسکینز میں لکیروں والے ٹیبلز Word ٹیبلز بن جاتے ہیں لیکن بغیر لکیروں والے مخصوص جگہوں پر رکھا ٹیکسٹ ہی رہتے ہیں۔ OCR جان بوجھ کر تصاویر، لوگوز اور آرائشی گرافکس کو نظر انداز کرتا ہے تاکہ وہ کبھی بے معنی حروف نہ بنیں، ہاتھ کی لکھائی اور مہروں کو تصویر ہی رہنے دیتا ہے، اور فی صفحہ چند سیکنڈ لیتا ہے۔

یہ ٹول اپنی ویب سائٹ پر لگائیں

کسی بھی بلاگ، کلاس پیج یا ہیلپ آرٹیکل کے لیے مفت۔ ایک اسنیپٹ پیسٹ کریں اور آپ کے وزیٹرز اسے سیدھا آپ کے صفحے پر استعمال کر سکیں گے۔