PDF کو HTML میں تبدیل کریں
PDF کو ایسی ایک HTML فائل میں بدلیں جو اصل جیسی دکھے اور جسے کسی اور چیز کی ضرورت نہ ہو — نہ اسٹائل شیٹ، نہ فونٹس، نہ تصاویر کا فولڈر۔
- کبھی محفوظ نہیں کی جاتی
- نہ قطار، نہ انتظار
- نہ سائن اپ، نہ واٹر مارک
یہ کیسے کام کرتا ہے
اپنی PDF شامل کریں
وہ دستاویز ڈراپ کریں جسے آپ ویب پیج کے طور پر چاہتے ہیں۔
تبدیل کریں
ہر صفحہ اپنے آرٹ ورک اور ٹیکسٹ کے ساتھ ایک مقررہ جگہ والے بلاک کے طور پر دوبارہ بنایا جاتا ہے۔
ڈاؤن لوڈ کریں
ایک .html فائل جسے آپ جوں کا توں کھول سکتے ہیں، ہوسٹ کر سکتے ہیں یا ای میل کر سکتے ہیں۔
ایک فائل، کوئی انحصار نہیں، مقررہ لے آؤٹ
نتیجہ ایک اکیلی .html فائل ہوتی ہے جس کے ساتھ کچھ اور نہیں ہوتا۔ ہر تصویر data URI کے طور پر اندر شامل ہوتی ہے، اسٹائل شیٹ head میں ہوتی ہے، اور کوئی فونٹ کہیں سے نہیں منگوایا جاتا — اس لیے صفحہ بغیر انٹرنیٹ والی مشین پر بھی بالکل ویسا ہی کھلتا ہے، اور HTML ایکسپورٹ کی صرف یہی قسم رکھنے کے قابل ہے۔ اس کی قیمت سیدھا حساب ہے: بائنری تصویری ڈیٹا کو ٹیکسٹ کی صورت میں انکوڈ کرنے سے وہ تقریباً ایک تہائی بڑا ہو جاتا ہے، اس لیے اسکینز کی 10 MB کی PDF تقریباً 14 MB کی HTML بنتی ہے، جسے براؤزر کو کچھ بھی دکھانے سے پہلے پورا پارس کرنا پڑتا ہے۔
لے آؤٹ مقررہ ہے، ریسپانسیو نہیں، اور یہ کوئی کمی نہیں بلکہ سوچا سمجھا انتخاب ہے۔ ہر صفحہ PDF کی بالکل وہی پیمائش (پوائنٹس میں) رکھنے والا ایک باکس ہے، اور ٹیکسٹ کی ہر لائن اپنے اصل کوآرڈینیٹس پر ایک absolute پوزیشن والا span ہے، جس کا سائز اور رنگ بھی ساتھ آتا ہے۔ کچھ بھی کبھی نہیں ڈھلتا — فون پر آپ کو پڑھنے کے قابل ٹیکسٹ کا کالم نہیں بلکہ پورا صفحہ چھوٹا ہو کر ملتا ہے۔ ایک پرنٹ اسٹائل شیٹ شامل ہے، اس لیے HTML پرنٹ کرنے پر صفحات اصل حدود پر صاف طور پر الگ ہوتے ہیں۔
چونکہ فائل کے ساتھ کوئی فونٹ نہیں جاتا، ٹیکسٹ پڑھنے والے کی مشین پر موجود Helvetica یا Arial میں دکھتا ہے۔ سائز اور جگہ درست ہوتی ہے مگر حروف کی شکل نہیں، اس لیے کوئی لائن اپنے پیچھے والے آرٹ ورک سے تھوڑی چوڑی ہو سکتی ہے۔ ایک عمدہ ترکیب جاننے کے لائق ہے: جب صفحے کے الفاظ اصل ٹیکسٹ کے بجائے بنے ہوئے آرٹ ورک کا حصہ ہوں، تب بھی ٹیکسٹ لیئر لکھی جاتی ہے، مگر شفاف — اس لیے صفحہ سلیکٹ اور تلاش کے قابل رہتا ہے اور الفاظ دو بار نظر نہیں آتے۔
PDF کے اندر کے لنکس anchor کے بجائے سادہ ٹیکسٹ کے طور پر آتے ہیں، ہیڈنگز heading عناصر کے بجائے مقررہ جگہ والے spans کے طور پر آتی ہیں، اور پڑھنے کی کوئی قابلِ ذکر ترتیب نہیں ہوتی۔ نتیجہ ایک ایسی دستاویز کی درست تصویر ہے جو اتفاق سے HTML سے بنی ہے — یہ منظم، سیمینٹک مارک اپ نہیں، اور اسے وہاں استعمال نہیں کرنا چاہیے جہاں اسکرین ریڈر یا سرچ انجن کو اسے سمجھنا ہو۔
جب آپ کو کچھ اور چاہیے
pdf2htmlEX وہ ٹول ہے جو یہ کام صحیح طریقے سے کرتا ہے۔ یہ PDF کے اپنے فونٹس نکال کر ویب فونٹس کے طور پر شامل کرتا ہے، اس لیے ٹیکسٹ صرف درست جگہ پر ہی نہیں بلکہ صحیح ٹائپ فیس اور صحیح چوڑائی میں ہوتا ہے، اور یہ صفحے کو تصویر میں چپٹا کرنے کے بجائے ویکٹر آرٹ ورک کو ویکٹر ہی کے طور پر دوبارہ بناتا ہے۔ نتیجہ کہیں زیادہ اصل کے مطابق ہوتا ہے اور کہیں زیادہ پیچیدہ بھی۔ Poppler کا pdftohtml -s -c in.pdf out.html فوری درمیانی راستہ ہے۔
اگر آپ کو دراصل صفحے کی تصویر نہیں بلکہ ویب پیج چاہیے — جو فون پر ڈھل جائے، جسے Google پڑھ سکے، جس میں اسکرین ریڈر راستہ تلاش کر سکے — تو کوئی بھی PDF سے HTML کنورٹر یہ نہیں دے گا، کیونکہ اس کے لیے درکار ساخت PDF بنتے وقت ہی ختم کر دی گئی تھی۔ فلوئنگ موڈ میں Word میں تبدیل کریں اور وہاں سے ایکسپورٹ کریں، یا اس اصل فائل پر واپس جائیں جس سے PDF پرنٹ کی گئی تھی۔
اکثر پوچھے جانے والے سوالات
کیا یہ واقعی ایک ہی فائل ہے؟
جی ہاں۔ ہر تصویر data URI کے طور پر فائل کے اندر شامل ہوتی ہے اور اسٹائلز بھی فائل ہی میں ہوتے ہیں، اس لیے ساتھ رکھنے کے لیے کوئی ایسٹس فولڈر نہیں ہوتا اور یہ انٹرنیٹ کنکشن کے بغیر بھی بالکل ویسی ہی کھلتی ہے۔
کیا ٹیکسٹ سلیکٹ کیا جا سکتا ہے؟
جی ہاں۔ ٹیکسٹ آرٹ ورک کے اوپر رکھے گئے اصل HTML ٹیکسٹ کے طور پر لکھا جاتا ہے، اس لیے اسے سلیکٹ اور تلاش کیا جا سکتا ہے اور اسکرین ریڈر اسے پڑھ سکتا ہے۔
کیا یہ فون پر اسکرین کے مطابق ڈھل جائے گی؟
نہیں، اور یہی ایمان دارانہ سودا ہے: ہر صفحہ اپنا بالکل وہی لے آؤٹ رکھتا ہے، اس لیے نتیجہ ریسپانسیو ویب سائٹ کے بجائے PDF جیسا دکھتا ہے۔ اگر آپ کو اسکرین کے مطابق ڈھلنے والا ٹیکسٹ چاہیے تو PDF سے Word یا PDF سے ٹیکسٹ استعمال کریں۔
کیا میری PDF کہیں محفوظ کی جاتی ہے؟
نہیں۔ کسی بھی مرحلے پر کچھ بھی محفوظ نہیں کیا جاتا۔
کیا میں اسے پرنٹ کر سکتا ہوں؟
جی ہاں — ایک پرنٹ اسٹائل شیٹ شامل ہے، اس لیے ہر صفحہ اسکرین والے سائے کے بغیر اپنی الگ شیٹ پر پرنٹ ہوتا ہے۔
جاننا مفید ہے: لے آؤٹ ریسپانسیو نہیں بلکہ مقررہ ہے: صفحات اپنی بالکل وہی پیمائش رکھتے ہیں اور چھوٹی اسکرینز پر نہیں ڈھلتے۔ صفحے کا آرٹ ورک ریسٹر تصویر کے طور پر شامل ہوتا ہے، اس لیے بہت بڑی دستاویزات سے بڑی HTML فائلیں بنتی ہیں۔ PDF کے اندر موجود لنکس سادہ ٹیکسٹ بن جاتے ہیں۔
یہ ٹول اپنی ویب سائٹ پر لگائیں
کسی بھی بلاگ، کلاس پیج یا ہیلپ آرٹیکل کے لیے مفت۔ ایک اسنیپٹ پیسٹ کریں اور آپ کے وزیٹرز اسے سیدھا آپ کے صفحے پر استعمال کر سکیں گے۔
مزید PDF ٹولز
HTML سے PDF
HTML سے PDF، بالکل ویسی جیسی براؤزر پرنٹ کرتا ہے
PDF سے ٹیکسٹ
سادہ ٹیکسٹ جسے کاپی اور ایڈٹ کر سکیں
PDF سے Word
قابلِ ترمیم .docx میں، اسکین کے لیے OCR کے ساتھ
PDF سے PDF/A
طویل مدت تک محفوظ رکھنے کا آرکائیو فارمیٹ
PDF سے Excel
ٹیبلز کو اصل اسپریڈشیٹ میں
PDF سے PowerPoint
کسی بھی PDF سے قابلِ ترمیم سلائیڈز