PDF-কে অনলাইনে Word-এ কনভার্ট করুন
যেখানেই বিদ্যমান, আমরা আপনার PDF থেকে সরাসরি প্রকৃত টেক্সট পড়ি — কোনো অনুমান করা হয় না। স্ক্যান করা পেজের জন্য, আমরা উচ্চ-নির্ভুল OCR চালাই যাতে বাকি ডকুমেন্টও সম্পূর্ণভাবে এডিটযোগ্য থাকে।
⚡ Real text extraction + OCR fallback, not OCR on everythingDrag & drop your PDF here
or click to browse from your computer
Max 100MB per upload
Document language
Only matters for scanned pages — matching the real language noticeably improves OCR accuracy.
Enhance scanned pages
Sharpens and cleans up low-quality scans before OCR runs. Recommended.
How accuracy works here: pages with a real text layer are extracted directly and come out exact. Pages that are scanned images go through OCR, which is very accurate on clean, high-resolution scans but can still misread blurry, handwritten, or low-quality pages — we'll show you which pages used which method.
Only convert specific pages instead of the whole document.
Preparing...
Your Word document is ready
যেখানে সম্ভব ঠিক নির্ভুল
ডিজিটাল টেক্সট সরাসরি PDF থেকে পড়া হয়, ইমেজ থেকে পুনরায় অনুমান করা হয় না, তাই এটি অক্ষর-প্রতি-অক্ষর সঠিক আসে।
উচ্চ-নির্ভুল OCR ফলব্যাক
স্ক্যান করা পেজ উন্নত করা হয় এবং সেরা বাস্তবসম্মত ফলাফলের জন্য আপনার নির্বাচিত ভাষায় OCR-এর মধ্য দিয়ে চালানো হয়।
সম্পূর্ণ ফ্রি
কোনো সাইন-আপ প্রয়োজন নেই — বিনামূল্যে ১৫০ পেজ এবং ১০০MB পর্যন্ত ফাইল কনভার্ট করুন।
কীভাবে PDF থেকে Word-এ কনভার্ট করবেন
- আপনার PDF আপলোড করুন — টেনে আনুন, অথবা ফাইল ব্রাউজ করুন।
- একটি ডকুমেন্ট ভাষা বেছে নিন (এটি শুধু স্ক্যান করা পেজের OCR নির্ভুলতাকে প্রভাবিত করে) এবং সেরা ফলাফলের জন্য "Enhance scanned pages" চালু রাখুন।
- Convert-এ ক্লিক করুন। প্রকৃত টেক্সটযুক্ত পেজ সরাসরি এক্সট্র্যাক্ট হয়; স্ক্যান করা ইমেজ পেজ স্বয়ংক্রিয়ভাবে OCR-এর মধ্য দিয়ে যায়।
- আপনার .docx ফাইল ডাউনলোড করুন, Word, Google Docs, বা LibreOffice-এ খোলা ও এডিট করার জন্য প্রস্তুত।
আপনি আসলে কী পান
আউটপুট সবসময় একটি আধুনিক .docx ফাইল — পুরনো .doc ফরম্যাট নয়। এখানে ঠিক কী আপনার PDF থেকে বজায় থাকে, এবং কী থাকে না:
সংরক্ষিত
- টেক্সট — যেখানেই একটি প্রকৃত টেক্সট লেয়ার আছে সেখানে অক্ষর-প্রতি-অক্ষর এক্সট্র্যাক্ট করা হয়।
- বোল্ড, ইটালিক, ফন্ট সাইজ, এবং ফন্ট রঙ — মূল PDF থেকে বহন করা হয়।
- অ্যালাইনমেন্ট এবং ইনডেন্টেশন — পেজে প্রতিটি লাইনের অবস্থান থেকে পুনর্নির্মাণ করা হয়।
- হেডিং — লক্ষণীয়ভাবে বড় ফন্ট সাইজের ছোট লাইনগুলো স্বয়ংক্রিয়ভাবে শনাক্ত হয় এবং Word হেডিং হিসেবে ট্যাগ হয়।
- ইমেজ — প্রকৃত টেক্সট লেয়ারযুক্ত পেজের জন্য ডকুমেন্টে এমবেড করা হয়।
- তালিকা — বুলেট এবং নম্বরযুক্ত তালিকা প্রকৃত, এডিটযোগ্য Word তালিকা ফরম্যাটিং হয়ে যায়, শুধু প্লেইন-টেক্সট বুলেট বা নম্বর অক্ষর নয়।
- আন্ডারলাইন — যখন একটি সম্পূর্ণ লাইন আন্ডারলাইন করা থাকে তখন সংরক্ষিত হয়; অন্যথায় সাধারণ একটি বাক্যের মধ্যে একটি একক আন্ডারলাইন করা শব্দ শনাক্ত হয় না।
- টেবিল — বর্ডারযুক্ত, রুলযুক্ত টেবিল প্রকৃত, এডিটযোগ্য Word টেবিল সেল হিসেবে পুনর্নির্মাণ হয়; দৃশ্যমান গ্রিড লাইন ছাড়া টেবিল তখনও সাধারণ টেক্সট হিসেবে কনভার্ট হয়।
- ফন্ট ফ্যামিলি — শনাক্ত হলে নিকটতম সাধারণ Word ফন্টে (Arial, Times New Roman, Calibri, এবং একই ধরনের) ম্যাপ করা হয়, যদিও এটি আপনার PDF-এর মূল টাইপফেসের সাথে হুবহু মেলে না।
সংরক্ষিত নয়
- সঠিক মাল্টি-কলাম লেআউট — কলাম (৩টি পর্যন্ত) একটি সর্বোত্তম-প্রচেষ্টা পঠন ক্রমে পুনর্বিন্যস্ত হয়, পিক্সেল-নির্ভুল নয়।
- হাইলাইটিং — হাইলাইট করা বা চিহ্নিত টেক্সট বহন করা হয় না।
এটি প্রকৃত লেআউট-সচেতন পুনর্নির্মাণ, শুধু একটি প্লেইন টেক্সট ডাম্প নয় — কিন্তু এটি অবস্থান ও সাইজ ডেটা থেকে তৈরি, আপনার PDF-এর একটি স্ট্রাকচারাল কপি নয়। আপনার ডকুমেন্ট যদি টেবিল-ভারী হয় বা অত্যন্ত জটিল লেআউট থাকে, কনভার্ট করার পর কিছু ম্যানুয়াল পরিষ্কারের কাজ আশা করুন।
প্রকৃত টেক্সট বনাম স্ক্যান করা পেজ (OCR)
প্রতিটি পেজ এতে আসলে কী আছে তার ভিত্তিতে স্বয়ংক্রিয়ভাবে পরিচালিত হয় — কোন পেজ স্ক্যান করা তা টুলকে বলার প্রয়োজন নেই।
- প্রকৃত টেক্সট লেয়ারযুক্ত পেজ সরাসরি এক্সট্র্যাক্ট করা হয়। এটি নির্ভুল, অনুমান নয়।
- টেক্সট লেয়ার ছাড়া পেজ (স্ক্যান করা ইমেজ) আপনার নির্বাচিত ভাষায় OCR-এর মধ্য দিয়ে চালানো হয়। পরিষ্কার, উচ্চ-রেজোলিউশন স্ক্যানে OCR খুবই নির্ভুল, কিন্তু ঝাপসা, হাতে লেখা, বা নিম্নমানের পেজ ভুল পড়তে পারে।
OCR বর্তমানে ১১টি ভাষা সাপোর্ট করে: ইংরেজি, স্প্যানিশ, ফরাসি, জার্মান, পর্তুগিজ, ইতালীয়, হিন্দি, চীনা (সরলীকৃত), আরবি, রাশিয়ান, এবং জাপানি।
ফাইল সাইজ, পেজ লিমিট, এবং এনক্রিপ্টেড PDF
| লিমিট | বিস্তারিত |
|---|---|
| ফাইল সাইজ | ১০০MB পর্যন্ত |
| পেজ সংখ্যা | প্রতি ডকুমেন্টে ১৫০ পেজ পর্যন্ত, প্রতিটি কনভার্সনের জন্য |
| পাসওয়ার্ড-সুরক্ষিত PDF | সাপোর্টেড নয় — প্রথমে পাসওয়ার্ড সরান |
১৫০ পেজের বেশি একটি ডকুমেন্ট আছে? Split PDF দিয়ে এটিকে ছোট ফাইলে ভাগ করুন, তারপর প্রতিটি অংশ আলাদাভাবে কনভার্ট করুন।
প্রাইভেসি ও প্রসেসিং
কনভার্সন আমাদের সার্ভারে হয় — এই টুলের জন্য কোনো ক্লায়েন্ট-সাইড অপশন নেই, কারণ টেক্সট ও লেআউট পুনর্নির্মাণের জন্য সার্ভার-সাইড প্রসেসিং প্রয়োজন। আপনার ফাইল সম্পূর্ণভাবে মেমোরিতে হ্যান্ডেল করা হয়: এটি কনভার্ট করার মুহূর্তের জন্যই বিদ্যমান থাকে, CurePDF-এর নিজস্ব অ্যাপ্লিকেশন কোড কখনো এটি ডিস্কে লেখে না, এবং এটি কখনো কোনো AI মডেল প্রশিক্ষণে ব্যবহৃত হয় না। কোনো অ্যাকাউন্ট বা সাইন-আপের প্রয়োজন নেই।
Frequently Asked Questions
CurePDF-এর PDF to Word কনভার্টার কি ফ্রি?
হ্যাঁ — সাইন-আপের প্রয়োজন নেই, এবং ওপরে দেখানো সাইজ ও পেজ লিমিট পর্যন্ত ডকুমেন্ট কনভার্ট করতে কোনো চার্জ নেই।
এটি কি DOC নাকি DOCX ফাইল আউটপুট দেয়?
সবসময় একটি আধুনিক .docx ফাইল, যা Microsoft Word, Google Docs, এবং LibreOffice-এর সাথে সামঞ্জস্যপূর্ণ।
আমার ফরম্যাটিং কি বজায় থাকবে?
বোল্ড, ইটালিক, ফন্ট সাইজ, ফন্ট রঙ, অ্যালাইনমেন্ট, ইনডেন্টেশন, এবং হেডিং বজায় থাকে। মূল ফন্ট টাইপফেস বজায় থাকে না — আউটপুট Word-এর ডিফল্ট ফন্ট ব্যবহার করে।
টেবিল কি প্রকৃত Word টেবিলে কনভার্ট হয়?
না। টেবিল কনটেন্ট আনুমানিক স্পেসিংসহ প্লেন টেক্সট হিসেবে এক্সট্র্যাক্ট করা হয়, এডিটযোগ্য Word টেবিল সেল হিসেবে পুনর্নির্মাণ করা হয় না।
আমি কি স্ক্যান করা PDF কনভার্ট করতে পারি?
হ্যাঁ। প্রকৃত টেক্সট লেয়ার নেই এমন যেকোনো পেজ স্বয়ংক্রিয়ভাবে OCR-এর মধ্য দিয়ে যায় — আপনাকে ম্যানুয়ালি কিছু চালু করার প্রয়োজন নেই।
OCR কতটা নির্ভুল?
পরিষ্কার, উচ্চ-রেজোলিউশন স্ক্যানে খুবই নির্ভুল। তবুও এটি ঝাপসা, হাতে লেখা, বা নিম্নমানের পেজ ভুল পড়তে পারে।
OCR কোন ভাষা সাপোর্ট করে?
ইংরেজি, স্প্যানিশ, ফরাসি, জার্মান, পর্তুগিজ, ইতালীয়, হিন্দি, চীনা (সরলীকৃত), আরবি, রাশিয়ান, এবং জাপানি।
পেজের কোনো লিমিট আছে কি?
হ্যাঁ — প্রতি ডকুমেন্টে সর্বোচ্চ ১৫০ পেজ। এটি প্রতিটি কনভার্সনে প্রযোজ্য, শুধু স্ক্যান করা পেজযুক্ত ডকুমেন্টে নয়।
ফাইল সাইজের কোনো লিমিট আছে কি?
প্রতি ফাইলে সর্বোচ্চ ১০০MB।
আমি কি পাসওয়ার্ড-প্রোটেক্টেড PDF কনভার্ট করতে পারি?
এখনো না — এনক্রিপ্টেড PDF সাপোর্টেড নয়।
আমার কি একটি অ্যাকাউন্ট তৈরি করতে হবে?
কোনো সাইন-আপের প্রয়োজন নেই।
আমার ফাইল কি আপনাদের সার্ভারে সংরক্ষিত হয়?
না — কনভার্সন মেমোরিতে হয়, এবং CurePDF অ্যাপ্লিকেশন লেভেলে আপনার ফাইল ডিস্কে লেখে না।
আমার PDF-এর ইমেজও কি সাথে আসবে?
হ্যাঁ, প্রকৃত টেক্সট লেয়ারযুক্ত পেজের জন্য। যে স্ক্যান করা পেজ OCR-এর মধ্য দিয়ে যায় তা শুধুমাত্র এডিটযোগ্য টেক্সট হয়ে যায়, মূল পেজ ইমেজ ছাড়াই।
মাল্টি-কলাম টেক্সট কি সঠিকভাবে কনভার্ট হয়?
CurePDF কলাম শনাক্ত করে সেগুলোকে পঠন ক্রমে সাজানোর সর্বোত্তম চেষ্টা করে, কিন্তু জটিল লেআউটে এটি সম্পূর্ণ নির্ভুল হওয়ার নিশ্চয়তা নেই।
হেডিংয়ের কী হয়?
আশেপাশের টেক্সটের চেয়ে উল্লেখযোগ্যভাবে বড় ফন্ট সাইজের ছোট লাইন স্বয়ংক্রিয়ভাবে শনাক্ত হয় এবং Word হেডিং হিসেবে ট্যাগ হয়।
আমার PDF-এ যদি ১৫০-এর বেশি পেজ থাকে তাহলে?
প্রথমে <a href="/split-pdf/">Split PDF</a> দিয়ে এটিকে ছোট ফাইলে ভাগ করুন, তারপর প্রতিটি অংশ আলাদাভাবে কনভার্ট করুন।