Bangla text
পুরনো বিজয় আর নতুন বিজয় কোডে একই লেখা দুই রকম কেন?
বিজয়ের নতুন ধরনের লেখায় কয়েকটা অক্ষর নতুন কোডে বসে, যেমন ক্ষ “¶”-এর বদলে “ÿ”, আর কিছু পুরনো কোডের মানেই বদলে গেছে। শুধু পুরনো তালিকা জানা কনভার্টার তাই “শুরু”-কে বানায় “শুরম্ন”। দুই ধরনের কোডই চেনে এমন কনভার্টার ব্যবহার করুন, আর ফলাফলে কঠিন শব্দগুলো মিলিয়ে নিন।
দুটো বিজয় ফাইল। দুটোতেই লেখা "শিক্ষা", সুতনি এমজে (SutonnyMJ) ফন্টে দেখতে হুবহু এক। কিন্তু ভেতরে একটায় আছে wk¶v, আরেকটায় wkÿv। পুরনো নিয়মের একটা কনভার্টারে দিলে প্রথমটা ঠিক "শিক্ষা" আসে, দ্বিতীয়টা আসে "শিÿা"।
এমন অভিযোগ অনেকেরই: "যুক্তবর্ণ ভেঙে যায়", "ক্ষ ভুল আসে", "শুরু লিখলে শুরম্ন আসে"। বেশিরভাগ ক্ষেত্রে দোষ আপনার লেখার নয়। লেখাটা বিজয়ের নতুন ধরনের কোডে, আর কনভার্টার চেনে শুধু পুরনোটা।
কেন এমন হয়
বিজয় লেখার পুরোটা ফন্টের ওপর দাঁড়িয়ে। কোন ইংরেজি অক্ষর বা চিহ্নের জায়গায় কোন বাংলা অক্ষর আঁকা হবে, তা ঠিক করে ফন্ট। সময়ের সাথে বিজয় আর সুতনি এমজের নতুন ধরনে কয়েকটা অক্ষর নতুন কোডে সরানো হয়েছে। ঠিক কোন সংস্করণে কবে বদলেছে, তা নিশ্চিত করে বলা কঠিন। কিন্তু সরকারি কাগজপত্রে নতুন কোড ভালোভাবেই আছে। ২০১৫ সালের একটা সরকারি প্রকাশনার পিডিএফে ক্ষ এসেছে ৭৭ বার, প্রতিবারই ÿ দিয়ে, একবারও ¶ দিয়ে নয়।
পুরনো ফাইলগুলো অবশ্য পুরনো কোডেই রয়ে গেছে। তাই আজ একই অফিসের কম্পিউটারে দুই ধরনের ফাইলই পাওয়া যায়।
কোন অক্ষরে পার্থক্য
| অক্ষর (শব্দ) | পুরনো কোড | নতুন কোড |
|---|---|---|
| ক্ষ (শিক্ষা) | wk¶v | wkÿv |
| রু (শুরু) | ïi“ | ïiæ |
| রু (ফেব্রুয়ারি) | †deª“qvwi | †deªæqvwi |
| ন্ত (অন্তত) | Aš—Z | AšÍZ |
| ণ্ড (খণ্ড) | LÊ | LÐ |
সুতনি এমজেতে দুই কলামই একই বাংলা দেখায়। পার্থক্য শুধু ভেতরের কোডে।
আসল বিপদ: একই চিহ্ন, দুই মানে
নতুন কোডগুলো যদি একদম নতুন চিহ্ন হতো, সমস্যা কম হতো। কনভার্টার বড়জোর অচেনা চিহ্ন রেখে দিত। কিন্তু কয়েকটা চিহ্ন পুরনো তালিকাতেও ছিল, অন্য মানে নিয়ে।
æপুরনো তালিকায় ম্ন (নিম্ন =wbæ)। নতুন লেখায় র-এর পরের উ-কার (শুরু =ïiæ)।øপুরনো তালিকায় স্ন (স্নান =øvb)। নতুন লেখায় ল-ফলা (কুমিল্লা =Kzwgjøv)।Íপুরনো তালিকায় ত্ম (আত্মা =AvÍv)। নতুন লেখায় ন্ বা স্-এর পরে বসলে ্ত (অন্তত =AšÍZ, বাস্তবায়ন =ev¯Íevqb)।Ðপুরনো তালিকায় ড্যাশ চিহ্ন। নতুন লেখায় ণ্ড (খণ্ড =LÐ)।
তাই শুধু পুরনো তালিকা দিয়ে নতুন লেখা পড়লে ভুলটা চুপচাপ হয়। কোনো সতর্কবার্তা আসে না, শুধু শব্দ বদলে যায়:
| নতুন কোডের লেখা | সঠিক বাংলা | শুধু পুরনো তালিকায় পড়লে |
|---|---|---|
ïiæ | শুরু | শুরম্ন |
Kzwgjøv | কুমিল্লা | কুমিলস্না |
AšÍZ | অন্তত | অন্ত্মত |
LÐ | খণ্ড | খ- |
wkÿv | শিক্ষা | শিÿা |
ভালো কনভার্টার চিহ্নটার আশপাশ দেখে মানে ঠিক করে। æ-এর ঠিক আগে র থাকলে সেটা উ-কার, নইলে ম্ন। Í-এর আগে ন্ বা স্-এর অর্ধেক রূপ থাকলে ্ত, নইলে ত্ম। এই টুল দুই ধরনের কোডই পড়ে, আর আশপাশ দেখে এভাবেই মানে ঠিক করে। টুলটা পরীক্ষা করা হয় কঠিন শব্দের একটা তালিকা দিয়ে। তাতে আসল সরকারি কাগজপত্র থেকে নেওয়া লেখাও আছে, আর দুই ধরনের কোডই আছে।
পিডিএফ থেকে কপি করলে আরেক ঝামেলা
বিজয়ে লেখা পিডিএফ থেকে লেখা কপি করলে মাঝে মাঝে আরেকটা অদলবদল ঘটে। ক্র-এর কোড µ কপি হয়ে আসে দেখতে হুবহু একই রকম আরেকটা চিহ্ন μ হয়ে। যেমন "সংক্রান্ত" আসে msμvšÍ হিসেবে। চোখে পার্থক্য ধরা যায় না, কিন্তু যে কনভার্টার এটা জানে না, সে দেয় "সংμান্ত্ম"। পরীক্ষার তালিকায় পিডিএফ থেকে তোলা এমন লেখাও রাখা আছে।
ধাপে ধাপে: কোড না চিনেও ঠিক রূপান্তর
- লেখাটা বিজয় থেকে ইউনিকোড বক্সে পেস্ট করুন, বা ফাইলটা দিন। লেখাটা পুরনো না নতুন কোডে, আপনাকে জানতে হবে না।
- ফলাফলের ওপরে দেখুন কতগুলো শব্দ বদলানো হলো, আর কোনো অক্ষর দাগানো আছে কি না।
- ওপরের টেবিলের মতো কঠিন শব্দগুলো খুঁজে দেখুন: ক্ষ, রু, ন্ত, ণ্ড, ল্ল আছে এমন শব্দ।
- দাগানো কিছু থাকলে নিচের অংশটা পড়ুন।
আপনার লেখা বা ফাইল এই ব্রাউজারেই থাকে। আমাদের সার্ভারে কিছু যায় না।
"চেনা যায়নি" দাগ মানে কী
টুল কোনো চিহ্ন চিনতে না পারলে সেটা মুছে ফেলে না। ফলাফলে রেখে দিয়ে দাগিয়ে দেখায়। মুছে ফেললে আপনি কখনো জানতেই পারতেন না যে একটা অক্ষর হারিয়েছে। সাধারণ কারণগুলো:
- লেখাটা বিজয়ের নয়। বিজয়ের বাইরেও কিছু পুরনো বাংলা লেখার পদ্ধতি ছিল। সেগুলোর লেখায় অনেক চিহ্ন একসাথে অচেনা থাকে।
- বিশেষ চিহ্ন বা নকশা। বুলেট, বক্স বা অন্য কোনো সিম্বল ফন্টের চিহ্ন।
- কপির সময় বদলে যাওয়া অক্ষর। পিডিএফ বা পুরনো কোনো সফটওয়্যার থেকে কপির সময় কোনো চিহ্ন অন্য চিহ্ন হয়ে এসেছে।
কী করবেন: মূল ফাইলে ওই জায়গাটা খুলে দেখুন কী লেখা ছিল, তারপর ইউনিকোড লেখায় শব্দটা হাতে ঠিক করে দিন। একটা-দুটো দাগ সাধারণ ব্যাপার। অনেক দাগ মানে লেখাটা সম্ভবত বিজয়েই নয়।
সাবধানতা ও সীমা
- আশপাশ দেখে মানে ঠিক করা প্রায় সবসময় কাজ করে, তবে শতভাগ নয়। খুব বিরল কোনো শব্দে পুরনো আর নতুন মানে দুটোই খাপ খেতে পারে। জরুরি কাগজে কঠিন শব্দগুলো একবার চোখে দেখে নিন।
- উল্টো দিকেও খেয়াল রাখুন। ইউনিকোড থেকে বিজয় করে প্রেসে পাঠালে তাদের কম্পিউটারে একটা নমুনা পাতা দেখে নিন, বিশেষ করে ক্ষ, রু, ন্ত, ণ্ড আছে এমন শব্দ। বাকি নিয়ম এখানে: প্রেসে পাঠানোর আগে ইউনিকোড থেকে বিজয়।
- একবার ইউনিকোড, তারপর আর দুশ্চিন্তা নেই। ইউনিকোডে প্রতিটা অক্ষরের একটাই কোড, পুরনো-নতুনের ঝামেলা নেই। তাই পুরনো ফাইল একবার ইউনিকোডে বদলে রাখা ভালো: বিজয়ে লেখা পুরনো ডকুমেন্টে সার্চ কাজ করে না কেন।
যা প্রায়ই জানতে চাওয়া হয়
বিজয় থেকে ইউনিকোড করলে “শুরু” কেন “শুরম্ন” হয়ে যায়?
লেখাটা বিজয়ের নতুন কোডে, যেখানে র-এর পরের উ-কার একটা নির্দিষ্ট চিহ্ন দিয়ে লেখা হয়। পুরনো তালিকায় সেই একই চিহ্নের মানে ছিল ম্ন। শুধু পুরনো তালিকা জানা কনভার্টার তাই ভুল পড়ে। দুই ধরনের কোড চেনে এমন কনভার্টারে দিন।
আমার ফাইল পুরনো না নতুন কোডে, জানা কি জরুরি?
না। বিজয় থেকে ইউনিকোড টুল দুই ধরনের কোডই পড়ে, আশপাশের অক্ষর দেখে মানে ঠিক করে। আপনাকে আলাদা কিছু বাছতে হয় না।
সুতনি এমজেতে দুটো লেখা একই দেখায়, তাহলে পার্থক্য কোথায়?
পার্থক্য ভেতরের কোডে। পর্দায় ফন্ট দুটোকেই একই অক্ষর হিসেবে আঁকে, কিন্তু কনভার্টার পড়ে কোড। তাই রূপান্তরের সময়ই পার্থক্যটা ধরা পড়ে।
টুলে কিছু অক্ষর দাগানো দেখাচ্ছে। মানে কী?
টুল সেই চিহ্নগুলো চিনতে পারেনি, তাই মুছে না ফেলে দেখিয়ে দিয়েছে। মূল ফাইলে জায়গাটা দেখে শব্দটা হাতে ঠিক করুন। অনেক দাগ থাকলে লেখাটা সম্ভবত বিজয়ে লেখা নয়।