Bangla text

পুরনো বিজয় আর নতুন বিজয় কোডে একই লেখা দুই রকম কেন?

বিজয়ের নতুন ধরনের লেখায় কয়েকটা অক্ষর নতুন কোডে বসে, যেমন ক্ষ “¶”-এর বদলে “ÿ”, আর কিছু পুরনো কোডের মানেই বদলে গেছে। শুধু পুরনো তালিকা জানা কনভার্টার তাই “শুরু”-কে বানায় “শুরম্ন”। দুই ধরনের কোডই চেনে এমন কনভার্টার ব্যবহার করুন, আর ফলাফলে কঠিন শব্দগুলো মিলিয়ে নিন।

পড়তে সময় লাগবে প্রায় ৪ মিনিট

দুটো বিজয় ফাইল। দুটোতেই লেখা "শিক্ষা", সুতনি এমজে (SutonnyMJ) ফন্টে দেখতে হুবহু এক। কিন্তু ভেতরে একটায় আছে wk¶v, আরেকটায় wkÿv। পুরনো নিয়মের একটা কনভার্টারে দিলে প্রথমটা ঠিক "শিক্ষা" আসে, দ্বিতীয়টা আসে "শিÿা"।

এমন অভিযোগ অনেকেরই: "যুক্তবর্ণ ভেঙে যায়", "ক্ষ ভুল আসে", "শুরু লিখলে শুরম্ন আসে"। বেশিরভাগ ক্ষেত্রে দোষ আপনার লেখার নয়। লেখাটা বিজয়ের নতুন ধরনের কোডে, আর কনভার্টার চেনে শুধু পুরনোটা।

কেন এমন হয়

বিজয় লেখার পুরোটা ফন্টের ওপর দাঁড়িয়ে। কোন ইংরেজি অক্ষর বা চিহ্নের জায়গায় কোন বাংলা অক্ষর আঁকা হবে, তা ঠিক করে ফন্ট। সময়ের সাথে বিজয় আর সুতনি এমজের নতুন ধরনে কয়েকটা অক্ষর নতুন কোডে সরানো হয়েছে। ঠিক কোন সংস্করণে কবে বদলেছে, তা নিশ্চিত করে বলা কঠিন। কিন্তু সরকারি কাগজপত্রে নতুন কোড ভালোভাবেই আছে। ২০১৫ সালের একটা সরকারি প্রকাশনার পিডিএফে ক্ষ এসেছে ৭৭ বার, প্রতিবারই ÿ দিয়ে, একবারও দিয়ে নয়।

পুরনো ফাইলগুলো অবশ্য পুরনো কোডেই রয়ে গেছে। তাই আজ একই অফিসের কম্পিউটারে দুই ধরনের ফাইলই পাওয়া যায়।

কোন অক্ষরে পার্থক্য

অক্ষর (শব্দ)পুরনো কোডনতুন কোড
ক্ষ (শিক্ষা)wk¶vwkÿv
রু (শুরু)ïi“ïiæ
রু (ফেব্রুয়ারি)†deª“qvwi†deªæqvwi
ন্ত (অন্তত)Aš—ZAšÍZ
ণ্ড (খণ্ড)LÊLÐ

সুতনি এমজেতে দুই কলামই একই বাংলা দেখায়। পার্থক্য শুধু ভেতরের কোডে।

আসল বিপদ: একই চিহ্ন, দুই মানে

নতুন কোডগুলো যদি একদম নতুন চিহ্ন হতো, সমস্যা কম হতো। কনভার্টার বড়জোর অচেনা চিহ্ন রেখে দিত। কিন্তু কয়েকটা চিহ্ন পুরনো তালিকাতেও ছিল, অন্য মানে নিয়ে।

  • æ পুরনো তালিকায় ম্ন (নিম্ন = wbæ)। নতুন লেখায় র-এর পরের উ-কার (শুরু = ïiæ)।
  • ø পুরনো তালিকায় স্ন (স্নান = øvb)। নতুন লেখায় ল-ফলা (কুমিল্লা = Kzwgjøv)।
  • Í পুরনো তালিকায় ত্ম (আত্মা = AvÍv)। নতুন লেখায় ন্ বা স্-এর পরে বসলে ্ত (অন্তত = AšÍZ, বাস্তবায়ন = ev¯Íevqb)।
  • Ð পুরনো তালিকায় ড্যাশ চিহ্ন। নতুন লেখায় ণ্ড (খণ্ড = LÐ)।

তাই শুধু পুরনো তালিকা দিয়ে নতুন লেখা পড়লে ভুলটা চুপচাপ হয়। কোনো সতর্কবার্তা আসে না, শুধু শব্দ বদলে যায়:

নতুন কোডের লেখাসঠিক বাংলাশুধু পুরনো তালিকায় পড়লে
ïiæশুরুশুরম্ন
Kzwgjøvকুমিল্লাকুমিলস্না
AšÍZঅন্ততঅন্ত্মত
LÐখণ্ডখ-
wkÿvশিক্ষাশিÿা

ভালো কনভার্টার চিহ্নটার আশপাশ দেখে মানে ঠিক করে। æ-এর ঠিক আগে র থাকলে সেটা উ-কার, নইলে ম্ন। Í-এর আগে ন্ বা স্-এর অর্ধেক রূপ থাকলে ্ত, নইলে ত্ম। এই টুল দুই ধরনের কোডই পড়ে, আর আশপাশ দেখে এভাবেই মানে ঠিক করে। টুলটা পরীক্ষা করা হয় কঠিন শব্দের একটা তালিকা দিয়ে। তাতে আসল সরকারি কাগজপত্র থেকে নেওয়া লেখাও আছে, আর দুই ধরনের কোডই আছে।

পিডিএফ থেকে কপি করলে আরেক ঝামেলা

বিজয়ে লেখা পিডিএফ থেকে লেখা কপি করলে মাঝে মাঝে আরেকটা অদলবদল ঘটে। ক্র-এর কোড µ কপি হয়ে আসে দেখতে হুবহু একই রকম আরেকটা চিহ্ন μ হয়ে। যেমন "সংক্রান্ত" আসে msμvšÍ হিসেবে। চোখে পার্থক্য ধরা যায় না, কিন্তু যে কনভার্টার এটা জানে না, সে দেয় "সংμান্ত্ম"। পরীক্ষার তালিকায় পিডিএফ থেকে তোলা এমন লেখাও রাখা আছে।

ধাপে ধাপে: কোড না চিনেও ঠিক রূপান্তর

  1. লেখাটা বিজয় থেকে ইউনিকোড বক্সে পেস্ট করুন, বা ফাইলটা দিন। লেখাটা পুরনো না নতুন কোডে, আপনাকে জানতে হবে না।
  2. ফলাফলের ওপরে দেখুন কতগুলো শব্দ বদলানো হলো, আর কোনো অক্ষর দাগানো আছে কি না।
  3. ওপরের টেবিলের মতো কঠিন শব্দগুলো খুঁজে দেখুন: ক্ষ, রু, ন্ত, ণ্ড, ল্ল আছে এমন শব্দ।
  4. দাগানো কিছু থাকলে নিচের অংশটা পড়ুন।

আপনার লেখা বা ফাইল এই ব্রাউজারেই থাকে। আমাদের সার্ভারে কিছু যায় না।

"চেনা যায়নি" দাগ মানে কী

টুল কোনো চিহ্ন চিনতে না পারলে সেটা মুছে ফেলে না। ফলাফলে রেখে দিয়ে দাগিয়ে দেখায়। মুছে ফেললে আপনি কখনো জানতেই পারতেন না যে একটা অক্ষর হারিয়েছে। সাধারণ কারণগুলো:

  • লেখাটা বিজয়ের নয়। বিজয়ের বাইরেও কিছু পুরনো বাংলা লেখার পদ্ধতি ছিল। সেগুলোর লেখায় অনেক চিহ্ন একসাথে অচেনা থাকে।
  • বিশেষ চিহ্ন বা নকশা। বুলেট, বক্স বা অন্য কোনো সিম্বল ফন্টের চিহ্ন।
  • কপির সময় বদলে যাওয়া অক্ষর। পিডিএফ বা পুরনো কোনো সফটওয়্যার থেকে কপির সময় কোনো চিহ্ন অন্য চিহ্ন হয়ে এসেছে।

কী করবেন: মূল ফাইলে ওই জায়গাটা খুলে দেখুন কী লেখা ছিল, তারপর ইউনিকোড লেখায় শব্দটা হাতে ঠিক করে দিন। একটা-দুটো দাগ সাধারণ ব্যাপার। অনেক দাগ মানে লেখাটা সম্ভবত বিজয়েই নয়।

সাবধানতা ও সীমা

  • আশপাশ দেখে মানে ঠিক করা প্রায় সবসময় কাজ করে, তবে শতভাগ নয়। খুব বিরল কোনো শব্দে পুরনো আর নতুন মানে দুটোই খাপ খেতে পারে। জরুরি কাগজে কঠিন শব্দগুলো একবার চোখে দেখে নিন।
  • উল্টো দিকেও খেয়াল রাখুন। ইউনিকোড থেকে বিজয় করে প্রেসে পাঠালে তাদের কম্পিউটারে একটা নমুনা পাতা দেখে নিন, বিশেষ করে ক্ষ, রু, ন্ত, ণ্ড আছে এমন শব্দ। বাকি নিয়ম এখানে: প্রেসে পাঠানোর আগে ইউনিকোড থেকে বিজয়।
  • একবার ইউনিকোড, তারপর আর দুশ্চিন্তা নেই। ইউনিকোডে প্রতিটা অক্ষরের একটাই কোড, পুরনো-নতুনের ঝামেলা নেই। তাই পুরনো ফাইল একবার ইউনিকোডে বদলে রাখা ভালো: বিজয়ে লেখা পুরনো ডকুমেন্টে সার্চ কাজ করে না কেন।

যা প্রায়ই জানতে চাওয়া হয়

বিজয় থেকে ইউনিকোড করলে “শুরু” কেন “শুরম্ন” হয়ে যায়?

লেখাটা বিজয়ের নতুন কোডে, যেখানে র-এর পরের উ-কার একটা নির্দিষ্ট চিহ্ন দিয়ে লেখা হয়। পুরনো তালিকায় সেই একই চিহ্নের মানে ছিল ম্ন। শুধু পুরনো তালিকা জানা কনভার্টার তাই ভুল পড়ে। দুই ধরনের কোড চেনে এমন কনভার্টারে দিন।

আমার ফাইল পুরনো না নতুন কোডে, জানা কি জরুরি?

না। বিজয় থেকে ইউনিকোড টুল দুই ধরনের কোডই পড়ে, আশপাশের অক্ষর দেখে মানে ঠিক করে। আপনাকে আলাদা কিছু বাছতে হয় না।

সুতনি এমজেতে দুটো লেখা একই দেখায়, তাহলে পার্থক্য কোথায়?

পার্থক্য ভেতরের কোডে। পর্দায় ফন্ট দুটোকেই একই অক্ষর হিসেবে আঁকে, কিন্তু কনভার্টার পড়ে কোড। তাই রূপান্তরের সময়ই পার্থক্যটা ধরা পড়ে।

টুলে কিছু অক্ষর দাগানো দেখাচ্ছে। মানে কী?

টুল সেই চিহ্নগুলো চিনতে পারেনি, তাই মুছে না ফেলে দেখিয়ে দিয়েছে। মূল ফাইলে জায়গাটা দেখে শব্দটা হাতে ঠিক করুন। অনেক দাগ থাকলে লেখাটা সম্ভবত বিজয়ে লেখা নয়।