HTML এনটিটি এনকোডার / ডিকোডার
টেক্সটকে HTML এনটিটিতে ও আবার ফিরিয়ে রূপান্তর করুন। HTML-এ টেক্সট নিরাপদে বসাতে HTML-বিশেষ অক্ষর
(& < > " ') এনকোড করুন, বা প্রতিটি নন-ASCII অক্ষরকে
নামযুক্ত বা সংখ্যাসূচক এনটিটি হিসেবে এনকোড করুন। ডিকোড যেকোনো নামযুক্ত বা সংখ্যাসূচক
এনটিটি — সম্পূর্ণ HTML5 টেবিল — আবার সাধারণ টেক্সটে সমাধান করে। সম্পূর্ণভাবে আপনার ব্রাউজারে চলে।
সর্বশেষ পর্যালোচনা 2026-06-19.
HTML এনটিটি কীভাবে কাজ করে
HTML কয়েকটি অক্ষরকে কাঠামোগত অর্থ দেয়: < ও > ট্যাগ খোলে ও বন্ধ
করে, & একটি এনটিটি শুরু করে, এবং " / '
অ্যাট্রিবিউট মান সীমাবদ্ধ করে। সেই অক্ষরগুলো আক্ষরিকভাবে দেখাতে — বা অবিশ্বস্ত টেক্সটকে
মার্কআপ হিসেবে ব্যাখ্যা না করে কোনো পৃষ্ঠায় ফেলতে — আপনি সেগুলোকে তাদের এনটিটি দিয়ে প্রতিস্থাপন করেন।
অন্য যেকোনো অক্ষরও এনটিটি হিসেবে নাম দিয়ে (© → ©) বা
সংখ্যা দিয়ে (© দশমিক, বা © হেক্স) লেখা যায়।
আমার কোন মোড ব্যবহার করা উচিত?
- কেবল HTML-বিশেষ — শুধু
& < > " 'এস্কেপ করে। HTML-এ টেক্সট নিরাপদে দেখানো বা বসানোর জন্য আপনার এটাই দরকার; বাকি সবকিছু (উচ্চারণ-চিহ্ন, ইমোজি, স্পেস) পঠনযোগ্য রেখে দেওয়া হয়। - সমস্ত নন-ASCII — নামযুক্ত — সাধারণ ASCII-র উপরের প্রতিটি অক্ষরকেও এনকোড করে,
যেখানে কোনো নাম আছে সেখানে পঠনযোগ্য নামযুক্ত এনটিটি (
é,—) ব্যবহার করে এবং অন্যথায় দশমিক সংখ্যাসূচক এনটিটিতে ফিরে যায়। মানুষ-পঠনযোগ্য থেকেও সর্বাধিক ইমেইল/লিগ্যাসি সামঞ্জস্যের জন্য ভালো। - সমস্ত নন-ASCII — দশমিক / হেক্স — প্রতিটি নন-ASCII অক্ষরকে বিশুদ্ধভাবে একটি
সংখ্যাসূচক এনটিটি (
©বা©) হিসেবে এনকোড করে। যেকোনো জায়গায় রেন্ডার হওয়া নিশ্চিত, এবং যেসব অক্ষরের কোনো নাম নেই তাদের জন্য সবচেয়ে নিরাপদ বিকল্প।
ডিকোড যেকোনো কিছুতেই কাজ করে: এটি প্রতিটি নামযুক্ত এনটিটি (সম্পূর্ণ HTML5 তালিকা) এবং দশমিক ও হেক্সাডেসিমেল উভয় সংখ্যাসূচক এনটিটিকে — অ্যাস্ট্রাল অক্ষর ও ইমোজি সহ — আবার সাধারণ টেক্সটে সমাধান করে, আপনার ইনপুটকে কখনো লাইভ মার্কআপ হিসেবে না বসিয়ে।
সাধারণ HTML এনটিটি
| অক্ষর | নামযুক্ত | দশমিক | হেক্স | বিবরণ |
|---|---|---|---|---|
| & | & | & | & | অ্যাম্পারস্যান্ড |
| < | < | < | < | লেস-দ্যান (ট্যাগ খোলে) |
| > | > | > | > | গ্রেটার-দ্যান (ট্যাগ বন্ধ করে) |
| " | " | " | " | ডবল কোট |
| ' | ' | ' | ' | অ্যাপোস্ট্রফি (HTML4-এর জন্য ' ব্যবহার করুন) |
|   |   | নন-ব্রেকিং স্পেস | |
| © | © | © | © | কপিরাইট |
| ® | ® | ® | ® | রেজিস্টার্ড ট্রেডমার্ক |
| ™ | ™ | ™ | ™ | ট্রেডমার্ক |
| € | € | € | € | ইউরো |
| £ | £ | £ | £ | পাউন্ড স্টার্লিং |
| ° | ° | ° | ° | ডিগ্রি |
| × | × | × | × | গুণ চিহ্ন |
| — | — | — | — | এম ড্যাশ |
| … | … | … | … | হরাইজন্টাল এলিপসিস |
| “ | “ | “ | “ | বাম ডবল কোট |
পরামর্শ: ' HTML5-এ বৈধ কিন্তু পুরনো HTML-এ নয়, তাই এনকোড করার সময় এই টুলটি
অ্যাপোস্ট্রফির জন্য সর্বজনীনভাবে নিরাপদ ' ব্যবহার করে।
HTML এনটিটির একটি সংক্ষিপ্ত ইতিহাস
এনটিটি বেশিরভাগ মানুষের চেনা ওয়েবের চেয়েও পুরনো। HTML আসলে SGML
(ISO 8879)-এর একটি প্রয়োগ, এবং এটি মূল স্মরণসহায়ক (mnemonic) নামসহ SGML-এর এনটিটি সিনট্যাক্স
উত্তরাধিকারসূত্রে পেয়েছে। এগুলোকে আনুষ্ঠানিক করা প্রথম ওয়েব মান, HTML 2.0 (RFC 1866,
নভেম্বর 1995), নথিকে ISO-8859-1 (Latin-1) অক্ষর-সেটে সীমিত রাখত এবং
SGML-এর "Added Latin 1" এনটিটি সেট ধার করত যাতে লেখকরা © ও
é-এর মতো অক্ষর কেবল সাধারণ ASCII দিয়ে লিখতে পারেন — এমন এক যুগে যখন
ASCII-র বাইরের যেকোনো কিছু নির্ভরযোগ্যভাবে পাঠানো ছিল এক জুয়া।
প্রতিটি পরবর্তী সংশোধন তালিকাটি সম্প্রসারিত করেছে। আজ WHATWG HTML মান নামযুক্ত অক্ষর
রেফারেন্সের (named character references) একটি বিশাল টেবিল সংজ্ঞায়িত করে — 2,000-এর বেশি
(মেশিন-পঠনযোগ্য entities.json তালিকা, সাধারণত 2,231টি এন্ট্রি হিসেবে উদ্ধৃত), যা
মুদ্রা, গণিত, গ্রিক অক্ষর, তীর, যতিচিহ্ন ও আরও অনেক কিছু কভার করে। অন্যদিকে সংখ্যাসূচক রেফারেন্স
যেকোনো ইউনিকোড অক্ষরে পৌঁছাতে পারে, তার নাম থাকুক বা না থাকুক, এ কারণেই দুটি ব্যবস্থা পাশাপাশি থাকে।
তিন ধরনের অক্ষর রেফারেন্স
"এনটিটি" হলো দৈনন্দিন শব্দ, কিন্তু স্পেসিফিকেশনের ব্যাপক শব্দটি হলো অক্ষর রেফারেন্স (character reference), এবং এর তিনটি রূপ আছে যা সবই একই অক্ষর তৈরি করে:
- নামযুক্ত অক্ষর রেফারেন্স —
&name;, একটি পঠনযোগ্য উপনাম যেমন&, বা©। পড়তে সবচেয়ে সহজ, কিন্তু কেবল সেসব অক্ষরের জন্য কাজ করে যাদের একটি সংজ্ঞায়িত নাম আছে। - দশমিক সংখ্যাসূচক রেফারেন্স —
&#NN;, অক্ষরের ইউনিকোড কোড পয়েন্ট বেস 10-এ (©= ©)। - হেক্সাডেসিমেল সংখ্যাসূচক রেফারেন্স —
&#xNN;, একই কোড পয়েন্ট বেস 16-এ (©= ©)।xবড় বা ছোট হাতের হতে পারে।
গুরুত্বপূর্ণ বিষয় হলো HTML4 ও HTML5-এ একটি সংখ্যাসূচক রেফারেন্স একটি ইউনিকোড কোড
পয়েন্টকে নাম দেয়, কোনো লিগ্যাসি এনকোডিং-এর কোনো বাইটকে নয়। এ কারণেই এই টুলটি ইমোজি ও
যেকোনো লিপির রাউন্ড-ট্রিপ করতে পারে — 😀 কেবল 😀 (দশমিক) বা 😀 (হেক্স) —
এবং এ কারণেই কোনো অক্ষরের নাম না থাকলে সংখ্যাসূচক রেফারেন্স রেন্ডার-হওয়ার-নিশ্চয়তাযুক্ত বিকল্প।
পাঁচটি পূর্বনির্ধারিত এনটিটি (এবং অ্যাপোস্ট্রফির ফাঁদ)
XML — এবং তাই কঠোর XHTML, RSS ও Atom ফিড — ঠিক পাঁচটি এনটিটি পূর্বনির্ধারিত করে:
&, <, >, "
ও '। HTML-এ হাজার হাজার নাম আছে, কিন্তু এই পাঁচটিই ভার বহনকারী, কারণ এগুলো
সেই অক্ষরগুলো এস্কেপ করে যা প্রকৃতপক্ষে মার্কআপ নিয়ন্ত্রণ করে। একটি বিখ্যাত ফাঁদ আছে:
' XML ও HTML5-এ সংজ্ঞায়িত, কিন্তু এটি কখনো HTML4-এর অংশ ছিল না।
কোনো পুরনো ব্রাউজার বা কঠোর HTML4 পার্সার '-কে আক্ষরিক টেক্সট হিসেবে দেখাবে।
সংখ্যাসূচক ' সর্বত্র কাজ করে, ঠিক এ কারণেই এই টুলটি অ্যাপোস্ট্রফির জন্য সুন্দর
নামের বদলে সর্বদা ' নির্গত করে।
এস্কেপিং হলো XSS-এর বিরুদ্ধে প্রথম সারির প্রতিরক্ষা
শুধু একটি < দেখানোর বাইরে, HTML এস্কেপিং হলো ক্রস-সাইট স্ক্রিপ্টিং (XSS)-এর
বিরুদ্ধে প্রাথমিক প্রতিরক্ষা।
OWASP XSS Prevention Cheat Sheet
থেকে নিয়মটি হলো অবিশ্বস্ত ডেটাকে ঠিক সেই মুহূর্তে এনকোড করা যখন এটি কোনো পৃষ্ঠায় লেখা হয়, যাতে
<script>…</script>-এর মতো কোনো মান কার্যকর ট্যাগের বদলে নিষ্ক্রিয় টেক্সট হয়ে যায়।
ফাঁদটি হলো এস্কেপিং প্রসঙ্গ-সংবেদনশীল (context-sensitive) — HTML এনটিটি
এনকোডিং কেবল একটি জায়গায় সঠিক:
| ডেটা কোথায় পৌঁছায় | সঠিক এস্কেপিং |
|---|---|
| HTML এলিমেন্ট কন্টেন্ট (পৃষ্ঠা বডি) | HTML এনটিটি এনকোড & < > |
| কোনো HTML অ্যাট্রিবিউটের ভেতরে | " ও '-ও এনকোড করুন, এবং অ্যাট্রিবিউট সর্বদা কোট করুন |
কোনো <script> / JavaScript-এর ভেতরে | JavaScript এস্কেপিং (\uXXXX) — HTML এনটিটি নয় |
কোনো URL / href-এর ভেতরে | URL (পার্সেন্ট) এনকোডিং |
কোনো <style> / CSS-এর ভেতরে | CSS এস্কেপিং |
এ কারণেই " ও ' অক্ষরগুলো এত গুরুত্বপূর্ণ: কোনো কোট-ছাড়া বা একক-কোট
অ্যাট্রিবিউটে, একটি এস্কেপ-না-করা কোট আক্রমণকারীকে অ্যাট্রিবিউট আগেভাগে বন্ধ করে
onmouseover=-এর মতো কোনো ইভেন্ট হ্যান্ডলার ইনজেক্ট করতে দেয়। HTML এনটিটি এনকোডিং
কোনো স্ক্রিপ্ট, CSS নিয়ম বা URL-এ রাখা ডেটাকে রক্ষা করে না — সেগুলোর নিজস্ব
এনকোডিং দরকার, যা দুর্বলতার একটি সাধারণ উৎস।
আপনার কখন সত্যিই এনটিটি দরকার (এবং কখন নয়)
একটি ব্যাপক ভুল ধারণা হলো আপনাকে প্রতিটি উচ্চারণ-চিহ্নযুক্ত বা নন-ল্যাটিন অক্ষর এনটিটি-এনকোড করতেই
হবে। একটি সঠিক UTF-8 নথির সাথে সাধারণত তা নয়: é, 日本語 ও
😀 তাদের আক্ষরিক রূপে নিখুঁতভাবে প্রদর্শিত হয়। এনটিটি মার্কআপ
নিরাপত্তা ও লিগ্যাসি সামঞ্জস্য নিয়ে, ইউনিকোড উপস্থাপন নিয়ে নয়।
এগুলো ব্যবহারের প্রকৃত কারণগুলো হলো:
- কোডকে টেক্সট হিসেবে দেখানো —
<div>ছাপানো যাতে পাঠক ব্রাউজার দ্বারা ট্যাগ রেন্ডার করার বদলে আক্ষরিক ট্যাগ দেখে। - XML / RSS / Atom ফিড, যা কঠোর এবং নগ্ন
&,<বা>প্রত্যাখ্যান করে। - ইমেইল ও পুরনো সিস্টেম যাদের UTF-8 হওয়ার ব্যাপারে ভরসা করা যায় না।
- ইনজেকশন প্রতিরোধ, উপরে যেমন বলা হয়েছে।
- স্মার্ট যতিচিহ্ন — কার্লি কোট, এম ড্যাশ,
©ও™— সেসব পরিবেশের জন্য যা ASCII-র বাইরের যেকোনো কিছু বিকৃত করে দেয়।
দুটি বিষয়ে সতর্ক থাকুন। ডাবল-এনকোডিং ঘটে যখন কোনো এস্কেপ ফাংশন দুবার চলে,
&-কে & এবং তারপর &amp; বানিয়ে দেয়, ফলে
ব্যবহারকারী পৃষ্ঠায় আক্ষরিক & দেখে — এটি সমাধান করতে এই টুলের Decode ব্যবহার করুন।
Mojibake হলো সেই বিকৃত টেক্সট (é যেখানে é থাকা উচিত)
যা UTF-8 বাইটকে Latin-1 হিসেবে পড়ার কারণে হয়; এর প্রকৃত সমাধান একটি সঠিক charset ঘোষণা, কোনো
এনটিটি টুল নয়। আর — নন-ব্রেকিং স্পেস, U+00A0 — "10 km"
বা "Mr. Smith"-এর মতো জিনিসকে লাইন-বিরতিতে ভেঙে যাওয়া থেকে রক্ষা করে; এটি সেই কাজের জন্যই
ব্যবহার করুন, কোনো লেআউট অবলম্বন হিসেবে নয় (স্পেসিং CSS ভালো করে)।
ব্রাউজার আসলে কীভাবে এনটিটি পার্স করে
ডিকোডিং-এ কয়েকটি ফাঁদ জানা দরকার, যেগুলো সবই এই টুল সামলায়। পশ্চাদ-সামঞ্জস্যের (backward
compatibility) জন্য, HTML5 পার্সার এখনও একটি নির্দিষ্ট সেট লিগ্যাসি নাম শেষ সেমিকোলন
ছাড়া চিনতে পারে — ©, &, < —
যা ?x©=1-এর মতো কোনো URL-এর ?x©=1 হয়ে যাওয়ার পেছনের ক্লাসিক
ফাঁদ। বেশিরভাগ নতুন নামের সেমিকোলন দরকার। পার্সার ইচ্ছাকৃতভাবে কিছু সংখ্যাসূচক রেফারেন্স
পুনরায় ম্যাপ করে: একটি NULL রেফারেন্স � প্রতিস্থাপন অক্ষর U+FFFD (�) হয়ে যায়;
€–Ÿ পরিসরের সংখ্যাসূচক রেফারেন্স আক্ষরিক C1 নিয়ন্ত্রণ কোডের বদলে
তাদের Windows-1252 অক্ষরে ম্যাপ করা হয় (তাই “ ও ”
কার্লি কোট হয়ে যায়); এবং সারোগেট বা পরিসর-বহির্ভূত কোড পয়েন্টের রেফারেন্সও U+FFFD
দিয়ে প্রতিস্থাপিত হয়। এই নিয়মগুলো স্পেসিফিকেশনে এমনভাবে গাঁথা যাতে অগোছালো বাস্তব-জগতের HTML-ও
অনুমেয়ভাবে রেন্ডার হয়।
অক্ষর এনকোডিং বনাম অক্ষর রেফারেন্স
দুটি জিনিস গুলিয়ে ফেলা সহজ যেগুলো দুটোই "অক্ষর" নিয়ে কাজ করে। অক্ষর এনকোডিং — আজ প্রায় সর্বদা UTF-8 — হলো কীভাবে অক্ষরগুলোকে একটি ফাইলে সংরক্ষিত ও নেটওয়ার্কে পাঠানো প্রকৃত বাইটে রূপান্তর করা হয়। অক্ষর রেফারেন্স (এনটিটি) হলো HTML/XML টেক্সট-এর নিজের একটি বৈশিষ্ট্য, কেবল ASCII ব্যবহার করে একটি অক্ষর লেখার উপায়। এরা ভিন্ন সমস্যা সমাধান করে, এবং সম্পর্কটি ভুল বোঝা অনেক বিকৃত টেক্সটের উৎস।
মূল অন্তর্দৃষ্টি: সঠিকভাবে ঘোষিত <meta charset="utf-8">-এর সাথে, আপনার নথিতে
প্রকৃত অক্ষর সরাসরি থাকতে পারে — café, €20, →, এমনকি
😀 — এবং সেগুলো একটিও এনটিটি ছাড়াই নিখুঁতভাবে প্রদর্শিত হবে। এনটিটি ইউনিকোডকে
"সমর্থন" করার উপায় নয়; UTF-8 এটি ইতিমধ্যেই করে। এনটিটির আশ্রয় নিন কেবল তখনই যখন আপনাকে
মার্কআপ-গুরুত্বপূর্ণ অক্ষরকে নিষ্ক্রিয় করতে হয়, বা যখন কোনো ডাউনস্ট্রিম সিস্টেম (কোনো পুরনো ইমেইল
গেটওয়ে, কোনো কঠোর XML পার্সার) UTF-8 সামলানোর ব্যাপারে ভরসাযোগ্য নয়। এনটিটিকে charset-এর
বিকল্প হিসেবে গণ্য করলে অতি-এনকোডেড, অপঠনযোগ্য সোর্স তৈরি হয়; UTF-8-কে ঐচ্ছিক ধরলে
é তৈরি হয় যেখানে é থাকা উচিত। প্রতিটি কাজের জন্য সঠিক টুল ব্যবহার করুন।
যেসব এনটিটি আপনি সত্যিই ব্যবহার করবেন তার একটি সফর
হাজার হাজার নামযুক্ত রেফারেন্সের মধ্যে মুষ্টিমেয় কয়েকটিই প্রায় সব আসল কাজ করে। প্রতিটি কীসের জন্য তা জানা অনেক আন্দাজ বাঁচিয়ে দেয়:
(নন-ব্রেকিং স্পেস) — দুটি শব্দকে একই লাইনে রাখে, যাতে "10 km" বা "Mr. Smith" কখনো বেঢপভাবে ভেঙে না যায়। এটি HTML-কে পুনরাবৃত্ত স্পেস সংকুচিত করা থেকেও থামায়। এটি ভেবেচিন্তে ব্যবহার করুন, কোনো লেআউট হ্যাক হিসেবে নয়।–ও—— এন ড্যাশ (–, 2010–2020-এর মতো পরিসরের জন্য) ও দীর্ঘতর এম ড্যাশ (—, বাক্যের মধ্যে বিরতির জন্য)। অনেক সিস্টেম এগুলো বিকৃত করে, তাই এনটিটি এদের নির্ভরযোগ্য করে তোলে।- স্মার্ট কোট — কার্লি একক কোটের জন্য
‘’এবং কার্লি ডবলের জন্য“”। কোনো ওয়ার্ড প্রসেসর থেকে কপি করলে এগুলো mojibake-এর একটি ক্লাসিক উৎস, তাই এদের এনকোড করলে টাইপোগ্রাফি অক্ষত থাকে। - আইনি ও বাণিজ্যিক —
©(©),®(®) ও™(™) কপিরাইট, রেজিস্টার্ড-ট্রেডমার্ক ও ট্রেডমার্ক চিহ্নের জন্য। - গণিত ও একক —
×(×),÷(÷),°(°),±(±) এবং তীর←/→।
এদের প্রত্যেকের একটি সঠিক সংখ্যাসূচক সমতুল্য আছে (উদাহরণস্বরূপ © আসলে
© বা ©), যা রেন্ডার-হওয়ার-নিশ্চয়তাযুক্ত বিকল্প যদি কোনো
লক্ষ্য সিস্টেম নামটি না চেনে। আপনি যা কিছু এনকোড করেন তার সংখ্যাসূচক রূপ দেখতে এই টুলটিকে "দশমিক"
বা "হেক্স" মোডে স্যুইচ করুন।
এই টুল কীভাবে নিরাপদে ডিকোড করে
ডিকোডিং সরল দেখায় কিন্তু একটি প্রকৃত ঝুঁকি লুকিয়ে রাখে: যদি কোনো টুল আপনার টেক্সটকে কোনো লাইভ
HTML এলিমেন্টে ফেলে এনটিটি সমাধান করত, তবে কোনো ক্ষতিকর স্ট্রিং একটি স্ক্রিপ্ট চালাতে পারত। এই
টুলটি এটি সম্পূর্ণভাবে এড়ায়। সংখ্যাসূচক রেফারেন্স গাণিতিকভাবে সমাধান হয় — কোড
পয়েন্ট পড়া হয় এবং সঠিক অক্ষর পুনর্গঠিত হয়, কোনো HTML জড়িত না করে। নামযুক্ত রেফারেন্স
একবারে একটি পরিচ্ছন্ন &name; টোকেন হিসেবে একটি বিচ্ছিন্ন এলিমেন্টের মাধ্যমে
সমাধান হয়, এবং যেহেতু এমন একটি টোকেন নিজে কখনো একটি < বা > ধারণ করতে
পারে না, তাই মার্কআপ বা স্ক্রিপ্টের গলে যাওয়ার কোনো উপায় নেই। সেই পদ্ধতির অর্থ ডিকোডারটি
সম্পূর্ণ HTML5 নামযুক্ত টেবিল সমর্থন করে — সেই 2,000-এর-বেশি নামের প্রতিটি — কেবল
হাতেগোনা কয়েকটি নয়, এবং তাও সম্পূর্ণভাবে আপনার ডিভাইসে থেকে। যা কিছু বৈধ, সমাপ্ত এনটিটি নয় তা
কেবল অস্পর্শিত রেখে দেওয়া হয়, তাই আপনার টেক্সটে কোনো বিপথগামী & বিকৃত হওয়ার
বদলে ডিকোডিং থেকে অক্ষত বেঁচে যায়। ফলাফল একটি ডিকোডার যা ব্যাপক ও নির্মাণ থেকেই নিরাপদ উভয়ই।
প্রায়শই জিজ্ঞাসিত প্রশ্ন
- HTML এনটিটি কী?
- HTML এনটিটি হলো এমন একটি কোড যা এমন কোনো অক্ষরকে উপস্থাপন করে যা HTML-এ সংরক্ষিত বা টাইপ করা কঠিন — এটি নাম দিয়ে (© এর জন্য ©) বা সংখ্যা দিয়ে (© বা ©) লেখা হয়। এনটিটি আপনাকে < > & এর মতো অক্ষর আক্ষরিকভাবে দেখাতে দেয়, ব্রাউজার সেগুলোকে মার্কআপ হিসেবে গণ্য করার পরিবর্তে।
- আমার কখন & < > " এবং ' এনকোড করা দরকার?
- যখনই আপনি HTML-এর ভেতরে টেক্সট রাখেন। < এবং > ট্যাগ শুরু ও শেষ করে, & একটি এনটিটি শুরু করে, এবং " ও ' অ্যাট্রিবিউট সীমাবদ্ধ করে — তাই সেগুলো আক্ষরিকভাবে দেখানো (বা ইউজার টেক্সট নিরাপদে কোনো পৃষ্ঠায় বসানো) মানে সেগুলোকে < > & " ও ' দিয়ে প্রতিস্থাপন করা। “কেবল HTML-বিশেষ অক্ষর” মোড ঠিক এটাই করে।
- নামযুক্ত বনাম সংখ্যাসূচক এনটিটি — আমার কোনটি ব্যবহার করা উচিত?
- দুটোই সমতুল্য। নামযুক্ত এনটিটি (©, —) বেশি পঠনযোগ্য; সংখ্যাসূচক এনটিটি (©, — বা হেক্স ©) এমন অক্ষরের জন্যও কাজ করে যাদের কোনো নাম নেই এবং এগুলোর রেন্ডার হওয়া নিশ্চিত। দশমিক ও হেক্স সংখ্যাসূচক এনটিটি পরস্পর বিনিময়যোগ্য — © ও © দুটোই © তৈরি করে।
- এটি কি ইমোজি ও নন-ল্যাটিন লিপি সামলাতে পারে?
- হ্যাঁ। এনকোডিং ইউনিকোড কোড পয়েন্ট অনুযায়ী চলে, তাই ইমোজি ও অ্যাস্ট্রাল-প্লেন অক্ষর (যেমন 😀 = 😀 / 😀) এবং 日本語 বা বাংলা-র মতো লিপি হুবহু সঠিকভাবে এনকোড ও আবার ডিকোড হয়, কোনো ভাঙা সারোগেট পেয়ার ছাড়াই।
- ডিকোডিং কি নিরাপদ — এটি কি কোনো স্ক্রিপ্ট চালাতে পারে?
- না। ডিকোডিং কখনো আপনার টেক্সটকে লাইভ HTML হিসেবে বসায় না। সংখ্যাসূচক এনটিটি তাদের কোড পয়েন্ট থেকে গাণিতিকভাবে সমাধান হয়, এবং নামযুক্ত এনটিটি একবারে একটি পরিচ্ছন্ন &name; টোকেন হিসেবে সমাধান হয়, তাই মার্কআপ বা স্ক্রিপ্ট চলার কোনো উপায় নেই। সবকিছু আপনার ডিভাইসেই থাকে।
- কোনো কিছু কি কোনো সার্ভারে আপলোড হয়?
- না। এনকোডিং ও ডিকোডিং সম্পূর্ণভাবে আপনার ব্রাউজারে JavaScript দিয়ে চলে, তাই আপনার টেক্সট কখনো আপনার ডিভাইস থেকে বাইরে যায় না। পৃষ্ঠা লোড হয়ে গেলে টুলটি অফলাইনেও কাজ করে।