پاسخ داده شده: انواع سیستم های کد گذاری
Unicode یونیکد
اینترنت و جهانی شدن ارتباطات، سبب افزایش تبادل اطلاعات در کشورهای مختلف شد. از آنجا که الفبای زبان هایی مانند زبان های چینی و ژاپنی و... بیش از 128حرف دارند، کدگذاری اسکی برای کدگذاری این زبان ها مناسب نیست. بنابراین استاندارد جدیدی به نام یونیکد به وجود آمد. یونیکد به هر نویسه مستقل از محیط، برنامه و زبان یک کد منحصربه فرد به نام Code pointاختصاص می دهد. این استاندارد یک کد به نویسه های مشترک در چند زبان مختلف اختصاص می دهد. نسخه جدید یونیکد دارای 136690 Code pointاست. Code point 128ابتدایی یونیکد، همانند کدهای اَسکی هستند و در یونیکد نویسه ها به صورت 32بیتی تعریف میشوند. ولی بسیاری از نرم افزارها به ویژه برنامههای ارسال و دریافت اطلاعات دراینترنت با نویسه های 8بیتی کار می ً کنند و عملا نمی توان Code point 136690را در 8بیت جا داد وبرای ارسال و دریافت 32بیت به پهنای باندی 4برابر بیشتر نیاز است. در این موارد از 1UTF-8استفاده شد که مخفف قالب 8 بیتی انتقال مجموعۀ نویسه ای جهانی است.
1 ـUniversal Character Set Transformation Format 8 bit
UTF-8یک رمزگذاری با طول متغیر 4بایتی است. یک بایت برای حروف و علائم استاندارد انگلیسی که همان کدهای اسکی هستند، دو بایت برای بقیه حروف لاتین و نویسههای خاورمیانه و سه بایت برای شرق آسیا استفاده میشود. بقیه نویسهها با چهار بایت نمایش داده میشوند.
با توجه به اینکه UTF-8از کدهای 127برای نویسه های اسکی استفاده می کند، در تمامی نرم افزارهایی که از نویسه های 7بیتی پشتیبانی می کنند قابل پردازش است.
UTF-8رایجترین روش رمزگذاری نویسه در میان تارنماها است. UTFدارای نسخه های مختلفی مانند
UTF-32، UTF-16، UTF-8، UTF-7است و UTF-8محبوبترین نوع کدگذاری یونیکد است
