Декодер HTML-сущностей
Мгновенное кодирование и декодирование HTML-сущностей. Преобразование между специальными символами и ссылками на сущности. Вся обработка выполняется в вашем браузере.
Статистика
Как использовать декодер HTML-сущностей
Выберите режим
Выберите «Кодировать» для преобразования символов в сущности или «Декодировать» для обратного преобразования.
Введите текст
Вставьте или введите текст, содержащий HTML-сущности или обычные символы.
Получите результат
Преобразованный результат появится мгновенно. Скопируйте его одним нажатием.
Что такое HTML-сущности?
HTML-сущности — это специальные коды для представления символов, имеющих особое значение в HTML (например, <, >, &), или символов, которые сложно ввести с клавиатуры. Они используют формат &имя; или &#число; или &#xhex;.
Типы HTML-сущностей
Именованные сущности
Используют читаемые имена: & для &, < для <, > для >, " для "
Десятичные числовые
Используют десятичные коды: & для &, < для <
Шестнадцатеричные числовые
Используют hex-коды: & для &, < для <
Часто задаваемые вопросы
Именованные сущности используют читаемые имена, например & для &. Числовые сущности используют десятичные (&) или шестнадцатеричные (&) коды. Оба варианта представляют один и тот же символ.
Да, инструмент поддерживает все стандартные именованные символьные ссылки HTML5, включая ©, €, — и сотни других.
Используйте кодирование сущностей при вставке текста в HTML, содержащего символы вроде <, >, & или кавычек, которые могут быть интерпретированы как разметка.
Спецификация HTML5 (ныне WHATWG Living Standard) определяет 2231 именованную символьную ссылку — огромное расширение по сравнению с 252 в HTML 4.01. К ним относятся такие символы, как © (знак авторского права), € (знак евро) и ✓ (галочка). У каждой из них есть и числовой эквивалент, например © или © для знака авторского права.
В HTML экранируйте < как <, > как > и & как &, а также " как " внутри значений атрибутов. XML 1.0 предопределяет ровно пять сущностей — эти четыре плюс ', причём HTML5 поддерживает ', хотя HTML 4 этого не делал. Из них важнее всего &: неэкранированный амперсанд, за которым следуют буквы, может быть ошибочно принят за начало сущности.
Двойное кодирование возникает, когда уже закодированный текст кодируется снова: & превращается в &, а затем в &amp;. Видимый симптом — буквальный & или &, отображаемый на странице. Исправление заключается в декодировании ровно один раз на границе, где значение попадает в HTML-контекст — этот инструмент позволяет проверять каждый проход отдельно.
Они решают разные задачи. Процентное кодирование (%20) — это стандарт URL из RFC 3986, и именно оно должно находиться внутри атрибутов href; HTML-сущности (&) экранируют символы разметки и применяются только там, где URL встроен в HTML. Значение параметра запроса, содержащее & и пробелы, обычно требует обоих уровней: пробелы кодируются процентным кодированием, а разделяющий & записывается в разметке как &.
Да — таблица именованных символьных ссылок полностью реализована во всех основных браузерах примерно с 2014 года, включая устаревшие сущности без точки с запятой, которые HTML5 сохраняет для обратной совместимости. Числовые ссылки (© или ©) ещё надёжнее, поскольку они зависят только от кодовых точек Unicode, а не от справочной таблицы браузера.
Похожие инструменты
Декодер Unicode
Конвертация между Unicode-экранированием и читаемым текстом
Декодер Base64 и URL
Декодирование и кодирование Base64, парсинг URL-кодированных строк, предпросмотр изображений Base64 и декодирование сегментов заголовка или полезной нагрузки JWT
Hex-декодер
Конвертация между шестнадцатеричным форматом и текстом с настройкой разделителей и префиксов
Авторитетные источники
Первоисточники, лежащие в основе этого инструмента, — официальные стандарты и спецификации, а не пересказы из вторых рук.