ГлавнаяИнструментыИнспектор Unicode

Инспектор Unicode

Два одинаковых на вид слова могут различаться: латинская «с» вместо кириллической, неразрывный пробел вместо обычного, символ нулевой ширины, вставленный при копировании. Инспектор разбирает текст по символам и для каждого показывает код U+XXXX, десятичный номер, байты UTF-8, кодовые единицы UTF-16, HTML-сущность и группу — кириллица, латиница, цифра, пробел, эмодзи, — а невидимые и подозрительные символы подсвечивает и считает. Полезно, когда пароль «не подходит», поиск по странице «не находит» или строка в базе не совпадает с такой же на вид. Проверено 04.09.2026.

В примере латинская e спрятана в слове Secret и стоит неразрывный пробел.

По символам

Подсвечены невидимые, нестандартные пробелы и буквы чужого алфавита внутри слова.
Коды по Unicode, байты UTF-8 через TextEncoder, единицы UTF-16 по JavaScript; группы — по диапазонам блоков. Проверено 04.09.2026.

Как пользоваться

  1. Любой: слово, пароль, строку из таблицы, адрес.
  2. Сколько символов, байт, невидимых и смешанных знаков.
  3. Невидимые и нестандартные пробелы, символы нулевой ширины, латиница среди кириллицы выделены в таблице.
  4. U+код, число, байты и HTML-сущность для каждого символа.

Частые вопросы

Что такое кодовая точка и U+

Номер символа в Unicode, записанный в шестнадцатеричной системе с префиксом U+: буква «я» — U+044F, то есть 1103. В UTF-8 этот номер занимает два байта D1 8F, в UTF-16 — одну единицу 044F.

Какие символы невидимые

Неразрывный пробел U+00A0, тонкие пробелы U+2009 и U+202F, символы нулевой ширины U+200B–U+200D, мягкий перенос U+00AD, метка порядка байтов U+FEFF, знаки направления письма. Инспектор находит их и показывает код.

Почему одинаковые слова не совпадают

Чаще всего из-за смешанных алфавитов: латинские a, c, e, o, p, x, y выглядят как кириллические. Инспектор помечает латиницу в слове с кириллицей и наоборот; отдельный инструмент сайта заменяет их автоматически.

Чем UTF-8 отличается от UTF-16

Оба кодируют одни и те же символы: UTF-8 переменной длиной от одного до четырёх байт и обратно совместим с ASCII, UTF-16 единицами по два байта, символы выше U+FFFF занимают две единицы — суррогатную пару. JavaScript считает длину строки в UTF-16.

Почему эмодзи — несколько символов

Флаги, семьи и тона кожи собираются из нескольких кодовых точек, соединённых знаком U+200D. Инспектор показывает каждую часть отдельно, поэтому один эмодзи может дать 3–7 строк.

Считает ли инспектор длину для SMS или Твиттера

Он показывает число символов и байт; лимиты площадок считает отдельный счётчик символов на сайте.

Данные куда-то отправляются

Нет, всё считается в браузере.

Ещё инструменты для SEO и маркетинга

Кластеризатор запросов, генераторы sitemap и robots.txt, минус-слова, разметка Schema.org и калькуляторы — в разделе инструментов.