Латиница в кириллице и невидимые символы
Текст выглядит обычно, а поиск по нему промахивается: внутри слова стоит латинская «о» или неразрывный пробел из Word. Инструмент проходит текст посимвольно, подсвечивает подозрительные места прямо в тексте и выписывает каждое в таблицу — с позицией, кодом вида U+00A0 и объяснением, чем оно мешает. Исправление здесь выборочное: у каждой находки своя галочка, потому что неразрывный пробел перед «₽» и длинное тире в предложении часто стоят по делу. Разбор идёт в браузере, текст никуда не отправляется.
Где стоят находки
Что нашлось
| Чинить | Позиция | Символ | Код | Что это | Чем мешает | Замена |
|---|---|---|---|---|---|---|
| Находок пока нет. | ||||||
Исправленный текст
Как пользоваться
- Заголовок, описание товара, кусок статьи или строку из выгрузки. Разбор запускается сразу при вставке, потолок — 100 000 знаков за раз.
- Смешанные слова, невидимки и двойники пунктуации закрашены разным цветом прямо в тексте. Переключатель «показать спрятанные символы» рисует метки вместо пустоты, чтобы находки было видно глазами.
- Каждая строка — позиция, сам символ, его код, название по-русски и объяснение, чем он мешает. Клик по подсветке в тексте отмечает нужную строку.
- Галочки заранее стоят у явного мусора: буквы-двойники и символы нулевой ширины. Неразрывные пробелы, тире и ёлочки отмечайте вручную — часть из них поставлена осознанно.
- Исправленный текст собирается под таблицей и обновляется на каждую галочку. Кнопка кладёт его в буфер обмена.
Частые вопросы
Почему поиск не находит слово, которое видно на экране?
Скорее всего внутри слова стоит буква из другого алфавита. Латинские «a», «c», «e», «o», «p», «x», «y» и прописные «A», «B», «C», «E», «H», «K», «M», «O», «P», «T», «X» рисуются так же, как кириллические, но для компьютера это другие символы. Слово «оптовые» с латинской «о» никогда не совпадёт с запросом, набранным кириллицей. Тот же эффект дают символы нулевой ширины: они рвут слово посередине и остаются невидимыми.
Откуда такие символы берутся в тексте?
Чаще всего из копирования. Word и Google Docs сами ставят неразрывные пробелы и типографские кавычки, PDF отдаёт тонкие шпации вместо пробелов, вёрстка в макете добавляет мягкие переносы, часть CMS вставляет символ нулевой ширины при переносе строки. Буквы-двойники приходят из раскладки и из чужих выгрузок: латинская «C» в артикуле, кириллическая «О» в английском названии.
Неразрывные пробелы нужно вычищать?
Далеко не всегда. Неразрывный пробел держит на одной строке инициалы и фамилию, число и единицу измерения, короткий предлог и следующее слово — там он поставлен по делу. Убирать его стоит, когда текст едет в код, в адрес страницы, в CSV или в поле, где ждут обычный пробел. Поэтому у каждой строки таблицы своя галочка, и у пробелов она снята заранее.
Чем латинская буква в русском слове вредит сайту?
Поисковая система разбирает такое слово как другую последовательность символов и перестаёт связывать его с обычным запросом. Страница теряется по своему же названию, фильтр в каталоге не собирает товар в нужную группу, выгрузка в маркетплейс отдаёт дубль карточки. В заголовке и в адресе страницы это заметно сильнее всего: адрес выглядит привычно, а ведёт в никуда.
Что будет со словами вроде «SEOшник» или «Яndex»?
Они попадут в таблицу как смешанные: два алфавита в одном слове инструмент видит именно так. Замену для них он не предлагает — у латинских «S», «n», «d» кириллических двойников нет, и подстановка испортила бы слово. Галочка у такой строки не ставится: находку видно, решение остаётся за вами.
Чего инструмент не делает?
Он не проверяет орфографию и пунктуацию, не переключает раскладку и не трогает буквы из третьих алфавитов: греческая «ο» или сербская «ј» внутри русского слова здесь проходят мимо проверки. Разбор ограничен парой кириллица-латиница, цифрой ноль и списком служебных символов из таблицы. Отличить осмысленный неразрывный пробел от случайного он тоже не берётся, это решение за вами.
Текст уходит на сервер?
Нет. Разбор, подсветка и правка считаются в вашем браузере на этой же странице, сетевых запросов инструмент не делает. Черновики и внутренние документы можно вставлять спокойно: они остаются на вашем компьютере.
Сколько текста он потянет?
За раз разбирается до 100 000 знаков — около полусотни машинописных страниц. Подсветка рисуется для первых 20 000 знаков, чтобы вкладка не подтормаживала на слабом ноутбуке, таблица показывает первые 400 находок. Исправление при этом применяется ко всему тексту, включая находки, которые в таблицу не поместились.
Похожие инструменты
Делит длинный текст на куски нужной длины: Telegram 4096, подпись 1024, ВК 4000, description 160, SMS 70. Не рвёт слова и предложения.
ОткрытьТипографорКавычки-ёлочки «», дефис → тире, неразрывные пробелы после предлогов, чистка двойных пробелов. Аккуратная типографика для сайта.
ОткрытьОбрезать строкиУдалить N символов с краёв, текст до/после символа, убрать приставку или окончание.
ОткрытьСчётчик символов и словСимволы, слова, предложения, время чтения + частотность слов и повторяющихся фраз (ключей). Для копирайтинга и SEO.
ОткрытьАнализ текста: тошнотаКлассическая и академическая тошнота, водность, символы, слова и частотность ключей. Проверка SEO-текста перед публикацией.
ОткрытьMarkdown ↔ HTMLПереводит Markdown в чистый HTML и обратно: заголовки, списки, ссылки, жирный, код, цитаты. Удобно, когда нейросеть выдала Markdown.
ОткрытьЕщё инструменты для SEO и маркетинга
Кластеризатор запросов, генераторы sitemap и robots.txt, минус-слова, разметка Schema.org и калькуляторы — в разделе инструментов.