belun.app Блог

Количество символов в тексте — счётчик знаков онлайн

Сколько символов в тексте? Вставьте его в поле ниже — количество появится сразу, без кнопок и регистрации. Отдельно показываем с пробелами и без пробелов: это разные цифры, и в ТЗ почти всегда имеют в виду вторую.

На обычном русском тексте пробелы занимают 14–18% объёма — тем меньше, чем длиннее слова. В строке «Краткость — сестра таланта, но заказчик платит за тысячу знаков без пробелов.» — 77 знаков с пробелами и 66 без них.

с пробелами или без ↓ · лимиты площадок ↓ · сколько символов в SMS ↓ · как посчитать в Word ↓

0 Символы
0 Без пробелов
0 Буквы
0 Цифры
0 Слова
0 Строки

Осталось до лимита

280 X (Twitter) · 280
1024 Telegram, подпись · 1024
2200 Instagram · 2200
60 Title · 60

SMS

0 сегментов
160 символов до следующего
кодировка GSM-7 (латиница)

Полная раскладка

Кириллица
0
Латиница
0
Пробелы
0
Прочие знаки
0
Видимые символы
0
Эмодзи
0
Уникальных символов
0
Байты UTF-8
0
Предложения
0
Абзацы
0
UTF-16 (String.length)
0

Вставьте текст — счётчик покажет, сколько в нём символов с пробелами и без, отдельно буквы кириллицы и латиницы, цифры, пробелы и знаки препинания. Рядом видно, сколько символов осталось до лимита X, Telegram, Instagram и title, и на сколько SMS разобьётся сообщение. Всё считается в браузере, текст никуда не отправляется.

Знаки с пробелами и без: какую цифру брать

Это самый дорогой вопрос на странице. Разница между двумя плитками на русском тексте — 14–18% объёма: на заказе в 20 000 знаков это около трёх тысяч знаков работы, то есть целая статья. Единицу стоит уточнять до начала работы, а не при сдаче.

Где спрашивают Считается Почему так
Биржи копирайтинга, оплата за текст без пробелов исторически: пробел не считался работой. «1000 знаков» в ТЗ почти всегда без пробелов
Бюро переводов, издательства с пробелами страница 1800 знаков и авторский лист 40 000 знаков считаются с пробелами
Соцсети и мессенджеры с пробелами лимит считает каждый введённый символ, пробел в том числе
SMS с пробелами пробел занимает в сообщении столько же места, сколько буква
Формы и поля БД с пробелами maxlength в HTML и varchar в базе считают всё подряд
Вузовские требования к объёму с пробелами объём листа считается по знакопечатным позициям машинописной страницы

Отдельная тонкость: «без пробелов» у нас означает без всех пробельных символов — обычных пробелов, табуляций и переносов строк. В Word под «знаками без пробелов» понимаются только пробелы, поэтому на тексте, разбитом на много коротких строк, Word насчитает чуть больше. Если текст пришёл из вёрстки и в нём двойные пробелы, сначала уберите лишние пробелы — иначе за них заплатят, а читатель их не увидит.

Лимиты символов: соцсети, мессенджеры, SEO, SMS

Жёсткие лимиты обрезают текст технически. Мягкие (помечены «≈») ничего не ломают, но всё, что за границей, читатель просто не увидит. Все значения — в символах с пробелами.

Где Символов Что важно знать
SMS, кириллица 70 в одном сегменте; дальше по 67
SMS, только латиница 160 в одном сегменте; дальше по 153
X (Twitter) 280 ссылка всегда считается за 23 символа
Telegram, сообщение 4096 длиннее — разрежется на несколько
Telegram, подпись к медиа 1024 2048 у Premium — частая ловушка
ВКонтакте, текст записи 16 384 в ленте видно первые ~350
Instagram, подпись 2200 до «ещё» видно около 125 символов
Instagram, описание профиля 150 переносы строк тоже считаются
LinkedIn, пост 3000 у страниц компаний — 700
YouTube, заголовок 100 в поиске обрезается около 60
YouTube, описание 5000 до «ещё» видно около 157
Title для поиска ≈60 Яндекс показывает около 52–70, Google меряет пиксели
Description ≈160 Яндекс иногда берёт до 300, Google режет по ширине

Заметьте разрыв между лимитом и видимой частью: у записи ВКонтакте лимит 16 384 символа, а в ленте до «Показать полностью» читается около 350. Лимит говорит, сколько поместится; видимая часть — сколько прочитают.

Сколько символов в одном SMS: 70 или 160

Это единственный случай, когда «количество символов» зависит не от текста, а от алфавита. Стандарт GSM-7 — таблица на 128 знаков: латиница, цифры, пунктуация и горстка европейских букв. Кириллицы в ней нет. Одна русская буква, одна «умная» кавычка или одно эмодзи переключают всё сообщение на двухбайтовую UCS-2, и вместимость падает со 160 символов до 70. Длинный текст режется на сегменты — по 153 в GSM-7 и по 67 в UCS-2, потому что заголовок склейки занимает место в каждом сегменте. Платят за сегменты.

Текст Символов Кодировка Сегментов
Здравствуйте! Ваш заказ собран и ждёт в пункте выдачи до пятницы. 65 UCS-2 1
Здравствуйте! Ваш заказ собран и ждёт в пункте выдачи на Ленина, 14 до пятницы. Спасибо, что выбрали нас. 105 UCS-2 2
Your order is ready for pickup at the Central Street store. We will keep it on the shelf until Friday evening. Thanks for shopping with us. 139 GSM-7 1
Your order is ready for pickup at the Central Street store. We will keep it on the shelf until Friday evening. Thanks for shopping with us. 🙂 141 UCS-2 3

Третья и четвёртая строки отличаются ровно одним смайликом — и это превращает одно сообщение в три. Английский текст на 139 знаков укладывается в один сегмент GSM-7; тот же текст с эмодзи уходит в UCS-2, где на сегмент остаётся 67 символов, и рассылка на миллион номеров дорожает втрое. В русском сообщении эмодзи не меняет ничего: кириллица и так заставляет использовать UCS-2.

Тихая ловушка — знаки, пришедшие из Word. Длинное тире «—», «ёлочки» и «кавычки-лапки» в GSM-7 отсутствуют, а обычный дефис и прямые кавычки в нём есть. Одна автозамена в редакторе способна урезать вместимость латинской рассылки со 160 символов до 70. Если бюджет важен, транслитерация русского текста в латиницу возвращает 160 символов на сегмент — ценой того, что читать его будет неприятно.

Что считает каждая плитка

Счётчики расходятся не потому, что кто-то ошибается, а потому, что считают разные вещи. Ниже — точное правило для каждой цифры на этой странице.

Плитка Что входит Пример
Символы кодовые точки Unicode — цифра, которую считают соцсети и лимиты полей «Привет, мир!» → 12
Без пробелов то же самое минус пробелы, табуляции и переносы строк «Привет, мир!» → 11
Видимые то, что читатель считает одним знаком: 👨‍👩‍👧 — один, а не пять «Привет 👨‍👩‍👧 мир» → 12 видимых при 16 символах
Кириллица буквы кириллического алфавита, включая ё и украинские і, ї, є, ґ «Привет, мир!» → 9
Латиница буквы латинского алфавита, включая é, ö, ñ «café» → 4
Цифры десятичные цифры любой письменности «100%» → 3
Пробелы пробелы, табуляции и переносы строк «Привет, мир!» → 1
Прочие всё остальное: знаки препинания, %, ₽, эмодзи, невидимые служебные символы «Привет, мир!» → 2 (запятая и восклицательный знак)
Байты UTF-8 сколько места текст занимает в файле или в колонке базы данных «Привет, мир!» → 21 байт при 12 символах

Разделение на кириллицу и латиницу удобно не только для статистики. Если в русском слове случайно осталась латинская «c» или «a» — а это классическая беда текстов, прошедших через автозамену, — сумма букв кириллицы и латиницы это сразу покажет.

Символы, видимые знаки и байты — три разных числа

Для обычного русского текста все три совпадают с точностью до кодировки. Расходятся они на эмодзи и на буквах с диакритикой — и именно эти расхождения ломают формы, поля баз данных и лимиты площадок.

Текст Символов Видимых UTF-16 Байт UTF-8
привет 6 6 6 12
ё 1 1 1 2
🙂 1 1 2 4
👨‍👩‍👧 5 1 8 18
café 4 4 4 5

Читается так. Символы — кодовые точки Unicode, цифра площадок и полей ввода. Видимые — то, что человек считает одним знаком: семья 👨‍👩‍👧 собрана из трёх человечков и двух невидимых соединителей, но выглядит как один символ. UTF-16 — то, что вернёт String.length в JavaScript и LEN() в SQL Server. Байты UTF-8 — место в файле и в колонке базы: «Привет, мир!» занимает 21 байт при 12 символах, потому что каждая кириллическая буква — это два байта. Отсюда классическая ошибка: varchar(15) с лимитом в байтах не примет текст, который по символам помещается с запасом.

Как посчитать символы в Word, Google Документах и Excel

Word. Вкладка «Рецензирование» → «Статистика», либо клик по счётчику слов в строке состояния. В окне есть и «Знаков (с пробелами)», и «Знаков (без пробелов)». Галочка «Учитывать надписи, сноски и концевые сноски» по умолчанию снята — из-за неё Word и показывает меньше нашего на документах с примечаниями. Чтобы посчитать не весь документ, а фрагмент, выделите его: статистика пересчитается по выделению.

Google Документы. «Инструменты» → «Статистика» или Ctrl+Shift+C. Там же галочка «Показывать статистику при вводе текста» — после неё счётчик висит в левом нижнем углу постоянно. Отдельной цифры «без пробелов» Google Документы не дают вовсе, её приходится считать снаружи.

Excel и Google Таблицы. Длина строки — =ДЛСТР(A1) в русском интерфейсе и =LEN(A1) в английском. Без пробелов — =ДЛСТР(ПОДСТАВИТЬ(A1;" ";"")), то есть =LEN(SUBSTITUTE(A1," ","")). Сумма по столбцу — =СУММПРОИЗВ(ДЛСТР(A1:A100)).

Командная строка. В Linux и macOS wc -m file.txt считает символы, а wc -c — байты; на русском тексте они разойдутся ровно вдвое, и это не ошибка.

Что делать с текстом дальше

Как это работает

  1. 1
    Вставьте или введите текст Кликните по полю и вставьте текст — пост, описание, SMS, мета-тег. Подсчёт идёт с первого нажатия клавиши, кнопку нажимать не нужно.
  2. 2
    Возьмите нужную цифру «Символы» — это с пробелами, «Без пробелов» — без них. Ниже раскладка: кириллица, латиница, цифры, пробелы, прочие знаки, видимые символы и байты UTF-8.
  3. 3
    Проверьте лимиты Полоски показывают, сколько символов осталось до лимита площадки, а блок SMS — на сколько сегментов разобьётся сообщение и в какой кодировке.

Ваши данные защищены

Всё обрабатывается прямо в вашем браузере. Никакие файлы или текст не отправляются на наши серверы. Отключите интернет — инструмент продолжит работать.

Часто задаваемые вопросы

Как посчитать количество символов в тексте онлайн?
Вставьте текст в поле выше — число в плитке «Символы» появится мгновенно. Это символы с пробелами. Если в ТЗ сказано «без пробелов», берите соседнюю плитку: на обычном русском тексте разница составляет 14–18% — тем меньше, чем длиннее слова.
Чем отличаются знаки с пробелами и без?
«С пробелами» — длина текста целиком: каждая буква, цифра, знак препинания, пробел и перенос строки. «Без пробелов» — то же самое, но пробельные символы выброшены. Биржи копирайтинга почти всегда имеют в виду знаки без пробелов, бюро переводов и издательства — с пробелами. На объёме в 20 000 знаков ошибка в единице стоит около трёх тысяч знаков работы, поэтому единицу лучше уточнять до начала, а не после сдачи.
Сколько символов помещается в одно SMS?
Если в тексте только латиница, цифры и базовая пунктуация — 160 символов, это кодировка GSM-7. Достаточно одной русской буквы, одной «умной» кавычки или одного эмодзи, и сообщение переключается на UCS-2, где в один сегмент влезает уже 70 символов. Длинный текст режется на сегменты по 153 (GSM-7) или по 67 (UCS-2) символов — заголовок склейки занимает место в каждом. Блок «SMS» под счётчиком показывает и кодировку, и число сегментов.
Почему русское SMS в два раза короче английского?
Стандарт GSM-7 — это таблица на 128 знаков: латиница, цифры, пунктуация и горстка европейских букв. Кириллицы там нет вообще. Как только в сообщении появляется хоть одна русская буква, оператор переключает всё сообщение на двухбайтовую кодировку UCS-2, и вместимость падает со 160 до 70 символов. Наполовину латинский текст это не спасает — кодировка выбирается для сообщения целиком.
Считает ли счётчик эмодзи за один символ?
Плитка «Символы» считает кодовые точки Unicode: простое эмодзи 🙂 — это один символ, а семья 👨‍👩‍👧 — пять (три человечка и два невидимых соединителя). Плитка «Видимые» считает так, как видит читатель: 👨‍👩‍👧 там один знак. Площадки ведут себя по-разному, поэтому обе цифры показаны рядом.
Почему Word показывает другое количество знаков?
Чаще всего из-за того, что попадает в подсчёт. Word по умолчанию не считает сноски, колонтитулы и надписи, пока не включена галочка «Учитывать надписи и сноски». Скрытый текст и содержимое некоторых таблиц тоже учитываются не всегда. И в Word «Знаков (без пробелов)» вычитает только пробелы, а мы вычитаем ещё табуляции и переносы строк — на тексте с разбивкой на строки это даёт расхождение в несколько знаков.
Как посчитать символы в Word и Google Документах?
В Word: вкладка «Рецензирование» → «Статистика», либо щелчок по счётчику слов в строке состояния. В Google Документах: «Инструменты» → «Статистика» или Ctrl+Shift+C; там же галочка «Показывать статистику при вводе текста». В Google Таблицах и Excel длину строки даёт формула =ДЛСТР(A1) (в англоязычном интерфейсе =LEN(A1)), а без пробелов — =ДЛСТР(ПОДСТАВИТЬ(A1;" ";"")).
Что такое байты UTF-8 и зачем их считать?
Ограничения в базах данных и API часто заданы в байтах, а не в символах. В UTF-8 латинская буква занимает 1 байт, кириллическая — 2, иероглиф — 3, эмодзи — 4. Поэтому «Привет, мир!» — это 12 символов, но 21 байт, и в колонку varchar(15) такой текст не поместится, хотя по символам запас есть. Плитка «Байты UTF-8» показывает эту цифру.
Сколько символов должно быть в title и description?
Title — около 60 символов: Яндекс показывает примерно 52–70, Google меряет не знаки, а ширину сниппета в пикселях, поэтому «ШИРОКИЙ ЗАГОЛОВОК» обрежется раньше узкого. Description — около 160 символов; Яндекс иногда берёт и до 300, если считает фрагмент полезным. Обе цифры — не ограничение движка, а граница видимой части: длиннее писать можно, но остаток в выдачу не попадёт.
Считаются ли переносы строк?
Да, перенос строки — обычный символ и входит в «Символы», но не входит в «Без пробелов». В Windows конец строки исторически состоит из двух символов (CR и LF), поэтому один и тот же файл может давать разное число знаков на разных системах. Плитка «Строки» считает только непустые строки — так же, как счётчик слов, чтобы два инструмента не спорили друг с другом.
Есть ли ограничение на длину текста?
Нет. Подсчёт идёт в вашем браузере, поэтому единственный предел — память устройства. Диплом на 150 000 знаков считается мгновенно.
Чем счётчик символов отличается от счётчика слов?
Это один и тот же текст, измеренный разными единицами. Символы нужны там, где есть жёсткий лимит поля: пост, SMS, мета-тег, колонка базы. Слова и страницы — там, где сдают работу: реферат, статья, перевод. Если нужен перевод объёма в страницы по 1800 знаков и авторские листы, это делает счётчик слов.
Отправляется ли текст на сервер?
Нет. Весь подсчёт выполняет JavaScript в вашем браузере, сетевых запросов инструмент не делает — можно отключить интернет и продолжить работу. Поэтому в него безопасно вставлять черновики, пароли и рабочие документы.

Из блога

Счётчик символов онлайн: зачем нужен и как правильно считать Практическое руководство по подсчёту символов для соцсетей, SEO, SMS и кода — с советами по лимитам платформ. Читать статью →

Похожие инструменты