belun.app Блог

Частотность слов в тексте — частотный анализ онлайн

«Частотность» в SEO означает две разные вещи. Частотность запроса — сколько раз фразу вводили в Яндексе за месяц; эти данные есть только у поисковика, и смотрят их в Вордстате. Частотность слова в тексте — сколько раз оно встречается в вашем документе. Эта страница считает второе.

Дальше всё арифметика: если ключ встретился 12 раз в тексте на 800 слов, его плотность — 12 ÷ 800 = 1,5%. Ориентир для целевого ключа — 0,5–2%. Ниже страница выглядит так, будто она про другое; выше 3% — будто её писали для робота.

Отдельные слова здесь · словосочетания в проверке плотности ключей · таблица плотности ↓

Всего слов
0
Уникальных слов
0
Водность
0%
Классическая тошнота
0.00

Здесь появится таблица частот…

Вставьте текст и получите таблицу всех слов по убыванию частоты — с числом повторов и долей в процентах, то есть плотностью. Рядом считаются водность (доля служебных слов) и классическая тошнота — те же показатели, которые показывают Advego и text.ru. Текст никуда не отправляется: весь подсчёт идёт в браузере.

Два разных «частотности» — какое вам нужно

Половина запросов вида «проверить частотность ключевых слов» приходит от людей, которым нужен Вордстат, а не анализатор текста. Разница принципиальная, и никакой браузерный инструмент её не обойдёт.

Что это Вопрос Где смотрят Есть здесь
Частотность запроса «сколько раз фразу искали в Яндексе за месяц» Яндекс Вордстат, Планировщик Google Ads, сервисы сбора семантики Нет Эти цифры есть только у самого поисковика — ни один анализатор текста их не знает.
Частотность слова в тексте «сколько раз слово встречается в моём тексте» Эта страница, Advego, text.ru Да Считается прямо в браузере по вставленному тексту.

Простое правило: собираете семантику — вам в Вордстат. Проверяете уже написанный текст на переспам и повторы — вы на нужной странице.

Плотность ключа: что означает каждый процент

Процент рядом со словом в таблице и есть его плотность: повторы ÷ число посчитанных слов. Ни Google, ни Яндекс не публикуют норматива, поэтому полосы ниже — это то, к чему сходится практика, а не правило, которое кто-то проверяет.

Плотность Что это обычно значит Что делать
0% Ключа в тексте нет вообще. Добавьте в H1, первый абзац и один подзаголовок.
0,1–0,5% Упомянут вскользь — один-два раза на 1000 слов. Для лонгрида нормально, для короткой посадочной мало.
0,5–2% Диапазон, к которому сходится почти любое руководство по внутренней оптимизации. Ничего не трогайте.
2–3% Заметный повтор — читатель начинает спотыкаться о слово. Треть вхождений замените синонимом или местоимением.
выше 3% Переспам. С апдейта Google Panda (2011) и «Баден-Бадена» Яндекса (2017) это вредит. Перепишите абзацы, где ключ скучкован.

Тонкость: при включённом «Скрыть служебные слова» знаменателем становятся оставшиеся значимые слова, а не весь текст, и проценты вырастают примерно вдвое. Это правильная мера для сравнения лексики двух черновиков и неправильная — для проверки плотности по нормативу: снимите галочку.

Водность и тошнота: формулы и нормы

Эти два показателя пришли из Advego и text.ru, и их ждут от любого русского анализатора. Обе цифры считаются здесь же, над таблицей. Формулы открытые, так что результат можно проверить руками.

Водность
Служебные слова ÷ все слова × 100%. Служебные — предлоги, союзы, местоимения, частицы, вводные: около 250 русских и английских слов в нашем списке. У каждого сервиса список свой и обычно шире, поэтому чужие нормы к нашему проценту не применимы — сравнивайте свои тексты между собой.
Классическая тошнота
√(повторы самого частого слова). Определение Advego. Смысл в том, что она не падает с ростом объёма, в отличие от плотности: 16 повторов дают 4,00 и в статье на 500 слов, и в книге. Ориентир — не выше 7, то есть не больше 49 повторов одного слова.
Академическая тошнота
Доля самого частого значимого слова среди значимых. Включите «Скрыть служебные слова» — это процент в первой строке таблицы. Единой формулы у сервисов нет, поэтому публикуемые ими нормы вроде «5–15%» к другим инструментам не переносятся.
Водность по нашему списку Какой это текст
до 25% Плотный, терминологичный текст: инструкция, документация, спецификация.
25–35% Обычная статья или публицистика. Нормально.
35–45% Разговорный стиль: много вводных, «на самом деле», «в общем-то».
выше 45% Воды больше, чем смысла. Режьте вводные конструкции и связки.

Полосы измерены на текстах этого сайта: русские статьи дают 22–28%, английские — 33–43%, потому что в английском артикли и вспомогательные глаголы обязательны там, где русский обходится падежом. Сравнивать водность текстов на разных языках бессмысленно.

Что считается одним словом

Если два счётчика на одном тексте расходятся, причина почти всегда здесь. Наш разбивает текст по категориям Юникода, а дефис и апостроф считает соединителями.

Ввод Считается как Записи Почему
кто-то 1 слово кто-то Дефис соединяет, а не разделяет.
из-за 1 слово из-за То же правило: сложные предлоги остаются одной записью.
COVID-19 1 слово covid-19 Цифры — тоже символы слова; регистр сводится, пока не включён его учёт.
1 200,50 ₽ 3 слова 1 · 200 · 50 Знаки препинания разбивают числа. Перед анализом прозы цифры лучше убрать.
ещё · еще 2 слова ещё · еще «ё» и «е» — разные символы, а значит разные слова. Приведите текст к одному варианту.
ключ, ключа, ключом 3 слова ключ · ключа · ключом Словоформы не склеиваются — лемматизации нет, см. вопросы ниже.
naïve · Москва · 東京 3 слова naïve · москва · 東京 Разбор идёт по категориям Юникода, поэтому работают любые алфавиты.

Лемматизации нет сознательно: морфологический разбор русского требует словаря, спотыкается на омонимах («стекло» — существительное или глагол) и делает результат непроверяемым. Здесь считаются ровно те словоформы, которые вы написали.

Как это работает

  1. 1
    Вставьте текст Кликните на поле ввода и вставьте или наберите текст. Таблица частот и все показатели обновляются по мере ввода — кнопки «Проверить» нет и ничего никуда не загружается.
  2. 2
    Уберите лишнее Включите «Скрыть служебные слова», чтобы выбросить «и», «в», «что» и ещё около 250 предлогов, союзов и местоимений, или задайте минимальную длину слова. Останется лексика, которая несёт смысл.
  3. 3
    Смотрите колонку процентов Процент рядом со словом — это его плотность, доля от числа посчитанных слов. Для целевого ключа ориентир 0,5–2%.
  4. 4
    Выгрузите, если нужно дальше Кнопка «Скачать CSV» отдаёт файл, который открывается в Excel и Google Таблицах: кодировка UTF-8 с BOM, поэтому кириллица не превращается в кракозябры.

Ваши данные защищены

Всё обрабатывается прямо в вашем браузере. Никакие файлы или текст не отправляются на наши серверы. Отключите интернет — инструмент продолжит работать.

Часто задаваемые вопросы

Как проверить частотность ключевых слов в тексте?
Вставьте текст в поле выше — таблица покажет каждое слово, число повторов и его долю в процентах, отсортировав по убыванию частоты. Чтобы найти конкретный ключ, нажмите Ctrl+F: таблица — обычный текст на странице. Важно: речь именно о частоте слова в вашем тексте, а не о числе запросов в поиске.
Чем частотность в тексте отличается от частотности запроса в Вордстате?
Это два разных числа. Частотность запроса — сколько раз фразу вводили в Яндексе за месяц; такие данные есть только у поисковой системы, и берут их в Яндекс Вордстате. Частотность слова в тексте — сколько раз оно встречается в конкретном документе; это и считает эта страница. Для сбора семантики нужен Вордстат, для проверки готового текста на переспам — частотный анализ.
Что такое водность и как она здесь считается?
Водность — доля служебных слов (предлогов, союзов, местоимений, вводных) от общего числа слов. У нас это процент по списку примерно из 250 русских и английских служебных слов. У Advego и text.ru списки другие и заметно шире, поэтому их проценты с нашими напрямую не сравнивают — сравнивайте свои тексты между собой.
Что такое классическая тошнота и какая норма?
Классическая тошнота — квадратный корень из числа повторов самого частого слова, как её определяет Advego. У неё есть особенность: она не падает при росте объёма, поэтому её смотрят вместе с плотностью. Ориентир — не выше 7, то есть слово не должно встречаться больше 49 раз. Значение около 4 (16 повторов) спокойно для текста любой длины.
А академическая тошнота?
Это доля самого частого значимого слова среди значимых. Включите «Скрыть служебные слова» — процент в первой строке таблицы и будет ей. Единой формулы у сервисов нет: каждый считает по своему списку стоп-слов, поэтому чужие нормы вроде «5–15%» к нашему числу применять нельзя.
Какая плотность ключевого слова считается нормальной?
Порога, который публиковал бы Google или Яндекс, не существует — и не существует с апдейтов Panda и «Баден-Бадена». На практике 0,5–2% читается естественно, 2–3% уже ощущается как повтор, выше 3% выглядит как текст для робота. Проверять полезно в обе стороны: ключ, встретившийся один раз на 2000 слов, — такая же проблема, как ключ, встретившийся сорок раз.
Считает ли инструмент словосочетания из двух и трёх слов?
На этой странице считаются отдельные слова. Для биграмм и триграмм — двух- и трёхсловных сочетаний — и для вердикта по одному целевому ключу есть отдельный инструмент: «Проверка плотности ключевых слов».
Приводятся ли слова к начальной форме?
Нет. «Ключ», «ключа» и «ключом» считаются как три разных слова — лемматизации нет. Это сознательно: морфологический разбор русского требует словаря, ошибается на омонимах и делает результат непроверяемым. Поставьте минимальную длину 4–5 и читайте словоформы одного корня группой либо ищите по корню через Ctrl+F.
Что считается одним словом?
Любая последовательность букв или цифр, причём дефис и апостроф соединяют: «кто-то» и «из-за» — по одному слову, а не по два. Знаки препинания разделяют. Поддерживается весь Юникод, так что кириллица, латиница с диакритикой и иероглифы считаются одинаково корректно.
Учитывается ли регистр букв?
По умолчанию нет — «Текст» и «текст» считаются одним словом. Включите опцию учёта регистра, если считаете имена собственные или аббревиатуры отдельно от обычных слов.
Можно ли проанализировать чужую страницу?
Да — скопируйте основной текст страницы конкурента и вставьте сюда. Меню, боковые колонки и подвал захватывать не нужно: они повторяются на всём сайте и искажают любые подсчёты. Смотреть стоит на содержательные слова, которые есть у конкурента и которых нет у вас.
Есть ли ограничение на объём текста?
Жёсткого лимита нет. Подсчёт линейный, поэтому целый роман обрабатывается меньше чем за секунду. На экране показываются первые 200 строк таблицы, чтобы не утонуть в прокрутке, — в выгрузке CSV присутствуют все слова.
Покидает ли текст моё устройство?
Нет. Весь подсчёт выполняется в браузере на JavaScript. Ничего не загружается на сервер, не логируется и нигде не сохраняется — можно отключить интернет, и инструмент продолжит работать.

Из блога

Частотный анализ текста: частотность слов, водность и тошнота Частотность слова в тексте и частотность запроса — разные вещи. Разбираем плотность ключей, водность и классическую тошноту на примерах. Читать статью →

Похожие инструменты