Техническое задание на текст
Инструмент собирает техническое задание на текст по целевому запросу и списку конкурентов из выдачи. Он загружает страницы топа, снимает с них метатеги, заголовки, вопросы и наполнение, считает частоты слов и сводит это в один документ: что писать, какого объёма, в каком порядке и с какими словами. Готовое ТЗ выгружается в Word или Markdown и отправляется автору как есть.
Что попадает в ТЗ
- Метатеги - три варианта title, H1 и description с длинами и замечаниями проверки.
- Объём текста - диапазон в словах от медианы топа и рекомендованное число заголовков.
- Структура - разделы H2 и H3 в порядке следования у конкурентов, с покрытием по сайтам.
- Обязательные слова - с рекомендованным числом вхождений, разбросом по топу и вашим текущим значением.
- Словосочетания и темы - устойчивые пары слов и термины с наибольшим весом BM25.
- Пробелы - разделы и слова, которые есть у топа и отсутствуют у вас.
- Вопросы для FAQ - собранные из блоков вопросов и микроразметки конкурентов.
- Оформление - сколько таблиц, списков и изображений держит топ.
Почему это один прогон, а не три
Метатеги, структуру и семантику можно собрать и по отдельности - для этого есть три самостоятельных инструмента. Разница в стоимости работы: каждый из них загружает свои страницы отдельно, то есть один и тот же топ выкачивается трижды, а страницы, которые приходится досматривать браузером, открываются заново каждый раз. Здесь загрузка происходит один раз, и уже загруженный код страницы уходит во все три разбора. Для пользователя это заметно по времени: полный отчёт собирается примерно за то же время, что раньше занимал один из трёх.
Второй эффект - согласованность. Когда отчёты собирались порознь, они могли разойтись: в одном отсеялась страница-заглушка, в другом она осталась и тянула вниз медианы. В одном прогоне набор конкурентов общий для всех разделов ТЗ, и цифры в разных блоках относятся к одному и тому же списку страниц.
Откуда берутся числа по словам
Сначала тексты конкурентов приводятся к начальным формам слов, отбрасываются служебные части речи и навигационный мусор. Дальше по корпусу считается, у скольких страниц встречается слово и с какой плотностью. В задание попадают слова, которые есть минимум у половины конкурентов - единичное употребление на одном сайте темой не является.
Рекомендованное число вхождений считается не как «среднее у конкурентов», а как медианная плотность, пересчитанная на целевой объём текста. Поэтому рекомендация бывает выше, чем фактические значения у топа: их статьи короче целевой. Рядом всегда показан разброс - минимум и максимум по конкурентам, чтобы было видно, насколько тема вообще устойчива. Если ваших вхождений больше, чем у самого плотного конкурента, слово помечается как перебор: добивать его дальше вредно.
Важная оговорка: плотность, тошнота и подобные метрики не являются факторами ранжирования. Это ограничители, которые показывают границу переспама. Смысл списка слов в другом - он показывает, какие темы топ считает обязательными для ответа на запрос, и охват этих тем важнее точного попадания в число.
Как пользоваться
- Укажите целевой запрос - тот, под который пишется текст.
- Вставьте адреса конкурентов из выдачи по этому запросу, каждый с новой строки (до 20).
- Если страница уже существует, добавьте её адрес - появятся колонки сравнения и списки пробелов.
- Нажмите «Собрать ТЗ» и дождитесь окончания: страницы загружаются, разбираются и сводятся в документ.
- Проверьте блок состава страниц: если в расчёт вошло меньше половины адресов, добавьте ещё конкурентов.
- Скачайте ТЗ в Word или Markdown и передайте автору.
Сборка метатегов и плана языковой моделью доступна пять раз в сутки с одного адреса. Остальные расчёты работают без ограничений: когда лимит исчерпан, задание собирается по правилам и в отчёте появляется отметка об этом.
Частые вопросы о составлении ТЗ на текст
Тем, что это один прогон вместо трёх. Раньше, чтобы собрать ТЗ, приходилось прогнать те же адреса через проверку метатегов, анализ структуры и семантический анализ, а потом сводить три отчёта руками. Здесь страницы конкурентов загружаются один раз, и один и тот же исходный код уходит во все три разбора сразу. На выходе не три отчёта, а готовый документ: метатеги, объём, план по разделам, список слов, вопросы для FAQ и требования к оформлению. Отдельные инструменты никуда не делись - они удобнее, когда нужен только один срез.
Нет. Без неё ТЗ собирается «с нуля»: объём, структура, слова и вопросы берутся по конкурентам - это обычный случай, когда статьи ещё нет. Если адрес указать, добавятся колонка «сейчас» у каждого слова, список разделов и слов, которых у вас нет, и сравнение по релевантности запросу. Мы намеренно не подставляем нули вместо отсутствующих данных: ноль вхождений и отсутствие страницы - разные вещи, и путать их в техническом задании нельзя.
Из плотности слова у конкурентов, пересчитанной на целевой объём текста. Берётся медианная плотность по топу и умножается на рекомендованный объём - поэтому рекомендация может быть выше, чем фактическое число вхождений у конкурентов: их тексты бывают короче целевого. Это ориентир, а не норма: охватить все слова из списка важнее, чем добить счётчик по одному конкретному. Верхняя граница тоже показана - если вхождений больше, чем у самого «плотного» конкурента, слово помечается как перебор.
Потому что знаки считаются по-разному: с пробелами, без пробелов, с учётом или без учёта таблиц и подписей. Слова однозначнее и ближе к тому, как объём обсуждают с автором. Медиана берётся по основному тексту конкурентов - без меню, подвала и сайдбара. Диапазон в ТЗ даётся от медианы минус десять процентов до плюс пятнадцати: попадание в него важнее точного числа, потому что топ по объёму всегда разбросан.
Составляет языковая модель, а формулы поставляют ей факты и потом проверяют результат. В запрос уходит ядро слов из тайтлов конкурентов с долями, целевые длины, заголовки и описания из выдачи и специфика вашей страницы. Ответ проверяется автоматически: длина в символах, наличие ключевых слов, отсутствие клише и длинного тире, а также то, не обещает ли заголовок того, чего на странице нет. Все замечания показываются под вариантом - их видно, а не прячут. Если модель недоступна или суточный лимит исчерпан, метатеги не выдумываются: показывается ядро слов и целевые длины.
Раздел встречается меньше чем у половины разобранных конкурентов. Такие темы попадают в план, но помечаются: они могут быть удачной находкой одного сайта, а могут быть его частной рубрикой, которая вам не нужна. Разделы без пометки есть у половины топа и больше - их отсутствие обычно и есть тот самый пробел. Рядом с каждым разделом указано, у скольких конкурентов он встретился, поэтому решение остаётся за вами, а не за инструментом.
Причин несколько, и все они показаны отдельно с формулировкой. Страница могла не открыться: закрыта от автоматических запросов, ответила ошибкой или не уложилась в таймаут. Могла открыться с кодом 200, но отдать заглушку, капчу или «проверку браузера». Могла оказаться не той страницей - лентой раздела вместо статьи, и тогда её выдаёт лексика, не совпадающая с остальным топом. Отсеянные адреса не исчезают: их состав виден в таблице внизу серой строкой, потому что страница всё равно стоит в выдаче и фильтр мог ошибиться.
Частично. Сначала страница загружается обычным запросом, и если в ответ пришла пустая оболочка или проверка браузера, она досматривается headless-браузером - на это уходит дополнительное время, поэтому в статусе появляется отдельная строка. Так открываются, например, страницы, которые рисуют контент скриптом уже после загрузки. Часть сайтов не открывается всё равно: некоторые крупные ресурсы режут запросы с серверов дата-центров независимо от того, чем и как их запрашивать.
Word, Markdown или таблицей. Файл Word собирается на сервере из того же документа, что вы видите на странице, - с заголовками, таблицами слов и требованиями, его можно сразу отправить автору. Markdown удобен, если ТЗ пойдёт в Google Docs, в задачу или в запрос к нейросети. CSV и Excel выгружают табличную часть: слова с рекомендациями и план разделов. Все выгрузки берутся из одного и того же посчитанного отчёта, поэтому расхождений между тем, что на экране, и тем, что в файле, нет.
До двадцати конкурентов плюс своя страница. Десяти адресов хватает, чтобы увидеть консенсус топа; двадцать берут, когда выдача разнородная - например, вперемешку калькуляторы и статьи - и по десяти страницам картина не складывается. Сборка метатегов и плана языковой моделью доступна пять раз в сутки с одного адреса - это ограничение платного внешнего сервиса. Всё остальное работает без ограничений: разбор структуры, подсчёт слов, плотностей, вопросов и блоков оформления считается формулами на нашем сервере. Когда лимит исчерпан, инструмент не отказывает, а собирает ТЗ по правилам и честно пишет об этом в отчёте.
Комментарии