История компании
Семён Ядрен — агентство семантики. С 2013 года мы собираем семантические ядра под ключ: разбираем тематику до последнего поискового запроса, группируем запросы по смыслу и разносим по будущим страницам сайта.
Делать это руками долго, а доверить машине целиком рискованно. Между двумя этими крайностями мы и строим свою серверную систему сбора семантики. Ниже — путь агентства по датам.
1 мая 2026
Начали разработку сервиса, который превращает готовое семантическое ядро в контент. На вход идут кластеры и данные из ТЗ копирайтеру, на выходе — структура текста для каждой страницы, сам текст по этой структуре, кликбейтные мета-теги под содержимое страницы и CTA-блоки, уводящие трафик со статей на близкие коммерческие страницы.
Отдельный модуль проверяет уже написанное. ContentEffortScore показывает, сколько реальной работы вложено в статью и насколько полно раскрыта тема, OriginalContentScore — насколько текст самостоятелен на фоне поисковой выдачи. Всё это работает на передовых языковых моделях, но отталкивается от нашей семантики: нейросеть без реального спроса из поиска пишет красиво и мимо.
2 февраля 2024
Переработали внешний вид семантического ядра и добавили новые отчёты. Вся работа теперь идёт вокруг файла «yadro.xlsx»: вкладка «Семантическое ядро» с кластерами, параметрами и конкурентами, вкладка «Структура» с покластерным анализом под архитектуру сайта, «ТОП доменов» с прямыми конкурентами и оценкой сложности ниши, «Близкие кластеры» с рекомендациями по перелинковке и защитой от каннибализации.
Появилась карта релевантности: она показывает, какая страница сайта уже отвечает за какой кластер и где трафик уходит конкурентам. Добавились сезонность спроса, лидеры в ТОПе и ещё несколько отчётов — всего в архиве их стало 12, под SEO, контекстную рекламу и работу с нейросетями.
15 августа 2022
Выпустили ТЗ копирайтеру TaskBilder, над которым работали больше двух лет. Excel-часть собирает 17 параметров и 34 варианта подсказок: анализ поисковой выдачи и страниц конкурентов, до 200 запросов из кластера, подсветки, подсказки и «Люди ищут», LSI-фразы из текстов и сниппетов, расчёт вхождений и коэффициент сложности вывода статьи в ТОП.
Вторая часть — формат *.tskb и десктопная программа «ПланМейкер». Она подтягивает структуры h1–h6 и тексты всех близких конкурентов, помогает собрать собственный план статьи и подготовить текст на рерайт из лучших фрагментов. Одно задание стоит 0,25$ и экономит до 7$ против ручной подготовки. Полностью автоматически составить ТЗ нельзя, но можно перестать бегать по десятку сервисов.
10 июля 2019
Система научилась видеть за запросом не только смысл, но и интент — то, что человек на самом деле хочет сделать. Отсюда вырос коэффициент коммерческости: шкала от 0 до 1, которая по 14 факторам считает, сколько коммерческих документов держит ТОП-10 Яндекса. Ноль означает, что с коммерческой страницей туда лучше не соваться, единица — что информационной статье там делать нечего.
Тем же летом запустили поиск каннибалов на моделях дистрибутивной семантики: система сравнивает фразы по их окружению в текстах и находит страницы, которые дерутся за один интент. Такая каннибализация ключевых слов годами съедает позиции, и до этого ловить её приходилось вручную.
Третье событие года — модуль «HandControl24» и собственный отдел контроля качества. Теперь ни одно ядро не уходит клиенту, пока отдельный семантист не пересмотрит глазами каждую группу запросов и не почистит то, что алгоритм увидеть не мог. Плюс 2–3 дня к срокам и заметно другое качество на выходе.
27 февраля 2018
Взялись за техническое задание для копирайтера. В ТЗ копирайтеру добавили блок «О чём писать статью» с четырьмя вариантами формулировки на выбор и семантически близкие слова из подсветок и подсказок поисковой выдачи. Копирайтер стал получать не голый список ключей, а словарь темы — те слова, которыми о ней говорит сам поиск.
30 апреля 2016
Алгоритм кластеризации запросов переписали с нуля, и разгруппировка при качественном сборе поднялась до 90–95%: почти все фразы находят свою страницу. Точнее заработало определение вида запроса. А в шаблоне ядра появились быстрые ссылки между структурой семантического ядра и группами страниц, и навигация по большому файлу перестала быть квестом.
4 июня 2015
Ядро перестало быть просто таблицей с группами. «Коэф. внедрения» выстроил группы от самых перспективных к остальным — сразу видно, с чего начинать работу над сайтом. Рядом появились вкладка «Структура» со всей структурой семантического ядра, вкладка «Описание полей», ссылки на файлы ТЗ прямо из ядра, объявления конкурентов из Яндекс.Директа и алгоритм, который сам размечает тип запроса: коммерческий, информационный или неопределённый.
Тогда же серверная система сбора семантики научилась работать с ядрами любого размера. Ядра от 50 000 фраз она делит на тематические разделы, после группировки ключевых слов прогоняет три автоматические пост-проверки, а после постмодерации семантистом пересобирает ядро заново. Эти проверки до сих пор экономят клиентам бюджет и поднимают качество финального ядра.
24 сентября 2014
Пересобрали поиск самых видимых конкурентов: вместо простой формулы система стала учитывать частотность фразы в группе и позицию документа в ТОП-50. Появился «Коэф. авторитетности» — он показывает, насколько один URL важнее остальных в группе. А в расчётах для копирайтера среднее значение заменили медианой, и шумы перестали портить ТЗ.
Ядро обросло данными для контекстной рекламы: конкуренция и цена клика из Google Adwords, прогноз бюджета, показы, CTR и CPC из Яндекс.Директа, реальные объявления конкурентов по каждой фразе. Плюс столбцы «Наш Title», «Наш H1», «Наш Description» и журнал работ — вся работа над страницей стала жить в одном файле.
8 мая 2014
Экспорт ядра в xls полностью ушёл из рук семантиста: всё считает и оформляет система. Вторая половина обновления — сбор и анализ конкурентов: десять самых видимых URL по всей группе фраз вместе с содержимым их тегов. Ядро начало отвечать не только на вопрос «что писать», но и «против кого».
10 апреля 2014
Скорость группировки ключевых слов выросла в 30 раз, до 0,01–0,07 секунды на группу даже на ядре в 30 000 фраз. Появилась предпроверка, которая сама находит фразы без связей и предлагает отправить их в мусор.
Добавились две пост-проверки, которые до сих пор экономят семантистам часы: система сравнивает связи каждой фразы с каждой внутри группы и опускает подозрительные вниз списка, а для «залётных» запросов сама подсказывает более подходящую группу.
8 марта 2014
Система научилась пересматривать собственные решения: уже сгруппированные фразы можно прогнать заново в поисках более подходящей группы. Тогда же уточнили логику группировки по ТОПу — если фразы пересекаются в ТОП-10, их связь умножается на коэффициент. Стоять рядом в первой десятке значит куда больше, чем встретиться где-то в ТОП-50.
10 января 2014
Главный разворот в нашей истории: идеологию группировки полностью переписали с автоматической на полуавтоматическую. У семантиста появился контроль на всех этапах, вплоть до нижнего порога связей, ниже которого фразы просто не попадают в одну группу.
Тогда же добавился выбор поисковой системы для группировки — Яндекс, Google или обе сразу — и история группировок по проектам и фразам.
10 мая 2013
Точка отсчёта. Мы запустили первую бета-версию собственного кластеризатора семантического ядра: он сам разносил поисковые запросы по группам, определял главную фразу каждой группы, находил самых видимых конкурентов и уже тогда формировал задание копирайтеру.
Но у него был минус, который нельзя было исправить на автомате: система на 100% полагалась на поисковую выдачу, а выдача не идеальна. На части тематик группировка ломалась. Отсюда родилось решение, определившее всё дальнейшее развитие агентства, — перевести систему в полуавтоматический режим и оставить последнее слово за семантистом. Первые тесты прототипа дали улучшение группировки на 20–40%. С этого и начался «Семён Ядрен», которого вы знаете сегодня.
История продолжается: страница обновляется по мере развития агентства.
