Семантическая кластеризация

Большой список ключей разбивается на смысловые группы: похожие по идее фразы оказываются в одном кластере, даже если слова разные. Работает на сервере, без опроса выдачи.

Как пользоваться

Инструмент группирует большой список запросов по смыслу, а не по пересечению выдачи. Похожие по идее фразы оказываются в одном кластере, даже если слова разные. Например «купить бу айфон» и «приобрести подержанный телефон apple».

  1. Вставьте ключи текстом (каждый с новой строки) или прикрепите .xlsx, .csv, .txt, .docx.
  2. Выберите режим группировки: насколько близкими должны быть фразы в одной группе.
  3. Запустите. Расчёт идёт на сервере, без опроса выдачи и без платных сервисов.
  4. Опционально опишите нишу: появятся понятные названия групп и типы запросов.
  5. Скачайте Excel: лист «Запросы» и сводка «Группы».

Для разбивки по словам и очистки ядра по формам используйте «Лемматизатор ключей и текста». Для группировки по пересечению выдачи используйте «Кластеризация ключей».

Список запросов

Текст или файл · до 300 000 за раз

Загружено: 0 запросов

Как объединять запросы

Порог косинусного сходства векторов — чем выше, тем строже кластеры

Названия групп и интенты (необязательно)

Нужна локальная Ollama. Без этого шага кластеризация идёт только по эмбеддингам

Лимит: 200 задач/мес · до 300 000 фраз

Добровольно

Поддержать Tomhub

Если Tomhub полезен, можно перевести любую сумму через СБП. Это помогает развивать сервис.

QR-код для перевода через Систему быстрых платежей
Оплата через СБП
  1. Откройте приложение своего банка
  2. Выберите оплату по QR или СБП
  3. Наведите камеру на код и укажите сумму

Служба поддержки

Идея, баг или чего не хватает

Создаём тикет: вы увидите ответ в личном кабинете и на почте. До 3 скриншотов (2 МБ).

Скриншоты

Отправляя данные, вы соглашаетесь с обработкой персональных данных согласно Политике конфиденциальности.