Entity Recognition
Entity Recognition — это задача обработки естественного языка, в ходе которой система автоматически находит в тексте упоминания сущностей (людей, организаций, товаров, географических объектов, дат, брендов) и относит каждое из них к определённой категории. В SEO-контексте распознавание сущностей позволяет поисковикам и языковым моделям понимать, о чём именно страница, а не просто какие ключевые слова на ней встречаются. Например, фраза «Apple выпустила новый iPhone в Купертино» содержит три сущности: организацию, продукт и локацию — и алгоритм должен разметить их корректно, не спутав компанию с фруктом.
Как работает распознавание сущностей
- Токенизация: текст разбивается на отдельные слова и словосочетания.
- Классификация: модель присваивает каждому токену метку — PERSON, ORG, PRODUCT, LOC, DATE и другие.
- Разрешение неоднозначности: определяется, что именно означает упоминание в данном контексте (например, «Мир» — это бренд, город или понятие).
- Связывание: сущность сопоставляется с записью в базе знаний — так работает entity linking.
Современные поисковые системы строят вокруг сущностей целые графы знаний, поэтому страница, где чётко названы объекты, бренды и их свойства, получает преимущество. Чтобы усилить этот сигнал, полезно провести SEO-аудит сайта и проверить, насколько корректно размечена структура материалов.
Зачем это нужно в SEO и GEO
- Поисковики лучше понимают тематику страницы и точнее ранжируют её по смысловым запросам.
- Языковые модели (ChatGPT, Gemini, Perplexity) охотнее цитируют контент с явными, однозначными сущностями.
- Снижается риск каннибализации запросов: разные сущности разводят страницы по смыслу.
- Упрощается построение семантического ядра вокруг реальных объектов, а не только ключевых фраз.
На практике это означает, что в текстах стоит явно называть бренды, продукты, модели, локации и годы — так, как их распознаёт алгоритм. Для проектов, ориентированных на выдачу с ИИ-ответами, помогает GEO продвижение: оно опирается именно на сущностную структуру контента.
Типичные ошибки
- Переспам ключевыми словами без указания конкретных сущностей.
- Неоднозначные названия без контекста — модель не может отнести их к нужной категории.
- Отсутствие структурированной разметки (Schema.org, микроразметка Organization, Product, Person).
- Разные написания одного и того же объекта на сайте — это мешает entity disambiguation.
Распознавание сущностей тесно связано с Named Entity Recognition (NER) и лежит в основе Entity SEO. Чем последовательнее вы описываете объекты, их свойства и связи, тем выше шанс, что поисковик или ИИ-ассистент выберет именно ваш материал как источник. Связанные темы: Brand Entity, Entity Salience.
