Лучшего поиска вообще нет ни у одной платформы, потому что движки в этой нише ломаются по разным осям — а какой именно сбой вам мешает, целиком зависит от того, как вы ищете. Ответ, который чего-то стоит, — тот, который вы измерите сами, на тайтлах, которые действительно ищете, примерно за двадцать минут.

Дальше — устройство теста и, что важнее, как читать результаты. Промах может означать три совершенно разные вещи, и именно из-за их смешения большинство заявлений вида «на сайте X плохой поиск» неверны.

Сами мы этот замер по платформам не проводили, поэтому никаких баллов здесь нет. Есть метод, который даёт баллы, верные для вашего собственного применения, — а это единственная версия, которую вообще можно перенести.

Из чего этот тест состоит?

Возьмите от 10 до 20 кодов, о существовании которых вы уже знаете, прогоните каждый через поиск каждой платформы и запишите, что вернулось и во сколько шагов.

Состав набора важнее его размера. Набор, собранный только из свежих релизов крупных студий, скажет вам, что все платформы прекрасны, потому что это лёгкий случай, с которым справляется любой движок. Соберите набор так, чтобы в нём были трудные случаи:

Тип тестового элемента Сколько Что проверяет
Свежий релиз крупной студии 3 Базовый уровень — должно находиться везде
Пятилетней давности и старше 3 Держат ли каталог и индекс старый материал
Небольшой или нишевый лейбл 3 Покрытие за пределами мейнстрима
Имя актрисы, а не код 2 Индексация по людям и работа с псевдонимами
Название японским письмом, набранное как есть 2 Хранит ли индекс исходный текст названия
Название латиницей, без кода 2 Индексируются ли транслитерации вообще

По каждому пункту записывайте три вещи: появился ли нужный результат, был он в первых строках или закопан, и сколько кликов от строки поиска до страницы тайтла. Третий столбец обычно забывают, а именно в нём разница между платформами заметнее всего в повседневном пользовании.

Какие именно виды сбоев вы проверяете?

Промахнуться по тайтлу, который у движка есть, заставляют пять разных механизмов. У каждого свой симптом — потому тест и получается диагностическим, а не просто таблицей очков.

Нормализация кода. Коды в отрасли и по всему интернету пишут вразнобой — с дефисом и без, с ведущими нулями, с префиксом студии и без него. Движок либо приводит набранную вами строку к своему внутреннему виду, либо нет. Один этот механизм объясняет большинство сообщений «на одном сайте работает, на другом нет».

Письменность и транслитерация. Название существует японским текстом, а англоязычная аудитория набирает латиницу. Совпадёт ли эта латиница, зависит от того, хранит ли её платформа вообще и чью именно транслитерацию она хранит. Единственно правильной транслитерации не существует, поэтому здесь всё ломается молча и часто.

Работа с псевдонимами. Актрисы меняют сценические имена. Индекс, в котором псевдонимы описаны, вернёт всю карьеру по любому из имён; индекс с одним плоским полем имени вернёт ту половину, которую вы случайно набрали.

Строгость сопоставления. Движки с точным совпадением на почти-попадание не возвращают ничего. Нечёткие движки возвращают что-нибудь на что угодно, в том числе когда правильного ответа нет вовсе, — это другой сбой и, пожалуй, худший, потому что выглядит как успех.

Покрытие. Тайтла в этом каталоге попросту нет. Это вообще не сбой поиска, и засчитывать его как сбой — самая частая ошибка в таких сравнениях.

Как отличить промах поиска от промаха покрытия?

Проверьте тот же код на второй платформе, про которую вы точно знаете, что он там есть. Если там он находится, то у первой платформы его либо нет, либо она не может сопоставить ваш запрос — и эти два случая разводит ещё одна проверка.

Поищите тот же тайтл по другой зацепке: имени актрисы, названию серии у студии или характерному слову из названия. Если тайтл всплывает этим путём, каталог его содержит и сломался именно поиск по коду. Если он не всплывает никаким путём — это промах покрытия, и никакое качество поиска тут не помогло бы.

Симптом Что это говорит о движке
Код с дефисом не работает, без дефиса работает Ввод не нормализуется — подстраиваться под внутренний формат придётся вам
Нужный результат появляется, но стоит ниже посторонних тайтлов Сопоставление работает, ранжирование по релевантности слабое
По имени актрисы возвращается лишь часть известной фильмографии Работы с псевдонимами нет или она неполная
Японское название работает, латиница не возвращает ничего Индексируется только текст в исходном письме
Любой запрос возвращает правдоподобные результаты, в том числе бессмысленный Нечёткое сопоставление без порога уверенности — доверять нельзя ничему
Ничего не находится ни по коду, ни по имени, ни по слову Промах покрытия, а не сбой поиска
Результат найден, но до него четыре клика и больше Цена навигации, а не качество выдачи — записать всё равно стоит

Строку про бессмысленный запрос стоит подчеркнуть. Наберите код, которого не может существовать, — случайный префикс и номер. Движок, который вернёт на него уверенно выглядящую выдачу, поступит так же, когда вашего настоящего запроса в каталоге не окажется, и отличить одно от другого вы уже не сможете.

Что делать с платформой, которая плохо ищет?

Сначала поменяйте формат запроса, а не платформу — большинство этих сбоев лечится с вашей стороны.

  • Пробуйте все варианты кода. С дефисом и без, с ведущими нулями и без, только префикс. Три попытки стоят десяти секунд и снимают самый частый сбой.
  • Ищите актрису вместо тайтла. Навигация по людям обходит нормализацию кода целиком.
  • Пользуйтесь исходным японским текстом, если он у вас есть. Копируйте его из карточки базы данных, а не набирайте латиницу.
  • Ищите характерный кусок строки, а не название целиком. Длинные точные строки рассыпаются из-за одного символа, редкий фрагмент — обычно нет.

Если текста у вас нет вообще — только скриншот и ничего больше, — то ни одна строка поиска ни на одной платформе не подходит, потому что все они требуют строку, которой у вас нет. Это другая задача с другим методом: как найти видео по одному скриншоту.

Как читать собственные результаты?

Читайте тест как профиль, а не как рейтинг. Нужен вывод вида «платформа A хорошо держит старые тайтлы и коверкает имена актрис; у платформы B наоборот» — потому что он подсказывает, какую открывать под какой запрос, а именно так люди и пользуются несколькими платформами сразу.

Два честных ограничения. Пятнадцать элементов — диагностическая выборка, а не статистическая, так что не превращайте её в проценты. И набор собран из ваших собственных интересов, поэтому результат верен для вас и не обобщается — ровно поэтому опубликованный универсальный рейтинг вам бы и не помог.

Похожие вопросы


Платформы, которые мы индексируем, и то, что в них есть, перечислены на нашей странице сайтов.