У вас есть один кадр — и ни названия, ни кода, ни имени файла. Рабочий путь состоит не в том, чтобы искать картинку, а в том, чтобы искать лицо внутри картинки, а затем идти от актрисы к тайтлу.

В этой перестановке и заключается весь метод. Скриншот — уникальное изображение, которого больше нигде в сети нет, поэтому как картинка он ни с чем не совпадёт. Лицо же встречается на сотнях обложек и кадров, и его можно математически сравнить со всеми ними.

Что на самом деле должно быть на скриншоте?

Одно лицо, видимое и не слишком отвёрнутое от камеры. Всё остальное необязательно.

Распознавание лиц работает так: находит опорные точки — центры глаз, кончик носа, уголки рта — и по ним выпрямляет лицо в стандартную позу перед кодированием. Если эти точки скрыты, выравнивать нечего, и конвейер останавливается ещё до того, как сопоставление вообще начнётся.

Элемент кадра Влияние на поиск по лицу
Лицо анфас или слегка под углом Лучший случай — все опорные точки видны
Резкий профиль (поворот больше ~45°) Детекция может сработать, но сопоставление резко ухудшается
Лицо частично закрыто рукой, волосами или предметом Обычно детекция не срабатывает
Сильный смаз от движения Опорные точки становятся ненадёжными
Очень мелкое лицо (несколько десятков пикселей в ширину) Слишком мало деталей, чтобы осмысленно закодировать
Фон, комната, мебель Игнорируется полностью — не даёт ничего
Надписи на экране, логотипы, таймкоды Игнорируются на шаге с лицом, но пригодятся вам позже

Две последние строки людей удивляют. Поиск по лицу намеренно выбрасывает фон. Поэтому в остальном «плохой» скриншот — тёмная комната, захламлённый кадр — всё равно может отработать идеально, лишь бы лицо было чистым.

Какие шаги и в каком порядке?

  1. Поставьте на паузу там, где лицо хорошо видно. Лучше момент, когда актриса смотрит в сторону камеры. Перемотать на несколько секунд вперёд почти всегда дешевле, чем потом спасать неудачный кадр.
  2. Снимите кадр в исходном разрешении. Скриншот плеера, а не фотография экрана. Не обрезайте до крошечного квадрата — детектор обрежет сам.
  3. Загрузите его и дайте отработать детекции. Детекция здесь происходит в вашем браузере: изображение анализируется локально, а дальше уходят только обрезанная область лица и координаты пяти опорных точек.
  4. Выберите нужное лицо, если найдено несколько. Групповые сцены дают несколько детекций. Неверный выбор молча уводит вас не туда.
  5. Читайте баллы сходства, а не только порядок. Ранжированный список всегда что-то возвращает. Значит ли это хоть что-нибудь, говорит балл.
  6. Сверьтесь с известными тайтлами актрисы. Получив имя, сопоставьте особенности вашего кадра — длину волос, одежду, обстановку, татуировки или пирсинг, любые видимые надписи — с обложками и кадрами.

Шаг 6 — тот самый, который пропускают, и именно оттуда берётся большинство неверных ответов. Поиск по лицу даёт вам человека, а не тайтл. Тайтл — это уже ваш вывод, и ему нужно второе доказательство.

Как читать балл сходства?

Векторы лиц сравниваются по косинусной близости — числу от 0 до 1. На наших данных порог, откалиброванный для кадров из видео, равен 0.40: выше него два лица считаются, вероятно, одним человеком.

Диапазон балла Как к нему относиться
Ниже 0.40 Ниже порога. Считайте, что совпадения нет, каким бы правдоподобным оно ни выглядело
0.40 – 0.50 Слабо. Нужно независимое подтверждение, прежде чем на это опираться
0.50 – 0.65 Разумно. Всё же стоит проверить по второму изображению того же человека
Выше 0.65 Сильно. Обычно это один человек, если кадр не испорчен

Результат с 0.42 и результат с 0.85 выглядят в списке одинаково, а означают совершенно разное. Любой инструмент, скрывающий балл, скрывает ровно ту часть, по которой вы и должны судить.

Почему индекс важнее алгоритма?

Потому что лицо, которое никогда не индексировали, вернуться не может, каким бы хорошим ни было сравнение.

В нашем индексе 241,792 лица и 2,333 актрисы с именем, собранные с обложек и кадров со 106 сайтов (наш индекс, срез 2026-08). Этого материала попросту нет в универсальном индексе изображений — вот почему универсальные инструменты не возвращают ничего полезного независимо от качества их инженерии.

Границу стоит проговорить прямо: наш охват неравномерен. Из 2,333 названных по имени актрис у 2,246 репрезентативное изображение взято с одного сайта. Это реальный перекос. Тайтл из каталога, который мы не индексировали, или актриса, никогда не появлявшаяся на покрытых нами источниках, найдены не будут — а инструмент всё равно покажет вам ранжированный список почти-попаданий. Именно чтение баллов от этого и защищает.

Что делать, если ничего правдоподобного не вернулось?

Меняйте вход, а не инструмент. В порядке того, как часто это помогает:

  • Попробуйте другой кадр. Второй скриншот с другого момента той же сцены — самый результативный шаг из всех.
  • Попробуйте другого человека в сцене, если он там не один.
  • Поищите код на экране. Во многие релизы идентификатор впечатан в заставку, в кадр с обложкой или в водяной знак. Код превращает задачу про изображение в текстовый поиск.
  • Допустите, что записи просто нет. У любительских заливок, очень старых релизов и материала из неиндексированных каталогов записи может действительно не быть.

Похожие вопросы


Если кадр у вас уже открыт, загрузите его здесь и посмотрите, что вернётся. Детекция идёт в вашем браузере: исходный скриншот не покидает ваше устройство, на сопоставление уходит только обрезанная область лица, и после ничего не сохраняется.