Оценка сходства — это косинусная близость двух векторов лица, то есть двух списков из 512 чисел, и меняется она от 0 до 1. В нашем индексе 0.40 — та точка, выше которой пара считается, вероятно, одним и тем же человеком. Это не процент, не уверенность и не вероятность. Это угол.
Число важно из-за того, о чём большинство инструментов поиска по лицу вам не говорит: плотный векторный поиск никогда не возвращает пустоту. Попросите у него десять результатов — получите десять, независимо от того, есть ли нужный человек в индексе вообще. Оценка — единственное, что отделяет ответ от ближайшего доступного незнакомца.
Что именно измеряет эта оценка?
Косинусная близость измеряет угол между двумя векторами, не обращая внимания на их длину. Два лица, закодированные в 512-мерные векторы, «похожи», когда их векторы смотрят почти в одну сторону.
Кодировщик — в нашем случае ArcFace — обучен так, чтобы изображения одного и того же человека давали векторы, смотрящие в одну сторону, а изображения разных людей — векторы, смотрящие врозь. Поза, освещение, фон и причёска по большей части отбрасываются на этапах детекции и выравнивания, ещё до того, как кодировщик увидит лицо.
Поэтому оценка и ведёт себя не так, как зрительное впечатление. Две фотографии, которые вам кажутся похожими, могут дать низкую оценку; две фотографии, не похожие вообще ничем — другой свет, другое десятилетие, другие волосы, — могут дать высокую.
Как читать каждую полосу оценок?
Считайте оценку полосой, а не приговором. Вот рабочие полосы, которыми мы пользуемся на своих данных.
| Оценка | Как читать | Что с этим делать |
|---|---|---|
| 0.70 и выше | Очень вероятно один и тот же человек | Считайте совпадением; страницу-источник всё равно проверьте |
| 0.55 – 0.70 | Вероятно один и тот же человек | Совпадение, но сверьтесь со вторым изображением |
| 0.40 – 0.55 | Выше порога, но слабо | Правдоподобно; так выглядит и неудачный ракурс, и двойник |
| 0.25 – 0.40 | Ниже порога | Сходство, а не тождество |
| Ниже 0.25 | Ближайший доступный вектор | Не говорит ни о чём, кроме того, что индексу надо было что-то вернуть |
Строки ниже 0.40 люди читают неверно чаще всего. Результат 0.31 — это не «шанс 31%». Это система сообщает вам, что вашего человека у неё нет, и показывает то, что есть.
Источник: наш индекс, срез 2026-08. Полосы — рабочие эвристики для чтения собственных результатов, а не опубликованный бенчмарк.
Зачем вообще нужен порог?
Затем, что порог превращает непрерывное расстояние в решение «да/нет», а всякое такое превращение меняет один вид ошибки на другой.
Опустите порог — вернёте больше настоящих совпадений, снятых под трудным углом или убитых сжатием, но впустите и больше посторонних лиц. Поднимите — то, что останется, будет чище, зато настоящие совпадения с профильного кадра или низкобитрейтного стрима вылетят из списка совсем.
Настройки, убирающей обе ошибки, не существует. 0.40 стоит там, где стоит, потому что типичный запрос у нас — кадр из видео: сжатый, смазанный движением, редко анфас, часто мелкий. Порог, настроенный на чистых студийных портретах, был бы выше и отсекал бы большинство реальных запросов.
Почему один и тот же человек получает разные оценки на разных фото?
Потому что кодировщик отбрасывает позу и свет несовершенно, а каждая потеря качества между камерой и вашим скриншотом сдвигает вектор.
| Условие | Влияние на оценку |
|---|---|
| Анфас, резко, хорошо освещено | Самые высокие оценки; лучший случай для кодировщика |
| Голова повёрнута дальше трёх четвертей | Существенное падение; часть лица просто отсутствует |
| Сильное сжатие видео, низкий битрейт | Падение; блочные артефакты съедают мелкие детали лица |
| Лицо мелкое в кадре | Падение, а детекция может не сработать ещё до кодирования |
| Перекрытие — рука, волосы, предмет поперёк лица | Точки съезжают, выравнивание перекашивает, вектор неверен |
| Годы между двумя изображениями | Умеренное падение; сигнал личности сохраняется, но слабеет |
| Косметические операции, заметная смена веса | Настоящие совпадения могут уйти ниже порога |
| Макияж, причёска, цвет волос | Влияет мало; выравнивание отрезает почти всё это |
Последняя строка людей удивляет, а предпоследняя расстраивает. Волосы почти бесплатны; изменившееся лицо — нет.
Почему не стоит доверять инструменту, который прячет оценку?
Потому что, пряча оценку, он прячет разницу между совпадением и догадкой, а эта разница и есть весь результат.
Ранжированный список без оценок выглядит одинаково, стоит ли первый результат на 0.85 или на 0.19. Оба отрисуются как «вот ваше ближайшее совпадение». Осмысленный из них только один. Инструмент, который показывает десять лиц и ни одной цифры, взял самое информативное поле и убрал его — причём ровно в той ситуации, где система гарантированно выдаёт результат независимо от истины.
Честный результат поиска по лицу содержит три вещи: оценку, порог, по которому её судят, и ссылку на изображение-источник, чтобы вы могли проверить своими глазами. Если чего-то из трёх нет, ответ не проаудировать.
Данные и метод
Источник. Векторы лиц, посчитанные по обложкам и кадрам, проиндексированным starlikeness со 106 сайтов.
Выборка. 241,792 вектора лиц в индексе; 2,333 записи об идентичности с привязанным именем (наш индекс, срез 2026-08).
Метод. Детекция через YuNet, дающая рамку и пять лицевых точек. Выравнивание к канонической позе по этим точкам. Кодирование через ArcFace в векторы размерности 512. Поиск по косинусной близости по всему индексу. Порог 0.40 откалиброван для запросов-видеокадров против этого индекса.
Дата среза. 2026-08.
Известное смещение. Охват сильно сконцентрирован. 2,246 из 2,333 названных по имени берут репрезентативное изображение с одного сайта, и лишь малое меньшинство из 106 проиндексированных сайтов вообще несёт японские идентификаторы контента. То, что мы измеряем, — это представленность на сайтах-агрегаторах, а не объём выпуска. Актрису, чьи работы попадают только на сайты, которые мы не индексировали, найти не удастся, и никакая оценка вам об этом не скажет — поиск всё равно вернёт десять ближайших незнакомцев.
Границы порога. 0.40 относится к этому кодировщику и этому индексу. Он не переносится ни на другой инструмент, ни на другую модель, ни на другой тип изображения-запроса. Всякое утверждение, будто оценка «означает» фиксированную вероятность тождества, — преувеличение: одно и то же число весит по-разному в зависимости от качества запроса.
Цитирование.
starlikeness (2026). "What Does a Similarity Score of 0.40 Mean?"
Face index, 2026-08 snapshot (n=241,792 faces; 2,333 named identities).
https://starlikeness.com/ru/articles/what-similarity-score-means
Похожие вопросы
- Как работает поиск по лицу, шаг за шагом
- В нашем индексе 589 человек без имени
- Какую часть индустрии мы вообще видим?
- Откуда берутся наши данные и чего в них нет
- Почему обратный поиск Google не работает для видео для взрослых
Порог можно увидеть в работе: загрузите кадр и читайте оценки рядом с лицами. Детекция идёт у вас в браузере, на сопоставление уходит только вырезанная область лица, а оригинал не покидает ваше устройство.