ОТКРЫТАЯ МЕТОДИКА · DSP 0.2.0

Что мы можем измерить

«Голос» разделяет акустику, выполнение упражнения и предпочтение слушателей. Психологические выводы и универсальный балл красоты не вычисляются.

Личный паспорт

ПоказательСмысл и ограничения
ВысотаYIN, моно 16 кГц, кадр 1024 отсчёта, шаг 20 мс, 65–1000 Гц.
Диапазон5-й и 95-й процентили высот в этом дубле. Не полный диапазон певца и не классификация бас/тенор/сопрано.
Периодичность1 − CMND метода YIN. Эвристика, а не калиброванная вероятность и не привлекательность тембра.
СпектрЭнергетический центроид и энергия выше 2 кГц. Зависят от гласной, ноты, комнаты и микрофона.
ВибратоОценивается только на длинном непрерывном участке одной ноты. Его отсутствие не считается недостатком.

Качество входа

Запись короче трёх секунд, слишком малая амплитуда, больше 1% перегруженных отсчётов или недостаточно периодических кадров запрещают техническое ранжирование. Периодичность не доказывает, что это живой человеческий голос: инструмент и синтетический сигнал тоже могут пройти проверку.

«Восемь ступеней»

Авторская последовательность C–D–E–G–G–E–D–C, по 0,8 секунды на ноту, без фонограммы. Разрешена общая смена тональности и умеренная смена общего темпа. Локальное время не деформируется через DTW.

S = 0.70 × P + 0.20 × T + 0.10 × C. P линейно убывает от 100 до 0 при средней ошибке 0–150 центов после компенсации общей тональности. T убывает при отклонении переходов до 40% длины ноты. C — процент периодического звучания в центральных участках восьми нот. Веса экспериментальные и пока не откалиброваны на репрезентативной группе певцов.

Предпочтение слушателей

Сравниваются анонимные пары одного упражнения с техническими баллами не дальше 20 пунктов. Собственные и скрытые записи исключены; за одну пару можно голосовать один раз. После десяти сравнений показываются доля побед и интервал Wilson 95%. Порядок определяется нижней границей интервала.

Интервал не устраняет смещение аудитории, зависимость голосов, разный состав соперников и несколько аккаунтов одного человека. Рейтинг пилота не объявляет универсально лучшего певца.

Лента и общий рейтинг 60/40

Лента сначала показывает наибольший технический результат и исключает собственные и уже просмотренные записи. Сердечко внутри сайта доступно после пяти секунд прослушивания; быстрый пропуск не является отрицательным голосом. Проверка времени — ограничение пилота, не защита от всех автоматических действий.

Для общего рейтинга S = сердечки сайта + последние зачтённые лайки Instagram/TikTok. Используется одна публикация на каждой платформе для одного исполнения. Индекс поддержки A = 100 × ln(1 + S) / ln(1 + Smax), где Smax — максимальная поддержка среди активных исполнений. Если поддержки нет, A = 0. Общий балл = 0,60 × техника + 0,40 × A. Логарифм уменьшает влияние разницы в охватах; показатель всё равно отражает популярность и не равен числу уникальных людей.

Место в общем рейтинге требует минимум 20 единиц поддержки и подтверждения владельца, соавторства и подписки для Instagram и TikTok. Один исполнитель занимает не больше одного места. Правила фиксируются до сбора голосов; изменение формулы после начала требует нового сезона. Призовые места автоматически не утверждаются.

Публикации и фонд

Принадлежность публикации и её код сверяются через разрешённый владельцем API. Совместная публикация и подписка отмечаются отдельно: если API не даёт соответствующего подтверждения, нужна документированная проверка организатором. Вставка ссылки, отметка в подписи и утверждение участника не подтверждают соавторство.

Расчётный фонд = зачтённые внешние лайки / 1000 долларов США, с округлением вниз до цента. В нём учитываются только публикации активных исполнений с подтверждёнными условиями. Счётчики обновляются снимками, а не прибавлением одного и того же общего числа. Удаление лайков, скрытие записи и отмена допуска могут уменьшить расчёт. Это не кошелёк и не подтверждение финансирования.

YouTube — только справочная статистика. Его лайки, подписки и соавторство не участвуют в призовых условиях, баллах и фонде. Правила YouTube API о вознаграждениях.

Исследовательская основа

В исследовании Bruder, Poeppel и Larrouy-Maestri (2024) изученные акустические признаки объясняли мало вариации предпочтений. Воспринимаемые слушателями качества предсказывали предпочтение лучше. Вывод ограничен использованными певицами и мелодиями. Оригинальная статья.

По одной записи нельзя установить психологическую зажатость. У изменений звучания много возможных причин. Материал NIDCD о голосе. Приложение не диагностирует голосовые нарушения.

Движение

MediaPipe Pose Landmarker lite оценивает точки тела локально. Вычисляются углы локтей и коленей с порогом видимости 0,65. Кадры с несколькими людьми исключаются. Это приблизительная геометрия из одного видео, а не балл красоты тела или качества танца. Документация Google.

Воспроизводимость

Один модуль audio-core.mjs исполняется в браузере и сервере пилота. Сервер пересчитывает технику из WAV. SHA-256 связывает паспорт с точными байтами файла, но не удостоверяет личность и не распознаёт изменённые копии. Синтетические тесты проверяют реализацию; валидация на реальных исполнителях остаётся необходимой.

← Вернуться в студию