# Mozilla Common Voice Spontaneous Speech 3.0 — Russian

Публичный корпус спонтанных ответов, релиз 2026-03-22. Исходный набор: <https://mozilladatacollective.com/datasets/cmn1pnb4n00vfmm07eqydzilq>. Лицензия: CC0-1.0.

В тест вошёл 491 клип с эталонной транскрипцией: 177,166 минуты аудио. Идентификатор в `source_audio_id` — это `audio_id` отдельного клипа, а не идентификатор говорящего.

## Важное условие использования

Не пытайтесь устанавливать личности говорящих или связывать между собой записи одного человека. Тексты являются свободными ответами и могут содержать ненормативную лексику или упоминания чувствительных тем.

## Файлы

- `../clips.json` — 491 клип, эталон и гипотезы 8 моделей в 2 режимах обработки, всего 11 конфигураций ASR;
- `clips.ndjson.gz` — те же строки в сжатом NDJSON;
- `corpus-manifest.csv` — манифест опубликованных клипов;
- `sidecars/*.ndjson.gz` — результаты распознавания каждой конфигурации;
- `single-engine-summary.json` — канонический пересчёт WER v2;
- `original-run-reports/` — отчёты исходных прогонов;
- `../audio/*.mp3` — исходные MP3 из публичного архива;
- `../SHA256SUMS.txt` — контрольные суммы публикации.

WER пересчитан офлайн из замороженных гипотез. Служебные квадратные метки удаляются только из эталона; `telegram` и `discord` сопоставляются только как самостоятельные токены.
