speech corpus

  • ХабрахабрФото Огромный открытый датасет русской речи версия 1.0

    Огромный открытый датасет русской речи версия 1.0

    Подробнее о нашей мотивации и о том, как всё начиналось,можно прочитать в этой статье — Огромный открытый датасет русской речи. В начале этого года по ряду причин мы загорелись идеей создать самый большой открытый датасет русской речи. 0. С тех пор наш проект прошел через ряд масштабных изменений, мы в три раза увеличили количество данных, повысили их качество, добавили лейблы…

    Читать далее »
  • ХабрахабрФото Огромный открытый датасет русской речи

    Огромный открытый датасет русской речи

    Специалистам по распознаванию речи давно не хватало большого открытого корпуса устной русской речи, поэтому только крупные компании могли позволить себе заниматься этой задачей, но они не спешили делиться своими наработками. Мы торопимся исправить это годами длящееся недоразумение. Итак, мы предлагаем вашему вниманию набор данных из 4000 часов аннотированной устной речи, собранный из различных интернет-источников. Подробности под катом. 3: Вот данные…

    Читать далее »


Кнопка «Наверх»