Появилась новая модель на основе wav2vec2: huggingface.co/...ad/wav2vec2-xls-r-300m-uk
Привет!
Пожалуйста :-)
Нужно сказать, что датасет у нас обновился и теперь в нём уже ~1200 часов.
Ссылка на него: academictorrents.com/...583df003d54ed61776650beb8
Я не работал ранее с платформой Kaggle и не могу сказать, сможет ли эта платформа поместить датасет объёмом в ~188 GB.
Может быть, кто-нибудь из знающих подскажет?
Тестировали?
Для тестирования новой модели Silero xxsmall можно использовать Telegram-бот: t.me/ukr_stt_small_bot
Один из наших участников вчера записал лекцию по созданию личного оффлайн ассистента по типу Алексы/Алисы с использованием проекта VOSK:
Он использовал русскую модель, но теперь можно повторить с украинской моделью и сделать ассистента понимающего украинский язык!
Автор выложил на свой гитхаб много полезного кода, который он сделал, поэтому сканируйте QR-коды в видео.
Я с object tracking в прошлом году игрался. Можете посмотреть эти видео:
—
—
Я не совсем понял к чему вы написали о проекте OpenTLD в контексте распознавания речи.
Этот проект о 2D-трекинге объектов в видео.
Отправьте, пожалуйста, ссылку на OpenTLD, не могу найти в гугле. Лично я не тренирую модели, поэтому не могу сказать насколько сложно/легко параметр WER считается.
Заходите к нам в чат, там все создатели моделей есть, можете вспупить с ними в дискусс по этому вопросу.
Спасибо! Так как у нас все бесплатно и нет никакой коммерции, то такие вещи как WER не выкладываются (нужно намного больше человеко-часов). Но тот, кто хочет более профессиональной поддержки и точных значений WER может обращаться к ребятам из Silero, они на платной основе готовы предоставлять такие услуги.
Появилась модель Silero xxsmall: github.com/...ech-recognition-uk#silero
Краще завітати до нашого телеграм-чату бо різні люди роблять на різних архітектурах.
Yurii Paniv сделал модель на DeepSpeech, можно посмотреть в его репозитории: github.com/...nhad/voice-recognition-ua
Ми це зробили!
Так) На жаль помилки присутні
Мы загрузили обновленные датасет (1000 часов!) на торрент, скачать можно тут: academictorrents.com/...e38919afee0a11d8145e35556
А на каких технологиях ваше решение работает?
Спасибо!
У нас обновление датасета. Уже 800 часов. Также добавили торрент (72.4 GB архив, 106.8 GB в распакованном виде), теперь скачать датасет стало проще.
Так.
Саме ця — colab.research.google.com/...master/examples_tts.ipynb
Якiсь проблеми з доступом?