Хорошие новости от нашего сообщества: Igor Sitdikov создал вторую модель для VOSK-a. Можно скачать её в чате t.me/speech_recognition_uk или со страницы проекта на GitHub github.com/...mkv/speech-recognition-uk
Ні. Схема збору датасету зараз проста — завантаження на MEGA даних та прямування до наступних джерел. Але я бачив, що цей датасет оновлюється час від часу і треба якость це виправити.
Так, додавали з цього сайту також книги.
Нужно найти ссылки youtube-каналы с украинским контентом в которых есть хорошие субтитры.
Silero еще поддерживает TensorFlow, но пока для него модель не опубликована.
Готовой реализации подобной библиотеки нет, но создать просто: nanomsg или другой локальный socket/http server + pytorch/python и в путь.
Ви про який транслятор від Google говорите? У нього їх два. Google Translator та Google Cloud Translation. З першого по закону ви не можете отримувати текст, а за другий треба платити. Тим більше обидва сервіси недоступні в тих місцях, де немає інтернету, а дану модель можна встановити на комп’ютер без інтернету і вона буде працювати.
Ничего страшного. Кому будет интересно — тот присоединится.