🗣 OpenAI представила систему распознавания речи с открытым исходным кодом Whisper, обеспечивающую транскрипцию на нескольких языках.
Разработчики использовали 680 000 часов многоязычных и мультизадачных данных, собранных из интернета. Благодаря этому система распознает уникальные акценты, фоновый шум и технический жаргон.
☝️ Исследователи признали, что из-за использования «зашумленных» данных в наборе для обучения модель имеет свои ограничения, особенно в области предсказания текста. Также Whisper не одинаково хорошо работает на разных языках.
forklog.com/news/op…-whisper
#OpenAI #NLP