Компания Amazon опубликовала под лицензией CC BY 4.0 набор речевых данных "MASSIVE" (Multilingual Amazon SLURP for Slot Filling, Intent Classification, and Virtual-assistant Evaluation), модели для систем машинного обучения и инструментарий для тренировки собственных моделей, которые можно использовать в таких областях, как распознавание речи и понимание информации на естественном языке (NLU, Natural Language Understanding). Набор включает более миллиона аннотированных и классифицированных высказываний, подготовленных для 51 языка.