SADA
Общедоступный корпус арабской речи (Saudi Audio Dataset for Arabic): размеченные записи из саудовских телепередач, в основном на саудовских диалектах, а также на других арабских диалектах. Его подготовил Национальный центр искусственного интеллекта при Саудовском управлении данных и искусственного интеллекта (SDAIA) вместе с Саудовским управлением радиовещания. Корпус служит для обучения и оценки систем распознавания арабской речи, особенно разговорной и диалектной, которой в других наборах данных мало.
проверено по: ieeexplore.ieee.org ↗
В новостях
NVIDIA почти вдвое снизила ошибки распознавания двух саудовских диалектов
Открытый набор записей арабской речи из саудовских телепередач, в основном на местных диалектах. Его собрали Саудовское управление данных и искусственного интеллекта (SDAIA) и государственный вещатель Саудовской Аравии.