ИИтак

← Назад

Общедоступный корпус арабской речи (Saudi Audio Dataset for Arabic): размеченные записи из саудовских телепередач, в основном на саудовских диалектах, а также на других арабских диалектах. Его подготовил Национальный центр искусственного интеллекта при Саудовском управлении данных и искусственного интеллекта (SDAIA) вместе с Саудовским управлением радиовещания. Корпус служит для обучения и оценки систем распознавания арабской речи, особенно разговорной и диалектной, которой в других наборах данных мало.

В новостях

  1. NVIDIA почти вдвое снизила ошибки распознавания двух саудовских диалектов

    Открытый набор записей арабской речи из саудовских телепередач, в основном на местных диалектах. Его собрали Саудовское управление данных и искусственного интеллекта (SDAIA) и государственный вещатель Саудовской Аравии.