1663323011-logo2022.png
SIGN IN

Total Size: 579MB

Dataset Overview

Dataset Type

N/A

Language

中国語の方言

Speech Style

Scripted

Content

Speech for navigation, ride-hailing, travel inquiries, and related scenarios

Audio Parameters

16 kHz, 16 bits, mono

File Format

WAV (PCM), TXT (UTF-8)

Recording Equipment

microphone

Recording Environment

Quiet Indoor Environment
Open Source
ASRデータセット
6.5 hours

MAGICDATA-DIALECT-SICHUANESE-NAVIGATION-TESTSET-PART2

数据集介绍

一套总时长约6.5小时、面向导航、打车与出行问询场景的中文方言语音识别(ASR)数据集。数据集以四川地区口音/方言表达为主要对象,围绕真实出行意图设计语音内容,覆盖路线出发地与目的地描述、车型选择、预约用车、平台优惠、订单确认等常见交互需求。

该数据集适合用于评估语音识别系统在四川方言导航语音中的转写准确率、场景词识别能力和口音鲁棒性。相较于通用朗读语料,导航领域文本包含大量地名、出行服务词和自然口语表达,可更直接反映车载语音助手、地图导航、网约车平台与本地生活服务中的实际识别难点。

数据采集与分布

数据集覆盖四川地区6个城市,包括成都、自贡、内江、巴中、广元、遂宁。所有语音数据均由当地方言使用者录制,说话人选自相应的城市,涵盖不同性别及城市分布,其中性别分布及城市分布情况如下图。

数据采用手机设备在安静室内环境录制,音频统一为16 kHz、16 bit、单通道WAV格式。

图1 数据集采集人员性别分布图

图2 数据集采集人员城市分布图

潜在应用

此数据集可用于:

  • 四川方言/口音中文ASR模型的测试与基准评估。
  • 导航、车载语音助手和网约车语音交互系统的场景化识别评测。
  • 地名、车型、时间、优惠活动等导航领域关键词识别效果分析。
  • 面向四川本地化智能出行服务的语音交互体验验证。

数据集下载

如需申请数据集,请发送邮件至 open@magicdatatech.com,并在邮件中注明您的单位、姓名、职位及数据集用途等相关信息。我们将在审核通过后,通过邮件发送数据集下载链接。

Dataset Overview

Dataset Type

N/A

Language

中国語の方言

Speech Style

Scripted

Content

Speech for navigation, ride-hailing, travel inquiries, and related scenarios

Audio Parameters

16 kHz, 16 bits, mono

File Format

WAV (PCM), TXT (UTF-8)

Recording Equipment

microphone

Recording Environment

Quiet Indoor Environment
{{ reviewsTotal }}{{ options.labels.singularReviewCountLabel }}
{{ reviewsTotal }}{{ options.labels.pluralReviewCountLabel }}
{{ options.labels.newReviewButton }}
{{ userData.canReview.message }}

Verifying Email