1663323011-logo2022.png
SIGN IN

Total Size: 1.14 GB

Dataset Overview

Dataset Type

N/A

Language

中国語の方言

Speech Style

Scripted

Content

Speech for navigation, ride-hailing, travel inquiries, and related scenarios.

Audio Parameters

16 kHz, 16 bits, mono

File Format

WAV (PCM), TXT (UTF-8)

Recording Equipment

microphone

Recording Environment

Quiet Indoor Environment
Open Source
ASRデータセット
13 hours

MAGICDATA-DIALECT-SICHUANESE-NAVIGATION-TRAININGSET

数据集介绍

一套总时长约13小时、面向导航、打车与出行问询场景的中文方言语音识别(ASR)数据集。数据集以川渝地区口音/方言表达为主要对象,围绕真实出行意图设计语音内容,覆盖路线出发地与目的地描述、车型选择、预约用车、平台优惠、订单确认等常见交互需求。

该数据集适合用于语音识别系统在四川方言导航语音场景中的模型开发、参数调优、验证评估与错误分析,可帮助开发者观察模型在场景词识别、地名识别和口音鲁棒性方面的表现。相较于通用朗读语料,导航领域文本包含大量地名、出行服务词和自然口语表达,可更直接反映车载语音助手、地图导航、网约车平台与本地生活服务中的实际识别难点。

数据采集与分布

数据集覆盖川渝地区12个城市,包括成都、重庆、乐山、宜宾、泸州、自贡、内江、资阳、绵阳、南充、达州、广安。所有语音数据均由当地方言使用者录制,说话人选自相应的城市,涵盖不同的年龄组、性别,其中性别分布及城市分布情况如下图。

数据采用手机设备在安静室内环境录制,音频统一为16 kHz、16 bit、单通道WAV格式。

图1 数据集采集人员性别分布图

图2 数据集采集人员城市分布图

潜在应用

此数据集可用于:

  • 川渝方言/口音中文ASR模型的训练开发、调参与验证评估。
  • 导航、车载语音助手和网约车语音交互系统的场景化模型优化。
  • 地名、车型、时间、优惠活动等导航领域关键词识别效果分析。
  • 面向川渝本地化智能出行服务的语音交互体验验证。

数据集下载

如需申请数据集,请发送邮件至 open@magicdatatech.com,并在邮件中注明您的单位、姓名、职位及数据集用途等相关信息。我们将在审核通过后,通过邮件发送数据集下载链接。

Dataset Overview

Dataset Type

N/A

Language

中国語の方言

Speech Style

Scripted

Content

Speech for navigation, ride-hailing, travel inquiries, and related scenarios.

Audio Parameters

16 kHz, 16 bits, mono

File Format

WAV (PCM), TXT (UTF-8)

Recording Equipment

microphone

Recording Environment

Quiet Indoor Environment
{{ reviewsTotal }}{{ options.labels.singularReviewCountLabel }}
{{ reviewsTotal }}{{ options.labels.pluralReviewCountLabel }}
{{ options.labels.newReviewButton }}
{{ userData.canReview.message }}

Verifying Email