WenetSpeech 项目使用教程

2026-01-16 10:16:03作者：明树来

A 10000+ hours dataset for Chinese speech recognition

项目地址：https://gitcode.com/gh_mirrors/we/WenetSpeech

1. 项目的目录结构及介绍

WenetSpeech 项目的目录结构如下：

WenetSpeech/
├── README.md
├── LICENSE
├── data/
│   ├── README.md
│   ├── scripts/
│   └── raw_data/
├── docs/
│   ├── README.md
│   └── images/
├── scripts/
│   ├── README.md
│   └── utils/
├── tools/
│   ├── README.md
│   └── third_party/
└── wenet/
    ├── README.md
    ├── bin/
    ├── conf/
    ├── dataset/
    ├── models/
    ├── utils/
    └── main.py

目录介绍

README.md: 项目的基本介绍和使用说明。
LICENSE: 项目的开源许可证。
data/: 存放数据集相关文件，包括数据处理脚本和原始数据。
docs/: 项目文档，包括图片等资源。
scripts/: 项目脚本，包括数据处理和模型训练等脚本。
tools/: 项目使用的工具和第三方库。
wenet/: 项目核心代码，包括模型定义、数据集处理、配置文件和主程序等。

2. 项目的启动文件介绍

项目的启动文件是 wenet/main.py。该文件是整个项目的入口点，负责初始化配置、加载数据、训练模型等任务。

启动文件功能

初始化配置：读取配置文件并设置运行参数。
加载数据：从指定数据集加载训练和验证数据。
模型训练：根据配置文件中的参数进行模型训练。
模型评估：在验证集上评估模型性能。

3. 项目的配置文件介绍

项目的配置文件位于 wenet/conf/ 目录下，主要包括以下几个配置文件：

config.yaml: 主配置文件，包含模型训练和评估的参数。
data_config.yaml: 数据集配置文件，包含数据加载和预处理的参数。
model_config.yaml: 模型配置文件，包含模型结构和优化器的参数。

配置文件内容

`config.yaml`

train:
  batch_size: 32
  epochs: 100
  learning_rate: 0.001
  save_interval: 10

eval:
  batch_size: 64
  metrics: [accuracy, f1_score]

`data_config.yaml`

data:
  train_path: "data/raw_data/train.txt"
  val_path: "data/raw_data/val.txt"
  test_path: "data/raw_data/test.txt"
  max_length: 100
  min_length: 10

`model_config.yaml`

model:
  type: "transformer"
  num_layers: 6
  d_model: 512
  num_heads: 8
  d_ff: 2048
  dropout: 0.1

optimizer:
  type: "adam"
  betas: [0.9, 0.98]
  eps: 1e-9

以上是 WenetSpeech 项目的基本使用教程，包括项目的目录结构、启动文件和配置文件的介绍。希望这些内容能帮助你更好地理解和使用该项目。

A 10000+ hours dataset for Chinese speech recognition

项目地址：https://gitcode.com/gh_mirrors/we/WenetSpeech

登录后查看全文

项目优选

收起

deepin linux kernel

ops-transformer

本项目是CANN提供的transformer类大模型算子库，实现网络在NPU上加速计算。

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

Ascend Extension for PyTorch

本项目是CANN提供的神经网络类计算算子库，实现网络在NPU上加速计算。

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

flutter_flutter

本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本，由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用，3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。

昇腾LLM分布式训练框架

CANNBot 是面向 CANN 开发的用于提升开发效率的系列智能体，本仓库为其提供可复用的 Skills 模块。