YAML Metadata Warning:empty or missing yaml metadata in repo card

Check out the documentation for more information.

TEN VAD for AX650

TEN VAD 是一款轻量级、低延迟的实时语音活动检测(Voice Activity Detection,VAD)模型,可对音频进行帧级(10ms)语音/非语音检测。

官方项目:TEN VAD GitHub

本仓库提供原始 ONNX 模型、面向爱芯元智 AX650 编译的模型产物,以及带标注的测试数据集。 模型输入音频的采样率为 16 kHz,支持 160 或 256 个采样点的帧移(分别对应 10 ms 或 16 ms)。

适配芯片平台

  • AX650

目录结构

.
├── README.md
├── models
│   ├── original
│   │   └── ten-vad.onnx
│   └── axmodel
│       └── ten-vad-ax650.axmodel
└── testset
    ├── testset-audio-01.wav
    ├── testset-audio-01.scv
    ├── ...
    ├── testset-audio-30.wav
    └── testset-audio-30.scv
  • models/original/:原始 ONNX 模型。
  • models/axmodel/:为 AX650 编译的端侧模型产物。
  • testset/:30 组 16 kHz WAV 测试音频及对应的 SCV 语音活动标注。

编译与端侧推理

具体的模型编译流程和端侧推理代码请参见 GitHub:


license: mit

Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support