YAML Metadata Warning:empty or missing yaml metadata in repo card
Check out the documentation for more information.
TEN VAD for AX650
TEN VAD 是一款轻量级、低延迟的实时语音活动检测(Voice Activity Detection,VAD)模型,可对音频进行帧级(10ms)语音/非语音检测。
官方项目:TEN VAD GitHub
本仓库提供原始 ONNX 模型、面向爱芯元智 AX650 编译的模型产物,以及带标注的测试数据集。 模型输入音频的采样率为 16 kHz,支持 160 或 256 个采样点的帧移(分别对应 10 ms 或 16 ms)。
适配芯片平台
- AX650
目录结构
.
├── README.md
├── models
│ ├── original
│ │ └── ten-vad.onnx
│ └── axmodel
│ └── ten-vad-ax650.axmodel
└── testset
├── testset-audio-01.wav
├── testset-audio-01.scv
├── ...
├── testset-audio-30.wav
└── testset-audio-30.scv
models/original/:原始 ONNX 模型。models/axmodel/:为 AX650 编译的端侧模型产物。testset/:30 组 16 kHz WAV 测试音频及对应的 SCV 语音活动标注。
编译与端侧推理
具体的模型编译流程和端侧推理代码请参见 GitHub:
license: mit
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support