Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Jinstudio
's Collections
Audio Understanding
Audio Generation
3D Generation
Image Generation: The U-Net Era
Research & Commercial Models under Licensing Terms
Audio Understanding
updated
18 days ago
Curated Audio understanding models worthy of academic research. Please read the License before use.
Upvote
-
Sort: Collection
Jinstudio/VibeVoice-ASR
Automatic Speech Recognition
•
9B
•
Updated
19 days ago
•
57
Jinstudio/Qwen3-ForcedAligner-0.6B
Automatic Speech Recognition
•
0.9B
•
Updated
19 days ago
•
21
Jinstudio/Qwen3-ASR-0.6B
Automatic Speech Recognition
•
0.9B
•
Updated
19 days ago
•
26
Jinstudio/Qwen3-ASR-1.7B
Automatic Speech Recognition
•
2B
•
Updated
19 days ago
•
26
Jinstudio/Voxtral-Mini-3B-2507
5B
•
Updated
18 days ago
•
31
Jinstudio/Voxtral-Mini-4B-Realtime-2602
Automatic Speech Recognition
•
4B
•
Updated
18 days ago
•
57
Upvote
-
Sort: Collection
Share collection
View history
Collection guide
Browse collections