Popular image, video, speech, and audio models you can run via Replicate using Hugging Face Inference Providers.
-
black-forest-labs/FLUX.1-schnell
Text-to-Image • 12B • Updated • 690k • • 5.7k -
black-forest-labs/FLUX.2-dev
Image-to-Image • 32B • Updated • 602k • • 2.16k -
Tongyi-MAI/Z-Image-Turbo
Text-to-Image • 6B • Updated • 679k • • 5.2k -
Wan-AI/Wan2.2-T2V-A14B
Text-to-Video • Updated • 3.14k • • 550