bytedance-research/HuMo
Image-to-Video โข Updated โข 43 โข 268
UMO based on OmniGen2
inpaint images using Qwen Image with inpainting Controlnet
Chat with AI using ERNIEโ4.5 model
Detect objects in images and videos
Convert uploaded audio to text with language detection
Generate images from text prompts