Image-Text-to-Video
Diffusers
Safetensors
MiniMaxH3ModularPipeline
text-to-video
image-to-video
video-to-video
text-to-audio-video
image-to-audio-video
image-text-to-audio-video
video-to-audio-video
audio-to-audio-video
audio-video-generation
multimodal
synchronized-audio-video
reference-to-audio-video
Instructions to use MiniMaxAI/MiniMax-H3 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use MiniMaxAI/MiniMax-H3 with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("MiniMaxAI/MiniMax-H3", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Inference
- Notebooks
- Google Colab
- Kaggle
请教一下,这个模型如何生成一个可以首尾循环的视频?
#54
by oioitff - opened
如题。当我尝试用同一张图片同时作为视频的首帧与尾帧时,发现生成的视频几乎完全不动了,或者模型干脆完全忽略掉了尾帧了。
这个问题还没研究过,有没有社区大神有结论的
提示词是怎么写的,我在提示词中描述了人物的动作和语言,没出现这样的情况,首尾帧相同
提示词是怎么写的,我在提示词中描述了人物的动作和语言,没出现这样的情况,首尾帧相同
提示词参考官方给出的模板写的。这些动作提示词在首帧模式、尾帧模式或者首尾帧是两张差距较大的图片时,都是可以正常工作的。可是,一旦首尾帧是两张一模一样的图片时,很多动作动态直接就失效了,几乎成了静止画面,最多只会有一些小幅度的动作。你可以试试图片中有水面的情况,其它模式下,水面都是会正常波动的,而在首尾帧是两张一模一样的图片时,水面直接就静止了。