
近距离观察细节
壁虎微距特写清晰呈现鳞片纹理、眼部反光和浅景深效果。
多模态 AI 视频模型
将文本、图像、视频和音频整合进同一个短视频工作流,再通过上方生成器安排动作、镜头、氛围与声音。
4–15 秒镜头 · 最高 2K · 在支持的工作流中生成原生立体声
MiniMax H3 作品展示
浏览六支 H3 官方演示,从细节丰富的微距特写到风格鲜明的片头设计。每段说明都会点出值得留意的画面或声音细节。

壁虎微距特写清晰呈现鳞片纹理、眼部反光和浅景深效果。

镜头沿工业升降梯向上移动,机械空间的纵深随之展开。建议打开声音,完整感受这段演示。

唱片、手写便笺、街灯与午夜天际线,以鲜明的视觉意象建立片头氛围。

鲜明的游戏角色与装备菜单接连出现,画面自然串起角色及其所处的世界。

奔跑的小角色配合超大字体,组成一支轻快醒目的社交媒体竖屏短片。

镜面护目镜配合紧凑的人像构图,营造出简洁利落的竖屏广告质感。
H3 可以同时参考文本、图像、视频和音频。既能从文字提示开始创作,也能用首帧、尾帧或多种素材共同引导画面。
H3 可以生成带原生立体声的视频,让对白、音效和环境声与画面一起成形。
在工作流支持的情况下,最高可输出 2K 视频,方便进行细节处理和二次构图。
在 Veemo 中,时长可按整秒设为 4 到 15 秒,方便围绕有限时间安排动作和镜头节奏。
如果希望方向更明确,请描述主体、场景、动作、镜头运动与氛围;如需声音,再加入对白、音效或环境声。以下示例均由 Veemo 原创,仅供创作参考,并非展示视频的原始提示词。
主体与场景 → 动作与节奏 → 镜头 → 光线与风格 → 对白与声音
黄昏时分,拉丝金属便携音箱置于雨后的深色屋顶。水珠聚集两秒,随首个低音鼓点向外震开。镜头缓慢顺时针环绕并推进至特写。冷蓝色轮廓光,精致商业质感。深沉的立体声低音、细雨声,无对白。
一名疲惫的车站值班员独自站在 20 世纪 80 年代候车大厅的时钟下。她折好电报,望向进站列车,轻声说:“正点到达。”镜头从腰部高度开始,随后缓缓推近。暖色环境灯光,低饱和胶片色调。远处刹车声、脚步声、轻声对白。
蓝调时刻,风吹过漫水的柏树林,一叶窄舟漂入银色薄雾。镜头与船平行跟拍,随后上摇至飞离树冠的鸟群。柔和自然光,克制的电影色彩,舒缓节奏。船桨划水声、虫鸣与远处雷声。
快速尝试产品亮相方式、广告概念和品牌短片。
测试竖屏开场、视觉反差和抓人眼球的动态创意。
围绕角色、动作与运镜,设计一段简洁的人物表演。
在投入更大规模制作前,探索构图、氛围与镜头节奏。
用已有图像、视频或音频,为新的短视频确定创作方向。
MiniMax H3 是一款多模态视频生成模型。Veemo 已将它的文生视频、图生视频和参考生成工作流整合进现有视频生成器。
你可以从文本开始,用首帧或尾帧引导视频,也可以将图像、视频、音频等参考素材与提示词结合使用。不同模式会显示对应的输入项。
在 Veemo 中,可按整秒选择 4 到 15 秒的生成时长。
支持。官方文档列出了 768P 和 2K 输出选项,因此 H3 最高可生成至 2K。实际可选分辨率取决于当前工作流和设置。
H3 可以在生成视频的同时生成原生立体声。如需对白、音效或环境声,请在提示词中明确描述。
参考素材应清楚表达希望延续的主体、动作、构图或声音氛围。选择模式后,Veemo 生成器会显示对应的输入项和文件限制。
Veemo 按生成视频时长计费,每秒 15 积分。参考模式下,输入视频每秒另计 15 积分;从第 6 张起,每张参考图像另计 5 积分;参考音频不额外收费。提交前,生成器会显示总积分。
把提示词当成简洁的镜头说明来写:先交代主体与场景,再描述动作和节奏、运镜方式、光线与风格,最后补充对白与声音。