文本生成视频
描述主体、场景、动作、镜头运动和氛围,从提示词创建短视频。
Omni 1.1 Flash
从文本、图片或兼容的参考视频创建短 AI 视频。在 NanoPic 中使用 Gemini Omni 1.1 Flash 探索动作、延展场景,并将创意逐步完善为高质量输出。
输入
文本 · 图片 · 视频
输出
360p · 720p · 1080p · 4K
格式
16:9 · 9:16
Omni 1.1 Flash 是 Gemini 系列中面向快速生成和对话式编辑的视频模型。NanoPic 围绕已接入的模型提供浏览器创作工作区,你可以提交提示词、添加视觉参考并查看结果,无需自行搭建视频处理流程。
描述主体、场景、动作、镜头运动和氛围,从提示词创建短视频。
上传静态图片并补充运动方向,同时保留主体和构图的关键特征。
在需要参考动作或构图时,使用兼容的视频作为生成指导。
通过描述下一步发生的内容,延续已有的视觉创意。
选择 16:9 横屏场景,或选择 9:16 制作竖屏社交内容。
先快速迭代,再在结果合适时选择 720p、1080p 或 4K 输出。
通过这些控制项,快速探索视觉实验和连续场景。
从提示词或静态图片开始,描述希望的动作、镜头路径和视觉氛围。
使用兼容的参考视频引导构图、节奏和场景运动方式。
描述接下来发生的内容,延续已有视觉创意,让连续镜头保持连贯。
先用短预览快速迭代,方向确定后再选择更高分辨率输出。
01
将产品画面转为短动态概念,用于商品页、营销活动或社交内容。
02
在制作最终版本前,快速探索竖屏开场、镜头运动和不同创意方向。
03
发展连续镜头,在单次生成不够时延续一个视觉创意。
04
在一个浏览器工作流中测试提示词、参考素材和节奏,再投入更大的制作流程。
实用工作流
使用 Omni 1.1 Flash 时,每次生成都应该有清晰的任务。先提出一个小的视觉问题,使用满足需求的最短预览,并让提示词聚焦于下一步变化。这样更容易比较版本、保持主体一致,也能判断什么时候适合输出更高分辨率。
描述主体、环境、时间、镜头距离,以及最重要的一项动作。具体的镜头说明能提供稳定起点,减少无关运动。
早期概念适合使用文本生成视频;产品或角色需要保持可识别时使用图片生成视频;当节奏或镜头运动是关键约束时,使用兼容的参考视频。
在确定更高分辨率前先生成短草稿。检查开头一秒、主要动作、面部或产品连续性以及结尾画面,在问题还容易定位时调整提示词。
如果镜头需要从指定状态开始并结束,提供清晰的首尾参考,并说明中间的动作。补充镜头路径和需要保持不变的元素,让过渡像一个完整镜头。
当方向确定后,用提示词描述接下来发生的内容,不必重复所有细节。引用已有主体、光线和镜头位置,帮助延展画面保持连贯。
在目标输出尺寸下检查草稿,确认构图和动作后再选择更高分辨率。保留最终提示词和导出视频,方便之后复现或修改。
实用的 Omni 1.1 Flash 提示词就像一份简短的分镜表:告诉模型哪些内容要保留、哪些内容要改变,以及镜头如何运动。避免在一个句子里堆叠无关动作,把主要动作和可选氛围分开描述。
先写必须保持可识别的人物、产品或物体,再补充环境和视觉风格。
镜头运动重要时,使用平移、推近、环绕、跟拍、倾斜或固定等词,并补充方向和速度。
描述变化前,先说明需要保持一致的身份、无标志包装或光线等元素。
一个清晰动作通常比多个互不相关的事件更适合短视频,避免几秒钟内出现多个竞争重点。
尽量一次只改变一个变量。每次预览都有明确用途,也更容易判断是哪段措辞改善了动作。
公开案例
这些压缩后的短片展示了大家正在用 Omni 1.1 Flash 探索的场景、编辑和动作效果。
探索电影感运动与时间连续性的短片。
保持提示词和参考内容一致,快速比较不同输出效果。
围绕纹理、运动和时间一致性进行的短片测试。
探索主体连续性、构图和镜头方向的参考视频片段。
先用低分辨率快速检查构图和动作,再决定是否进行更大尺寸输出。
通过多模态参考素材探索节奏和可控的镜头运动。
可用控制项取决于输入模式。NanoPic 当前提供以下 Gemini Omni 工作流设置。
生成使用 NanoPic 积分。最终消耗取决于输入类型、时长和输出分辨率,提交前会在生成器中显示。
Omni 1.1 Flash 是 Gemini 系列中的快速多模态视频生成与编辑模型。在 NanoPic 中,它通过浏览器视频生成器提供使用入口。
可以。选择图片转视频工作流,上传支持的图片,并描述希望添加的动作或镜头方向。
当前接入的工作流提供 4K 输出选项。具体可用性和积分消耗以提交前生成器显示为准。
当前 NanoPic 工作流在文本或图片输入时支持 4、6、8 和 10 秒。使用视频输入时,输出时长可能由模型自动决定。
可以,在兼容的视频参考工作流中使用。上传大小、格式和时长限制由生成器执行。