跳过主要内容
年度计费

EveryGen AI 年度计划总价约比连续月付 低 50%

省

EveryGen AI · Gemini Omni:动作与声音结合的短场景

把观众看到与听到的内容作为一个瞬间规划。EveryGen AI 的 Gemini Omni 从文本或单图创作短视频,将视觉指引与生成音频结合,在聚焦工作区中发展节奏明确的场景。

视频工作区

0/20000
正在恢复已保存的输入……

木制电梯门打开

28/33
查看提示词

Five-second continuous frontal shot of closed wooden elevator doors opening slowly to reveal one adult woman standing inside. Keep the camera fixed at eye level and the woman relaxed, facing forward. Preserve a simple, balanced composition with warm wood grain and soft interior light. End with the doors open and the woman still standing.

01

简介

EveryGen AI | 什么是 Gemini Omni?

EveryGen AI 的 Gemini Omni 是本工作区具有独立文本与图片路径的短视频选择。平台独立于模型提供商;准备一个视觉事件,提交前审阅请求设置。

场景描述可以包含声音

EveryGen AI 的 Gemini Omni 工作区标记原生音频始终开启。一起描述动作、节奏与预期声音,包括适用时的氛围或不需要对话。图片路径添加一张提供的首帧。声音指令指引请求,不保证精确同步、特定声线或按要求静音;结合画面聆听实际结果。

这里的 Gemini Omni 工作区

EveryGen AI 的 Gemini Omni 默认文本模式,请求 720p、八秒和 16:9。必需提示词最长 20000 字符。只提供 720p,两种模式都支持三至十秒整数时长,以及 16:9 或 9:16。图片模式需要一张首帧,没有尾帧。两种路径都没有参考视频或音频上传、seed 或音频关闭开关。围绕这些选择规划小而完整的构想。

02

使用方法

如何在 EveryGen AI 中创作 Gemini Omni 片段

  1. 提示词
    步骤 1

    选择视觉输入

    在 EveryGen AI 中以文本或图片模式打开 Gemini Omni。描述原创场景,或上传一张清楚起始图,为主体周围预期运动留足空间。

  2. 模型
    Gemini Omni
    720p16:98s
    提示词
    步骤 2

    一起描述动作与声音

    给 EveryGen AI 的 Gemini Omni 一个主要动作、镜头方向与声音意图。在要求中描述氛围或对话需要,让构想与短片段相称。

  3. 首帧尾帧
    检查 1
    0.0s
    检查 2
    4.0s
    检查 3
    7.2s
    步骤 3

    设置观看格式

    选择 16:9 或 9:16,以及三至十秒整数时长。EveryGen AI 的 Gemini Omni 这里只提供请求 720p,原生音频始终开启。提交前审阅完整请求与显示积分。

  4. Text mode: In one continuous shot, a folded paper map slowly opens on a wooden desk beside a plain compass. The camera stays close and steady. Gentle paper rustling is the foreground sound, with quiet room ambience and no speech or music. End with the map resting flat. No added text overlays.下载
    步骤 4

    审阅结合后的场景

    在 EveryGen AI 中生成 Gemini Omni 视频,带声音观看。将主体细节、动作、时序与结尾对照意图。组合需要改善时,做一次聚焦修改。

03

功能

EveryGen AI | 将声音带入 Gemini Omni 要求

声音可以建立房间氛围、强调动作,也可能分散注意。告诉 EveryGen AI 的 Gemini Omni 声轨应承担什么角色。

将声音连接可见事件

在动作旁描述属于它的声音:折叠地图打开时的纸响,或石子入水的轻溅。让 EveryGen AI 的 Gemini Omni 要求足够具体,以便之后判断关系。生成声音应结合画面审阅;仅有合理氛围,不证明每个动作精确同步。

为重要瞬间留空间

在描述中区分前景声音与背景氛围。小动作背后,柔和室内底噪可能就足够。对话或音乐会竞争视觉事件时,要求 EveryGen AI 的 Gemini Omni 保持克制。这些是场景要求内的指令,不是独立混音控件,也不承诺声轨无需后期整理。

EveryGen AI | 在三至十秒内构建 Gemini Omni 场景

可用时长适合聚焦序列与易读结果。给 EveryGen AI 的 Gemini Omni 开头、有意义变化与结束。

让最初几秒承载构想

短片段没有太多空间做复杂介绍。立即展示重要物品,描述首次运动。EveryGen AI 的 Gemini Omni 中,铃铛在安静房间轻摆,比多个地点的匆忙故事更易评估。让开头建立主体,不要求观众寻找它。

规划 Gemini Omni 收尾节拍

有意识地使用剩余时间。动作可以归于静止、镜头停稳,或可见运动停止后声音渐弱。在 EveryGen AI 的 Gemini Omni 提示词中描述关系。有用结尾给剪辑者落刀位置,不假定最后一帧单独就能解释场景如何到达。

EveryGen AI | 从选定单图开始 Gemini Omni

图片可以在动画开始前确定外观。用 EveryGen AI 的 Gemini Omni 围绕已建立视觉起点发展运动。

让来源建立构图

选择清楚展示主体且为预期动作留空间的图片。手伸出紧密裁切,或物品被前景杂物遮住,都会增加不确定性。EveryGen AI 的 Gemini Omni 这里只接收一张图,应提前准备安排,不期望额外参考补足缺失细节或替代视角。

描述变化,不替换主体

说明哪些应移动、哪些保持可辨。玩具机器人可以转头,身体仍站在桌上。告诉 EveryGen AI 的 Gemini Omni 镜头如何表现、环境如何发声。再对照原图,检查整段有无比例变化、表面漂移或意外新增。

EveryGen AI | 为横版或竖版观看构图 Gemini Omni

16:9 与 9:16 给场景两种不同构图。围绕观看形状规划 EveryGen AI 的 Gemini Omni,不把方向当成事后选择。

用宽度表达关系,用高度强调主体

宽画幅可以同时容纳物品与环境。高画幅可以给吊灯、站立角色或上升动作更多空间。告诉 EveryGen AI 的 Gemini Omni 注意力应放在哪里。必要细节远离边缘,为另行剪辑添加标题或图形预留空间。

为所选方向准备来源

图片模式使用适合所选画幅的来源,不依赖精确自动裁切。EveryGen AI 的 Gemini Omni 本页不是布局编辑器。检查结果构图中动画是否让重要特点可见。裁切即使好看,若隐藏要求展示的动作,仍不适用。

EveryGen AI | 通过清楚场景指引精修 Gemini Omni

写出可以评估的指令。EveryGen AI 的 Gemini Omni 通过提示词支持场景指引,包括节奏与排除要求,无需额外参数面板。

让 Gemini Omni 修改聚焦

首次结果未抓住重点时,确定最小有用变化。减少镜头运动、缩短动作,或简化背景声音。保持 EveryGen AI 的其他 Gemini Omni 指令稳定,让下次比较回答具体问题。避免累积矛盾要求,例如固定视角之后又要求激烈环绕同一主体。

一起评估画面与声轨

先看视觉故事,再听声音,最后结合观看。检查声音开始是否合理,意外话语是否改变含义。EveryGen AI 的 Gemini Omni 结果支持预期场景时才适合选定,而非仅因单帧精致。再次请求前审阅积分。提交前登录且确保积分足够。选择一至四个独立候选任务,依赖网络的云端处理将输入和结果保存到账户。候选数量不会组装影片,也不保证结果中一定出现偏好表演。保留前检查实际输出。

示例提示词

Map unfolding on a quiet desk

Text mode: In one continuous shot, a folded paper map slowly opens on a wooden desk beside a plain compass. The camera stays close and steady. Gentle paper rustling is the foreground sound, with quiet room ambience and no speech or music. End with the map resting flat. No added text overlays.

A robot noticing the rain

Image mode: Use the uploaded image as the opening scene. The small toy robot turns its head toward the window, then pauses while raindrops slide down the glass. Keep its proportions and the desk arrangement recognizable. Soft rain ambience, one quiet mechanical click with the turn, no dialogue or music.

A single drop in a bowl

Text mode: A close view of a plain ceramic bowl of water under soft light. One drop lands, circular ripples spread, and the surface becomes still again. A delicate splash followed by quiet ambience. Keep the camera steady and the bowl unchanged. No hands, additional objects, or scene cuts.
04

工作流示例

规划、生成和检查作品的示例场景。

EveryGen AI 工作流示例

01
产品图初稿
工作流示例

从产品照片和明确的图片编辑要求开始。将初稿与原图比较,核对外形、标签和比例,再放入商品页面。在设计应用中补上已经确认的标志和准确文案。

02
简短产品镜头
工作流示例

选择视频模型,描述一个小动作,例如物体缓缓转动。核对可用时长、分辨率和积分。把镜头用于后续剪辑前,检查物体连续性和声音。

03
文章配图
工作流示例

为图片工作区说明主体、视角和支持文章主题的视觉隐喻。在目标版式中预览结果。若图片抢占标题的注意力或遮挡重要细节,调整裁剪或构图。

04
减小图片附件
工作流示例

图片尺寸合适但文件偏大时,登录后使用图片压缩工具。压缩在浏览器中完成,输入和结果会保存到你的账户。下载单张图片或 ZIP 前先比较结果。

05
更清晰的文字初稿
工作流示例

把草稿粘贴到 Humanize AI,选择自然、亲切或专业语气。核对改写后的含义、名称、数字和技术术语,再复制或下载已经检查的版本;检测分数和发表结果没有保证。

06
系列视觉内容
工作流示例

将配色、视角、光线和主体尺度记录在可复用的创作说明中。所选图片模型支持参考图时,提供相关素材。把图片放在一起比较,针对差异修改,不假设整个系列会自动保持一致。

EveryGen AI · MiniMax H3 Max 价格与积分套餐

随时取消

Lite

50%折扣

0.025/积分

$29.9$14.950%折扣

每年计费$179· 节省$179.8

600/月
视频模型
MiniMaxSeedanceWanGrok ImagineKling
图像模型
SeedreamGPT ImageNano Banana
  • 包含 MiniMax H3 及所有高级模型
  • 最多1个批量生成任务
  • 标准生成速度
  • 标准生成成功率
  • 标准客户支持
  • 商业使用许可
最受欢迎

Standard

50%折扣

0.017/积分

$49.9$24.950%折扣

每年计费$299· 节省$299.8

1,500/月
视频模型
MiniMaxSeedanceWanGrok ImagineKling
图像模型
SeedreamGPT ImageNano Banana
  • 包含 MiniMax H3 及所有高级模型
  • 最多4个批量生成任务
  • 优先处理速度
  • 高生成成功率
  • 优先客户支持
  • 商业使用许可

Pro

50%折扣

0.014/积分

$99.9$49.950%折扣

每年计费$599· 节省$599.8

3,600/月
视频模型
MiniMaxSeedanceWanGrok ImagineKling
图像模型
SeedreamGPT ImageNano Banana
  • 包含 MiniMax H3 及所有高级模型
  • 最多10个批量生成任务
  • 最快生成速度
  • 高生成成功率
  • 专属客户经理
  • 商业使用许可

Max

50%折扣

0.012/积分

$199.9$99.950%折扣

每年计费$1,199· 节省$1,199.8

1x
1x2x3x4x5x
8,000/月
视频模型
MiniMaxSeedanceWanGrok ImagineKling
图像模型
SeedreamGPT ImageNano Banana
  • 包含 MiniMax H3 及所有高级模型
  • 最多10个批量生成任务
  • 最快生成速度
  • 高生成成功率
  • 专属客户经理
  • 商业使用许可

通过以下方式安全支付

  • Mastercard
  • Visa
  • Apple Pay
  • UnionPay
  • Google Pay
  • Discover
  • PayPal
  • Click to Pay
  • Bancontact
  • SEPA
  • Link
  • Diners Club
  • Crypto
  • Cash App
  • eftpos
  • Revolut Pay
05

常见问题

常见问题

EveryGen AI 的 Gemini Omni 可以用什么起始素材?

EveryGen AI 的 Gemini Omni 提供文本来描述想象场景,或图片模式中的一张必需首帧。它是短视频工作区,不是通用聊天界面。没有尾帧、参考图片集合,或视频和音频参考上传。

EveryGen AI 的 Gemini Omni 这里有哪些分辨率?

当前 EveryGen AI 的 Gemini Omni 工作区只提供请求 720p,本页没有更高分辨率选择。按预期显示尺寸审阅下载尺寸与细节;设置不证明原生像素、特定帧率或自动放大。

EveryGen AI 的 Gemini Omni 可以同时生成视频音频吗?

EveryGen AI 的 Gemini Omni 标记原生音频始终开启,没有关闭开关或录音上传。在视觉动作旁描述预期声音,检查返回文件。要求不保证精确话语、复制声线、准确时序或成品混音。

EveryGen AI 的 Gemini Omni 可以让多张参考图动起来吗?

EveryGen AI 的 Gemini Omni 图片流程接收一张图,这里没有多图参考集合与视频编辑。先建立连贯起始构图,再写出从该图发展出的运动。

EveryGen AI 的 Gemini Omni 视频最长多久?

在 EveryGen AI 中为 Gemini Omni 选择 3 至 10 秒。要求保持聚焦,让动作在所选时间内完成。片段需要自然衔接其他素材时,为收尾节拍留空间。

Gemini Omni 有 seed 控件吗?

EveryGen AI 的 Gemini Omni 工作区没有 seed 控件。改为记录提示词、图片、时长与方向。比较创意选择,不把重复请求当成获取完全相同帧的方法。

怎样避免 Gemini Omni 中出现多余文字?

在 EveryGen AI 的 Gemini Omni 场景要求中,加入“不要添加文字”等直接指令,再检查结果。这里排除内容写进提示词。选定合适素材后,可单独添加重要措辞或图形。

06

行动入口

在 EveryGen AI 中构思 Gemini Omni 瞬间

将一个视觉动作与其声音结合。在 EveryGen AI 中配置 Gemini Omni、检查工作区积分,审阅完整场景。

打开 Gemini Omni