> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-claude-comfy-concurrency-limits-page-s84u33.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# GeminiVideoOmni - ComfyUI Built-in Node Documentation

> 使用 Google 的 Gemini Omni Flash 模型，根据文本提示生成带有音频的视频。

使用 Google 的 Gemini Omni Flash 模型，根据文本提示生成带有音频的视频。可选择提供参考图像和/或参考视频来引导或编辑结果。直接在提示中描述所需的时长（3-10 秒）和宽高比（16:9 或 9:16）。

## 输入

### 通用输入

| 参数 | 描述 | 数据类型 | 是否必填 | 范围 |
| - | - | - | - | - |
| `model` | 用于生成视频的 Gemini 视频模型。 | DYNAMIC\_COMBO | 是 | "Omni Flash" |
| `seed` | `seed` 控制节点是否应重新运行；无论种子如何，结果都是不确定的（默认值：42）。 | INT | 是 | 0 到 2147483647 |

### Omni Flash 输入

| 参数 | 描述 | 数据类型 | 是否必填 | 范围 |
| - | - | - | - | - |
| `prompt` | 描述要生成的视频。直接在提示中指定时长和宽高比，例如“一个 6 秒、16:9 的片段”。时长可为 3-10 秒；宽高比必须为 16:9（横向）或 9:16（纵向）。输出为 720p、24 FPS，并带有音频。 | STRING | 是 | 去除空白后至少 1 个字符 |
| `temperature` | 控制随机性。较低的值更聚焦/确定，较高的值变化更多（默认值：1.0）。 | FLOAT | 否 | 0.0 到 2.0 |
| `top_p` | 核采样：从累积概率达到 `top_p` 的最小标记集合中进行采样（默认值：0.95）。 | FLOAT | 否 | 0.0 到 1.0 |

### 参考输入

| 参数 | 描述 | 数据类型 | 是否必填 | 范围 |
| - | - | - | - | - |
| `images` | 可增长插槽：连接一个或多个参考图像（`image_1`...`image_14`）以引导或动画化视频。总共最多 14 张图像。 | IMAGE | 否 | 0 到 14 张图像 |
| `videos` | 可增长插槽：连接一个或多个参考视频（`video_1`...`video_3`）以引导或编辑。最多 3 个视频，每个最长 10 秒。 | VIDEO | 否 | 0 到 3 个视频，每个最长 10 秒 |

注意事项：

* 如果图像输入包含多个帧，则每一帧都计入 14 张图像的上限。
* 当提供参考图像或视频时，编码后的媒体总大小必须保持在约 90 MB 以下；否则节点会报错。
* 当未提供参考图像或视频时，节点仅根据文本提示生成视频。

## 输出

| Output Name | 描述 | 数据类型 |
| - | - | - |
| `VIDEO` | 来自 Gemini 模型的、带有音频的生成视频。 | VIDEO |
| `STRING` | 模型返回的任何文本回复，例如推理或解释。 | STRING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/GeminiVideoOmni/zh.md)

***

**Source fingerprint (SHA-256):** `648844868affb68298d2eac8ac20095bfe378d32e721396781de330ef6a6d69f`
