From 3a0393bd7b6c8828e3cc8c4677478809e9522844 Mon Sep 17 00:00:00 2001 From: lin-bot23 Date: Sun, 20 Sep 2026 03:04:49 +0800 Subject: [PATCH 1/2] docs: sync built-in nodes documentation (2026-09-16 to 09-20) Forward sync of node docs merged into Comfy-Org/embedded-docs after the previous sync (PR #1693, which covered 2026-09-06 to 09-16). New node pages (ComfyUI partner nodes): - Pruna p-video-2: PrunaTextToVideoNode, PrunaImageToVideoNode (ComfyUI #16315) - Tripo P2: TripoPSeriesTextToModelNode, TripoPSeriesImageToModelNode, TripoPSeriesMultiviewToModelNode (ComfyUI #16320) Updated pages: - MoGeInference / MoGePanoramaInference: refine_steps (ComfyUI #16381) - YuE2GenerateMusic: cfg_scale (ComfyUI #16373) - OpenAIGPTImage1 / OpenAIGPTImageNodeV2: GPT Image 2 transparent background (#16366) - TextGenerate / TextGenerateLTX2Prompt: mtp speculative decoding - Translation maintenance plus nav group alignment for renamed categories (Trellis2 -> Trellis, SeedVR2 latent nodes -> Seedvr) Files: 56 mdx (en + zh + ja + ko) + docs.json nav entries. Source: embedded-docs main via docs-generation/scripts/sync_to_comfy_docs.py --mode all. --- built-in-nodes/MoGeInference.mdx | 7 +- built-in-nodes/MoGePanoramaInference.mdx | 3 +- built-in-nodes/OpenAIGPTImage1.mdx | 3 +- built-in-nodes/OpenAIGPTImageNodeV2.mdx | 7 +- built-in-nodes/PrunaImageToVideoNode.mdx | 53 ++++++++ built-in-nodes/PrunaTextToVideoNode.mdx | 50 +++++++ built-in-nodes/TextGenerate.mdx | 5 +- built-in-nodes/TextGenerateLTX2Prompt.mdx | 39 ++++-- .../TripoPSeriesImageToModelNode.mdx | 56 ++++++++ .../TripoPSeriesMultiviewToModelNode.mdx | 59 ++++++++ .../TripoPSeriesTextToModelNode.mdx | 55 ++++++++ built-in-nodes/YuE2GenerateMusic.mdx | 3 +- docs.json | 128 ++++++++++++------ ja/built-in-nodes/MoGeInference.mdx | 25 ++-- ja/built-in-nodes/MoGePanoramaInference.mdx | 17 +-- ja/built-in-nodes/OpenAIGPTImage1.mdx | 31 ++--- ja/built-in-nodes/OpenAIGPTImageNodeV2.mdx | 61 ++++----- ja/built-in-nodes/PrunaImageToVideoNode.mdx | 53 ++++++++ ja/built-in-nodes/PrunaTextToVideoNode.mdx | 50 +++++++ ja/built-in-nodes/StartLoop.mdx | 8 +- ja/built-in-nodes/TextGenerate.mdx | 39 +++--- ja/built-in-nodes/TextGenerateLTX2Prompt.mdx | 57 +++++--- .../TripoPSeriesImageToModelNode.mdx | 56 ++++++++ .../TripoPSeriesMultiviewToModelNode.mdx | 59 ++++++++ .../TripoPSeriesTextToModelNode.mdx | 55 ++++++++ ja/built-in-nodes/YuE2GenerateMusic.mdx | 31 +++-- ko/built-in-nodes/EndLoop.mdx | 8 +- ko/built-in-nodes/GeminiNodeV3.mdx | 2 +- ko/built-in-nodes/GetItemFromList.mdx | 4 +- ko/built-in-nodes/LoopIteration.mdx | 12 +- ko/built-in-nodes/LoopProgress.mdx | 6 +- ko/built-in-nodes/LoopResult.mdx | 2 +- ko/built-in-nodes/MoGeInference.mdx | 23 ++-- ko/built-in-nodes/MoGePanoramaInference.mdx | 19 +-- ko/built-in-nodes/OpenAIGPTImage1.mdx | 37 +++-- ko/built-in-nodes/OpenAIGPTImageNodeV2.mdx | 85 ++++++------ ko/built-in-nodes/PrunaImageToVideoNode.mdx | 53 ++++++++ ko/built-in-nodes/PrunaTextToVideoNode.mdx | 50 +++++++ ko/built-in-nodes/StartLoop.mdx | 2 +- ko/built-in-nodes/TextGenerate.mdx | 35 ++--- ko/built-in-nodes/TextGenerateLTX2Prompt.mdx | 51 ++++--- .../TripoPSeriesImageToModelNode.mdx | 56 ++++++++ .../TripoPSeriesMultiviewToModelNode.mdx | 59 ++++++++ .../TripoPSeriesTextToModelNode.mdx | 55 ++++++++ ko/built-in-nodes/YuE2GenerateMusic.mdx | 33 ++--- zh/built-in-nodes/MoGeInference.mdx | 23 ++-- zh/built-in-nodes/MoGePanoramaInference.mdx | 25 ++-- zh/built-in-nodes/OpenAIGPTImage1.mdx | 31 ++--- zh/built-in-nodes/OpenAIGPTImageNodeV2.mdx | 69 +++++----- zh/built-in-nodes/PrunaImageToVideoNode.mdx | 53 ++++++++ zh/built-in-nodes/PrunaTextToVideoNode.mdx | 50 +++++++ zh/built-in-nodes/TextGenerate.mdx | 39 +++--- zh/built-in-nodes/TextGenerateLTX2Prompt.mdx | 49 ++++--- .../TripoPSeriesImageToModelNode.mdx | 56 ++++++++ .../TripoPSeriesMultiviewToModelNode.mdx | 59 ++++++++ .../TripoPSeriesTextToModelNode.mdx | 55 ++++++++ zh/built-in-nodes/YuE2GenerateMusic.mdx | 21 +-- 57 files changed, 1671 insertions(+), 461 deletions(-) create mode 100644 built-in-nodes/PrunaImageToVideoNode.mdx create mode 100644 built-in-nodes/PrunaTextToVideoNode.mdx create mode 100644 built-in-nodes/TripoPSeriesImageToModelNode.mdx create mode 100644 built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx create mode 100644 built-in-nodes/TripoPSeriesTextToModelNode.mdx create mode 100644 ja/built-in-nodes/PrunaImageToVideoNode.mdx create mode 100644 ja/built-in-nodes/PrunaTextToVideoNode.mdx create mode 100644 ja/built-in-nodes/TripoPSeriesImageToModelNode.mdx create mode 100644 ja/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx create mode 100644 ja/built-in-nodes/TripoPSeriesTextToModelNode.mdx create mode 100644 ko/built-in-nodes/PrunaImageToVideoNode.mdx create mode 100644 ko/built-in-nodes/PrunaTextToVideoNode.mdx create mode 100644 ko/built-in-nodes/TripoPSeriesImageToModelNode.mdx create mode 100644 ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx create mode 100644 ko/built-in-nodes/TripoPSeriesTextToModelNode.mdx create mode 100644 zh/built-in-nodes/PrunaImageToVideoNode.mdx create mode 100644 zh/built-in-nodes/PrunaTextToVideoNode.mdx create mode 100644 zh/built-in-nodes/TripoPSeriesImageToModelNode.mdx create mode 100644 zh/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx create mode 100644 zh/built-in-nodes/TripoPSeriesTextToModelNode.mdx diff --git a/built-in-nodes/MoGeInference.mdx b/built-in-nodes/MoGeInference.mdx index 102e400c46..d91ce7943c 100644 --- a/built-in-nodes/MoGeInference.mdx +++ b/built-in-nodes/MoGeInference.mdx @@ -1,12 +1,12 @@ --- title: "MoGeInference - ComfyUI Built-in Node Documentation" -description: "Run MoGe on a single image to estimate depth and geometry." +description: "Run MoGe on images to estimate depth and geometry." sidebarTitle: "MoGeInference" icon: "circle" mode: wide --- -Run MoGe on a single image to estimate depth and geometry. This node processes an input image through the MoGe model to generate a 3D point cloud, depth map, camera intrinsics, a mask, and surface normals. +Run MoGe on images to estimate depth and geometry. This node processes an input image through the MoGe model to generate a 3D point cloud, depth map, camera intrinsics, a mask, and surface normals. ## Inputs @@ -19,6 +19,7 @@ Run MoGe on a single image to estimate depth and geometry. This node processes a | `batch_size` | Images per inference call. Lower if you OOM on a long video / image set. (default: 4) | INT | Yes | 1 to 64 | | `force_projection` | (Advanced) Forces projection of the predicted points. (default: True) | BOOLEAN | Yes | True/False | | `apply_mask` | (Advanced) Set masked-out (sky / invalid) pixels to inf in points and depth so meshing culls them. Disable to keep the raw predicted geometry everywhere; the mask is still returned separately. (default: True) | BOOLEAN | Yes | True/False | +| `refine_steps` | (Advanced) MoGe-3 only: sparse volumetric refinement passes over the predicted depth. More passes sharpen fine detail and edges at a roughly linear cost. 0 disables refinement. Ignored by MoGe-1 / MoGe-2. (default: 3) | INT | Yes | 0 to 8 | Note: When the input `image` contains more frames than `batch_size`, the node processes them in multiple inference calls and combines the results into a single output geometry. @@ -31,4 +32,4 @@ Note: When the input `image` contains more frames than `batch_size`, the node pr > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGeInference/en.md) --- -**Source fingerprint (SHA-256):** `59f6b8b1ab65147a47f5dc7ebee7b965a5ab37c6a0843a2c80d50c767ad98db4` +**Source fingerprint (SHA-256):** `10f3399d9b6bc4ff8a940c940f538a8ec8f38a15e7d65f162499c5ab264fad65` diff --git a/built-in-nodes/MoGePanoramaInference.mdx b/built-in-nodes/MoGePanoramaInference.mdx index 9c602fc64d..c8c68c417e 100644 --- a/built-in-nodes/MoGePanoramaInference.mdx +++ b/built-in-nodes/MoGePanoramaInference.mdx @@ -18,6 +18,7 @@ This node performs depth estimation on equirectangular panorama images. It split | `split_resolution` | Resolution of each perspective split (default: 512). | INT | Yes | 256 to 1024 | | `merge_resolution` | Long-side resolution of the merged equirect distance map (default: 1920). | INT | Yes | 256 to 8192 | | `batch_size` | Views per inference batch (12 splits total) (default: 4). | INT | Yes | 1 to 12 | +| `refine_steps` | MoGe-3 only: sparse volumetric refinement passes over the predicted depth. More passes sharpen fine detail and edges at a roughly linear cost. 0 disables refinement. Ignored by MoGe-1 / MoGe-2 (default: 3). | INT | Yes | 0 to 8 | **Notes:** @@ -33,4 +34,4 @@ This node performs depth estimation on equirectangular panorama images. It split > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGePanoramaInference/en.md) --- -**Source fingerprint (SHA-256):** `d35b6d42a5bb17c184bc56fe3867d3a183017084dc81649c0663a9fba2362770` +**Source fingerprint (SHA-256):** `7f21452d035b2fe9d30b0cd15ddad10916439492b1d682a8b28f1a79e375df58` diff --git a/built-in-nodes/OpenAIGPTImage1.mdx b/built-in-nodes/OpenAIGPTImage1.mdx index b1444a8d9b..1f1bd3fde7 100644 --- a/built-in-nodes/OpenAIGPTImage1.mdx +++ b/built-in-nodes/OpenAIGPTImage1.mdx @@ -35,7 +35,6 @@ Generates images synchronously through OpenAI's GPT Image endpoint. It can creat - The longest edge of a custom resolution must be 3840 or less. - Custom resolution aspect ratio must not exceed 3:1. - Custom resolution total pixels must be between 655,360 and 8,294,400. -- Transparent background is not supported for the `gpt-image-2` model. - The `gpt-image-1` and `gpt-image-1.5` models only support the sizes `auto`, `1024x1024`, `1024x1536`, and `1536x1024`. Other sizes are only supported by the `gpt-image-2` model. ## Outputs @@ -47,4 +46,4 @@ Generates images synchronously through OpenAI's GPT Image endpoint. It can creat > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImage1/en.md) --- -**Source fingerprint (SHA-256):** `bf588bffced6e66536b4cb54655ef6ebb9cf988d9739e3c379a8ebda1486e20a` +**Source fingerprint (SHA-256):** `f0f0db7fd2cdf8efd2155522b289aa8f3f939fa79a6e9060b0ffbb2dd20efa1e` diff --git a/built-in-nodes/OpenAIGPTImageNodeV2.mdx b/built-in-nodes/OpenAIGPTImageNodeV2.mdx index 8fe889848f..e3314f22a0 100644 --- a/built-in-nodes/OpenAIGPTImageNodeV2.mdx +++ b/built-in-nodes/OpenAIGPTImageNodeV2.mdx @@ -44,7 +44,7 @@ These inputs appear when `model` is set to `gpt-image-2`. | `model.size` | Image size. Select "Custom" to use the custom width and height (default: `"auto"`). | COMBO | Yes | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | | `model.custom_width` | Used only when `model.size` is "Custom". Must be a multiple of 16 (default: `1024`). | INT | No | 480 to 3840 (step 16) | | `model.custom_height` | Used only when `model.size` is "Custom". Must be a multiple of 16 (default: `1024`). | INT | No | 480 to 3840 (step 16) | -| `model.background` | Return image with or without background (default: `"auto"`). | COMBO | Yes | `"auto"`
`"opaque"` | +| `model.background` | Return image with or without background (default: `"auto"`). | COMBO | Yes | `"auto"`
`"opaque"`
`"transparent"` | | `model.quality` | Image quality, affects cost and generation time (default: `"low"`). | COMBO | Yes | `"low"`
`"medium"`
`"high"` | | `model.images` | Optional reference image(s) for image editing. Up to 16 images. See Reference Inputs for details. | IMAGE | No | 0 to 16 | | `model.mask` | Optional mask for inpainting (white areas will be replaced). Requires exactly one reference image. | MASK | No | N/A | @@ -65,7 +65,7 @@ These inputs appear when `model` is set to `gpt-image-1.5` or `gpt-image-1`. Bot | Parameter | Description | Data Type | Required | Range | | --- | --- | --- | --- | --- | -| `model.images` | Growable slot: connect 1..N items (e.g. `image_1`...`image_16`); up to 16 reference images for all models. | IMAGE | No | 1 to 16 | +| `model.images` | Growable slot: connect 1..N items (e.g. `image_1`...`image_16`); up to 16 reference images for all models. | IMAGE | No | 0 to 16 | | `model.mask` | Optional mask for inpainting (white areas will be replaced). Requires exactly one reference image. | MASK | No | N/A | **Parameter Constraints and Limitations:** @@ -76,7 +76,6 @@ These inputs appear when `model` is set to `gpt-image-1.5` or `gpt-image-1`. Bot - When `model.images` is provided, the node runs in image editing mode; without `model.images`, it generates images from the prompt alone. - Reference images and the mask are downscaled before being sent to the API. - `"xhigh"` and `"max"` quality levels are only available for `gpt-image-2.5-flare` and `gpt-image-2.5-sunburst`. -- The `"transparent"` background option is available for `gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-1.5`, and `gpt-image-1`, but not for `gpt-image-2`. - `seed` is currently not implemented in the backend. ## Outputs @@ -88,4 +87,4 @@ These inputs appear when `model` is set to `gpt-image-1.5` or `gpt-image-1`. Bot > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImageNodeV2/en.md) --- -**Source fingerprint (SHA-256):** `4f77b79f9f432a1f2e0fd814012aebe7cc42a8aa983ee9a61f3b32984bf65148` +**Source fingerprint (SHA-256):** `804ea35d0e2aa0b2993a293cb10cb41e2f9c6a3732304306253f7f7b1eb59b8a` diff --git a/built-in-nodes/PrunaImageToVideoNode.mdx b/built-in-nodes/PrunaImageToVideoNode.mdx new file mode 100644 index 0000000000..8414591c27 --- /dev/null +++ b/built-in-nodes/PrunaImageToVideoNode.mdx @@ -0,0 +1,53 @@ +--- +title: "PrunaImageToVideoNode - ComfyUI Built-in Node Documentation" +description: "Animates an image into a video with Pruna's P-Video-2 model." +sidebarTitle: "PrunaImageToVideoNode" +icon: "circle" +mode: wide +--- + +Animates an image into a video with Pruna's P-Video-2 model. The first frame is required and fixes the aspect ratio of the output; an optional last frame gives the video an end point to interpolate towards. The prompt describes how the scene moves, and the node either generates its own soundtrack or takes an audio clip that drives the motion. + +## Inputs + +### Common Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model` | Pruna video model to use. Selecting a model reveals its own inputs below. | DYNAMIC_COMBO | Yes | `"p-video-2"` | + +### P-Video-2 Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model.first_frame` | Image the video starts from. The output keeps the aspect ratio of this image. | IMAGE | Yes | - | +| `model.last_frame` | Image the video ends on. Its aspect ratio must be close to the first frame's. | IMAGE | No | - | +| `model.prompt` | Describes how the scene moves and sounds. Must contain at least one non-whitespace character, up to 5000 characters (default: empty). | STRING | Yes | Up to 5000 characters | +| `model.duration` | Length of the video in seconds. `"auto"` lets the model choose the length from the prompt. Ignored when `model.audio` is connected: the video then follows the audio length, rounded up to a whole second, up to 20 seconds (default: `"5"`). | COMBO | Yes | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `model.resolution` | Output resolution. 720p renders about 0.9 megapixels (1280x704 at 16:9), 1080p about 2 megapixels (1920x1088 at 16:9) (default: `"720p"`). | COMBO | Yes | `"720p"`
`"1080p"` | +| `model.fps` | Frames per second. 48 fps is not available with draft at 1080p (default: `"24"`). | COMBO | Yes | `"24"`
`"48"` | +| `model.draft` | Faster, less detailed render, billed at a lower rate than a standard render (default: False). | BOOLEAN | Yes | True/False | +| `model.generate_audio` | Generate a soundtrack for the video. Ignored when `model.audio` is connected, which becomes the soundtrack instead (default: True). | BOOLEAN | Yes | True/False | +| `model.enhance_prompt` | Rewrite the prompt with more detail before generation; short prompts need it. Turn it off to reproduce a result exactly with the same seed (default: True). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.audio` | Audio that drives the motion and becomes the soundtrack. At least 1 second long; audio longer than 20 seconds is truncated. Sets the video length instead of `model.duration`. | AUDIO | No | - | +| `model.seed` | Seed for the generation. The same seed reproduces a result exactly only when `model.enhance_prompt` is off (default: 42). | INT | Yes | 0 to 2147483647 | + +**Notes:** + +- `model.first_frame` is required and fixes the output aspect ratio, so this node has no aspect ratio input. +- `model.last_frame` is optional, but its aspect ratio has to be close to the first frame's or the node raises an error. +- `model.prompt` is required and limited to 5000 characters. +- Draft at 1080p cannot be combined with 48 fps: the node raises an error, so either turn draft off or use 24 fps. +- Connected audio must be at least 1 second long; anything past 20 seconds is ignored. +- With `model.audio` connected the audio sets the video length, so `model.duration` and `model.generate_audio` have no effect. + +## Outputs + +| Output Name | Description | Data Type | +| --- | --- | --- | +| `video` | The generated video with its soundtrack. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaImageToVideoNode/en.md) + +--- +**Source fingerprint (SHA-256):** `da8952e478eee593543fa7ae1aa329ad5bd5078024f905cdba185d18e76db130` diff --git a/built-in-nodes/PrunaTextToVideoNode.mdx b/built-in-nodes/PrunaTextToVideoNode.mdx new file mode 100644 index 0000000000..ef3e7f6667 --- /dev/null +++ b/built-in-nodes/PrunaTextToVideoNode.mdx @@ -0,0 +1,50 @@ +--- +title: "PrunaTextToVideoNode - ComfyUI Built-in Node Documentation" +description: "Generates a video from a text prompt with Pruna's P-Video-2 model." +sidebarTitle: "PrunaTextToVideoNode" +icon: "circle" +mode: wide +--- + +Generates a video from a text prompt with Pruna's P-Video-2 model. The prompt describes the scene, its motion and its sound, and the node either generates its own soundtrack or takes an audio clip that drives the motion and becomes the soundtrack. + +## Inputs + +### Common Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model` | Pruna video model to use. Selecting a model reveals its own inputs below. | DYNAMIC_COMBO | Yes | `"p-video-2"` | + +### P-Video-2 Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model.prompt` | Describes the video, its motion and its sound. Must contain at least one non-whitespace character, up to 5000 characters (default: empty). | STRING | Yes | Up to 5000 characters | +| `model.aspect_ratio` | Aspect ratio of the output video (default: `"16:9"`). | COMBO | Yes | `"16:9"`
`"9:16"`
`"4:3"`
`"3:4"`
`"3:2"`
`"2:3"`
`"1:1"` | +| `model.duration` | Length of the video in seconds. `"auto"` lets the model choose the length from the prompt. Ignored when `model.audio` is connected: the video then follows the audio length, rounded up to a whole second, up to 20 seconds (default: `"5"`). | COMBO | Yes | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `model.resolution` | Output resolution. 720p renders about 0.9 megapixels (1280x704 at 16:9), 1080p about 2 megapixels (1920x1088 at 16:9) (default: `"720p"`). | COMBO | Yes | `"720p"`
`"1080p"` | +| `model.fps` | Frames per second. 48 fps is not available with draft at 1080p (default: `"24"`). | COMBO | Yes | `"24"`
`"48"` | +| `model.draft` | Faster, less detailed render, billed at a lower rate than a standard render (default: False). | BOOLEAN | Yes | True/False | +| `model.generate_audio` | Generate a soundtrack for the video. Ignored when `model.audio` is connected, which becomes the soundtrack instead (default: True). | BOOLEAN | Yes | True/False | +| `model.enhance_prompt` | Rewrite the prompt with more detail before generation; short prompts need it. Turn it off to reproduce a result exactly with the same seed (default: True). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.audio` | Audio that drives the motion and becomes the soundtrack. At least 1 second long; audio longer than 20 seconds is truncated. Sets the video length instead of `model.duration`. | AUDIO | No | - | +| `model.seed` | Seed for the generation. The same seed reproduces a result exactly only when `model.enhance_prompt` is off (default: 42). | INT | Yes | 0 to 2147483647 | + +**Notes:** + +- `model.prompt` is required and limited to 5000 characters. +- Draft at 1080p cannot be combined with 48 fps: the node raises an error, so either turn draft off or use 24 fps. +- Connected audio must be at least 1 second long; anything past 20 seconds is ignored. +- With `model.audio` connected the audio sets the video length, so `model.duration` and `model.generate_audio` have no effect. + +## Outputs + +| Output Name | Description | Data Type | +| --- | --- | --- | +| `video` | The generated video with its soundtrack. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaTextToVideoNode/en.md) + +--- +**Source fingerprint (SHA-256):** `bb7bacf2591618220c72525c1e32382174abe3a55069720adbc84fc1d8081718` diff --git a/built-in-nodes/TextGenerate.mdx b/built-in-nodes/TextGenerate.mdx index 3dacd20b49..1529cadac3 100644 --- a/built-in-nodes/TextGenerate.mdx +++ b/built-in-nodes/TextGenerate.mdx @@ -23,6 +23,7 @@ The TextGenerate node uses a CLIP model to create text based on a user's prompt. | `max_length` | The maximum number of tokens the model will generate. The default value is 512. | INT | Yes | 1 to 32768 | | `thinking` | Operate in thinking mode if the model supports it. The default value is False. | BOOLEAN | No | True or False | | `use_default_template` | Use the built in system prompt/template if the model has one. The default value is True. This is an advanced parameter. | BOOLEAN | No | True or False | +| `mtp` | Speculative decoding with the checkpoint's multi-token-prediction head. Has no effect without MTP weights. `"auto"` adapts the draft depth, `"2"` to `"5"` pin it. Sampled output stays correctly distributed but differs from non-MTP output for the same seed (default: `"auto"`). | COMBO | No | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | ### Sampling Parameters (when `sampling_mode` is "on") @@ -30,7 +31,7 @@ The TextGenerate node uses a CLIP model to create text based on a user's prompt. | --- | --- | --- | --- | --- | | `temperature` | Controls the randomness of the output. Lower values make the output more predictable, higher values make it more creative. The default value is 0.7. | FLOAT | Yes | 0.01 to 2.0 | | `top_k` | Limits the sampling pool to the top K most likely next tokens. A value of 0 disables this filter. The default value is 64. | INT | Yes | 0 to 1000 | -| `top_p` | Uses nucleus sampling, limiting choices to tokens whose cumulative probability is less than this value. The default value is 0.95. | FLOAT | Yes | 0.0 to 1.0 | +| `top_p` | Uses nucleus sampling: it keeps the smallest set of most likely tokens whose cumulative probability reaches this value. The default value is 0.95. | FLOAT | Yes | 0.0 to 1.0 | | `min_p` | Sets a minimum probability threshold for tokens to be considered. The default value is 0.05. | FLOAT | Yes | 0.0 to 1.0 | | `repetition_penalty` | Penalizes tokens that have already been generated to reduce repetition. A value of 1.0 applies no penalty. The default value is 1.05. | FLOAT | Yes | 0.0 to 5.0 | | `seed` | A number used to initialize the random number generator for reproducible results. The default value is 0. | INT | Yes | 0 to 18446744073709551615 | @@ -47,4 +48,4 @@ The TextGenerate node uses a CLIP model to create text based on a user's prompt. > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerate/en.md) --- -**Source fingerprint (SHA-256):** `6274a2db7c9a963304daf6df494b2b20879155e918d73429fd2ce7f3b5b9da02` +**Source fingerprint (SHA-256):** `7d9f6aee19e076aa0afb4d57060b09474206ecf2492c0944762965fabac92c51` diff --git a/built-in-nodes/TextGenerateLTX2Prompt.mdx b/built-in-nodes/TextGenerateLTX2Prompt.mdx index b33002590b..bf4185aea5 100644 --- a/built-in-nodes/TextGenerateLTX2Prompt.mdx +++ b/built-in-nodes/TextGenerateLTX2Prompt.mdx @@ -10,17 +10,34 @@ The TextGenerateLTX2Prompt node expands a short user prompt into a detailed, aud ## Inputs +### Common Inputs + | Parameter | Description | Data Type | Required | Range | | --- | --- | --- | --- | --- | -| `clip` | The CLIP model used for text encoding. The node checks the model's tokenizer name to select the matching instructions: Gemma 4 based models use the LTX-2.4 format, while other models use the LTX-2 (Gemma 3) format. | CLIP | Yes | | -| `prompt` | The raw text input describing the scene or concept to be expanded into a detailed video generation prompt. | STRING | Yes | | -| `max_length` | The maximum number of tokens the language model is allowed to generate. | INT | Yes | | -| `sampling_mode` | The sampling strategy used to select the next token during text generation. | COMBO | Yes | `"greedy"`
`"top_k"`
`"top_p"`
`"temperature"` | -| `image` | An optional input image used as the first frame of the video. When provided, the node switches to image-to-video mode and uses a system prompt that expands the user prompt based on the image's content. | IMAGE | No | | -| `thinking` | When enabled, the model is instructed to reason before answering. Any reasoning block is removed from the returned output (default: False). | BOOLEAN | No | | -| `use_default_template` | When enabled, the node uses the default chat template for formatting (default: True). | BOOLEAN | No | | -| `video` | An optional video input that can be used as additional context for generation. | VIDEO | No | | -| `audio` | An optional audio input that can be used as additional context for generation. | AUDIO | No | | +| `clip` | The CLIP model used for text encoding. The node checks the model's tokenizer name to select the matching instructions: Gemma 4 based models use the LTX-2.4 format, while other models use the LTX-2 (Gemma 3) format. | CLIP | Yes | - | +| `prompt` | The raw text input describing the scene or concept to be expanded into a detailed video generation prompt. | STRING | Yes | - | +| `image` | An optional input image used as the first frame of the video. When provided, the node switches to image-to-video mode and uses a system prompt that expands the user prompt based on the image's content. | IMAGE | No | - | +| `video` | An optional video input used as additional context. Passed to the language model as an image batch; assumed to be 24 FPS and subsampled to 1 FPS internally. | IMAGE | No | - | +| `audio` | An optional audio input that can be used as additional context for generation. | AUDIO | No | - | +| `max_length` | The maximum number of tokens the language model is allowed to generate (default: 512). | INT | Yes | 1 to 32768 | +| `sampling_mode` | Controls whether random sampling is used during text generation. When set to `"on"`, the sampling parameters below become available; with `"off"` the node generates text without random sampling. | DYNAMIC_COMBO | Yes | `"on"`
`"off"` | +| `thinking` | When enabled, the model is instructed to reason before answering. Any reasoning block is removed from the returned output (default: False). | BOOLEAN | No | True/False | +| `use_default_template` | When enabled, the node uses the default chat template for formatting (default: True). Advanced setting. | BOOLEAN | No | True/False | +| `mtp` | Speculative decoding with the checkpoint's multi-token-prediction head. Has no effect without MTP weights. `"auto"` adapts the draft depth, `"2"` to `"5"` pin it. Sampled output stays correctly distributed but differs from non-MTP output for the same seed (default: `"auto"`). | COMBO | No | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | + +### Sampling Parameters (when `sampling_mode` is "on") + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `temperature` | Controls the randomness of the output. Lower values make the output more predictable, higher values make it more creative (default: 0.7). | FLOAT | Yes | 0.01 to 2.0 | +| `top_k` | Limits the sampling pool to the top K most likely next tokens. A value of 0 disables this filter (default: 64). | INT | Yes | 0 to 1000 | +| `top_p` | Uses nucleus sampling: it keeps the smallest set of most likely tokens whose cumulative probability reaches this value. (default: 0.95) | FLOAT | Yes | 0.0 to 1.0 | +| `min_p` | Sets a minimum probability threshold for tokens to be considered (default: 0.05). | FLOAT | Yes | 0.0 to 1.0 | +| `repetition_penalty` | Penalizes tokens that have already been generated to reduce repetition. A value of 1.0 applies no penalty (default: 1.05). | FLOAT | Yes | 0.0 to 5.0 | +| `seed` | A number used to initialize the random number generator for reproducible results (default: 0). | INT | Yes | 0 to 18446744073709551615 | +| `presence_penalty` | Penalizes new tokens based on whether they have appeared in the text so far, encouraging the model to talk about new topics (default: 0.0). | FLOAT | No | 0.0 to 5.0 | + +**Note:** The sampling parameters above are only active and visible in the node interface when `sampling_mode` is set to "on". When it is set to "off", no sampling parameters are available and the node generates text without random sampling. **Note:** The behavior of the node changes based on its inputs: @@ -33,9 +50,9 @@ The TextGenerateLTX2Prompt node expands a short user prompt into a detailed, aud | Output Name | Description | Data Type | | --- | --- | --- | -| `output` | The enhanced video-generation prompt produced by the language model, with any reasoning block removed. If the result is empty, the original user prompt is returned. | STRING | +| `generated_text` | The enhanced video-generation prompt produced by the language model, with any reasoning block removed. If the result is empty, the original user prompt is returned. | STRING | > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/en.md) --- -**Source fingerprint (SHA-256):** `8f524ea60a247217dde8a1edaf7a689e253ae05acc9eb52ad47b91e879dba1df` +**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943` diff --git a/built-in-nodes/TripoPSeriesImageToModelNode.mdx b/built-in-nodes/TripoPSeriesImageToModelNode.mdx new file mode 100644 index 0000000000..ef06d7a64e --- /dev/null +++ b/built-in-nodes/TripoPSeriesImageToModelNode.mdx @@ -0,0 +1,56 @@ +--- +title: "TripoPSeriesImageToModelNode - ComfyUI Built-in Node Documentation" +description: "Generates a low-poly 3D model with clean topology from a single image using Tripo's P2 model." +sidebarTitle: "TripoPSeriesImageToModelNode" +icon: "circle" +mode: wide +--- + +Generates a low-poly 3D model with clean topology from a single image using Tripo's P2 model. The result comes back as a triangle mesh (GLB) or, when `model.quad` is enabled, as a quad-dominant mesh (FBX). + +## Inputs + +### Common Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model` | Tripo P-series model to use. Selecting a model reveals its own inputs below. | DYNAMIC_COMBO | Yes | `"P2"` | + +### P2 Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model.image` | The image the model is generated from. | IMAGE | Yes | - | +| `model.quad` | Return a quad-dominant mesh on the FBX output instead of a triangle mesh on the GLB output (default: False). | BOOLEAN | Yes | True/False | +| `model.face_limit` | Target face count. `-1` lets Tripo choose. With `model.quad` enabled the limit is 48 to 25,000, otherwise 48 to 50,000 (default: -1). | INT | Yes | -1, or 48 to 50000 | +| `model.texture` | Base color texture resolution: standard is 2K, detailed 4K and extreme 8K. `"none"` returns an untextured mesh (default: `"standard"`). | COMBO | Yes | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `model.pbr` | Add metallic, roughness and normal maps to the base color. Ignored when `model.texture` is `"none"` (default: True). | BOOLEAN | Yes | True/False | +| `model.model_seed` | Seed for the geometry (default: 42). | INT | Yes | 0 to 2147483647 | +| `model.texture_alignment` | Match the colors of the input image, or fit the textures to the generated geometry. Ignored when `model.texture` is `"none"` (default: `"original_image"`). Advanced setting. | COMBO | Yes | `"original_image"`
`"geometry"` | +| `model.orientation` | `"align_image"` rotates the model to the viewpoint of the input image. Ignored when `model.texture` is `"none"` (default: `"default"`). Advanced setting. | COMBO | Yes | `"default"`
`"align_image"` | +| `model.enable_image_autofix` | Let Tripo enhance a low-resolution or low-quality image before modeling (default: False). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.texture_seed` | Seed for the textures (default: 42). Advanced setting. | INT | Yes | 0 to 2147483647 | +| `model.auto_size` | Scale the model to its real-world size in meters through its scene transform. Ignored when `model.texture` is `"none"` (default: False). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.export_uv` | UV unwrap the mesh when it is untextured. Textured meshes are always unwrapped (default: True). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.compress_geometry` | Apply meshopt geometry compression: much smaller files, but ComfyUI's 3D preview cannot display them. Ignored for quad meshes (default: False). Advanced setting. | BOOLEAN | Yes | True/False | + +**Notes:** + +- `model.image` is required and only the first image of the batch is used. +- `model.face_limit` is a target rather than a hard cap, so the result can contain more faces than requested. `-1` leaves the choice to Tripo. +- `model.quad` decides which output carries the mesh. With it enabled the model arrives on the FBX output and the GLB output stays empty; with it disabled the model arrives on GLB and FBX stays empty. The node raises an error if the empty output is the one you connected. +- `model.texture`, `model.pbr`, `model.texture_seed`, `model.auto_size`, `model.texture_alignment` and `model.orientation` only apply to textured models: with `"none"` the node sends no texture settings and returns bare geometry. +- `model.compress_geometry` has no effect on quad meshes. + +## Outputs + +| Output Name | Description | Data Type | +| --- | --- | --- | +| `model task_id` | The unique task ID for the model generation request. | MODEL_TASK_ID | +| `GLB` | The generated 3D model in GLB format. Empty when `model.quad` is enabled. | FILE3DGLB | +| `FBX` | The generated 3D model in FBX format. Only populated when `model.quad` is enabled. | FILE3DFBX | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesImageToModelNode/en.md) + +--- +**Source fingerprint (SHA-256):** `9bfad31ee00546d0603ce3273502cfc93c79e3b125941fed255866aa83f770a5` diff --git a/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx b/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx new file mode 100644 index 0000000000..1f78254a9d --- /dev/null +++ b/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx @@ -0,0 +1,59 @@ +--- +title: "TripoPSeriesMultiviewToModelNode - ComfyUI Built-in Node Documentation" +description: "Generates a low-poly 3D model with clean topology from several views of the same subject using Tripo's P2 model." +sidebarTitle: "TripoPSeriesMultiviewToModelNode" +icon: "circle" +mode: wide +--- + +Generates a low-poly 3D model with clean topology from several views of the same subject using Tripo's P2 model. The front view is required and one to three of the left, back and right views can be added to improve the result. The model comes back as a triangle mesh (GLB) or, when `model.quad` is enabled, as a quad-dominant mesh (FBX). + +## Inputs + +### Common Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model` | Tripo P-series model to use. Selecting a model reveals its own inputs below. | DYNAMIC_COMBO | Yes | `"P2"` | + +### P2 Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model.image` | Front view (0°) of the subject. | IMAGE | Yes | - | +| `model.image_left` | Left view (90°), the subject's own left side. | IMAGE | No | - | +| `model.image_back` | Back view (180°). | IMAGE | No | - | +| `model.image_right` | Right view (270°), the subject's own right side. | IMAGE | No | - | +| `model.quad` | Return a quad-dominant mesh on the FBX output instead of a triangle mesh on the GLB output (default: False). | BOOLEAN | Yes | True/False | +| `model.face_limit` | Target face count. `-1` lets Tripo choose. With `model.quad` enabled the limit is 48 to 25,000, otherwise 48 to 50,000 (default: -1). | INT | Yes | -1, or 48 to 50000 | +| `model.texture` | Base color texture resolution: standard is 2K, detailed 4K and extreme 8K. `"none"` returns an untextured mesh (default: `"standard"`). | COMBO | Yes | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `model.pbr` | Add metallic, roughness and normal maps to the base color. Ignored when `model.texture` is `"none"` (default: True). | BOOLEAN | Yes | True/False | +| `model.model_seed` | Seed for the geometry (default: 42). | INT | Yes | 0 to 2147483647 | +| `model.texture_alignment` | Match the colors of the input images, or fit the textures to the generated geometry. Ignored when `model.texture` is `"none"` (default: `"original_image"`). Advanced setting. | COMBO | Yes | `"original_image"`
`"geometry"` | +| `model.orientation` | `"align_image"` rotates the model to the viewpoint of the input images. Ignored when `model.texture` is `"none"` (default: `"default"`). Advanced setting. | COMBO | Yes | `"default"`
`"align_image"` | +| `model.texture_seed` | Seed for the textures (default: 42). Advanced setting. | INT | Yes | 0 to 2147483647 | +| `model.auto_size` | Scale the model to its real-world size in meters through its scene transform. Ignored when `model.texture` is `"none"` (default: False). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.export_uv` | UV unwrap the mesh when it is untextured. Textured meshes are always unwrapped (default: True). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.compress_geometry` | Apply meshopt geometry compression: much smaller files, but ComfyUI's 3D preview cannot display them. Ignored for quad meshes (default: False). Advanced setting. | BOOLEAN | Yes | True/False | + +**Notes:** + +- `model.image` is required, and at least one of `model.image_left`, `model.image_back` or `model.image_right` has to be connected as well; the node raises an error if the front view is the only image. +- Only the first image of each batch is used. +- `model.face_limit` is a target rather than a hard cap, so the result can contain more faces than requested. `-1` leaves the choice to Tripo. +- `model.quad` decides which output carries the mesh. With it enabled the model arrives on the FBX output and the GLB output stays empty; with it disabled the model arrives on GLB and FBX stays empty. The node raises an error if the empty output is the one you connected. +- `model.texture`, `model.pbr`, `model.texture_seed`, `model.auto_size`, `model.texture_alignment` and `model.orientation` only apply to textured models: with `"none"` the node sends no texture settings and returns bare geometry. +- `model.compress_geometry` has no effect on quad meshes. + +## Outputs + +| Output Name | Description | Data Type | +| --- | --- | --- | +| `model task_id` | The unique task ID for the model generation request. | MODEL_TASK_ID | +| `GLB` | The generated 3D model in GLB format. Empty when `model.quad` is enabled. | FILE3DGLB | +| `FBX` | The generated 3D model in FBX format. Only populated when `model.quad` is enabled. | FILE3DFBX | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesMultiviewToModelNode/en.md) + +--- +**Source fingerprint (SHA-256):** `cea0a65ca001bc8298af9fbe2a83f592abf497987e634b0126482f3d2a18571c` diff --git a/built-in-nodes/TripoPSeriesTextToModelNode.mdx b/built-in-nodes/TripoPSeriesTextToModelNode.mdx new file mode 100644 index 0000000000..5b3a2941fc --- /dev/null +++ b/built-in-nodes/TripoPSeriesTextToModelNode.mdx @@ -0,0 +1,55 @@ +--- +title: "TripoPSeriesTextToModelNode - ComfyUI Built-in Node Documentation" +description: "Generates a low-poly 3D model with clean topology from a text prompt using Tripo's P2 model." +sidebarTitle: "TripoPSeriesTextToModelNode" +icon: "circle" +mode: wide +--- + +Generates a low-poly 3D model with clean topology from a text prompt using Tripo's P2 model. The result comes back as a triangle mesh (GLB) or, when `model.quad` is enabled, as a quad-dominant mesh (FBX). + +## Inputs + +### Common Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model` | Tripo P-series model to use. Selecting a model reveals its own inputs below. | DYNAMIC_COMBO | Yes | `"P2"` | + +### P2 Inputs + +| Parameter | Description | Data Type | Required | Range | +| --- | --- | --- | --- | --- | +| `model.prompt` | Text description of the 3D model to generate. Must not be empty, up to 1024 characters (default: empty). | STRING | Yes | Up to 1024 characters | +| `model.negative_prompt` | Text description of what to avoid in the generated model (default: empty). | STRING | No | Up to 255 characters | +| `model.quad` | Return a quad-dominant mesh on the FBX output instead of a triangle mesh on the GLB output (default: False). | BOOLEAN | Yes | True/False | +| `model.face_limit` | Target face count. `-1` lets Tripo choose. With `model.quad` enabled the limit is 48 to 25,000, otherwise 48 to 50,000 (default: -1). | INT | Yes | -1, or 48 to 50000 | +| `model.texture` | Base color texture resolution: standard is 2K, detailed 4K and extreme 8K. `"none"` returns an untextured mesh (default: `"standard"`). | COMBO | Yes | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `model.pbr` | Add metallic, roughness and normal maps to the base color. Ignored when `model.texture` is `"none"` (default: True). | BOOLEAN | Yes | True/False | +| `model.model_seed` | Seed for the geometry (default: 42). | INT | Yes | 0 to 2147483647 | +| `model.image_seed` | Seed for the image Tripo draws from the prompt before modeling (default: 42). Advanced setting. | INT | Yes | 0 to 2147483647 | +| `model.texture_seed` | Seed for the textures (default: 42). Advanced setting. | INT | Yes | 0 to 2147483647 | +| `model.auto_size` | Scale the model to its real-world size in meters through its scene transform. Ignored when `model.texture` is `"none"` (default: False). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.export_uv` | UV unwrap the mesh when it is untextured. Textured meshes are always unwrapped (default: True). Advanced setting. | BOOLEAN | Yes | True/False | +| `model.compress_geometry` | Apply meshopt geometry compression: much smaller files, but ComfyUI's 3D preview cannot display them. Ignored for quad meshes (default: False). Advanced setting. | BOOLEAN | Yes | True/False | + +**Notes:** + +- `model.prompt` is required; `model.negative_prompt` is optional and limited to 255 characters. +- `model.face_limit` is a target rather than a hard cap, so the result can contain more faces than requested. `-1` leaves the choice to Tripo. +- `model.quad` decides which output carries the mesh. With it enabled the model arrives on the FBX output and the GLB output stays empty; with it disabled the model arrives on GLB and FBX stays empty. The node raises an error if the empty output is the one you connected. +- `model.texture`, `model.pbr`, `model.texture_seed` and `model.auto_size` only apply to textured models: with `"none"` the node sends no texture settings and returns bare geometry. +- `model.compress_geometry` has no effect on quad meshes. + +## Outputs + +| Output Name | Description | Data Type | +| --- | --- | --- | +| `model task_id` | The unique task ID for the model generation request. | MODEL_TASK_ID | +| `GLB` | The generated 3D model in GLB format. Empty when `model.quad` is enabled. | FILE3DGLB | +| `FBX` | The generated 3D model in FBX format. Only populated when `model.quad` is enabled. | FILE3DFBX | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesTextToModelNode/en.md) + +--- +**Source fingerprint (SHA-256):** `e55596c1a237cf6b92e3bdead4359f380c6cba60992dcc61b5ee4e6b1bdd843b` diff --git a/built-in-nodes/YuE2GenerateMusic.mdx b/built-in-nodes/YuE2GenerateMusic.mdx index 193a678bd5..a62ba90628 100644 --- a/built-in-nodes/YuE2GenerateMusic.mdx +++ b/built-in-nodes/YuE2GenerateMusic.mdx @@ -23,6 +23,7 @@ Generates music tokens and acoustic conditioning from a style, lyrics, and an AB | `top_p` | Nucleus sampling probability threshold. default: 0.95 (advanced) | FLOAT | Yes | 0.01 to 1.0 | | `top_k` | Top-k sampling limit. default: 100 (advanced) | INT | Yes | 1 to 32768 | | `repetition_penalty` | Penalty applied to repeated tokens. default: 1.2 (advanced) | FLOAT | Yes | 0.01 to 10.0 | +| `cfg_scale` | Autoregressive guidance for style and lyrics. 1.0 disables CFG, matching the ABC workflow. Use 1.01 to match the original off-mode guidance. default: 1.0 (advanced, optional) | FLOAT | No | 0.0 to 100.0 | Note: If `abc` is empty or contains only whitespace, the `mode` selection is ignored and off mode is used automatically. @@ -36,4 +37,4 @@ Note: If `abc` is empty or contains only whitespace, the `mode` selection is ign > This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/YuE2GenerateMusic/en.md) --- -**Source fingerprint (SHA-256):** `54f5d46cf083726bdf97c86e5683b2727840f75bb553bddf9525cfbf5affa44c` +**Source fingerprint (SHA-256):** `5a88e185d2998c51acff7f0c76c8c35ca30b80b88cb541d97f9ab91566b5a3ed` diff --git a/docs.json b/docs.json index 5379a816e5..49f602132d 100644 --- a/docs.json +++ b/docs.json @@ -1678,7 +1678,7 @@ ] }, { - "group": "Trellis2", + "group": "Trellis", "pages": [ "built-in-nodes/Pixal3DConditioning", "built-in-nodes/Pixal3DMultiViewConditioning", @@ -1870,9 +1870,7 @@ "built-in-nodes/LatentFromBatch", "built-in-nodes/RebatchLatents", "built-in-nodes/RepeatLatentBatch", - "built-in-nodes/ReplaceVideoLatentFrames", - "built-in-nodes/SeedVR2TemporalChunk", - "built-in-nodes/SeedVR2TemporalMerge" + "built-in-nodes/ReplaceVideoLatentFrames" ] }, { @@ -1899,12 +1897,6 @@ "built-in-nodes/EmptyHiDreamO1LatentImage" ] }, - { - "group": "Hunyhuan Video", - "pages": [ - "built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" - ] - }, { "group": "Hunyuan 3d", "pages": [ @@ -1922,7 +1914,8 @@ "group": "Hunyuan Video", "pages": [ "built-in-nodes/EmptyHunyuanLatentVideo", - "built-in-nodes/EmptyHunyuanVideo15Latent" + "built-in-nodes/EmptyHunyuanVideo15Latent", + "built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" ] }, { @@ -1962,6 +1955,13 @@ "built-in-nodes/EmptyQwenImageLayeredLatentImage" ] }, + { + "group": "Seedvr", + "pages": [ + "built-in-nodes/SeedVR2TemporalChunk", + "built-in-nodes/SeedVR2TemporalMerge" + ] + }, { "group": "Stable Cascade", "pages": [ @@ -2376,6 +2376,9 @@ "built-in-nodes/TripoP1ImageToModelNode", "built-in-nodes/TripoP1MultiviewToModelNode", "built-in-nodes/TripoP1TextToModelNode", + "built-in-nodes/TripoPSeriesImageToModelNode", + "built-in-nodes/TripoPSeriesMultiviewToModelNode", + "built-in-nodes/TripoPSeriesTextToModelNode", "built-in-nodes/TripoRetargetNode", "built-in-nodes/TripoRetopologyNode", "built-in-nodes/TripoRigCheckNode", @@ -2831,6 +2834,13 @@ "built-in-nodes/PixverseV6TextToVideoNode" ] }, + { + "group": "Pruna", + "pages": [ + "built-in-nodes/PrunaImageToVideoNode", + "built-in-nodes/PrunaTextToVideoNode" + ] + }, { "group": "Runway", "pages": [ @@ -5021,7 +5031,7 @@ ] }, { - "group": "Trellis2", + "group": "Trellis", "pages": [ "zh/built-in-nodes/Pixal3DConditioning", "zh/built-in-nodes/Pixal3DMultiViewConditioning", @@ -5213,9 +5223,7 @@ "zh/built-in-nodes/LatentFromBatch", "zh/built-in-nodes/RebatchLatents", "zh/built-in-nodes/RepeatLatentBatch", - "zh/built-in-nodes/ReplaceVideoLatentFrames", - "zh/built-in-nodes/SeedVR2TemporalChunk", - "zh/built-in-nodes/SeedVR2TemporalMerge" + "zh/built-in-nodes/ReplaceVideoLatentFrames" ] }, { @@ -5242,12 +5250,6 @@ "zh/built-in-nodes/EmptyHiDreamO1LatentImage" ] }, - { - "group": "Hunyhuan Video", - "pages": [ - "zh/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" - ] - }, { "group": "Hunyuan 3d", "pages": [ @@ -5265,7 +5267,8 @@ "group": "Hunyuan Video", "pages": [ "zh/built-in-nodes/EmptyHunyuanLatentVideo", - "zh/built-in-nodes/EmptyHunyuanVideo15Latent" + "zh/built-in-nodes/EmptyHunyuanVideo15Latent", + "zh/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" ] }, { @@ -5305,6 +5308,13 @@ "zh/built-in-nodes/EmptyQwenImageLayeredLatentImage" ] }, + { + "group": "Seedvr", + "pages": [ + "zh/built-in-nodes/SeedVR2TemporalChunk", + "zh/built-in-nodes/SeedVR2TemporalMerge" + ] + }, { "group": "Stable Cascade", "pages": [ @@ -5719,6 +5729,9 @@ "zh/built-in-nodes/TripoP1ImageToModelNode", "zh/built-in-nodes/TripoP1MultiviewToModelNode", "zh/built-in-nodes/TripoP1TextToModelNode", + "zh/built-in-nodes/TripoPSeriesImageToModelNode", + "zh/built-in-nodes/TripoPSeriesMultiviewToModelNode", + "zh/built-in-nodes/TripoPSeriesTextToModelNode", "zh/built-in-nodes/TripoRetargetNode", "zh/built-in-nodes/TripoRetopologyNode", "zh/built-in-nodes/TripoRigCheckNode", @@ -6174,6 +6187,13 @@ "zh/built-in-nodes/PixverseV6TextToVideoNode" ] }, + { + "group": "Pruna", + "pages": [ + "zh/built-in-nodes/PrunaImageToVideoNode", + "zh/built-in-nodes/PrunaTextToVideoNode" + ] + }, { "group": "Runway", "pages": [ @@ -8768,7 +8788,7 @@ ] }, { - "group": "Trellis2", + "group": "Trellis", "pages": [ "ja/built-in-nodes/Pixal3DConditioning", "ja/built-in-nodes/Pixal3DMultiViewConditioning", @@ -8960,9 +8980,7 @@ "ja/built-in-nodes/LatentFromBatch", "ja/built-in-nodes/RebatchLatents", "ja/built-in-nodes/RepeatLatentBatch", - "ja/built-in-nodes/ReplaceVideoLatentFrames", - "ja/built-in-nodes/SeedVR2TemporalChunk", - "ja/built-in-nodes/SeedVR2TemporalMerge" + "ja/built-in-nodes/ReplaceVideoLatentFrames" ] }, { @@ -8989,12 +9007,6 @@ "ja/built-in-nodes/EmptyHiDreamO1LatentImage" ] }, - { - "group": "Hunyhuan Video", - "pages": [ - "ja/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" - ] - }, { "group": "Hunyuan 3d", "pages": [ @@ -9012,7 +9024,8 @@ "group": "Hunyuan Video", "pages": [ "ja/built-in-nodes/EmptyHunyuanLatentVideo", - "ja/built-in-nodes/EmptyHunyuanVideo15Latent" + "ja/built-in-nodes/EmptyHunyuanVideo15Latent", + "ja/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" ] }, { @@ -9052,6 +9065,13 @@ "ja/built-in-nodes/EmptyQwenImageLayeredLatentImage" ] }, + { + "group": "Seedvr", + "pages": [ + "ja/built-in-nodes/SeedVR2TemporalChunk", + "ja/built-in-nodes/SeedVR2TemporalMerge" + ] + }, { "group": "Stable Cascade", "pages": [ @@ -9466,6 +9486,9 @@ "ja/built-in-nodes/TripoP1ImageToModelNode", "ja/built-in-nodes/TripoP1MultiviewToModelNode", "ja/built-in-nodes/TripoP1TextToModelNode", + "ja/built-in-nodes/TripoPSeriesImageToModelNode", + "ja/built-in-nodes/TripoPSeriesMultiviewToModelNode", + "ja/built-in-nodes/TripoPSeriesTextToModelNode", "ja/built-in-nodes/TripoRetargetNode", "ja/built-in-nodes/TripoRetopologyNode", "ja/built-in-nodes/TripoRigCheckNode", @@ -9921,6 +9944,13 @@ "ja/built-in-nodes/PixverseV6TextToVideoNode" ] }, + { + "group": "Pruna", + "pages": [ + "ja/built-in-nodes/PrunaImageToVideoNode", + "ja/built-in-nodes/PrunaTextToVideoNode" + ] + }, { "group": "Runway", "pages": [ @@ -12440,7 +12470,7 @@ ] }, { - "group": "Trellis2", + "group": "Trellis", "pages": [ "ko/built-in-nodes/Pixal3DConditioning", "ko/built-in-nodes/Pixal3DMultiViewConditioning", @@ -12632,9 +12662,7 @@ "ko/built-in-nodes/LatentFromBatch", "ko/built-in-nodes/RebatchLatents", "ko/built-in-nodes/RepeatLatentBatch", - "ko/built-in-nodes/ReplaceVideoLatentFrames", - "ko/built-in-nodes/SeedVR2TemporalChunk", - "ko/built-in-nodes/SeedVR2TemporalMerge" + "ko/built-in-nodes/ReplaceVideoLatentFrames" ] }, { @@ -12661,12 +12689,6 @@ "ko/built-in-nodes/EmptyHiDreamO1LatentImage" ] }, - { - "group": "Hunyhuan Video", - "pages": [ - "ko/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" - ] - }, { "group": "Hunyuan 3d", "pages": [ @@ -12684,7 +12706,8 @@ "group": "Hunyuan Video", "pages": [ "ko/built-in-nodes/EmptyHunyuanLatentVideo", - "ko/built-in-nodes/EmptyHunyuanVideo15Latent" + "ko/built-in-nodes/EmptyHunyuanVideo15Latent", + "ko/built-in-nodes/HunyuanVideo15LatentUpscaleWithModel" ] }, { @@ -12724,6 +12747,13 @@ "ko/built-in-nodes/EmptyQwenImageLayeredLatentImage" ] }, + { + "group": "Seedvr", + "pages": [ + "ko/built-in-nodes/SeedVR2TemporalChunk", + "ko/built-in-nodes/SeedVR2TemporalMerge" + ] + }, { "group": "Stable Cascade", "pages": [ @@ -13138,6 +13168,9 @@ "ko/built-in-nodes/TripoP1ImageToModelNode", "ko/built-in-nodes/TripoP1MultiviewToModelNode", "ko/built-in-nodes/TripoP1TextToModelNode", + "ko/built-in-nodes/TripoPSeriesImageToModelNode", + "ko/built-in-nodes/TripoPSeriesMultiviewToModelNode", + "ko/built-in-nodes/TripoPSeriesTextToModelNode", "ko/built-in-nodes/TripoRetargetNode", "ko/built-in-nodes/TripoRetopologyNode", "ko/built-in-nodes/TripoRigCheckNode", @@ -13593,6 +13626,13 @@ "ko/built-in-nodes/PixverseV6TextToVideoNode" ] }, + { + "group": "Pruna", + "pages": [ + "ko/built-in-nodes/PrunaImageToVideoNode", + "ko/built-in-nodes/PrunaTextToVideoNode" + ] + }, { "group": "Runway", "pages": [ diff --git a/ja/built-in-nodes/MoGeInference.mdx b/ja/built-in-nodes/MoGeInference.mdx index 65e5bcaa1b..19578299df 100644 --- a/ja/built-in-nodes/MoGeInference.mdx +++ b/ja/built-in-nodes/MoGeInference.mdx @@ -1,34 +1,35 @@ --- title: "MoGeInference - ComfyUI Built-in Node Documentation" -description: "MoGe を単一の画像に対して実行し、深度とジオメトリを推定します。" +description: "画像に対して MoGe を実行し、深度とジオメトリを推定します。" sidebarTitle: "MoGeInference" icon: "circle" mode: wide --- -MoGe を単一の画像に対して実行し、深度とジオメトリを推定します。このノードは入力画像を MoGe モデルで処理し、3D点群、深度マップ、カメラ内部行列、マスク、表面法線を生成します。 +画像に対して MoGe を実行し、深度とジオメトリを推定します。このノードは入力画像を MoGe モデルで処理し、3D ポイントクラウド、深度マップ、カメラ内部パラメータ、マスク、およびサーフェス法線を生成します。 ## 入力 | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `moge_model` | 推論に使用するMoGeモデルです。 | MOGE_MODEL | はい | N/A | -| `image` | 深度とジオメトリ推定用の入力画像です。最初の3つのカラーチャンネル(RGB)のみが使用されます。 | IMAGE | はい | N/A | -| `resolution_level` | 処理解像度を制御します。0が最も速く、9が最も詳細です。(デフォルト: 9) | INT | はい | 0〜9 | -| `fov_x_degrees` | (上級設定)ソースカメラの水平画角(度単位)です。深度マップを3Dに投影する際の焦点距離を設定します。0.0に設定すると、予測された点から画角を自動的に復元します。(デフォルト: 0.0) | FLOAT | はい | 0.0〜170.0 | -| `batch_size` | 1回の推論呼び出しあたりの画像数です。長い動画や画像セットでメモリが不足する場合は、この値を低くしてください。(デフォルト: 4) | INT | はい | 1〜64 | -| `force_projection` | (上級設定)予測された点の投影を強制します。(デフォルト: True) | BOOLEAN | はい | True/False | -| `apply_mask` | (上級設定)マスクされた(空または無効な)ピクセルを、点群および深度出力で無限遠に設定し、メッシュ化ツールがそれらを無視できるようにします。無効にすると、すべての場所で生の予測ジオメトリを保持しますが、マスクは引き続き個別に返されます。(デフォルト: True) | BOOLEAN | はい | True/False | +| `moge_model` | 推論に使用する MoGe モデルです。 | MOGE_MODEL | はい | N/A | +| `image` | 深度とジオメトリの推定に使用する入力画像です。最初の 3 つのカラーチャンネル(RGB)のみが使用されます。 | IMAGE | はい | N/A | +| `resolution_level` | 処理解像度を制御します。0 = 最速、9 = 最も詳細です。(デフォルト: 9) | INT | はい | 0 から 9 | +| `fov_x_degrees` | (詳細設定)ソースカメラの水平方向の視野角です。深度マップを 3D に逆投影する際に使用する焦点距離を設定します。0 = 予測されたポイントから自動復元します。(デフォルト: 0.0) | FLOAT | はい | 0.0 から 170.0(ステップ 0.1) | +| `batch_size` | 1 回の推論呼び出しあたりの画像数です。長い動画や画像セットで OOM(メモリ不足)が発生する場合は、この値を下げてください。(デフォルト: 4) | INT | はい | 1 から 64 | +| `force_projection` | (詳細設定)予測されたポイントの投影を強制します。(デフォルト: True) | BOOLEAN | はい | True/False | +| `apply_mask` | (詳細設定)マスクされた(空や無効な)ピクセルのポイントと深度を inf に設定し、メッシュ化時にそれらが除外されるようにします。無効にすると、予測された生のジオメトリがすべての箇所で維持されますが、マスクは別途返されます。(デフォルト: True) | BOOLEAN | はい | True/False | +| `refine_steps` | (詳細設定)MoGe-3 専用: 予測された深度に対してスパースなボリュメトリック・リファインメントを実行する回数です。回数を増やすと細部やエッジがより鮮明になりますが、コストはほぼ線形に増加します。0 にするとリファインメントが無効になります。MoGe-1 / MoGe-2 では無視されます。(デフォルト: 3) | INT | はい | 0 から 8 | -注:入力 `image` に `batch_size` より多くのフレームが含まれる場合、ノードはそれらを複数の推論呼び出しで処理し、結果を単一の出力ジオメトリに結合します。 +注: 入力 `image` のフレーム数が `batch_size` を超える場合、ノードは複数回の推論呼び出しで処理を行い、結果を単一の出力ジオメトリに結合します。 ## 出力 | 出力名 | 説明 | データ型 | | --- | --- | --- | -| `moge_geometry` | 推定されたジオメトリを含む辞書です。元の `image` が含まれ、`points`(3D点群)、`depth`(深度マップ)、`intrinsics`(カメラ内部行列)、`mask`(有効なピクセルを識別するマスク)、`normal`(表面法線)が含まれる場合があります。 | MOGE_GEOMETRY | +| `moge_geometry` | 推定されたジオメトリを含む辞書です。元の `image` を含み、さらに `points`(3D ポイントクラウド)、`depth`(深度マップ)、`intrinsics`(カメラ内部パラメータ行列)、`mask`(有効なピクセルを識別するマスク)、`normal`(サーフェス法線)を含む場合があります。 | MOGE_GEOMETRY | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGeInference/ja.md) --- -**Source fingerprint (SHA-256):** `59f6b8b1ab65147a47f5dc7ebee7b965a5ab37c6a0843a2c80d50c767ad98db4` +**Source fingerprint (SHA-256):** `10f3399d9b6bc4ff8a940c940f538a8ec8f38a15e7d65f162499c5ab264fad65` diff --git a/ja/built-in-nodes/MoGePanoramaInference.mdx b/ja/built-in-nodes/MoGePanoramaInference.mdx index 595b3d6856..81c04d9567 100644 --- a/ja/built-in-nodes/MoGePanoramaInference.mdx +++ b/ja/built-in-nodes/MoGePanoramaInference.mdx @@ -1,36 +1,37 @@ --- title: "MoGePanoramaInference - ComfyUI Built-in Node Documentation" -description: "このノードは、正距円筒図法のパノラマ画像に対して深度推定を実行します。" +description: "このノードは正距円筒パノラマ画像に対して深度推定を実行します。" sidebarTitle: "MoGePanoramaInference" icon: "circle" mode: wide --- -このノードは、正距円筒図法のパノラマ画像に対して深度推定を実行します。パノラマを12個の透視ビューに分割し、各ビューでMoGe深度推定モデルを実行し、ビューごとの結果を完全なパノラマをカバーする単一の深度マップにマージします。ビューごとに予測された法線とメートルスケールは無視されます。これは、ビューごとのスケールがオーバーラップする継ぎ目で一致しないためです。 +このノードは正距円筒パノラマ画像に対して深度推定を実行します。パノラマを12個の透視ビューに分割し、各ビューでMoGe深度推定モデルを実行し、ビューごとの結果を全パノラマを覆う単一の深度マップへマージします。ビューごとに予測された法線およびメートルスケールは無視されます。これは、ビューごとのスケールがオーバーラップする継ぎ目をまたいで一致しないためです。 ## 入力 | パラメータ | 説明 | データ型 | 必須 | 範囲 | |-----------|-------------|-----------|----------|-------| | `moge_model` | 推論に使用するMoGeモデル。 | MOGE_MODEL | はい | | -| `image` | 正距円筒図法のパノラマ(任意のアスペクト比)。このノードは単一の画像のみを受け付けます。画像のバッチを渡すとエラーになります。最初の3つのカラーチャンネル(RGB)のみが使用されます。 | IMAGE | はい | | +| `image` | 正距円筒パノラマ(任意のアスペクト比)。このノードは単一画像のみを受け付けます。画像のバッチを渡すとエラーが発生します。最初の3つのカラーチャンネル(RGB)のみが使用されます。 | IMAGE | はい | | | `resolution_level` | ビューごとの詳細度(0 = 最速、9 = 最も詳細)(デフォルト: 9)。 | INT | はい | 0 〜 9 | | `split_resolution` | 各透視分割の解像度(デフォルト: 512)。 | INT | はい | 256 〜 1024 | | `merge_resolution` | マージされた正距円筒距離マップの長辺解像度(デフォルト: 1920)。 | INT | はい | 256 〜 8192 | | `batch_size` | 推論バッチあたりのビュー数(合計12分割)(デフォルト: 4)。 | INT | はい | 1 〜 12 | +| `refine_steps` | MoGe-3のみ: 予測深度に対するスパースボリュメトリック精密化パス。パスを増やすと、ほぼ線形のコストで微細な詳細とエッジが鮮明になります。0にすると精密化は無効になります。MoGe-1 / MoGe-2では無視されます(デフォルト: 3)。 | INT | はい | 0 〜 8 | -**注意:** +**注記:** -- 入力は単一の画像である必要があります。`image` のバッチに複数の画像が含まれている場合、ノードはエラーを発生させます。 -- `merge_resolution` は長辺の最大サイズとして扱われます。パノラマがこの値より小さい場合、マージされたマップはアップスケールされず、元のパノラマサイズで生成されます。マージ結果は返される前に、元のパノラマ解像度にリサイズされます。 +- 入力は単一画像である必要があります。`image` のバッチに複数の画像が含まれている場合、このノードはエラーを発生させます。 +- `merge_resolution` は長辺の最大サイズとして扱われます。パノラマがこの値より小さい場合、マージされたマップはアップスケールされず、元のパノラマサイズで生成されます。マージ結果は返される前に元のパノラマ解像度へリサイズされます。 ## 出力 | 出力名 | 説明 | データ型 | |-------------|-------------|-----------| -| `moge_geometry` | 推定されたジオメトリを含む辞書: `points`(3D点群)、`depth`(深度マップ)、`mask`(有効領域マスク)、および `image`(入力画像)。 | MOGE_GEOMETRY | +| `moge_geometry` | 推定されたジオメトリを含む辞書:`points`(3D点群)、`depth`(深度マップ)、`mask`(有効領域マスク)、および `image`(入力画像)。 | MOGE_GEOMETRY | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGePanoramaInference/ja.md) --- -**Source fingerprint (SHA-256):** `d35b6d42a5bb17c184bc56fe3867d3a183017084dc81649c0663a9fba2362770` +**Source fingerprint (SHA-256):** `7f21452d035b2fe9d30b0cd15ddad10916439492b1d682a8b28f1a79e375df58` diff --git a/ja/built-in-nodes/OpenAIGPTImage1.mdx b/ja/built-in-nodes/OpenAIGPTImage1.mdx index 4d61ee9719..9d5f7d52b5 100644 --- a/ja/built-in-nodes/OpenAIGPTImage1.mdx +++ b/ja/built-in-nodes/OpenAIGPTImage1.mdx @@ -1,42 +1,41 @@ --- title: "OpenAIGPTImage1 - ComfyUI Built-in Node Documentation" -description: "OpenAI の GPT Image エンドポイントを介して同期的に画像を生成します。" +description: "OpenAI の GPT Image エンドポイントを通じて同期的に画像を生成します。" sidebarTitle: "OpenAIGPTImage1" icon: "circle" mode: wide --- -OpenAI の GPT Image エンドポイントを介して同期的に画像を生成します。テキストプロンプトから新しい画像を作成したり、入力画像とオプションのマスクが提供された場合は既存の画像を編集できます。このノードは `gpt-image-1`、`gpt-image-1.5`、`gpt-image-2` モデルをサポートしており、非推奨としてマークされています。 +OpenAI の GPT Image エンドポイントを通じて同期的に画像を生成します。テキストプロンプトから新しい画像を作成したり、入力画像とオプションのマスクが提供された場合に既存の画像を編集したりできます。このノードは `gpt-image-1`、`gpt-image-1.5`、`gpt-image-2` モデルをサポートしており、非推奨としてマークされています。 ## 入力 | パラメータ | 説明 | データ型 | 必須 | 範囲 | |-----------|-------------|-----------|----------|-------| | `プロンプト` | GPT Image 用のテキストプロンプト(デフォルト: "") | STRING | はい | - | -| `シード` | 生成用のランダムシード。バックエンドではまだ実装されていません(デフォルト: 0) | INT | いいえ | 0 〜 2147483647 | +| `シード` | 生成用のランダムシード。バックエンドではまだ実装されていません(デフォルト: 0) | INT | いいえ | 0〜2147483647 | | `品質` | 画像品質。コストと生成時間に影響します(デフォルト: "low") | COMBO | いいえ | "low"
"medium"
"high" | -| `背景` | 背景あり/なしで画像を返します(デフォルト: "auto") | COMBO | いいえ | "auto"
"opaque"
"transparent" | +| `背景` | 背景ありまたは背景なしで画像を返します(デフォルト: "auto") | COMBO | いいえ | "auto"
"opaque"
"transparent" | | `サイズ` | 画像サイズ。"Custom" を選択すると、カスタム幅と高さを使用します(GPT Image 2 のみ)(デフォルト: "auto") | COMBO | いいえ | "auto"
"1024x1024"
"1024x1536"
"1536x1024"
"2048x2048"
"2048x1152"
"1152x2048"
"3840x2160"
"2160x3840"
"Custom" | -| `生成数` | 生成する画像の数(デフォルト: 1) | INT | いいえ | 1 〜 8 | +| `生成数` | 生成する画像の数(デフォルト: 1) | INT | いいえ | 1〜8 | | `参照画像` | 画像編集用のオプションの参照画像 | IMAGE | いいえ | - | | `マスク` | インペイント用のオプションのマスク(白い領域が置き換えられます) | MASK | いいえ | - | | `model` | 使用する GPT Image モデル(デフォルト: "gpt-image-2") | COMBO | いいえ | "gpt-image-1"
"gpt-image-1.5"
"gpt-image-2" | -| `custom_width` | `size` が "Custom" の場合にのみ使用されます。16 の倍数である必要があります(GPT Image 2 のみ)(デフォルト: 1024) | INT | いいえ | 1024 〜 3840, step 16 | -| `custom_height` | `size` が "Custom" の場合にのみ使用されます。16 の倍数である必要があります(GPT Image 2 のみ)(デフォルト: 1024) | INT | いいえ | 1024 〜 3840, step 16 | +| `custom_width` | `size` が "Custom" の場合にのみ使用されます。16 の倍数である必要があります(GPT Image 2 のみ)(デフォルト: 1024) | INT | いいえ | 1024〜3840、ステップ 16 | +| `custom_height` | `size` が "Custom" の場合にのみ使用されます。16 の倍数である必要があります(GPT Image 2 のみ)(デフォルト: 1024) | INT | いいえ | 1024〜3840、ステップ 16 | -**パラメータの制約:** +**パラメータの制約:** -- `image` が提供された場合、ノードは画像編集エンドポイントを使用します。 -- `mask` は `image` が提供された場合にのみ使用できます。 +- `image` が提供されている場合、ノードは画像編集エンドポイントを使用します。 +- `mask` は `image` が提供されている場合にのみ使用できます。 - `mask` を使用する場合、単一の画像のみがサポートされます(バッチサイズは 1 である必要があります)。 - `mask` と `image` は同じサイズである必要があります。 -- カスタム解像度(`size` = "Custom")は `gpt-image-2` モデルのみがサポートしています。 +- カスタム解像度(`size` = "Custom")は `gpt-image-2` モデルのみでサポートされています。 - カスタム幅と高さは 16 の倍数である必要があります。 - カスタム解像度の最長辺は 3840 以下である必要があります。 -- カスタム解像度のアスペクト比は 3:1 を超えてはなりません。 -- カスタム解像度の総ピクセル数は 655,360 から 8,294,400 の間である必要があります。 -- `gpt-image-2` モデルでは透明背景はサポートされていません。 -- `gpt-image-1` および `gpt-image-1.5` モデルは、`auto`、`1024x1024`、`1024x1536`、`1536x1024` のサイズのみをサポートしています。その他のサイズは `gpt-image-2` モデルのみがサポートしています。 +- カスタム解像度のアスペクト比は 3:1 を超えてはいけません。 +- カスタム解像度の総ピクセル数は 655,360 ~ 8,294,400 である必要があります。 +- `gpt-image-1` および `gpt-image-1.5` モデルは、サイズ `auto`、`1024x1024`、`1024x1536`、`1536x1024` のみをサポートします。その他のサイズは `gpt-image-2` モデルのみでサポートされています。 ## 出力 @@ -47,4 +46,4 @@ OpenAI の GPT Image エンドポイントを介して同期的に画像を生 > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImage1/ja.md) --- -**Source fingerprint (SHA-256):** `bf588bffced6e66536b4cb54655ef6ebb9cf988d9739e3c379a8ebda1486e20a` +**Source fingerprint (SHA-256):** `f0f0db7fd2cdf8efd2155522b289aa8f3f939fa79a6e9060b0ffbb2dd20efa1e` diff --git a/ja/built-in-nodes/OpenAIGPTImageNodeV2.mdx b/ja/built-in-nodes/OpenAIGPTImageNodeV2.mdx index 1c771b601b..b82ee8267b 100644 --- a/ja/built-in-nodes/OpenAIGPTImageNodeV2.mdx +++ b/ja/built-in-nodes/OpenAIGPTImageNodeV2.mdx @@ -6,7 +6,7 @@ icon: "circle" mode: wide --- -このノードは、OpenAI の GPT Image API を使用して画像を生成します。`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-2`、`gpt-image-1.5`、`gpt-image-1` の5つのモデルに対応しており、画像編集用の参照画像を添付したり、マスクを使用して画像の置き換える部分を指定したりできます。 +このノードは、OpenAI の GPT Image API を使用して画像を生成します。`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-2`、`gpt-image-1.5`、`gpt-image-1` の 5 つのモデルをサポートし、画像編集用の参照画像を添付できます。また、マスクを使用して画像のどの部分を置き換えるかを指定できます。 ## 入力 @@ -17,9 +17,9 @@ mode: wide | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | | `モデル` | 使用する OpenAI GPT Image モデル。モデルを選択すると、そのモデル固有の追加パラメータが表示されます。 | DYNAMIC_COMBO | はい | `"gpt-image-2.5-flare"`
`"gpt-image-2.5-sunburst"`
`"gpt-image-2"`
`"gpt-image-1.5"`
`"gpt-image-1"` | -| `プロンプト` | GPT Image 用のテキストプロンプト(デフォルト: `""`)。 | STRING | はい | N/A | -| `n` | 生成する画像の枚数(デフォルト: `1`)。 | INT | はい | 1〜8 | -| `シード` | 再現性のためのシード値(デフォルト: `0`)。バックエンドではまだ実装されていません。 | INT | はい | 0〜2147483647 | +| `プロンプト` | GPT Image のテキストプロンプト(デフォルト: `""`)。 | STRING | はい | N/A | +| `n` | 生成する画像の数(デフォルト: `1`)。 | INT | はい | 1〜8 | +| `シード` | 再現性のためのシード(デフォルト: `0`)。バックエンドではまだ実装されていません。 | INT | はい | 0〜2147483647 | ### gpt-image-2.5-flare および gpt-image-2.5-sunburst 入力 @@ -27,13 +27,13 @@ mode: wide | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `サイズ` | 画像サイズ。「Custom」を選択すると、カスタムの幅と高さを使用できます(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `カスタム幅` | `model.size` が "Custom" の場合にのみ使用されます。16の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | -| `カスタム高さ` | `model.size` が "Custom" の場合にのみ使用されます。16の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | -| `背景` | 背景あり・なしの画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"`
`"transparent"` | +| `サイズ` | 画像サイズ。`"Custom"` を選択すると、カスタム幅と高さを使用します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `カスタム幅` | `model.size` が `"Custom"` の場合にのみ使用されます。16 の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | +| `カスタム高さ` | `model.size` が `"Custom"` の場合にのみ使用されます。16 の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | +| `背景` | 背景ありまたは背景なしで画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"`
`"transparent"` | | `品質` | 画像品質。コストと生成時間に影響します(デフォルト: `"low"`)。 | COMBO | はい | `"low"`
`"medium"`
`"high"`
`"xhigh"`
`"max"` | -| `model.images` | 画像編集用のオプションの参照画像(複数可)。最大16枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | -| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像が正確に1枚必要です。 | MASK | いいえ | N/A | +| `model.images` | 画像編集用のオプションの参照画像。最大 16 枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | +| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像がちょうど 1 枚必要です。 | MASK | いいえ | N/A | ### gpt-image-2 入力 @@ -41,13 +41,13 @@ mode: wide | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `サイズ` | 画像サイズ。「Custom」を選択すると、カスタムの幅と高さを使用できます(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `カスタム幅` | `model.size` が "Custom" の場合にのみ使用されます。16の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | -| `カスタム高さ` | `model.size` が "Custom" の場合にのみ使用されます。16の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | -| `背景` | 背景あり・なしの画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"` | +| `サイズ` | 画像サイズ。`"Custom"` を選択すると、カスタム幅と高さを使用します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `カスタム幅` | `model.size` が `"Custom"` の場合にのみ使用されます。16 の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | +| `カスタム高さ` | `model.size` が `"Custom"` の場合にのみ使用されます。16 の倍数である必要があります(デフォルト: `1024`)。 | INT | いいえ | 480〜3840 (ステップ 16) | +| `背景` | 背景ありまたは背景なしで画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"`
`"transparent"` | | `品質` | 画像品質。コストと生成時間に影響します(デフォルト: `"low"`)。 | COMBO | はい | `"low"`
`"medium"`
`"high"` | -| `model.images` | 画像編集用のオプションの参照画像(複数可)。最大16枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | -| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像が正確に1枚必要です。 | MASK | いいえ | N/A | +| `model.images` | 画像編集用のオプションの参照画像。最大 16 枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | +| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像がちょうど 1 枚必要です。 | MASK | いいえ | N/A | ### gpt-image-1.5 および gpt-image-1 入力 @@ -56,36 +56,35 @@ mode: wide | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | | `サイズ` | 画像サイズ(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"` | -| `背景` | 背景あり・なしの画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"`
`"transparent"` | +| `背景` | 背景ありまたは背景なしで画像を返します(デフォルト: `"auto"`)。 | COMBO | はい | `"auto"`
`"opaque"`
`"transparent"` | | `品質` | 画像品質。コストと生成時間に影響します(デフォルト: `"low"`)。 | COMBO | はい | `"low"`
`"medium"`
`"high"` | -| `model.images` | 画像編集用のオプションの参照画像(複数可)。最大16枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | -| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像が正確に1枚必要です。 | MASK | いいえ | N/A | +| `model.images` | 画像編集用のオプションの参照画像。最大 16 枚。詳細は「参照入力」を参照してください。 | IMAGE | いいえ | 0〜16 | +| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像がちょうど 1 枚必要です。 | MASK | いいえ | N/A | ### 参照入力 | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `model.images` | 拡張可能スロット: 1..N 個の項目を接続できます(例: `image_1`...`image_16`)。すべてのモデルで最大16枚の参照画像を使用できます。 | IMAGE | いいえ | 1〜16 | -| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像が正確に1枚必要です。 | MASK | いいえ | N/A | +| `model.images` | 拡張可能なスロット: 1..N 個の項目(例: `image_1`...`image_16`)を接続します。すべてのモデルで最大 16 枚の参照画像。 | IMAGE | いいえ | 0〜16 | +| `model.mask` | インペインティング用のオプションのマスク(白い領域が置き換えられます)。参照画像がちょうど 1 枚必要です。 | MASK | いいえ | N/A | -**パラメータの制約と制限:** +**パラメータの制約と制限:** -- `model.size` が "Custom" の場合(`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、および `gpt-image-2` のみ)、`model.custom_width` と `model.custom_height` は両方とも16の倍数である必要があります。最長辺は3840を超えてはならず、アスペクト比は3:1を超えてはならず、総ピクセル数は655,360〜8,294,400の範囲内である必要があります。 -- `model.mask` を使用するには、`model.images` に参照画像が正確に1枚含まれている必要があります。画像なしでは使用できず、また複数の画像と一緒にも使用できません。 -- `model.mask` を使用する場合、その高さと幅は参照画像の高さと幅と一致している必要があります。 -- `model.images` が指定された場合、ノードは画像編集モードで動作します。`model.images` がない場合は、プロンプトのみから画像を生成します。 +- `model.size` が `"Custom"` の場合(`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、および `gpt-image-2` のみ)、`model.custom_width` と `model.custom_height` はどちらも 16 の倍数である必要があり、最長辺は 3840 を超えてはならず、アスペクト比は 3:1 を超えてはならず、総ピクセル数は 655,360 ~ 8,294,400 の範囲である必要があります。 +- `model.mask` を使用するには、`model.images` に参照画像がちょうど 1 枚必要です。画像なしでは使用できず、複数の画像と一緒に使用することもできません。 +- `model.mask` を使用する場合、その高さと幅は参照画像の高さと幅に一致する必要があります。 +- `model.images` が指定されている場合、ノードは画像編集モードで実行されます。`model.images` がない場合は、プロンプトのみから画像を生成します。 - 参照画像とマスクは、API に送信される前にダウンスケールされます。 -- `"xhigh"` および `"max"` の品質レベルは、`gpt-image-2.5-flare` と `gpt-image-2.5-sunburst` でのみ利用できます。 -- `"transparent"` 背景オプションは、`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-1.5`、`gpt-image-1` で利用できますが、`gpt-image-2` では利用できません。 -- `seed` は現在バックエンドで実装されていません。 +- `"xhigh"` および `"max"` の品質レベルは、`gpt-image-2.5-flare` および `gpt-image-2.5-sunburst` でのみ使用できます。 +- `seed` は現在、バックエンドで実装されていません。 ## 出力 | 出力名 | 説明 | データ型 | | --- | --- | --- | -| `image` | 生成された画像。返されたすべての画像は1つのバッチにまとめられ、サイズが異なる場合は最初の画像に合わせてリサイズされます。 | IMAGE | +| `image` | 生成された画像(1 枚または複数枚)。返されたすべての画像は 1 つのバッチにスタックされます。各画像の寸法が異なる場合は、最初の画像に合わせてリサイズされます。 | IMAGE | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImageNodeV2/ja.md) --- -**Source fingerprint (SHA-256):** `4f77b79f9f432a1f2e0fd814012aebe7cc42a8aa983ee9a61f3b32984bf65148` +**Source fingerprint (SHA-256):** `804ea35d0e2aa0b2993a293cb10cb41e2f9c6a3732304306253f7f7b1eb59b8a` diff --git a/ja/built-in-nodes/PrunaImageToVideoNode.mdx b/ja/built-in-nodes/PrunaImageToVideoNode.mdx new file mode 100644 index 0000000000..4247978fba --- /dev/null +++ b/ja/built-in-nodes/PrunaImageToVideoNode.mdx @@ -0,0 +1,53 @@ +--- +title: "PrunaImageToVideoNode - ComfyUI Built-in Node Documentation" +description: "Pruna の P-Video-2 モデルを使用して、画像を動画にアニメーション化します。" +sidebarTitle: "PrunaImageToVideoNode" +icon: "circle" +mode: wide +--- + +Pruna の P-Video-2 モデルを使用して、画像を動画にアニメーション化します。最初のフレームは必須で、出力のアスペクト比を固定します。任意の最後のフレームを指定すると、動画が補間して向かう終了点を与えます。プロンプトはシーンがどのように動くかを記述し、このノードは独自のサウンドトラックを生成するか、動きを駆動するオーディオクリップを受け取ります。 + +## 入力 + +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `モデル` | 使用する Pruna ビデオモデル。モデルを選択すると、そのモデル独自の入力が以下に表示されます。 | DYNAMIC_COMBO | はい | `"p-video-2"` | + +### P-Video-2 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `model.first_frame` | 動画の開始画像。出力はこの画像のアスペクト比を維持します。 | IMAGE | はい | - | +| `model.last_frame` | 動画の終了画像。アスペクト比は最初のフレームのものに近い必要があります。 | IMAGE | いいえ | - | +| `プロンプト` | シーンがどのように動き、どのように聞こえるかを記述します。空白以外の文字を少なくとも1文字含む必要があり、最大5000文字です(デフォルト:空)。 | STRING | はい | 最大5000文字 | +| `長さ` | 動画の長さ(秒)。`"auto"` はモデルがプロンプトから長さを選択できるようにします。`model.audio` が接続されている場合は無視されます。その場合、動画はオーディオの長さに従い、整数秒に切り上げられ、最大20秒になります(デフォルト:`"5"`)。 | COMBO | はい | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `解像度` | 出力解像度。720p は約0.9メガピクセル(16:9 で1280x704)、1080p は約2メガピクセル(16:9 で1920x1088)をレンダリングします(デフォルト:`"720p"`)。 | COMBO | はい | `"720p"`
`"1080p"` | +| `fps` | 1秒あたりのフレーム数。1080p のドラフトでは48 fpsは利用できません(デフォルト:`"24"`)。 | COMBO | はい | `"24"`
`"48"` | +| `下書き` | より高速で詳細が少ないレンダリングで、標準レンダリングより低い料金で課金されます(デフォルト:False)。 | BOOLEAN | はい | True/False | +| `音声を生成` | 動画のサウンドトラックを生成します。`model.audio` が接続されている場合は無視され、代わりにそのオーディオがサウンドトラックになります(デフォルト:True)。 | BOOLEAN | はい | True/False | +| `プロンプトを強化` | 生成前にプロンプトをより詳細に書き換えます。短いプロンプトにはこれが必要です。同じシードで結果を正確に再現するにはオフにします(デフォルト:True)。詳細設定です。 | BOOLEAN | はい | True/False | +| `model.audio` | 動きを駆動し、サウンドトラックになるオーディオ。長さは少なくとも1秒必要です。20秒を超えるオーディオは切り詰められます。`model.duration` の代わりに動画の長さを設定します。 | AUDIO | いいえ | - | +| `シード` | 生成用のシード。同じシードで結果を正確に再現できるのは、`model.enhance_prompt` がオフの場合だけです(デフォルト:42)。 | INT | はい | 0~2147483647 | + +**注記:** + +- `model.first_frame` は必須で、出力のアスペクト比を固定するため、このノードにはアスペクト比の入力がありません。 +- `model.last_frame` は任意ですが、アスペクト比が最初のフレームのものに近くない場合、ノードはエラーを発生させます。 +- `model.prompt` は必須で、5000文字に制限されています。 +- 1080p のドラフトは48 fpsと組み合わせられません。ノードがエラーを発生させるため、ドラフトをオフにするか、24 fpsを使用してください。 +- 接続されたオーディオは少なくとも1秒の長さが必要です。20秒を超える部分は無視されます。 +- `model.audio` が接続されている場合、オーディオが動画の長さを設定するため、`model.duration` と `model.generate_audio` は効果がありません。 + +## 出力 + +| 出力名 | 説明 | データ型 | +| --- | --- | --- | +| `video` | 生成された動画とそのサウンドトラック。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaImageToVideoNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `da8952e478eee593543fa7ae1aa329ad5bd5078024f905cdba185d18e76db130` diff --git a/ja/built-in-nodes/PrunaTextToVideoNode.mdx b/ja/built-in-nodes/PrunaTextToVideoNode.mdx new file mode 100644 index 0000000000..5ac5231e61 --- /dev/null +++ b/ja/built-in-nodes/PrunaTextToVideoNode.mdx @@ -0,0 +1,50 @@ +--- +title: "PrunaTextToVideoNode - ComfyUI Built-in Node Documentation" +description: "PrunaのP-Video-2モデルを使用して、テキストプロンプトから動画を生成します。" +sidebarTitle: "PrunaTextToVideoNode" +icon: "circle" +mode: wide +--- + +PrunaのP-Video-2モデルを使用して、テキストプロンプトから動画を生成します。プロンプトはシーン、その動き、およびその音を記述し、ノードは独自のサウンドトラックを生成するか、動きを制御してサウンドトラックになるオーディオクリップを受け取ります。 + +## 入力 + +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `モデル` | 使用するPruna動画モデル。モデルを選択すると、以下にそのモデル固有の入力が表示されます。 | DYNAMIC_COMBO | はい | `"p-video-2"` | + +### P-Video-2 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `プロンプト` | 動画、その動き、およびその音を記述します。空白以外の文字を少なくとも1文字含む必要があり、最大5000文字です(デフォルト:空)。 | STRING | はい | 最大5000文字 | +| `アスペクト比` | 出力動画のアスペクト比(デフォルト:`"16:9"`)。 | COMBO | はい | `"16:9"`
`"9:16"`
`"4:3"`
`"3:4"`
`"3:2"`
`"2:3"`
`"1:1"` | +| `長さ` | 動画の長さ(秒単位)。`"auto"` はプロンプトからモデルに長さを選択させます。`model.audio` が接続されている場合は無視されます。その場合、動画はオーディオの長さに従い、整数秒に切り上げられ、最大20秒になります(デフォルト:`"5"`)。 | COMBO | はい | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `解像度` | 出力解像度。720pは約0.9メガピクセル(16:9で1280x704)、1080pは約2メガピクセル(16:9で1920x1088)をレンダリングします(デフォルト:`"720p"`)。 | COMBO | はい | `"720p"`
`"1080p"` | +| `fps` | 1秒あたりのフレーム数。1080pのドラフトでは48 fpsは利用できません(デフォルト:`"24"`)。 | COMBO | はい | `"24"`
`"48"` | +| `下書き` | より高速で詳細さの低いレンダリングで、標準レンダリングよりも低い料金で請求されます(デフォルト:False)。 | BOOLEAN | はい | True/False | +| `音声を生成` | 動画のサウンドトラックを生成します。`model.audio` が接続されている場合は無視され、代わりにそのオーディオがサウンドトラックになります(デフォルト:True)。 | BOOLEAN | はい | True/False | +| `プロンプトを強化` | 生成前にプロンプトをより詳細に書き換えます。短いプロンプトにはこれが必要です。同じシードで結果を正確に再現するにはオフにします(デフォルト:True)。詳細設定。 | BOOLEAN | はい | True/False | +| `model.audio` | 動きを制御し、サウンドトラックになるオーディオ。少なくとも1秒以上の長さが必要です。20秒を超えるオーディオは切り詰められます。`model.duration` の代わりに動画の長さを設定します。 | AUDIO | いいえ | - | +| `シード` | 生成用のシード。同じシードで結果を正確に再現できるのは、`model.enhance_prompt` がオフの場合だけです(デフォルト:42)。 | INT | はい | 0 ~ 2147483647 | + +**注意:** + +- `model.prompt` は必須で、5000文字に制限されています。 +- 1080pのドラフトは48 fpsと組み合わせられません。ノードがエラーを発生させるため、ドラフトをオフにするか、24 fpsを使用してください。 +- 接続されたオーディオは少なくとも1秒以上の長さが必要です。20秒を超える部分は無視されます。 +- `model.audio` が接続されている場合、オーディオが動画の長さを設定するため、`model.duration` と `model.generate_audio` は効果がありません。 + +## 出力 + +| 出力名 | 説明 | データ型 | +| --- | --- | --- | +| `video` | サウンドトラック付きの生成動画。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaTextToVideoNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `bb7bacf2591618220c72525c1e32382174abe3a55069720adbc84fc1d8081718` diff --git a/ja/built-in-nodes/StartLoop.mdx b/ja/built-in-nodes/StartLoop.mdx index 0326186646..4570568827 100644 --- a/ja/built-in-nodes/StartLoop.mdx +++ b/ja/built-in-nodes/StartLoop.mdx @@ -14,10 +14,10 @@ Start Loop ノードは、ワークフロー内でループ構造を開始しま | パラメータ | 説明 | データ型 | 必須 | 範囲 | |-----------|-------------|-----------|----------|-------| -| `mode` | ループの反復モード(デフォルト: "simple")。選択したモードによって、表示される追加パラメータが決まります。 | DYNAMIC_COMBO | はい | `"simple"`
`"For"`
`"List"` | -| `cache_iterations` | 前回の実行で変更されていない反復結果を再利用します。無効にすると、すべての反復を再度実行します。デフォルト: false。 | BOOLEAN | はい | true
false | -| `parent_iteration` | 外側の Start Loop からの iteration_index を接続して、このループをネストします。この入力は強制入力専用です(リンクが必要です)。 | INT | いいえ | 任意の整数 | -| `initial_iteration_value` | 最初のイテレーションで current_iteration_value として公開される値。 | ANY (type-matched) | いいえ | 任意の値 | +| `モード` | ループの反復モード(デフォルト: "simple")。選択したモードによって、表示される追加パラメータが決まります。 | DYNAMIC_COMBO | はい | `"simple"`
`"For"`
`"List"` | +| `反復結果をキャッシュ` | 前回の実行で変更されていない反復結果を再利用します。無効にすると、すべての反復を再度実行します。デフォルト: false。 | BOOLEAN | はい | true
false | +| `親の反復` | 外側の Start Loop からの iteration_index を接続して、このループをネストします。この入力は強制入力専用です(リンクが必要です)。 | INT | いいえ | 任意の整数 | +| `初期反復値` | 最初のイテレーションで current_iteration_value として公開される値。 | ANY (type-matched) | いいえ | 任意の値 | ### Simple モード入力 diff --git a/ja/built-in-nodes/TextGenerate.mdx b/ja/built-in-nodes/TextGenerate.mdx index 8e4da2bfc3..f3840bb4c1 100644 --- a/ja/built-in-nodes/TextGenerate.mdx +++ b/ja/built-in-nodes/TextGenerate.mdx @@ -1,12 +1,12 @@ --- title: "TextGenerate - ComfyUI Built-in Node Documentation" -description: "TextGenerate ノードは、ユーザーのプロンプトに基づいてテキストを生成するために CLIP モデルを使用します。" +description: "TextGenerate ノードは、CLIP モデルを使用してユーザーのプロンプトに基づいたテキストを生成します。" sidebarTitle: "TextGenerate" icon: "circle" mode: wide --- -TextGenerate ノードは、ユーザーのプロンプトに基づいてテキストを生成するために CLIP モデルを使用します。オプションで、画像、ビデオ、またはオーディオを追加のコンテキストとして使用し、テキスト生成をガイドできます。出力の長さを制御したり、対応モデルで思考モードを有効にしたり、さまざまな設定でランダムサンプリングを使用するか、サンプリングなしでテキストを生成するかを選択できます。 +TextGenerate ノードは、CLIP モデルを使用してユーザーのプロンプトに基づいたテキストを生成します。オプションで画像、動画、または音声を追加のコンテキストとして使用し、テキスト生成を誘導できます。出力の長さを制御したり、対応モデルではシンキングモードを有効にしたり、さまざまな設定を伴うランダムサンプリングを使用するか、サンプリングなしでテキストを生成するかを選択できます。 ## 入力 @@ -14,37 +14,38 @@ TextGenerate ノードは、ユーザーのプロンプトに基づいてテキ | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `サンプリングモード` | テキスト生成中にランダムサンプリングを使用するかどうかを制御します。"on" に設定すると、追加のサンプリングパラメータが使用可能になります。"off" に設定すると、ノードはランダムサンプリングなしでテキストを生成します。 | DYNAMIC_COMBO | はい | `"on"`
`"off"` | +| `サンプリングモード` | テキスト生成時にランダムサンプリングを使用するかどうかを制御します。"on" に設定すると、追加のサンプリングパラメータが使用可能になります。"off" に設定すると、ノードはランダムサンプリングなしでテキストを生成します。 | DYNAMIC_COMBO | はい | `"on"`
`"off"` | | `clip` | プロンプトのトークン化とテキスト生成に使用される CLIP モデルです。 | CLIP | はい | N/A | -| `プロンプト` | 生成をガイドするテキストプロンプトです。このフィールドは複数行と動的プロンプトをサポートしています。デフォルト値は空の文字列です。 | STRING | はい | N/A | -| `画像` | テキストプロンプトと併用して生成テキストに影響を与えることができるオプションの画像です。 | IMAGE | いいえ | N/A | -| `ビデオ` | 画像バッチとしてのビデオフレームです。24 FPS と想定され、内部的に 1 FPS にサブサンプリングされます。 | IMAGE | いいえ | N/A | -| `オーディオ` | テキストプロンプトと併用して生成テキストに影響を与えることができるオプションのオーディオ入力です。 | AUDIO | いいえ | N/A | -| `最大長` | モデルが生成する最大トークン数です。デフォルト値は 512 です。 | INT | はい | 1 ~ 32768 | -| `思考モード` | モデルがサポートしている場合、思考モードで動作します。デフォルト値は False です。 | BOOLEAN | いいえ | True または False | -| `use_default_template` | モデルに組み込みのシステムプロンプト/テンプレートがある場合にそれを使用します。デフォルト値は True です。これは上級者向けパラメータです。 | BOOLEAN | いいえ | True または False | +| `プロンプト` | 生成を誘導するテキストプロンプトです。このフィールドは複数行および動的プロンプトをサポートします。デフォルト値は空文字列です。 | STRING | はい | N/A | +| `画像` | テキストプロンプトと併用して生成されるテキストに影響を与えることができるオプションの画像です。 | IMAGE | いいえ | N/A | +| `ビデオ` | 画像バッチとしての動画フレーム。24 FPS を想定しており、内部的に 1 FPS にサブサンプリングされます。 | IMAGE | いいえ | N/A | +| `オーディオ` | テキストプロンプトと併用して生成されるテキストに影響を与えることができるオプションの音声入力です。 | AUDIO | いいえ | N/A | +| `最大長` | モデルが生成するトークンの最大数です。デフォルト値は 512 です。 | INT | はい | 1 ~ 32768 | +| `思考モード` | モデルが対応している場合、シンキングモードで動作します。デフォルト値は False です。 | BOOLEAN | いいえ | True or False | +| `use_default_template` | モデルに組み込みのシステムプロンプト/テンプレートがある場合、それを使用します。デフォルト値は True です。これは詳細設定パラメータです。 | BOOLEAN | いいえ | True or False | +| `mtp` | チェックポイントのマルチトークン予測ヘッドを使用した投機的デコーディングです。MTP 重みがない場合は効果がありません。"auto" はドラフト深度を適応させ、"2" から "5" はそれを固定します。サンプリングされた出力は正しい分布を保ちますが、同じシードであっても MTP なしの出力とは異なります(デフォルト: "auto")。 | COMBO | いいえ | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | ### サンプリングパラメータ(`sampling_mode` が "on" の場合) | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | | `temperature` | 出力のランダム性を制御します。値が低いほど出力は予測しやすくなり、値が高いほど創造的になります。デフォルト値は 0.7 です。 | FLOAT | はい | 0.01 ~ 2.0 | -| `top_k` | サンプリングプールを、次に来る可能性が最も高い上位 K 個のトークンに制限します。0 を指定するとこのフィルターは無効になります。デフォルト値は 64 です。 | INT | はい | 0 ~ 1000 | -| `top_p` | ニュークリアスサンプリングを使用し、累積確率がこの値未満のトークンに選択肢を制限します。デフォルト値は 0.95 です。 | FLOAT | はい | 0.0 ~ 1.0 | -| `min_p` | トークンを考慮するための最小確率しきい値を設定します。デフォルト値は 0.05 です。 | FLOAT | はい | 0.0 ~ 1.0 | -| `repetition_penalty` | すでに生成されたトークンにペナルティを課し、繰り返しを減らします。1.0 を指定するとペナルティは適用されません。デフォルト値は 1.05 です。 | FLOAT | はい | 0.0 ~ 5.0 | -| `seed` | 再現可能な結果を得るために乱数ジェネレーターを初期化する数値です。デフォルト値は 0 です。 | INT | はい | 0 ~ 18446744073709551615 | -| `presence_penalty` | テキスト内にすでに出現しているかどうかに基づいて新しいトークンにペナルティを課し、モデルが新しいトピックについて話すことを促します。デフォルト値は 0.0 です。 | FLOAT | いいえ | 0.0 ~ 5.0 | +| `top_k` | サンプリングプールを、次に来る可能性が高い上位 K 個のトークンに制限します。値が 0 の場合、このフィルタは無効になります。デフォルト値は 64 です。 | INT | はい | 0 ~ 1000 | +| `top_p` | nucleus sampling を使用し、累積確率がこの値に達する、最も可能性の高いトークンの最小集合を保持します。デフォルト値は 0.95 です。 | FLOAT | はい | 0.0 ~ 1.0 | +| `min_p` | 検討対象とするトークンの最小確率しきい値を設定します。デフォルト値は 0.05 です。 | FLOAT | はい | 0.0 ~ 1.0 | +| `repetition_penalty` | すでに生成されたトークンにペナルティを与え、繰り返しを減らします。値が 1.0 の場合はペナルティが適用されません。デフォルト値は 1.05 です。 | FLOAT | はい | 0.0 ~ 5.0 | +| `seed` | 再現可能な結果を得るために乱数ジェネレータを初期化するために使用される数値です。デフォルト値は 0 です。 | INT | はい | 0 ~ 18446744073709551615 | +| `presence_penalty` | これまでにテキスト内に出現したかどうかに基づいて新しいトークンにペナルティを与え、モデルが新しいトピックについて話すように促します。デフォルト値は 0.0 です。 | FLOAT | いいえ | 0.0 ~ 5.0 | -**注記:** 上記のサンプリングパラメータは、`sampling_mode` が "on" に設定されている場合にのみノードインターフェースで有効になり表示されます。`sampling_mode` が "off" に設定されている場合、サンプリングパラメータは使用できず、ノードはランダムサンプリングなしでテキストを生成します。 +**注:** 上記のサンプリングパラメータは、`sampling_mode` が "on" に設定されている場合にのみ、ノードインターフェース上で有効となり表示されます。`sampling_mode` が "off" に設定されている場合、サンプリングパラメータは使用できず、ノードはランダムサンプリングなしでテキストを生成します。 ## 出力 | 出力名 | 説明 | データ型 | | --- | --- | --- | -| `生成テキスト` | 入力プロンプトとオプションの画像、ビデオ、またはオーディオに基づいてモデルが生成したテキストです。 | STRING | +| `generated_text` | 入力プロンプトとオプションの画像、動画、または音声に基づいてモデルが生成したテキストです。 | STRING | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerate/ja.md) --- -**Source fingerprint (SHA-256):** `6274a2db7c9a963304daf6df494b2b20879155e918d73429fd2ce7f3b5b9da02` +**Source fingerprint (SHA-256):** `7d9f6aee19e076aa0afb4d57060b09474206ecf2492c0944762965fabac92c51` diff --git a/ja/built-in-nodes/TextGenerateLTX2Prompt.mdx b/ja/built-in-nodes/TextGenerateLTX2Prompt.mdx index 96ceb67a90..6a396d6347 100644 --- a/ja/built-in-nodes/TextGenerateLTX2Prompt.mdx +++ b/ja/built-in-nodes/TextGenerateLTX2Prompt.mdx @@ -1,41 +1,58 @@ --- title: "TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation" -description: "TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した詳細な音声付き映像の説明へと拡張します。" +description: "TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した、音声付き映像の詳細な説明へと拡張します。" sidebarTitle: "TextGenerateLTX2Prompt" icon: "circle" mode: wide --- -TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した詳細な音声付き映像の説明へと拡張します。タスク固有のシステム指示を自動的に追加し、整形されたプロンプトを言語モデルに送信して、拡張されたテキストを返します。任意の参照画像が指定された場合、ノードは image-to-video モードに切り替わり、その画像の内容を起点としてプロンプトを拡張します。 +TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した、音声付き映像の詳細な説明へと拡張します。タスク固有のシステム指示を自動的に追加し、フォーマット済みのプロンプトを言語モデルに送信して、拡張されたテキストを返します。オプションの参照画像が指定されると、ノードは image-to-video モードに切り替わり、その画像の内容を起点にプロンプトを拡張します。 ## 入力 +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `clip` | テキストエンコードに使用される CLIP モデル。ノードはモデルのトークナイザー名を確認して、対応する指示を選択します。Gemma 4 ベースのモデルは LTX-2.4 形式を使用し、それ以外のモデルは LTX-2(Gemma 3)形式を使用します。 | CLIP | はい | - | +| `プロンプト` | 詳細な動画生成プロンプトへ拡張されるシーンまたは概念を記述した生のテキスト入力。 | STRING | はい | - | +| `画像` | 動画の最初のフレームとして使用されるオプションの入力画像。指定すると、ノードは image-to-video モードに切り替わり、画像の内容に基づいてユーザープロンプトを拡張するシステムプロンプトを使用します。 | IMAGE | いいえ | - | +| `ビデオ` | 追加のコンテキストとして使用されるオプションの動画入力。言語モデルには画像バッチとして渡されます。24 FPS であると想定され、内部的に 1 FPS にサブサンプリングされます。 | IMAGE | いいえ | - | +| `オーディオ` | 生成の追加コンテキストとして使用できるオプションの音声入力。 | AUDIO | いいえ | - | +| `最大長` | 言語モデルが生成できる最大トークン数(デフォルト: 512)。 | INT | はい | 1~32768 | +| `サンプリングモード` | テキスト生成中にランダムサンプリングを使用するかどうかを制御します。`"on"` に設定すると、以下のサンプリングパラメータが利用可能になります。`"off"` の場合、ノードはランダムサンプリングなしでテキストを生成します。 | DYNAMIC_COMBO | はい | `"on"`
`"off"` | +| `思考モード` | 有効にすると、モデルは回答する前に推論するよう指示されます。推論ブロックは返される出力から削除されます(デフォルト: False)。 | BOOLEAN | いいえ | True/False | +| `use_default_template` | 有効にすると、ノードはフォーマットにデフォルトのチャットテンプレートを使用します(デフォルト: True)。詳細設定。 | BOOLEAN | いいえ | True/False | +| `mtp` | チェックポイントのマルチトークン予測ヘッドを使用した投機的デコーディング。MTP 重みがない場合は効果がありません。`"auto"` はドラフト深さを適応させ、`"2"` から `"5"` はそれを固定します。サンプリングされた出力は正しい分布を保ちますが、同じシードでも MTP なしの出力とは異なります(デフォルト: `"auto"`)。 | COMBO | いいえ | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | + +### サンプリングパラメータ(`sampling_mode` が "on" の場合) + | パラメータ | 説明 | データ型 | 必須 | 範囲 | | --- | --- | --- | --- | --- | -| `clip` | テキストエンコードに使用される CLIP モデル。ノードはモデルのトークナイザー名を確認し、対応する指示を選択します。Gemma 4 ベースのモデルは LTX-2.4 形式を使用し、その他のモデルは LTX-2(Gemma 3)形式を使用します。 | CLIP | はい | | -| `プロンプト` | 詳細な動画生成プロンプトへ拡張する対象となる、シーンやコンセプトを説明する生テキスト入力。 | STRING | はい | | -| `最大長` | 言語モデルが生成できるトークンの最大数。 | INT | はい | | -| `サンプリングモード` | テキスト生成中に次のトークンを選択するために使用されるサンプリング戦略。 | COMBO | はい | `"greedy"`
`"top_k"`
`"top_p"`
`"temperature"` | -| `画像` | 動画の最初のフレームとして使用される任意の入力画像。指定すると、ノードは image-to-video モードに切り替わり、画像の内容に基づいてユーザープロンプトを拡張するシステムプロンプトを使用します。 | IMAGE | いいえ | | -| `思考モード` | 有効にすると、モデルは回答前に推論するよう指示されます。推論ブロックは返される出力から削除されます(デフォルト:False)。 | BOOLEAN | いいえ | | -| `use_default_template` | 有効にすると、ノードはフォーマットにデフォルトのチャットテンプレートを使用します(デフォルト:True)。 | BOOLEAN | いいえ | | -| `ビデオ` | 生成の追加コンテキストとして使用できる任意の動画入力。 | VIDEO | いいえ | | -| `オーディオ` | 生成の追加コンテキストとして使用できる任意の音声入力。 | AUDIO | いいえ | | - -**注記:** ノードの動作は入力に応じて変わります: - -- `image` が指定された場合、生成されるプロンプトは image-to-video タスク用にフォーマットされ、画像の内容に基づいてプロンプトを拡張する方法を記述したシステムプロンプトを使用します。画像が指定されない場合、テキストから動画のタスク用にフォーマットされ、プロンプトを詳細な動画生成の説明へ拡張するシステムプロンプトを使用します。 -- CLIP トークナイザーの名前に "gemma4" が含まれる場合、ノードは LTX-2.4 システムプロンプトと Gemma 4 チャット形式を使用します。それ以外の場合は、LTX-2(Gemma 3)システムプロンプトとチャット形式を使用します。 -- Gemma 4 モデルで `thinking` を有効にすると、モデルはその推論チャネルで開かれます。無効にすると、モデルは最終回答チャネルで直接開かれます。Gemma 4 以外のモデルでは、`thinking` は基盤となる生成ステップにそのまま渡されます。 -- 言語モデルが推論ブロックを削除した後に使用可能なテキストを生成しなかった場合、ノードは元の `prompt` を返します。 +| `temperature` | 出力のランダム性を制御します。値を低くすると出力がより予測可能になり、高くするとより創造的になります(デフォルト: 0.7)。 | FLOAT | はい | 0.01~2.0 | +| `top_k` | サンプリング対象を、次に来る可能性が最も高い上位 K 個のトークンに制限します。値 0 はこのフィルターを無効にします(デフォルト: 64)。 | INT | はい | 0~1000 | +| `top_p` | nucleus sampling を使用し、累積確率がこの値に達する、最も可能性の高いトークンの最小集合を保持します。(デフォルト: 0.95) | FLOAT | はい | 0.0~1.0 | +| `min_p` | 考慮対象とするトークンの最小確率しきい値を設定します(デフォルト: 0.05)。 | FLOAT | はい | 0.0~1.0 | +| `repetition_penalty` | すでに生成されたトークンにペナルティを課し、繰り返しを減らします。値 1.0 ではペナルティは適用されません(デフォルト: 1.05)。 | FLOAT | はい | 0.0~5.0 | +| `seed` | 再現可能な結果を得るために乱数生成器を初期化する数値(デフォルト: 0)。 | INT | はい | 0~18446744073709551615 | +| `presence_penalty` | これまでにテキスト内に出現したかどうかに基づいて新しいトークンにペナルティを課し、モデルが新しい話題について話すよう促します(デフォルト: 0.0)。 | FLOAT | いいえ | 0.0~5.0 | + +**注:** 上記のサンプリングパラメータは、`sampling_mode` が "on" に設定されている場合にのみ、ノードインターフェースで有効になり表示されます。"off" に設定されている場合、サンプリングパラメータは利用できず、ノードはランダムサンプリングなしでテキストを生成します。 + +**注:** ノードの動作は入力に基づいて変化します: + +- `image` が指定された場合、生成されたプロンプトは image-to-video タスク用にフォーマットされ、画像の内容に基づいてプロンプトを拡張する方法を記述したシステムプロンプトを使用します。画像が指定されていない場合、フォーマットは text-to-video タスク用となり、プロンプトを詳細な動画生成説明に拡張するシステムプロンプトを使用します。 +- CLIP トークナイザー名に "gemma4" が含まれる場合、ノードは LTX-2.4 システムプロンプトと Gemma 4 チャット形式を使用します。それ以外の場合は、LTX-2(Gemma 3)システムプロンプトとチャット形式を使用します。 +- Gemma 4 モデルで `thinking` が有効な場合、モデルは推論チャネルで開かれます。無効な場合、モデルは最終回答チャネルで直接開かれます。Gemma 4 以外のモデルでは、`thinking` は基盤となる生成ステップにそのまま渡されます。 +- 推論ブロックを削除した後に言語モデルが使用可能なテキストを生成しなかった場合、ノードは代わりに元の `prompt` を返します。 ## 出力 | 出力名 | 説明 | データ型 | | --- | --- | --- | -| `output` | 言語モデルによって生成された拡張済みの動画生成プロンプト。推論ブロックは削除されています。結果が空の場合、元のユーザープロンプトが返されます。 | STRING | +| `generated_text` | 言語モデルによって生成された拡張済みの動画生成プロンプト。推論ブロックはすべて削除されています。結果が空の場合、元のユーザープロンプトが返されます。 | STRING | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/ja.md) --- -**Source fingerprint (SHA-256):** `8f524ea60a247217dde8a1edaf7a689e253ae05acc9eb52ad47b91e879dba1df` +**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943` diff --git a/ja/built-in-nodes/TripoPSeriesImageToModelNode.mdx b/ja/built-in-nodes/TripoPSeriesImageToModelNode.mdx new file mode 100644 index 0000000000..ec3b8aa2ef --- /dev/null +++ b/ja/built-in-nodes/TripoPSeriesImageToModelNode.mdx @@ -0,0 +1,56 @@ +--- +title: "TripoPSeriesImageToModelNode - ComfyUI Built-in Node Documentation" +description: "Tripo の P2 モデルを使用して、単一画像からクリーンなトポロジーのローポリゴン3Dモデルを生成します。" +sidebarTitle: "TripoPSeriesImageToModelNode" +icon: "circle" +mode: wide +--- + +Tripo の P2 モデルを使用して、単一画像からクリーンなトポロジーのローポリゴン3Dモデルを生成します。結果は三角形メッシュ(GLB)として返されます。`model.quad` が有効な場合は、クアッド優勢メッシュ(FBX)として返されます。 + +## 入力 + +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `model` | 使用する Tripo Pシリーズモデル。モデルを選択すると、そのモデル固有の入力が以下に表示されます。 | DYNAMIC_COMBO | はい | `"P2"` | + +### P2 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `model.image` | モデルの生成元となる画像。 | IMAGE | はい | - | +| `quad` | GLB出力の三角形メッシュの代わりに、FBX出力でクアッド優勢メッシュを返します(デフォルト: False)。 | BOOLEAN | はい | True/False | +| `face_limit` | 目標フェイス数。`-1` の場合、Tripo が選択します。`model.quad` が有効な場合、制限は48~25,000、それ以外は48~50,000です(デフォルト: -1)。 | INT | はい | -1、または 48〜50000 | +| `texture` | ベースカラーテクスチャの解像度: standard は2K、detailed は4K、extreme は8Kです。`"none"` はテクスチャなしのメッシュを返します(デフォルト: `"standard"`)。 | COMBO | はい | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | ベースカラーにメタリック、ラフネス、ノーマルマップを追加します。`model.texture` が `"none"` の場合は無視されます(デフォルト: True)。 | BOOLEAN | はい | True/False | +| `model_seed` | ジオメトリのシード(デフォルト: 42)。 | INT | はい | 0〜2147483647 | +| `texture_alignment` | 入力画像の色に合わせるか、生成されたジオメトリにテクスチャをフィットさせます。`model.texture` が `"none"` の場合は無視されます(デフォルト: `"original_image"`)。詳細設定。 | COMBO | はい | `"original_image"`
`"geometry"` | +| `orientation` | `"align_image"` はモデルを入力画像の視点に回転させます。`model.texture` が `"none"` の場合は無視されます(デフォルト: `"default"`)。詳細設定。 | COMBO | はい | `"default"`
`"align_image"` | +| `enable_image_autofix` | モデリング前に低解像度または低品質の画像を Tripo に改善させます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | +| `texture_seed` | テクスチャのシード(デフォルト: 42)。詳細設定。 | INT | はい | 0〜2147483647 | +| `auto_size` | シーントランスフォームを通じてモデルを実世界のサイズ(メートル)にスケーリングします。`model.texture` が `"none"` の場合は無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | +| `export_uv` | メッシュがテクスチャなしの場合に UV 展開します。テクスチャ付きメッシュは常に展開されます(デフォルト: True)。詳細設定。 | BOOLEAN | はい | True/False | +| `compress_geometry` | meshopt ジオメトリ圧縮を適用します: ファイルは大幅に小さくなりますが、ComfyUI の3Dプレビューでは表示できません。クアッドメッシュでは無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | + +**注意:** + +- `model.image` は必須で、バッチの最初の画像のみが使用されます。 +- `model.face_limit` はハードキャップではなく目標値であるため、結果に要求より多くのフェイスが含まれることがあります。`-1` は選択を Tripo に任せます。 +- `model.quad` はどちらの出力がメッシュを担うかを決定します。有効な場合、モデルは FBX 出力に渡され、GLB 出力は空のままです。無効な場合、モデルは GLB に渡され、FBX は空のままです。空になる方の出力に接続している場合、ノードはエラーを発生させます。 +- `model.texture`、`model.pbr`、`model.texture_seed`、`model.auto_size`、`model.texture_alignment`、`model.orientation` はテクスチャ付きモデルにのみ適用されます。`"none"` の場合、ノードはテクスチャ設定を送信せず、テクスチャなしのジオメトリを返します。 +- `model.compress_geometry` はクアッドメッシュには効果がありません。 + +## 出力 + +| 出力名 | 説明 | データ型 | +| --- | --- | --- | +| `model task_id` | モデル生成リクエストの一意のタスク ID。 | MODEL_TASK_ID | +| `GLB` | 生成された3Dモデル(GLB形式)。`model.quad` が有効な場合は空です。 | FILE3DGLB | +| `FBX` | 生成された3Dモデル(FBX形式)。`model.quad` が有効な場合にのみ設定されます。 | FILE3DFBX | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesImageToModelNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `9bfad31ee00546d0603ce3273502cfc93c79e3b125941fed255866aa83f770a5` diff --git a/ja/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx b/ja/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx new file mode 100644 index 0000000000..fbb1c432b1 --- /dev/null +++ b/ja/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx @@ -0,0 +1,59 @@ +--- +title: "TripoPSeriesMultiviewToModelNode - ComfyUI Built-in Node Documentation" +description: "Tripo の P2 モデルを使用して、同じ被写体の複数ビューから、クリーンなトポロジーのローポリ 3D モデルを生成します。" +sidebarTitle: "TripoPSeriesMultiviewToModelNode" +icon: "circle" +mode: wide +--- + +Tripo の P2 モデルを使用して、同じ被写体の複数ビューから、クリーンなトポロジーのローポリ 3D モデルを生成します。正面ビューは必須で、左、背面、右のビューのうち 1~3 つを追加して結果を改善できます。モデルは三角形メッシュ(GLB)として返されます。`model.quad` が有効な場合は、四角形主体のメッシュ(FBX)として返されます。 + +## 入力 + +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `model` | 使用する Tripo P シリーズ モデル。モデルを選択すると、そのモデル独自の入力が以下に表示されます。 | DYNAMIC_COMBO | はい | `"P2"` | + +### P2 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `model.image` | 被写体の正面ビュー(0°)。 | IMAGE | はい | - | +| `model.image_left` | 左ビュー(90°)、被写体自身の左側。 | IMAGE | いいえ | - | +| `model.image_back` | 背面ビュー(180°)。 | IMAGE | いいえ | - | +| `model.image_right` | 右ビュー(270°)、被写体自身の右側。 | IMAGE | いいえ | - | +| `quad` | GLB 出力の三角形メッシュの代わりに、FBX 出力で四角形主体のメッシュを返します(デフォルト: False)。 | BOOLEAN | はい | True/False | +| `face_limit` | 目標フェイス数。`-1` にすると Tripo が選択します。`model.quad` が有効な場合、制限は 48~25,000、それ以外は 48~50,000 です(デフォルト: -1)。 | INT | はい | -1、または 48〜50000 | +| `テクスチャ` | ベースカラーテクスチャの解像度。standard は 2K、detailed は 4K、extreme は 8K です。`"none"` はテクスチャなしのメッシュを返します(デフォルト: `"standard"`)。 | COMBO | はい | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | ベースカラーにメタリック、ラフネス、ノーマルマップを追加します。`model.texture` が `"none"` の場合は無視されます(デフォルト: True)。 | BOOLEAN | はい | True/False | +| `model_seed` | ジオメトリのシード(デフォルト: 42)。 | INT | はい | 0〜2147483647 | +| `テクスチャ位置合わせ` | 入力画像の色に一致させるか、生成されたジオメトリにテクスチャを合わせます。`model.texture` が `"none"` の場合は無視されます(デフォルト: `"original_image"`)。詳細設定。 | COMBO | はい | `"original_image"`
`"geometry"` | +| `orientation` | `"align_image"` はモデルを入力画像の視点に回転させます。`model.texture` が `"none"` の場合は無視されます(デフォルト: `"default"`)。詳細設定。 | COMBO | はい | `"default"`
`"align_image"` | +| `テクスチャシード` | テクスチャのシード(デフォルト: 42)。詳細設定。 | INT | はい | 0〜2147483647 | +| `auto_size` | シーンのトランスフォームを通じて、モデルを実世界のメートル単位のサイズにスケーリングします。`model.texture` が `"none"` の場合は無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | +| `export_uv` | メッシュがテクスチャなしの場合に UV 展開します。テクスチャ付きメッシュは常に展開されます(デフォルト: True)。詳細設定。 | BOOLEAN | はい | True/False | +| `compress_geometry` | meshopt ジオメトリ圧縮を適用します。ファイルは大幅に小さくなりますが、ComfyUI の 3D プレビューでは表示できません。四角形メッシュでは無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | + +**注意事項:** + +- `model.image` は必須で、`model.image_left`、`model.image_back`、`model.image_right` の少なくとも 1 つも接続する必要があります。正面ビューのみの画像の場合、ノードはエラーを発生させます。 +- 各バッチの最初の画像のみが使用されます。 +- `model.face_limit` は厳密な上限ではなく目標値であるため、結果に指定より多くのフェイスが含まれることがあります。`-1` は選択を Tripo に委ねます。 +- `model.quad` はどちらの出力がメッシュを運ぶかを決定します。有効な場合、モデルは FBX 出力に届き、GLB 出力は空のままです。無効な場合、モデルは GLB に届き、FBX は空のままです。空の出力に接続した場合、ノードはエラーを発生させます。 +- `model.texture`、`model.pbr`、`model.texture_seed`、`model.auto_size`、`model.texture_alignment`、`model.orientation` はテクスチャ付きモデルにのみ適用されます。`"none"` の場合、ノードはテクスチャ設定を送信せず、ジオメトリのみを返します。 +- `model.compress_geometry` は四角形メッシュには効果がありません。 + +## 出力 + +| 出力名 | 説明 | データ型 | +| --- | --- | --- | +| `model task_id` | モデル生成リクエストの一意のタスク ID。 | MODEL_TASK_ID | +| `GLB` | 生成された 3D モデル(GLB 形式)。`model.quad` が有効な場合は空です。 | FILE3DGLB | +| `FBX` | 生成された 3D モデル(FBX 形式)。`model.quad` が有効な場合にのみ設定されます。 | FILE3DFBX | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesMultiviewToModelNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `cea0a65ca001bc8298af9fbe2a83f592abf497987e634b0126482f3d2a18571c` diff --git a/ja/built-in-nodes/TripoPSeriesTextToModelNode.mdx b/ja/built-in-nodes/TripoPSeriesTextToModelNode.mdx new file mode 100644 index 0000000000..d051eb1c15 --- /dev/null +++ b/ja/built-in-nodes/TripoPSeriesTextToModelNode.mdx @@ -0,0 +1,55 @@ +--- +title: "TripoPSeriesTextToModelNode - ComfyUI Built-in Node Documentation" +description: "Tripo の P2 モデルを使用して、テキストプロンプトからクリーンなトポロジーのローポリ 3D モデルを生成します。" +sidebarTitle: "TripoPSeriesTextToModelNode" +icon: "circle" +mode: wide +--- + +Tripo の P2 モデルを使用して、テキストプロンプトからクリーンなトポロジーのローポリ 3D モデルを生成します。結果は三角形メッシュ(GLB)として返されます。`model.quad` が有効な場合は、クアッド主体のメッシュ(FBX)として返されます。 + +## 入力 + +### 共通入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `モデル` | 使用する Tripo P シリーズモデル。モデルを選択すると、以下に対応する入力が表示されます。 | DYNAMIC_COMBO | はい | `"P2"` | + +### P2 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +| --- | --- | --- | --- | --- | +| `プロンプト` | 生成する 3D モデルのテキスト記述。空にできません。最大 1024 文字です(デフォルト: 空)。 | STRING | はい | 最大 1024 文字 | +| `ネガティブプロンプト` | 生成されたモデルで避ける内容のテキスト記述(デフォルト: 空)。 | STRING | いいえ | 最大 255 文字 | +| `クアッド` | GLB 出力の三角形メッシュの代わりに、FBX 出力でクアッド主体のメッシュを返します(デフォルト: False)。 | BOOLEAN | はい | True/False | +| `面数上限` | 対象の面数。`-1` の場合、Tripo が選択します。`model.quad` が有効な場合、制限は 48~25,000、それ以外は 48~50,000 です(デフォルト: -1)。 | INT | はい | -1、または 48~50000 | +| `テクスチャ` | ベースカラーテクスチャの解像度。standard は 2K、detailed は 4K、extreme は 8K です。`"none"` はテクスチャなしのメッシュを返します(デフォルト: `"standard"`)。 | COMBO | はい | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `PBR` | ベースカラーにメタリック、ラフネス、ノーマルマップを追加します。`model.texture` が `"none"` の場合は無視されます(デフォルト: True)。 | BOOLEAN | はい | True/False | +| `モデルシード` | ジオメトリのシード(デフォルト: 42)。 | INT | はい | 0~2147483647 | +| `画像シード` | モデリング前に Tripo がプロンプトから描画する画像のシード(デフォルト: 42)。詳細設定。 | INT | はい | 0~2147483647 | +| `テクスチャシード` | テクスチャのシード(デフォルト: 42)。詳細設定。 | INT | はい | 0~2147483647 | +| `自動サイズ` | シーントランスフォームを通じて、モデルを実世界のメートル単位のサイズにスケーリングします。`model.texture` が `"none"` の場合は無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | +| `UVをエクスポート` | メッシュがテクスチャなしの場合に UV 展開します。テクスチャ付きメッシュは常に展開されます(デフォルト: True)。詳細設定。 | BOOLEAN | はい | True/False | +| `ジオメトリを圧縮` | meshopt ジオメトリ圧縮を適用します。ファイルは大幅に小さくなりますが、ComfyUI の 3D プレビューでは表示できません。クアッドメッシュでは無視されます(デフォルト: False)。詳細設定。 | BOOLEAN | はい | True/False | + +**注記:** + +- `model.prompt` は必須です。`model.negative_prompt` は任意で、255 文字に制限されます。 +- `model.face_limit` は厳密な上限ではなく目標値であるため、結果に要求より多くの面が含まれることがあります。`-1` の場合、選択は Tripo に委ねられます。 +- `model.quad` はどちらの出力がメッシュを保持するかを決定します。有効にするとモデルは FBX 出力に渡され、GLB 出力は空のままです。無効にするとモデルは GLB に渡され、FBX は空のままです。接続した出力が空になる側である場合、ノードはエラーを発生させます。 +- `model.texture`、`model.pbr`、`model.texture_seed`、`model.auto_size` はテクスチャ付きモデルにのみ適用されます。`"none"` の場合、ノードはテクスチャ設定を送信せず、素のジオメトリを返します。 +- `model.compress_geometry` はクアッドメッシュには効果がありません。 + +## 出力 + +| 出力名 | 説明 | データ型 | +| --- | --- | --- | +| `model task_id` | モデル生成リクエストの一意のタスク ID。 | MODEL_TASK_ID | +| `GLB` | GLB 形式で生成された 3D モデル。`model.quad` が有効な場合は空です。 | FILE3DGLB | +| `FBX` | FBX 形式で生成された 3D モデル。`model.quad` が有効な場合にのみデータが入ります。 | FILE3DFBX | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesTextToModelNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `e55596c1a237cf6b92e3bdead4359f380c6cba60992dcc61b5ee4e6b1bdd843b` diff --git a/ja/built-in-nodes/YuE2GenerateMusic.mdx b/ja/built-in-nodes/YuE2GenerateMusic.mdx index 9bed94e80f..da9ca3ef44 100644 --- a/ja/built-in-nodes/YuE2GenerateMusic.mdx +++ b/ja/built-in-nodes/YuE2GenerateMusic.mdx @@ -1,39 +1,40 @@ --- title: "YuE2GenerateMusic - ComfyUI Built-in Node Documentation" -description: "スタイル、歌詞、ABC 記譜法から音楽トークンと音響コンディショニングを生成します。" +description: "スタイル、歌詞、ABC記譜法から音楽トークンと音響コンディショニングを生成します。" sidebarTitle: "YuE2GenerateMusic" icon: "circle" mode: wide --- -スタイル、歌詞、ABC 記譜法から音楽トークンと音響コンディショニングを生成します。コンディショニングと生成された長さ(秒)を返します。これは Empty YuE2 Latent Audio ノードに渡す必要があります。ABC 入力が空のままの場合、選択したモードは無視され、自動的にオフモードが使用されます。 +スタイル、歌詞、ABC記譜法から音楽トークンと音響コンディショニングを生成します。コンディショニングと生成された長さ(秒)を返します。これは Empty YuE2 Latent Audio ノードに渡す必要があります。ABC入力が空のままの場合、選択したモードは無視され、自動的にオフモードが使用されます。 ## 入力 | パラメータ | 説明 | データ型 | 必須 | 範囲 | |-----------|-------------|-----------|----------|-------| | `clip` | 音楽入力をトークン化およびエンコードするために使用される CLIP モデル。 | CLIP | はい | - | -| `スタイル` | 音楽スタイルを説明するテキスト。複数行入力と動的プロンプトをサポートします。 | STRING | はい | 複数行テキスト | +| `スタイル` | 音楽スタイルを記述するテキスト。複数行入力と動的プロンプトをサポートします。 | STRING | はい | 複数行テキスト | | `歌詞` | 生成される音楽の歌詞。複数行入力と動的プロンプトをサポートします。 | STRING | はい | 複数行テキスト | -| `ABC` | ABC ジェネレーターを接続するか、編集済みのスコアを指定します。空のままにすると、自動的にオフモードが使用されます。デフォルト: "" | STRING | はい | 複数行テキスト | -| `シード` | 生成用のランダムシード。デフォルト: 0 | INT | はい | 0 ~ 18446744073709551615 | -| `モード` | full: メロディーとコードを生成します。melody: メロディーのみを生成します。カバーにおすすめです。デフォルト: "full" | COMBO | はい | "full"
"melody" | -| `max_duration` | 最大長(秒)。長いプロンプトでは自動的に短縮されます。生成はより早く停止する場合があります。デフォルト: 360.0 | FLOAT | はい | 0.04 ~ 900.0 | -| `温度` | 生成のサンプリング温度。デフォルト: 1.0(詳細設定) | FLOAT | はい | 0.0 ~ 5.0 | -| `top_p` | ニュークリアスサンプリングの確率しきい値。デフォルト: 0.95(詳細設定) | FLOAT | はい | 0.01 ~ 1.0 | -| `top_k` | Top-k サンプリングの上限。デフォルト: 100(詳細設定) | INT | はい | 1 ~ 32768 | -| `repetition_penalty` | 繰り返されるトークンに適用されるペナルティ。デフォルト: 1.2(詳細設定) | FLOAT | はい | 0.01 ~ 10.0 | - -注: `abc` が空または空白文字のみの場合、`mode` の選択は無視され、自動的にオフモードが使用されます。 +| `ABC` | ABC ジェネレーターを接続するか、編集した楽譜を指定します。空のままにすると、自動的にオフモードが使用されます。デフォルト: "" | STRING | はい | 複数行テキスト | +| `シード` | 生成用のランダムシード。デフォルト: 0 | INT | はい | 0 〜 18446744073709551615 | +| `モード` | full: メロディとコードを生成します。melody: メロディのみを生成し、カバーに推奨されます。デフォルト: "full" | COMBO | はい | "full"
"melody" | +| `max_duration` | 最大時間(秒)。長いプロンプトでは自動的に短縮されます。生成はそれより早く停止する場合があります。デフォルト: 360.0 | FLOAT | はい | 0.04 〜 900.0 | +| `温度` | 生成のサンプリング温度。デフォルト: 1.0(詳細設定) | FLOAT | はい | 0.0 〜 5.0 | +| `top_p` | Nucleus サンプリングの確率しきい値。デフォルト: 0.95(詳細設定) | FLOAT | はい | 0.01 〜 1.0 | +| `top_k` | Top-k サンプリングの上限。デフォルト: 100(詳細設定) | INT | はい | 1 〜 32768 | +| `repetition_penalty` | 繰り返されるトークンに適用されるペナルティ。デフォルト: 1.2(詳細設定) | FLOAT | はい | 0.01 〜 10.0 | +| `cfg_scale` | スタイルと歌詞に対する自己回帰ガイダンス。1.0 にすると CFG が無効になり、ABC ワークフローと一致します。元のオフモードのガイダンスに合わせるには 1.01 を使用してください。デフォルト: 1.0(詳細設定、任意) | FLOAT | いいえ | 0.0 〜 100.0 | + +注: `abc` が空、または空白文字のみの場合は、`mode` の選択は無視され、自動的にオフモードが使用されます。 ## 出力 | 出力名 | 説明 | データ型 | |-------------|-------------|-----------| | `CONDITIONING` | 音楽トークンから生成された音響コンディショニング。 | CONDITIONING | -| `seconds` | 生成された音声の長さ(秒)。この値を Empty YuE2 Latent Audio ノードに渡してください。 | FLOAT | +| `seconds` | 生成されたオーディオの長さ(秒)。この値を Empty YuE2 Latent Audio ノードに渡してください。 | FLOAT | > このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/YuE2GenerateMusic/ja.md) --- -**Source fingerprint (SHA-256):** `54f5d46cf083726bdf97c86e5683b2727840f75bb553bddf9525cfbf5affa44c` +**Source fingerprint (SHA-256):** `5a88e185d2998c51acff7f0c76c8c35ca30b80b88cb541d97f9ab91566b5a3ed` diff --git a/ko/built-in-nodes/EndLoop.mdx b/ko/built-in-nodes/EndLoop.mdx index 68aa52b5ab..251886d932 100644 --- a/ko/built-in-nodes/EndLoop.mdx +++ b/ko/built-in-nodes/EndLoop.mdx @@ -12,10 +12,10 @@ End Loop는 루프 블록의 끝을 표시합니다. 루프 본문의 마지막 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `output_value` | End Loop에서 반환되는 값입니다. accumulate에 따라 최종 반복 또는 모든 반복을 반환합니다. | ANY | 아니요 | 모든 값 타입 | -| `next_iteration_value` | 다음 반복을 위해 End Loop에서 Start Loop로 다시 전달되는 값입니다. | ANY | 아니요 | 모든 값 타입 | -| `accumulate` | 활성화하면 모든 반복에서 output_value를 반환하고, 그렇지 않으면 최종 반복만 반환합니다. | BOOLEAN | 아니요 | `true`
`false` (기본값: `false`) | -| `terminations` | 모든 반복에서 실행되어야 하는 출력을 연결합니다. 해당 값은 반환되지 않습니다. `termination_1`, `termination_2` 등으로 이름이 지정되는 확장 가능한 슬롯입니다. | ANY | 아니요 | 0~50 슬롯 | +| `출력 값` | End Loop에서 반환되는 값입니다. accumulate에 따라 최종 반복 또는 모든 반복을 반환합니다. | ANY | 아니요 | 모든 값 타입 | +| `다음 반복 값` | 다음 반복을 위해 End Loop에서 Start Loop로 다시 전달되는 값입니다. | ANY | 아니요 | 모든 값 타입 | +| `누적` | 활성화하면 모든 반복에서 output_value를 반환하고, 그렇지 않으면 최종 반복만 반환합니다. | BOOLEAN | 아니요 | `true`
`false` (기본값: `false`) | +| `종료 항목` | 모든 반복에서 실행되어야 하는 출력을 연결합니다. 해당 값은 반환되지 않습니다. `termination_1`, `termination_2` 등으로 이름이 지정되는 확장 가능한 슬롯입니다. | ANY | 아니요 | 0~50 슬롯 | 참고: `terminations`는 최소 0개, 최대 50개 연결을 지원하는 확장 가능한 슬롯 목록입니다. 여기에 연결된 값은 모든 반복에서 실행되도록 강제하지만 반환 결과에는 포함되지 않습니다. diff --git a/ko/built-in-nodes/GeminiNodeV3.mdx b/ko/built-in-nodes/GeminiNodeV3.mdx index 42b1400d28..2ceccf4039 100644 --- a/ko/built-in-nodes/GeminiNodeV3.mdx +++ b/ko/built-in-nodes/GeminiNodeV3.mdx @@ -12,7 +12,7 @@ mode: wide | 매개변수 | 설명 | 데이터 유형 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `model` | 응답 생성에 사용할 Gemini 모델입니다. 선택한 모델에 따라 표시되는 추가 입력이 결정됩니다. | DYNAMIC_COMBO | 예 | `"Gemini 3.8 Flash"`
`"Gemini 3.7 Flash"`
`"Gemini 3.5 Flash"`
`"Gemini 3.1 Pro"`
`"Gemini 3.1 Flash-Lite"` | +| `모델` | 응답 생성에 사용할 Gemini 모델입니다. 선택한 모델에 따라 표시되는 추가 입력이 결정됩니다. | DYNAMIC_COMBO | 예 | `"Gemini 3.8 Flash"`
`"Gemini 3.7 Flash"`
`"Gemini 3.5 Flash"`
`"Gemini 3.1 Pro"`
`"Gemini 3.1 Flash-Lite"` | ### 미디어 입력 diff --git a/ko/built-in-nodes/GetItemFromList.mdx b/ko/built-in-nodes/GetItemFromList.mdx index dd59bc7990..39c4600251 100644 --- a/ko/built-in-nodes/GetItemFromList.mdx +++ b/ko/built-in-nodes/GetItemFromList.mdx @@ -12,8 +12,8 @@ mode: wide | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `list` | 선택할 값의 목록입니다. 이 노드는 목록 입력을 받는 것으로 표시되어 있으므로, 연결된 값은 항목 그룹으로 처리됩니다. | Any Type | 예 | 모든 값 목록 | -| `index` | 반환할 항목의 위치입니다. 값은 0부터 시작하므로 `0`은 첫 번째 항목을, `1`은 두 번째 항목을 반환하는 식입니다(기본값: 0). | INT | 예 | 모든 정수 인덱스 | +| `목록` | 선택할 값의 목록입니다. 이 노드는 목록 입력을 받는 것으로 표시되어 있으므로, 연결된 값은 항목 그룹으로 처리됩니다. | Any Type | 예 | 모든 값 목록 | +| `인덱스` | 반환할 항목의 위치입니다. 값은 0부터 시작하므로 `0`은 첫 번째 항목을, `1`은 두 번째 항목을 반환하는 식입니다(기본값: 0). | INT | 예 | 모든 정수 인덱스 | ## 출력 diff --git a/ko/built-in-nodes/LoopIteration.mdx b/ko/built-in-nodes/LoopIteration.mdx index 9db454024d..762a21ac3c 100644 --- a/ko/built-in-nodes/LoopIteration.mdx +++ b/ko/built-in-nodes/LoopIteration.mdx @@ -12,12 +12,12 @@ mode: wide | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `iteration_index` | 현재 반복의 인덱스이며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | INT | 예 | - | -| `is_first` | 현재 반복이 첫 번째인지 여부를 나타내며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | BOOLEAN | 예 | - | -| `is_last` | 현재 반복이 마지막인지 여부를 나타내며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | BOOLEAN | 예 | - | -| `list_item` | 이번 반복을 위해 리스트에서 가져온 항목입니다. 선택 사항이며, 제공된 경우 첫 번째 요소가 출력으로 전달되고, 그렇지 않으면 None이 반환됩니다. | ANY | 아니요 | - | -| `current_iteration_value` | 현재 반복이 전달하는 값입니다. 선택 사항이며, 제공된 경우 전체 값이 출력으로 전달되고, 그렇지 않으면 None이 반환됩니다. | ANY | 아니요 | - | -| `reuse_cache` | 결과를 캐시에서 재사용할 수 있는지 여부를 제어합니다. 활성화하면 노드가 안정적인 핑거프린트를 유지하여 캐시된 결과를 재사용할 수 있습니다. 비활성화하면 일치하지 않는 핑거프린트가 생성되어 각 반복마다 노드가 다시 실행됩니다. | BOOLEAN | 예 | - | +| `반복 인덱스` | 현재 반복의 인덱스이며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | INT | 예 | - | +| `첫 번째 여부` | 현재 반복이 첫 번째인지 여부를 나타내며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | BOOLEAN | 예 | - | +| `마지막 여부` | 현재 반복이 마지막인지 여부를 나타내며 리스트로 제공됩니다. 첫 번째 요소가 출력으로 전달됩니다. | BOOLEAN | 예 | - | +| `목록 항목` | 이번 반복을 위해 리스트에서 가져온 항목입니다. 선택 사항이며, 제공된 경우 첫 번째 요소가 출력으로 전달되고, 그렇지 않으면 None이 반환됩니다. | ANY | 아니요 | - | +| `현재 반복 값` | 현재 반복이 전달하는 값입니다. 선택 사항이며, 제공된 경우 전체 값이 출력으로 전달되고, 그렇지 않으면 None이 반환됩니다. | ANY | 아니요 | - | +| `캐시 재사용` | 결과를 캐시에서 재사용할 수 있는지 여부를 제어합니다. 활성화하면 노드가 안정적인 핑거프린트를 유지하여 캐시된 결과를 재사용할 수 있습니다. 비활성화하면 일치하지 않는 핑거프린트가 생성되어 각 반복마다 노드가 다시 실행됩니다. | BOOLEAN | 예 | - | 참고: 이 노드는 리스트 입력이 활성화되어 있습니다. 즉, 각 입력은 리스트로 도착하는 것으로 예상되며, 노드는 각 리스트의 첫 번째 요소만 출력합니다(`current_iteration_value`는 예외로, 리스트로 그대로 전달됩니다). 또한 여기에 나열된 것 외의 추가 입력도 허용합니다. diff --git a/ko/built-in-nodes/LoopProgress.mdx b/ko/built-in-nodes/LoopProgress.mdx index 090812377c..35cd260537 100644 --- a/ko/built-in-nodes/LoopProgress.mdx +++ b/ko/built-in-nodes/LoopProgress.mdx @@ -12,9 +12,9 @@ LoopProgress는 루프의 진행 상황을 ComfyUI 서버 인터페이스에 보 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `start_id` | 진행 메시지가 속한 프롬프트/루프 인스턴스의 식별자입니다. 제공된 목록의 첫 번째 항목은 진행 텍스트를 올바른 실행 중인 실행으로 라우팅하는 데 사용됩니다. | STRING | 예 | - | -| `position` | 현재 반복 위치(인덱스)입니다. 제공된 목록의 첫 번째 항목은 진행 메시지에 사용되며 출력으로도 반환됩니다. | INT | 예 | - | -| `total` | 전체 반복 횟수입니다. `position`과 함께 사용되어 "Iteration X / Y" 진행 메시지를 구성합니다. | INT | 예 | - | +| `시작 ID` | 진행 메시지가 속한 프롬프트/루프 인스턴스의 식별자입니다. 제공된 목록의 첫 번째 항목은 진행 텍스트를 올바른 실행 중인 실행으로 라우팅하는 데 사용됩니다. | STRING | 예 | - | +| `위치` | 현재 반복 위치(인덱스)입니다. 제공된 목록의 첫 번째 항목은 진행 메시지에 사용되며 출력으로도 반환됩니다. | INT | 예 | - | +| `합계` | 전체 반복 횟수입니다. `position`과 함께 사용되어 "Iteration X / Y" 진행 메시지를 구성합니다. | INT | 예 | - | 참고: 이 노드는 목록 입력(`is_input_list=True`)으로 선언되어 모든 입력을 허용하므로, 연결된 각 값은 목록으로 처리되며 첫 번째 요소만 읽습니다. 이 노드는 항상 실행되며(입력 지문이 고정됨), 따라서 루프를 통과할 때마다 다시 실행됩니다. diff --git a/ko/built-in-nodes/LoopResult.mdx b/ko/built-in-nodes/LoopResult.mdx index 0136ead637..4d0fd4a45c 100644 --- a/ko/built-in-nodes/LoopResult.mdx +++ b/ko/built-in-nodes/LoopResult.mdx @@ -12,7 +12,7 @@ LoopResult는 루프 블록의 종료 지점을 표시하는 개발자 전용 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `close_id` | 닫을 루프 블록의 식별자입니다. 목록의 첫 번째 값만 사용됩니다. | STRING | 예 | - | +| `종료 ID` | 닫을 루프 블록의 식별자입니다. 목록의 첫 번째 값만 사용됩니다. | STRING | 예 | - | | `output0`, `output1`, ... | 루프 블록에서 수집된 값입니다. 이 노드는 추가 입력을 모두 허용하며 `output0`부터 시작하여 순차적으로 수집하고, 처음 누락된 인덱스에서 중지합니다. | 모든 타입 | 아니요 | - | 참고: 이 노드는 모든 입력을 허용합니다(`accept_all_inputs`). `close_id` 이외의 모든 입력은 수집된 루프 값으로 처리되며, 결과에 포함되려면 `output0`, `output1`, `output2` 등과 같이 빈틈없이 이름이 지정되어야 합니다. diff --git a/ko/built-in-nodes/MoGeInference.mdx b/ko/built-in-nodes/MoGeInference.mdx index 7f5e67130b..1498d0ae40 100644 --- a/ko/built-in-nodes/MoGeInference.mdx +++ b/ko/built-in-nodes/MoGeInference.mdx @@ -1,34 +1,35 @@ --- title: "MoGeInference - ComfyUI Built-in Node Documentation" -description: "단일 이미지에 MoGe를 실행하여 깊이와 지오메트리를 추정합니다. 이 노드는 입력 이미지를 MoGe 모델로 처리하여 3D 포인트 클라우드, 깊이 맵, 카메라 내부 파라미터, 마스크 및 표면 법선을 생성합니다." +description: "이미지에서 MoGe를 실행하여 깊이와 기하 구조를 추정합니다. 이 노드는 입력 이미지를 MoGe 모델을 통해 처리하여 3D 포인트 클라우드, 깊이 맵, 카메라 내부 파라미터, 마스크 및 표면 법선을 생성합니다." sidebarTitle: "MoGeInference" icon: "circle" mode: wide --- -단일 이미지에 MoGe를 실행하여 깊이와 지오메트리를 추정합니다. 이 노드는 입력 이미지를 MoGe 모델로 처리하여 3D 포인트 클라우드, 깊이 맵, 카메라 내부 파라미터, 마스크 및 표면 법선을 생성합니다. +이미지에서 MoGe를 실행하여 깊이와 기하 구조를 추정합니다. 이 노드는 입력 이미지를 MoGe 모델을 통해 처리하여 3D 포인트 클라우드, 깊이 맵, 카메라 내부 파라미터, 마스크 및 표면 법선을 생성합니다. ## 입력 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | | `moge_model` | 추론에 사용할 MoGe 모델입니다. | MOGE_MODEL | 예 | N/A | -| `image` | 깊이 및 지오메트리 추정을 위한 입력 이미지입니다. 처음 세 개의 색상 채널(RGB)만 사용됩니다. | IMAGE | 예 | N/A | -| `resolution_level` | 처리 해상도를 제어합니다. 0이 가장 빠르고, 9가 가장 상세합니다. (기본값: 9) | INT | 예 | 0 ~ 9 | -| `fov_x_degrees` | (고급) 소스 카메라의 수평 화각(도)입니다. 깊이 맵을 3D로 역투영하는 데 사용되는 초점 거리를 설정합니다. 0.0으로 설정하면 예측된 점에서 화각을 자동으로 복원합니다. (기본값: 0.0) | FLOAT | 예 | 0.0 ~ 170.0 | -| `batch_size` | 추론 호출당 이미지 수입니다. 긴 비디오 또는 이미지 세트에서 메모리가 부족한 경우 이 값을 낮추십시오. (기본값: 4) | INT | 예 | 1 ~ 64 | -| `force_projection` | (고급) 예측된 점의 투영을 강제합니다. (기본값: True) | BOOLEAN | 예 | True/False | -| `apply_mask` | (고급) 마스킹된(하늘 또는 유효하지 않은) 픽셀을 점 및 깊이 출력에서 무한대로 설정하여 메시 생성 도구가 무시할 수 있게 합니다. 비활성화하면 원시 예측 지오메트리를 모든 곳에 유지하며, 마스크는 별도로 계속 반환됩니다. (기본값: True) | BOOLEAN | 예 | True/False | +| `image` | 깊이 및 기하 구조 추정을 위한 입력 이미지입니다. 처음 세 개의 색상 채널(RGB)만 사용됩니다. | IMAGE | 예 | N/A | +| `resolution_level` | 처리 해상도를 제어합니다. 0 = 가장 빠름, 9 = 가장 세밀함. (기본값: 9) | INT | 예 | 0 ~ 9 | +| `fov_x_degrees` | (고급) 소스 카메라의 수평 화각입니다. 깊이 맵을 3D로 역투영하는 데 사용되는 초점 거리를 설정합니다. 0 = 예측된 포인트에서 자동 복구합니다. (기본값: 0.0) | FLOAT | 예 | 0.0 ~ 170.0 (단계 0.1) | +| `batch_size` | 추론 호출당 이미지 수입니다. 긴 비디오/이미지 세트에서 OOM이 발생하면 낮추십시오. (기본값: 4) | INT | 예 | 1 ~ 64 | +| `force_projection` | (고급) 예측된 포인트의 투영을 강제합니다. (기본값: True) | BOOLEAN | 예 | True/False | +| `apply_mask` | (고급) 마스크 처리된(하늘/유효하지 않은) 픽셀을 포인트와 깊이에서 inf로 설정하여 메싱(meshing) 시 해당 픽셀을 제거하도록 합니다. 비활성화하면 원시 예측 기하 구조를 모든 위치에 유지합니다. 마스크는 여전히 별도로 반환됩니다. (기본값: True) | BOOLEAN | 예 | True/False | +| `refine_steps` | (고급) MoGe-3 전용: 예측된 깊이에 대한 희소 볼류메트릭(sparse volumetric) 정제 패스를 수행합니다. 패스가 많을수록 대략 선형 비용으로 미세한 디테일과 경계를 선명하게 합니다. 0은 정제를 비활성화합니다. MoGe-1 / MoGe-2에서는 무시됩니다. (기본값: 3) | INT | 예 | 0 ~ 8 | -참고: 입력 `image`에 `batch_size`보다 많은 프레임이 포함된 경우, 노드는 여러 번의 추론 호출로 처리하고 결과를 단일 출력 지오메트리로 결합합니다. +참고: 입력 `image`에 `batch_size`보다 많은 프레임이 포함된 경우, 노드는 여러 추론 호출로 이를 처리하고 결과를 단일 출력 기하 구조로 결합합니다. ## 출력 | 출력 이름 | 설명 | 데이터 타입 | | --- | --- | --- | -| `moge_geometry` | 추정된 지오메트리를 포함하는 딕셔너리입니다. 원본 `image`를 포함하며, `points`(3D 포인트 클라우드), `depth`(깊이 맵), `intrinsics`(카메라 내부 파라미터 행렬), `mask`(유효한 픽셀을 식별하는 마스크), `normal`(표면 법선)을 포함할 수 있습니다. | MOGE_GEOMETRY | +| `moge_geometry` | 추정된 기하 구조를 포함하는 딕셔너리입니다. 원본 `image`를 포함하며, `points` (3D 포인트 클라우드), `depth` (깊이 맵), `intrinsics` (카메라 내부 파라미터 행렬), `mask` (유효한 픽셀을 식별하는 마스크), `normal` (표면 법선)을 포함할 수 있습니다. | MOGE_GEOMETRY | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGeInference/ko.md) --- -**Source fingerprint (SHA-256):** `59f6b8b1ab65147a47f5dc7ebee7b965a5ab37c6a0843a2c80d50c767ad98db4` +**Source fingerprint (SHA-256):** `10f3399d9b6bc4ff8a940c940f538a8ec8f38a15e7d65f162499c5ab264fad65` diff --git a/ko/built-in-nodes/MoGePanoramaInference.mdx b/ko/built-in-nodes/MoGePanoramaInference.mdx index 39367f69e9..5767adf549 100644 --- a/ko/built-in-nodes/MoGePanoramaInference.mdx +++ b/ko/built-in-nodes/MoGePanoramaInference.mdx @@ -1,26 +1,29 @@ --- title: "MoGePanoramaInference - ComfyUI Built-in Node Documentation" -description: "This node performs depth estimation on equirectangular panorama images." +description: "이 노드는 등장방형 파노라마 이미지에 대해 깊이 추정을 수행합니다. 파노라마를 12개의 원근 뷰로 분할하고, 각 뷰에서 MoGe 깊이 추정 모델을 실행한 뒤, 뷰별 결과를 다시 전체 파노라마를 포괄하는 단일 깊이 맵으로 병합합니다. 뷰별로 예측된 법선과 메트릭 스케일은 무시되는데, 뷰별 스케일은 중첩 이음새에서 서로 정렬" sidebarTitle: "MoGePanoramaInference" icon: "circle" mode: wide --- +이 노드는 등장방형 파노라마 이미지에 대해 깊이 추정을 수행합니다. 파노라마를 12개의 원근 뷰로 분할하고, 각 뷰에서 MoGe 깊이 추정 모델을 실행한 뒤, 뷰별 결과를 다시 전체 파노라마를 포괄하는 단일 깊이 맵으로 병합합니다. 뷰별로 예측된 법선과 메트릭 스케일은 무시되는데, 뷰별 스케일은 중첩 이음새에서 서로 정렬되지 않기 때문입니다. + ## 입력 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| | `moge_model` | 추론에 사용할 MoGe 모델입니다. | MOGE_MODEL | 예 | | | `image` | 등장방형 파노라마(모든 종횡비)입니다. 이 노드는 단일 이미지만 허용하며, 이미지 배치를 전달하면 오류가 발생합니다. 처음 3개 색상 채널(RGB)만 사용됩니다. | IMAGE | 예 | | -| `resolution_level` | 뷰별 세부 수준입니다(0 = 가장 빠름, 9 = 가장 세밀함)(기본값: 9). | INT | 예 | 0 ~ 9 | -| `split_resolution` | 각 원근 분할의 해상도입니다(기본값: 512). | INT | 예 | 256 ~ 1024 | -| `merge_resolution` | 병합된 등장방형 거리 맵의 긴 변 해상도입니다(기본값: 1920). | INT | 예 | 256 ~ 8192 | -| `batch_size` | 추론 배치당 뷰 수입니다(총 12개 분할)(기본값: 4). | INT | 예 | 1 ~ 12 | +| `resolution_level` | 뷰별 세부 수준입니다(0 = 가장 빠름, 9 = 가장 세부적임)(기본값: 9). | INT | 예 | 0 ~ 9 | +| `split_resolution` | 각 원근 분할의 해상도입니다(기본값: 512). | INT | 예 | 256 ~ 1024 | +| `merge_resolution` | 병합된 등장방형 거리 맵의 긴 변 해상도입니다(기본값: 1920). | INT | 예 | 256 ~ 8192 | +| `batch_size` | 추론 배치당 뷰 수입니다(총 12개 분할)(기본값: 4). | INT | 예 | 1 ~ 12 | +| `refine_steps` | MoGe-3 전용: 예측된 깊이에 대해 희소 볼류메트릭 정제 패스를 수행합니다. 패스를 더 많이 수행할수록 대략 선형 비용으로 미세한 디테일과 가장자리가 선명해집니다. 0은 정제를 비활성화합니다. MoGe-1 / MoGe-2에서는 무시됩니다(기본값: 3). | INT | 예 | 0 ~ 8 | **참고:** -- 입력은 단일 이미지여야 합니다. `image`에 배치에 둘 이상의 이미지가 포함되어 있으면 노드에서 오류가 발생합니다. -- `merge_resolution`은 최대 긴 변 크기로 처리됩니다. 파노라마가 이 값보다 작으면 병합된 맵은 업스케일되지 않고 원본 파노라마 크기로 생성됩니다. 병합된 결과는 반환되기 전에 원본 파노라마 해상도로 다시 조정됩니다. +- 입력은 단일 이미지여야 합니다. `image`에 배치 내 이미지가 둘 이상 포함되어 있으면 노드에서 오류가 발생합니다. +- `merge_resolution`은 최대 긴 변 크기로 처리됩니다. 파노라마가 이 값보다 작으면 병합된 맵은 업스케일되지 않고 원본 파노라마 크기로 생성됩니다. 병합 결과는 반환되기 전에 원본 파노라마 해상도로 다시 크기 조정됩니다. ## 출력 @@ -31,4 +34,4 @@ mode: wide > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGePanoramaInference/ko.md) --- -**Source fingerprint (SHA-256):** `d35b6d42a5bb17c184bc56fe3867d3a183017084dc81649c0663a9fba2362770` +**Source fingerprint (SHA-256):** `7f21452d035b2fe9d30b0cd15ddad10916439492b1d682a8b28f1a79e375df58` diff --git a/ko/built-in-nodes/OpenAIGPTImage1.mdx b/ko/built-in-nodes/OpenAIGPTImage1.mdx index a17c341aa7..609619737f 100644 --- a/ko/built-in-nodes/OpenAIGPTImage1.mdx +++ b/ko/built-in-nodes/OpenAIGPTImage1.mdx @@ -1,50 +1,49 @@ --- title: "OpenAIGPTImage1 - ComfyUI Built-in Node Documentation" -description: "OpenAI의 GPT Image 엔드포인트를 통해 동기적으로 이미지를 생성합니다. 텍스트 프롬프트로 새 이미지를 만들거나, 입력 이미지와 선택적 마스크가 제공되면 기존 이미지를 편집할 수 있습니다. 이 노드는 gpt-image-1, gpt-image-1.5, gpt-image-2 모델을 지원하며, 사용 중단됨(" +description: "OpenAI의 GPT Image 엔드포인트를 통해 이미지를 동기식으로 생성합니다. 텍스트 프롬프트로 새 이미지를 만들거나, 입력 이미지와 선택적 마스크가 제공되면 기존 이미지를 편집할 수 있습니다. 이 노드는 gpt-image-1, gpt-image-1.5, gpt-image-2 모델을 지원하며, 더 이상 사용" sidebarTitle: "OpenAIGPTImage1" icon: "circle" mode: wide --- -OpenAI의 GPT Image 엔드포인트를 통해 동기적으로 이미지를 생성합니다. 텍스트 프롬프트로 새 이미지를 만들거나, 입력 이미지와 선택적 마스크가 제공되면 기존 이미지를 편집할 수 있습니다. 이 노드는 `gpt-image-1`, `gpt-image-1.5`, `gpt-image-2` 모델을 지원하며, 사용 중단됨(deprecated)으로 표시되어 있습니다. +OpenAI의 GPT Image 엔드포인트를 통해 이미지를 동기식으로 생성합니다. 텍스트 프롬프트로 새 이미지를 만들거나, 입력 이미지와 선택적 마스크가 제공되면 기존 이미지를 편집할 수 있습니다. 이 노드는 `gpt-image-1`, `gpt-image-1.5`, `gpt-image-2` 모델을 지원하며, 더 이상 사용되지 않음(deprecated)으로 표시되어 있습니다. ## 입력 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| | `프롬프트` | GPT Image용 텍스트 프롬프트 (기본값: "") | STRING | 예 | - | -| `시드` | 생성용 무작위 시드입니다. 백엔드에서 아직 구현되지 않았습니다. (기본값: 0) | INT | 아니요 | 0 ~ 2147483647 | -| `품질` | 이미지 품질입니다. 비용과 생성 시간에 영향을 줍니다. (기본값: "low") | COMBO | 아니요 | "low"
"medium"
"high" | -| `배경` | 배경이 있거나 없는 이미지를 반환합니다. (기본값: "auto") | COMBO | 아니요 | "auto"
"opaque"
"transparent" | -| `크기` | 이미지 크기입니다. 사용자 지정 너비와 높이를 사용하려면 "Custom"을 선택합니다. (GPT Image 2 전용) (기본값: "auto") | COMBO | 아니요 | "auto"
"1024x1024"
"1024x1536"
"1536x1024"
"2048x2048"
"2048x1152"
"1152x2048"
"3840x2160"
"2160x3840"
"Custom" | -| `개수` | 생성할 이미지 수입니다. (기본값: 1) | INT | 아니요 | 1 ~ 8 | -| `참조 이미지` | 이미지 편집을 위한 선택적 참조 이미지입니다. | IMAGE | 아니요 | - | -| `마스크` | 인페인팅을 위한 선택적 마스크입니다. (흰색 영역이 대체됩니다.) | MASK | 아니요 | - | -| `model` | 사용할 GPT Image 모델입니다. (기본값: "gpt-image-2") | COMBO | 아니요 | "gpt-image-1"
"gpt-image-1.5"
"gpt-image-2" | -| `custom_width` | `size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다. (GPT Image 2 전용) (기본값: 1024) | INT | 아니요 | 1024 ~ 3840, step 16 | -| `custom_height` | `size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다. (GPT Image 2 전용) (기본값: 1024) | INT | 아니요 | 1024 ~ 3840, step 16 | - -**매개변수 제약 조건:** +| `시드` | 생성을 위한 무작위 시드. 백엔드에서는 아직 구현되지 않았습니다 (기본값: 0) | INT | 아니요 | 0 ~ 2147483647 | +| `품질` | 이미지 품질. 비용과 생성 시간에 영향을 줍니다 (기본값: "low") | COMBO | 아니요 | "low"
"medium"
"high" | +| `배경` | 배경 포함 또는 미포함 이미지를 반환합니다 (기본값: "auto") | COMBO | 아니요 | "auto"
"opaque"
"transparent" | +| `크기` | 이미지 크기. 사용자 지정 너비와 높이를 사용하려면 "Custom"을 선택합니다 (GPT Image 2 전용) (기본값: "auto") | COMBO | 아니요 | "auto"
"1024x1024"
"1024x1536"
"1536x1024"
"2048x2048"
"2048x1152"
"1152x2048"
"3840x2160"
"2160x3840"
"Custom" | +| `개수` | 생성할 이미지 수 (기본값: 1) | INT | 아니요 | 1 ~ 8 | +| `참조 이미지` | 이미지 편집용 선택적 참조 이미지 | IMAGE | 아니요 | - | +| `마스크` | 인페인팅용 선택적 마스크 (흰색 영역이 대체됩니다) | MASK | 아니요 | - | +| `model` | 사용할 GPT Image 모델 (기본값: "gpt-image-2") | COMBO | 아니요 | "gpt-image-1"
"gpt-image-1.5"
"gpt-image-2" | +| `custom_width` | `size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다 (GPT Image 2 전용) (기본값: 1024) | INT | 아니요 | 1024 ~ 3840, 간격 16 | +| `custom_height` | `size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다 (GPT Image 2 전용) (기본값: 1024) | INT | 아니요 | 1024 ~ 3840, 간격 16 | + +**매개변수 제약 사항:** - `image`가 제공되면 노드는 이미지 편집 엔드포인트를 사용합니다. - `mask`는 `image`가 제공된 경우에만 사용할 수 있습니다. -- `mask`를 사용할 때는 단일 이미지만 지원됩니다. (배치 크기는 1이어야 합니다.) +- `mask`를 사용할 때는 단일 이미지만 지원됩니다 (배치 크기가 1이어야 합니다). - `mask`와 `image`는 크기가 같아야 합니다. - 사용자 지정 해상도(`size` = "Custom")는 `gpt-image-2` 모델에서만 지원됩니다. - 사용자 지정 너비와 높이는 16의 배수여야 합니다. - 사용자 지정 해상도의 가장 긴 변은 3840 이하여야 합니다. - 사용자 지정 해상도의 가로세로 비율은 3:1을 초과할 수 없습니다. -- 사용자 지정 해상도의 총 픽셀 수는 655,360에서 8,294,400 사이여야 합니다. -- `gpt-image-2` 모델에서는 투명 배경이 지원되지 않습니다. +- 사용자 지정 해상도의 총 픽셀 수는 655,360~8,294,400 사이여야 합니다. - `gpt-image-1` 및 `gpt-image-1.5` 모델은 `auto`, `1024x1024`, `1024x1536`, `1536x1024` 크기만 지원합니다. 다른 크기는 `gpt-image-2` 모델에서만 지원됩니다. ## 출력 | 출력 이름 | 설명 | 데이터 타입 | |-------------|-------------|-----------| -| `IMAGE` | 생성되거나 편집된 이미지입니다. 여러 이미지는 배치로 반환됩니다. 반환된 이미지의 크기가 서로 다르면 첫 번째 이미지에 맞게 크기가 조정됩니다. | IMAGE | +| `IMAGE` | 생성되거나 편집된 이미지입니다. 여러 이미지는 배치로 반환되며, 반환된 이미지의 크기가 서로 다르면 첫 번째 이미지에 맞게 크기가 조정됩니다. | IMAGE | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImage1/ko.md) --- -**Source fingerprint (SHA-256):** `bf588bffced6e66536b4cb54655ef6ebb9cf988d9739e3c379a8ebda1486e20a` +**Source fingerprint (SHA-256):** `f0f0db7fd2cdf8efd2155522b289aa8f3f939fa79a6e9060b0ffbb2dd20efa1e` diff --git a/ko/built-in-nodes/OpenAIGPTImageNodeV2.mdx b/ko/built-in-nodes/OpenAIGPTImageNodeV2.mdx index 4e6e6395cd..3b71a697a8 100644 --- a/ko/built-in-nodes/OpenAIGPTImageNodeV2.mdx +++ b/ko/built-in-nodes/OpenAIGPTImageNodeV2.mdx @@ -1,91 +1,90 @@ --- title: "OpenAIGPTImageNodeV2 - ComfyUI Built-in Node Documentation" -description: "이 노드는 OpenAI의 GPT Image API를 사용하여 이미지를 생성합니다. gpt-image-2.5-flare, gpt-image-2.5-sunburst, gpt-image-2, gpt-image-1.5, gpt-image-1 등 다섯 가지 모델을 지원하며, 이미지 편집을 위해 참조 이미지를 첨부" +description: "이 노드는 OpenAI의 GPT Image API를 사용하여 이미지를 생성합니다. 다섯 가지 모델 — gpt-image-2.5-flare, gpt-image-2.5-sunburst, gpt-image-2, gpt-image-1.5, gpt-image-1 — 을 지원하며, 이미지 편집을 위해 참조 이미지를" sidebarTitle: "OpenAIGPTImageNodeV2" icon: "circle" mode: wide --- -이 노드는 OpenAI의 GPT Image API를 사용하여 이미지를 생성합니다. `gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-2`, `gpt-image-1.5`, `gpt-image-1` 등 다섯 가지 모델을 지원하며, 이미지 편집을 위해 참조 이미지를 첨부할 수 있고, 마스크를 사용하여 이미지에서 교체할 부분을 지정할 수 있습니다. +이 노드는 OpenAI의 GPT Image API를 사용하여 이미지를 생성합니다. 다섯 가지 모델 — `gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-2`, `gpt-image-1.5`, `gpt-image-1` — 을 지원하며, 이미지 편집을 위해 참조 이미지를 첨부할 수 있고, 마스크를 사용하여 이미지에서 대체할 부분을 지정할 수 있습니다. ## 입력 ### 공통 입력 -이 입력들은 항상 표시됩니다. +이러한 입력은 항상 표시됩니다. -| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | | `모델` | 사용할 OpenAI GPT Image 모델입니다. 모델을 선택하면 해당 모델에 특화된 추가 매개변수가 표시됩니다. | DYNAMIC_COMBO | 예 | `"gpt-image-2.5-flare"`
`"gpt-image-2.5-sunburst"`
`"gpt-image-2"`
`"gpt-image-1.5"`
`"gpt-image-1"` | -| `프롬프트` | GPT Image에 전달할 텍스트 프롬프트입니다(기본값: `""`). | STRING | 예 | 해당 없음 | -| `개수` | 생성할 이미지 수입니다(기본값: `1`). | INT | 예 | 1~8 | -| `시드` | 재현을 위한 시드입니다(기본값: `0`). 아직 백엔드에서 구현되지 않았습니다. | INT | 예 | 0~2147483647 | +| `프롬프트` | GPT Image용 텍스트 프롬프트입니다(기본값: `""`). | STRING | 예 | N/A | +| `개수` | 생성할 이미지 수입니다(기본값: `1`). | INT | 예 | 1 ~ 8 | +| `시드` | 재현성을 위한 시드입니다(기본값: `0`). 아직 백엔드에서 구현되지 않았습니다. | INT | 예 | 0 ~ 2147483647 | ### gpt-image-2.5-flare 및 gpt-image-2.5-sunburst 입력 -이 입력들은 `model`이 `gpt-image-2.5-flare` 또는 `gpt-image-2.5-sunburst`로 설정된 경우 표시됩니다. 두 모델은 동일한 매개변수 세트를 공유합니다. +이러한 입력은 `model`이 `gpt-image-2.5-flare` 또는 `gpt-image-2.5-sunburst`로 설정된 경우 나타납니다. 두 모델은 동일한 매개변수 집합을 공유합니다. -| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `사이즈` | 이미지 크기입니다. 사용자 지정 너비와 높이를 사용하려면 "Custom"을 선택하세요(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `사용자 지정 너비` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480~3840 (단계 16) | -| `사용자 지정 높이` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480~3840 (단계 16) | -| `배경` | 배경 포함 여부를 지정하여 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"`
`"transparent"` | -| `품질` | 이미지 품질입니다. 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"`
`"xhigh"`
`"max"` | -| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개까지 사용할 수 있습니다. 자세한 내용은 참조 입력 섹션을 참조하세요. | IMAGE | 아니요 | 0~16 | -| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 교체됩니다). 참조 이미지가 정확히 한 장 필요합니다. | MASK | 아니요 | 해당 없음 | +| `사이즈` | 이미지 크기입니다. "Custom"을 선택하면 사용자 지정 너비와 높이를 사용합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `사용자 지정 너비` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480 ~ 3840 (단계 16) | +| `사용자 지정 높이` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480 ~ 3840 (단계 16) | +| `배경` | 배경이 있거나 없는 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"`
`"transparent"` | +| `품질` | 이미지 품질로, 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"`
`"xhigh"`
`"max"` | +| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개 이미지까지 가능합니다. 자세한 내용은 참조 입력을 참조하세요. | IMAGE | 아니요 | 0 ~ 16 | +| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 대체됩니다). 정확히 하나의 참조 이미지가 필요합니다. | MASK | 아니요 | N/A | ### gpt-image-2 입력 -이 입력들은 `model`이 `gpt-image-2`로 설정된 경우 표시됩니다. +이러한 입력은 `model`이 `gpt-image-2`로 설정된 경우 나타납니다. -| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `사이즈` | 이미지 크기입니다. 사용자 지정 너비와 높이를 사용하려면 "Custom"을 선택하세요(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `사용자 지정 너비` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480~3840 (단계 16) | -| `사용자 지정 높이` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480~3840 (단계 16) | -| `배경` | 배경 포함 여부를 지정하여 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"` | -| `품질` | 이미지 품질입니다. 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"` | -| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개까지 사용할 수 있습니다. 자세한 내용은 참조 입력 섹션을 참조하세요. | IMAGE | 아니요 | 0~16 | -| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 교체됩니다). 참조 이미지가 정확히 한 장 필요합니다. | MASK | 아니요 | 해당 없음 | +| `사이즈` | 이미지 크기입니다. "Custom"을 선택하면 사용자 지정 너비와 높이를 사용합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `사용자 지정 너비` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480 ~ 3840 (단계 16) | +| `사용자 지정 높이` | `model.size`가 "Custom"일 때만 사용됩니다. 16의 배수여야 합니다(기본값: `1024`). | INT | 아니요 | 480 ~ 3840 (단계 16) | +| `배경` | 배경이 있거나 없는 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"`
`"transparent"` | +| `품질` | 이미지 품질로, 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"` | +| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개 이미지까지 가능합니다. 자세한 내용은 참조 입력을 참조하세요. | IMAGE | 아니요 | 0 ~ 16 | +| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 대체됩니다). 정확히 하나의 참조 이미지가 필요합니다. | MASK | 아니요 | N/A | ### gpt-image-1.5 및 gpt-image-1 입력 -이 입력들은 `model`이 `gpt-image-1.5` 또는 `gpt-image-1`로 설정된 경우 표시됩니다. 두 모델은 동일한 매개변수 세트를 공유합니다. +이러한 입력은 `model`이 `gpt-image-1.5` 또는 `gpt-image-1`로 설정된 경우 나타납니다. 두 모델은 동일한 매개변수 집합을 공유합니다. -| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | | `사이즈` | 이미지 크기입니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"` | -| `배경` | 배경 포함 여부를 지정하여 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"`
`"transparent"` | -| `품질` | 이미지 품질입니다. 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"` | -| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개까지 사용할 수 있습니다. 자세한 내용은 참조 입력 섹션을 참조하세요. | IMAGE | 아니요 | 0~16 | -| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 교체됩니다). 참조 이미지가 정확히 한 장 필요합니다. | MASK | 아니요 | 해당 없음 | +| `배경` | 배경이 있거나 없는 이미지를 반환합니다(기본값: `"auto"`). | COMBO | 예 | `"auto"`
`"opaque"`
`"transparent"` | +| `품질` | 이미지 품질로, 비용과 생성 시간에 영향을 줍니다(기본값: `"low"`). | COMBO | 예 | `"low"`
`"medium"`
`"high"` | +| `model.images` | 이미지 편집을 위한 선택적 참조 이미지입니다. 최대 16개 이미지까지 가능합니다. 자세한 내용은 참조 입력을 참조하세요. | IMAGE | 아니요 | 0 ~ 16 | +| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 대체됩니다). 정확히 하나의 참조 이미지가 필요합니다. | MASK | 아니요 | N/A | ### 참조 입력 -| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `model.images` | 확장 가능 슬롯: 항목 1..N개를 연결합니다(예: `image_1`...`image_16`). 모든 모델에서 최대 16개의 참조 이미지를 지원합니다. | IMAGE | 아니요 | 1~16 | -| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 교체됩니다). 참조 이미지가 정확히 한 장 필요합니다. | MASK | 아니요 | 해당 없음 | +| `model.images` | 확장 가능한 슬롯: 1..N개 항목(예: `image_1`...`image_16`)을 연결합니다. 모든 모델에서 최대 16개의 참조 이미지를 지원합니다. | IMAGE | 아니요 | 0 ~ 16 | +| `model.mask` | 인페인팅을 위한 선택적 마스크입니다(흰색 영역이 대체됩니다). 정확히 하나의 참조 이미지가 필요합니다. | MASK | 아니요 | N/A | -**매개변수 제약 조건 및 제한 사항:** +**매개변수 제약 및 제한 사항:** -- `model.size`가 "Custom"인 경우(`gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-2` 전용), `model.custom_width` 및 `model.custom_height`는 모두 16의 배수여야 하며, 가장 긴 변은 3840을 초과할 수 없고, 종횡비는 3:1을 초과할 수 없으며, 총 픽셀 수는 655,360 이상 8,294,400 이하여야 합니다. -- `model.mask`는 `model.images`에 참조 이미지가 정확히 한 장 있을 때만 사용할 수 있습니다. 이미지 없이는 사용할 수 없으며, 두 장 이상과 함께 사용할 수도 없습니다. -- `model.mask`를 사용할 때 마스크의 높이와 너비는 참조 이미지의 높이 및 너비와 일치해야 합니다. -- `model.images`가 제공되면 노드는 이미지 편집 모드로 실행되고, `model.images` 없이 프롬프트만으로 이미지를 생성합니다. -- 참조 이미지와 마스크는 API로 전송되기 전에 축소됩니다. +- `model.size`가 "Custom"인 경우(`gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-2`에만 해당), `model.custom_width`와 `model.custom_height`는 모두 16의 배수여야 하며, 가장 긴 변은 3840을 초과할 수 없고, 종횡비는 3:1을 초과할 수 없으며, 총 픽셀 수는 655,360에서 8,294,400 사이여야 합니다. +- `model.mask`는 `model.images`에 정확히 하나의 참조 이미지가 있어야 합니다. 이미지 없이 사용할 수 없으며, 둘 이상의 이미지와 함께 사용할 수 없습니다. +- `model.mask`를 사용할 때, 해당 높이와 너비는 참조 이미지의 높이와 너비와 일치해야 합니다. +- `model.images`가 제공되면 노드는 이미지 편집 모드로 실행됩니다. `model.images`가 없으면 프롬프트만으로 이미지를 생성합니다. +- 참조 이미지와 마스크는 API로 전송되기 전에 다운스케일됩니다. - `"xhigh"` 및 `"max"` 품질 수준은 `gpt-image-2.5-flare` 및 `gpt-image-2.5-sunburst`에서만 사용할 수 있습니다. -- `"transparent"` 배경 옵션은 `gpt-image-2.5-flare`, `gpt-image-2.5-sunburst`, `gpt-image-1.5`, `gpt-image-1`에서 사용할 수 있으며, `gpt-image-2`에서는 사용할 수 없습니다. - `seed`는 현재 백엔드에서 구현되지 않았습니다. ## 출력 | 출력 이름 | 설명 | 데이터 타입 | | --- | --- | --- | -| `image` | 생성된 이미지 또는 이미지들입니다. 반환된 모든 이미지는 하나의 배치로 결합되며, 크기가 다른 경우 첫 번째 이미지에 맞게 크기가 조정됩니다. | IMAGE | +| `image` | 생성된 이미지 또는 이미지들입니다. 반환된 모든 이미지는 하나의 배치로 스택됩니다. 크기가 다른 경우 첫 번째 이미지에 맞게 크기가 조정됩니다. | IMAGE | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImageNodeV2/ko.md) --- -**Source fingerprint (SHA-256):** `4f77b79f9f432a1f2e0fd814012aebe7cc42a8aa983ee9a61f3b32984bf65148` +**Source fingerprint (SHA-256):** `804ea35d0e2aa0b2993a293cb10cb41e2f9c6a3732304306253f7f7b1eb59b8a` diff --git a/ko/built-in-nodes/PrunaImageToVideoNode.mdx b/ko/built-in-nodes/PrunaImageToVideoNode.mdx new file mode 100644 index 0000000000..14e9d758cc --- /dev/null +++ b/ko/built-in-nodes/PrunaImageToVideoNode.mdx @@ -0,0 +1,53 @@ +--- +title: "PrunaImageToVideoNode - ComfyUI Built-in Node Documentation" +description: "Pruna의 P-Video-2 모델을 사용하여 이미지를 비디오로 애니메이션합니다. 첫 번째 프레임은 필수이며 출력의 화면 비율을 고정합니다. 선택적 마지막 프레임은 비디오가 보간되어 도달할 끝 지점을 제공합니다. 프롬프트는 장면이 어떻게 움직이는지 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 모션을 구동하는 오디오" +sidebarTitle: "PrunaImageToVideoNode" +icon: "circle" +mode: wide +--- + +Pruna의 P-Video-2 모델을 사용하여 이미지를 비디오로 애니메이션합니다. 첫 번째 프레임은 필수이며 출력의 화면 비율을 고정합니다. 선택적 마지막 프레임은 비디오가 보간되어 도달할 끝 지점을 제공합니다. 프롬프트는 장면이 어떻게 움직이는지 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 모션을 구동하는 오디오 클립을 받습니다. + +## 입력 + +### 공통 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `모델` | 사용할 Pruna 비디오 모델입니다. 모델을 선택하면 아래에 해당 모델의 입력이 표시됩니다. | DYNAMIC_COMBO | 예 | `"p-video-2"` | + +### P-Video-2 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `model.first_frame` | 비디오가 시작되는 이미지입니다. 출력은 이 이미지의 화면 비율을 유지합니다. | IMAGE | 예 | - | +| `model.last_frame` | 비디오가 끝나는 이미지입니다. 이 이미지의 화면 비율은 첫 번째 프레임의 화면 비율과 가까워야 합니다. | IMAGE | 아니요 | - | +| `프롬프트` | 장면이 어떻게 움직이고 들리는지 설명합니다. 공백이 아닌 문자를 최소 1자 이상 포함해야 하며, 최대 5000자까지 가능합니다(기본값: 비어 있음). | STRING | 예 | 최대 5000자 | +| `기간` | 비디오 길이(초)입니다. `"auto"`는 모델이 프롬프트에서 길이를 선택하도록 합니다. `model.audio`가 연결된 경우 무시됩니다. 이 경우 비디오는 오디오 길이를 따르며, 최대 20초까지 정수 초로 올림됩니다(기본값: `"5"`). | COMBO | 예 | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `해상도` | 출력 해상도입니다. 720p는 약 0.9메가픽셀(16:9에서 1280x704)을 렌더링하고, 1080p는 약 2메가픽셀(16:9에서 1920x1088)을 렌더링합니다(기본값: `"720p"`). | COMBO | 예 | `"720p"`
`"1080p"` | +| `fps` | 초당 프레임 수입니다. 1080p에서 초안 모드와 함께 48 fps는 사용할 수 없습니다(기본값: `"24"`). | COMBO | 예 | `"24"`
`"48"` | +| `초안` | 더 빠르지만 세부 묘사가 적은 렌더링이며, 표준 렌더링보다 낮은 요금으로 과금됩니다(기본값: False). | BOOLEAN | 예 | True/False | +| `generate_audio` | 비디오의 사운드트랙을 생성합니다. `model.audio`가 연결된 경우 무시되며, 대신 해당 오디오가 사운드트랙이 됩니다(기본값: True). | BOOLEAN | 예 | True/False | +| `enhance_prompt` | 생성 전에 프롬프트를 더 자세하게 다시 작성합니다. 짧은 프롬프트에는 이것이 필요합니다. 동일한 시드로 결과를 정확히 재현하려면 끄십시오(기본값: True). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `model.audio` | 모션을 구동하고 사운드트랙이 되는 오디오입니다. 최소 1초 이상이어야 하며, 20초를 초과하는 오디오는 잘립니다. `model.duration` 대신 비디오 길이를 설정합니다. | AUDIO | 아니요 | - | +| `시드` | 생성용 시드입니다. 동일한 시드는 `model.enhance_prompt`가 꺼져 있을 때만 결과를 정확히 재현합니다(기본값: 42). | INT | 예 | 0 ~ 2147483647 | + +**참고 사항:** + +- `model.first_frame`은 필수이며 출력 화면 비율을 고정하므로, 이 노드에는 화면 비율 입력이 없습니다. +- `model.last_frame`은 선택 사항이지만, 화면 비율이 첫 번째 프레임과 가까워야 하며 그렇지 않으면 노드에서 오류가 발생합니다. +- `model.prompt`는 필수이며 5000자로 제한됩니다. +- 1080p에서 초안 모드는 48 fps와 함께 사용할 수 없습니다. 노드에서 오류가 발생하므로 초안 모드를 끄거나 24 fps를 사용하십시오. +- 연결된 오디오는 최소 1초 이상이어야 하며, 20초를 초과하는 부분은 무시됩니다. +- `model.audio`가 연결된 경우 오디오가 비디오 길이를 설정하므로 `model.duration`과 `model.generate_audio`는 영향을 주지 않습니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +| --- | --- | --- | +| `video` | 사운드트랙이 포함된 생성된 비디오입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaImageToVideoNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `da8952e478eee593543fa7ae1aa329ad5bd5078024f905cdba185d18e76db130` diff --git a/ko/built-in-nodes/PrunaTextToVideoNode.mdx b/ko/built-in-nodes/PrunaTextToVideoNode.mdx new file mode 100644 index 0000000000..a668600bb6 --- /dev/null +++ b/ko/built-in-nodes/PrunaTextToVideoNode.mdx @@ -0,0 +1,50 @@ +--- +title: "PrunaTextToVideoNode - ComfyUI Built-in Node Documentation" +description: "Pruna의 P-Video-2 모델을 사용하여 텍스트 프롬프트로부터 비디오를 생성합니다. 프롬프트는 장면, 움직임, 사운드를 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 움직임을 주도하고 사운드트랙이 되는 오디오 클립을 받습니다." +sidebarTitle: "PrunaTextToVideoNode" +icon: "circle" +mode: wide +--- + +Pruna의 P-Video-2 모델을 사용하여 텍스트 프롬프트로부터 비디오를 생성합니다. 프롬프트는 장면, 움직임, 사운드를 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 움직임을 주도하고 사운드트랙이 되는 오디오 클립을 받습니다. + +## 입력 + +### 공통 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `모델` | 사용할 Pruna 비디오 모델입니다. 모델을 선택하면 아래에 해당 모델의 입력이 표시됩니다. | DYNAMIC_COMBO | 예 | `"p-video-2"` | + +### P-Video-2 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `프롬프트` | 비디오, 움직임, 사운드를 설명합니다. 공백 문자가 아닌 문자를 최소 하나 포함해야 하며, 최대 5000자까지 가능합니다(기본값: 비어 있음). | STRING | 예 | 최대 5000자 | +| `aspect_ratio` | 출력 비디오의 화면 비율입니다(기본값: `"16:9"`). | COMBO | 예 | `"16:9"`
`"9:16"`
`"4:3"`
`"3:4"`
`"3:2"`
`"2:3"`
`"1:1"` | +| `기간` | 비디오 길이(초)입니다. `"auto"`는 모델이 프롬프트에서 길이를 선택하도록 합니다. `model.audio`가 연결된 경우 무시됩니다. 이때 비디오는 오디오 길이를 따르며, 정수 초 단위로 올림되고 최대 20초까지입니다(기본값: `"5"`). | COMBO | 예 | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `해상도` | 출력 해상도입니다. 720p는 약 0.9메가픽셀(16:9에서 1280x704), 1080p는 약 2메가픽셀(16:9에서 1920x1088)을 렌더링합니다(기본값: `"720p"`). | COMBO | 예 | `"720p"`
`"1080p"` | +| `fps` | 초당 프레임 수입니다. 1080p에서 드래프트와 함께 48 fps를 사용할 수 없습니다(기본값: `"24"`). | COMBO | 예 | `"24"`
`"48"` | +| `초안` | 더 빠르고 세부 묘사가 적은 렌더링이며, 표준 렌더링보다 낮은 요금으로 청구됩니다(기본값: False). | BOOLEAN | 예 | True/False | +| `generate_audio` | 비디오용 사운드트랙을 생성합니다. `model.audio`가 연결된 경우 무시되며, 대신 해당 오디오가 사운드트랙이 됩니다(기본값: True). | BOOLEAN | 예 | True/False | +| `enhance_prompt` | 생성 전에 프롬프트를 더 자세하게 재작성합니다. 짧은 프롬프트에는 이 기능이 필요합니다. 동일한 시드로 결과를 정확히 재현하려면 끄세요(기본값: True). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `model.audio` | 움직임을 주도하고 사운드트랙이 되는 오디오입니다. 최소 1초 이상이어야 하며, 20초를 초과하는 오디오는 잘립니다. `model.duration` 대신 비디오 길이를 설정합니다. | AUDIO | 아니요 | - | +| `시드` | 생성을 위한 시드입니다. 동일한 시드는 `model.enhance_prompt`가 꺼져 있을 때만 결과를 정확히 재현합니다(기본값: 42). | INT | 예 | 0 ~ 2147483647 | + +**참고:** + +- `model.prompt`는 필수이며 5000자로 제한됩니다. +- 1080p에서 드래프트는 48 fps와 함께 사용할 수 없습니다. 노드가 오류를 발생시키므로 드래프트를 끄거나 24 fps를 사용하세요. +- 연결된 오디오는 최소 1초 이상이어야 하며, 20초를 초과하는 부분은 무시됩니다. +- `model.audio`가 연결된 경우 오디오가 비디오 길이를 설정하므로 `model.duration`과 `model.generate_audio`는 아무런 영향을 주지 않습니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +| --- | --- | --- | +| `video` | 생성된 비디오와 사운드트랙입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaTextToVideoNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `bb7bacf2591618220c72525c1e32382174abe3a55069720adbc84fc1d8081718` diff --git a/ko/built-in-nodes/StartLoop.mdx b/ko/built-in-nodes/StartLoop.mdx index 884f0bc85a..e641fa2728 100644 --- a/ko/built-in-nodes/StartLoop.mdx +++ b/ko/built-in-nodes/StartLoop.mdx @@ -14,7 +14,7 @@ Start Loop 노드는 워크플로 내부에서 반복 구조를 시작합니다. | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| -| `mode` | 루프 반복 모드입니다(기본값: "simple"). 선택한 모드에 따라 표시되는 추가 매개변수가 결정됩니다. | DYNAMIC_COMBO | 예 | `"simple"`
`"For"`
`"List"` | +| `모드` | 루프 반복 모드입니다(기본값: "simple"). 선택한 모드에 따라 표시되는 추가 매개변수가 결정됩니다. | DYNAMIC_COMBO | 예 | `"simple"`
`"For"`
`"List"` | | `cache_iterations` | 이전 실행에서 변경되지 않은 반복 결과를 재사용합니다. 비활성화하면 모든 반복을 다시 실행합니다. 기본값: false. | BOOLEAN | 예 | true
false | | `parent_iteration` | 이 루프를 중첩하려면 외부 Start Loop의 iteration_index를 연결합니다. 이 입력은 강제 입력(force-input) 전용이며 링크가 필요합니다. | INT | 아니요 | 임의의 정수 | | `initial_iteration_value` | 첫 번째 반복에서 current_iteration_value로 노출되는 값입니다. | ANY (type-matched) | 아니요 | 모든 값 | diff --git a/ko/built-in-nodes/TextGenerate.mdx b/ko/built-in-nodes/TextGenerate.mdx index 0997bb8985..903abbe295 100644 --- a/ko/built-in-nodes/TextGenerate.mdx +++ b/ko/built-in-nodes/TextGenerate.mdx @@ -1,12 +1,12 @@ --- title: "TextGenerate - ComfyUI Built-in Node Documentation" -description: "TextGenerate 노드는 CLIP 모델을 사용하여 사용자의 프롬프트를 기반으로 텍스트를 생성합니다. 선택적으로 이미지, 비디오 또는 오디오를 추가 컨텍스트로 사용하여 텍스트 생성을 안내할 수 있습니다. 출력 길이를 제어하고, 지원되는 모델의 경우 thinking 모드를 활성화할 수 있으며, 다양한 설정으로 무작위 샘" +description: "TextGenerate 노드는 CLIP 모델을 사용하여 사용자의 프롬프트를 기반으로 텍스트를 생성합니다. 선택적으로 이미지, 비디오 또는 오디오를 추가 컨텍스트로 사용하여 텍스트 생성을 안내할 수 있습니다. 출력 길이를 제어하고, 지원되는 모델에서 사고 모드를 활성화하며, 다양한 설정으로 무작위 샘플링을 사용할지 또는 샘" sidebarTitle: "TextGenerate" icon: "circle" mode: wide --- -TextGenerate 노드는 CLIP 모델을 사용하여 사용자의 프롬프트를 기반으로 텍스트를 생성합니다. 선택적으로 이미지, 비디오 또는 오디오를 추가 컨텍스트로 사용하여 텍스트 생성을 안내할 수 있습니다. 출력 길이를 제어하고, 지원되는 모델의 경우 thinking 모드를 활성화할 수 있으며, 다양한 설정으로 무작위 샘플링을 사용할지 또는 샘플링 없이 텍스트를 생성할지 선택할 수 있습니다. +TextGenerate 노드는 CLIP 모델을 사용하여 사용자의 프롬프트를 기반으로 텍스트를 생성합니다. 선택적으로 이미지, 비디오 또는 오디오를 추가 컨텍스트로 사용하여 텍스트 생성을 안내할 수 있습니다. 출력 길이를 제어하고, 지원되는 모델에서 사고 모드를 활성화하며, 다양한 설정으로 무작위 샘플링을 사용할지 또는 샘플링 없이 텍스트를 생성할지 선택할 수 있습니다. ## 입력 @@ -14,37 +14,38 @@ TextGenerate 노드는 CLIP 모델을 사용하여 사용자의 프롬프트를 | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `샘플링 모드` | 텍스트 생성 중 무작위 샘플링 사용 여부를 제어합니다. "on"으로 설정하면 추가 샘플링 매개변수를 사용할 수 있습니다. "off"로 설정하면 노드는 무작위 샘플링 없이 텍스트를 생성합니다. | DYNAMIC_COMBO | 예 | `"on"`
`"off"` | +| `샘플링 모드` | 텍스트 생성 중 무작위 샘플링 사용 여부를 제어합니다. "on"으로 설정하면 추가 샘플링 매개변수를 사용할 수 있습니다. "off"로 설정하면 노드가 무작위 샘플링 없이 텍스트를 생성합니다. | DYNAMIC_COMBO | 예 | `"on"`
`"off"` | | `clip` | 프롬프트를 토큰화하고 텍스트를 생성하는 데 사용되는 CLIP 모델입니다. | CLIP | 예 | N/A | | `프롬프트` | 생성을 안내하는 텍스트 프롬프트입니다. 이 필드는 여러 줄과 동적 프롬프트를 지원합니다. 기본값은 빈 문자열입니다. | STRING | 예 | N/A | -| `이미지` | 생성된 텍스트에 영향을 주기 위해 텍스트 프롬프트와 함께 사용할 수 있는 선택적 이미지입니다. | IMAGE | 아니요 | N/A | -| `비디오` | 이미지 배치 형태의 비디오 프레임입니다. 24 FPS로 가정되며 내부적으로 1 FPS로 서브샘플링됩니다. | IMAGE | 아니요 | N/A | -| `오디오` | 생성된 텍스트에 영향을 주기 위해 텍스트 프롬프트와 함께 사용할 수 있는 선택적 오디오 입력입니다. | AUDIO | 아니요 | N/A | +| `이미지` | 텍스트 프롬프트와 함께 사용되어 생성된 텍스트에 영향을 줄 수 있는 선택적 이미지입니다. | IMAGE | 아니요 | N/A | +| `비디오` | 이미지 배치로 제공되는 비디오 프레임입니다. 24 FPS로 가정하며 내부적으로 1 FPS로 서브샘플링됩니다. | IMAGE | 아니요 | N/A | +| `오디오` | 텍스트 프롬프트와 함께 사용되어 생성된 텍스트에 영향을 줄 수 있는 선택적 오디오 입력입니다. | AUDIO | 아니요 | N/A | | `최대 길이` | 모델이 생성할 최대 토큰 수입니다. 기본값은 512입니다. | INT | 예 | 1 ~ 32768 | -| `생각 중` | 모델이 지원하는 경우 thinking 모드로 작동합니다. 기본값은 False입니다. | BOOLEAN | 아니요 | True or False | -| `use_default_template` | 모델에 내장 시스템 프롬프트/템플릿이 있는 경우 이를 사용합니다. 기본값은 True입니다. 고급 매개변수입니다. | BOOLEAN | 아니요 | True or False | +| `생각 중` | 모델이 지원하는 경우 사고 모드로 동작합니다. 기본값은 False입니다. | BOOLEAN | 아니요 | True or False | +| `use_default_template` | 모델에 내장 시스템 프롬프트/템플릿이 있는 경우 사용합니다. 기본값은 True입니다. 고급 매개변수입니다. | BOOLEAN | 아니요 | True or False | +| `mtp` | 체크포인트의 다중 토큰 예측 헤드를 사용한 추측 디코딩입니다. MTP 가중치가 없으면 효과가 없습니다. `"auto"`는 드래프트 깊이를 조정하고, `"2"`에서 `"5"`는 이를 고정합니다. 샘플링된 출력은 올바른 분포를 유지하지만 동일한 시드에 대해 비 MTP 출력과 다릅니다(기본값: `"auto"`). | COMBO | 아니요 | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | -### 샘플링 매개변수 (`sampling_mode`가 "on"인 경우) +### 샘플링 매개변수 (`sampling_mode`가 "on"일 때) | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `temperature` | 출력의 무작위성을 제어합니다. 값이 낮을수록 출력이 더 예측 가능해지고, 값이 높을수록 더 창의적이 됩니다. 기본값은 0.7입니다. | FLOAT | 예 | 0.01 ~ 2.0 | -| `top_k` | 샘플링 풀을 상위 K개의 가장 가능성이 높은 다음 토큰으로 제한합니다. 0 값은 이 필터를 비활성화합니다. 기본값은 64입니다. | INT | 예 | 0 ~ 1000 | -| `top_p` | 누적 확률이 이 값보다 낮은 토큰으로 선택을 제한하는 핵 샘플링(nucleus sampling)을 사용합니다. 기본값은 0.95입니다. | FLOAT | 예 | 0.0 ~ 1.0 | +| `temperature` | 출력의 무작위성을 제어합니다. 값이 낮을수록 출력이 더 예측 가능해지고, 높을수록 더 창의적이 됩니다. 기본값은 0.7입니다. | FLOAT | 예 | 0.01 ~ 2.0 | +| `top_k` | 다음 토큰으로 가장 가능성이 높은 상위 K개로 샘플링 풀을 제한합니다. 값이 0이면 이 필터가 비활성화됩니다. 기본값은 64입니다. | INT | 예 | 0 ~ 1000 | +| `top_p` | 뉴클리어스 샘플링을 사용하여 누적 확률이 이 값에 도달하는 가장 가능성이 높은 토큰의 최소 집합을 유지합니다.기본값은 0.95입니다. | FLOAT | 예 | 0.0 ~ 1.0 | | `min_p` | 고려할 토큰의 최소 확률 임계값을 설정합니다. 기본값은 0.05입니다. | FLOAT | 예 | 0.0 ~ 1.0 | -| `repetition_penalty` | 반복을 줄이기 위해 이미 생성된 토큰에 패널티를 부과합니다. 1.0 값은 패널티를 적용하지 않습니다. 기본값은 1.05입니다. | FLOAT | 예 | 0.0 ~ 5.0 | +| `repetition_penalty` | 이미 생성된 토큰에 페널티를 적용하여 반복을 줄입니다. 값이 1.0이면 페널티가 적용되지 않습니다. 기본값은 1.05입니다. | FLOAT | 예 | 0.0 ~ 5.0 | | `seed` | 재현 가능한 결과를 위해 난수 생성기를 초기화하는 데 사용되는 숫자입니다. 기본값은 0입니다. | INT | 예 | 0 ~ 18446744073709551615 | -| `presence_penalty` | 지금까지 텍스트에 나타난 적이 있는지 여부에 따라 새로운 토큰에 패널티를 부과하여 모델이 새로운 주제에 대해 이야기하도록 유도합니다. 기본값은 0.0입니다. | FLOAT | 아니요 | 0.0 ~ 5.0 | +| `presence_penalty` | 지금까지 텍스트에 등장했는지 여부에 따라 새 토큰에 페널티를 적용하여 모델이 새로운 주제에 대해 이야기하도록 유도합니다. 기본값은 0.0입니다. | FLOAT | 아니요 | 0.0 ~ 5.0 | -**참고:** 위의 샘플링 매개변수는 `sampling_mode`가 "on"으로 설정된 경우에만 노드 인터페이스에서 활성화되고 표시됩니다. `sampling_mode`가 "off"로 설정되면 샘플링 매개변수를 사용할 수 없으며 노드는 무작위 샘플링 없이 텍스트를 생성합니다. +**참고:** 위 샘플링 매개변수는 `sampling_mode`가 "on"으로 설정된 경우에만 노드 인터페이스에서 활성화되고 표시됩니다. `sampling_mode`가 "off"로 설정되면 사용 가능한 샘플링 매개변수가 없으며 노드는 무작위 샘플링 없이 텍스트를 생성합니다. ## 출력 | 출력 이름 | 설명 | 데이터 타입 | | --- | --- | --- | -| `생성된 텍스트` | 모델이 입력 프롬프트와 선택적 이미지, 비디오 또는 오디오를 기반으로 생성한 텍스트입니다. | STRING | +| `generated_text` | 입력 프롬프트와 선택적 이미지, 비디오 또는 오디오를 기반으로 모델이 생성한 텍스트입니다. | STRING | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerate/ko.md) --- -**Source fingerprint (SHA-256):** `6274a2db7c9a963304daf6df494b2b20879155e918d73429fd2ce7f3b5b9da02` +**Source fingerprint (SHA-256):** `7d9f6aee19e076aa0afb4d57060b09474206ecf2492c0944762965fabac92c51` diff --git a/ko/built-in-nodes/TextGenerateLTX2Prompt.mdx b/ko/built-in-nodes/TextGenerateLTX2Prompt.mdx index 35f90a5d95..35d42db420 100644 --- a/ko/built-in-nodes/TextGenerateLTX2Prompt.mdx +++ b/ko/built-in-nodes/TextGenerateLTX2Prompt.mdx @@ -1,41 +1,58 @@ --- title: "TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation" -description: "TextGenerateLTX2Prompt 노드는 짧은 사용자 프롬프트를 LTX-2 시리즈 비디오 모델로 비디오를 생성하는 데 적합한 상세한 오디오-비주얼 설명으로 확장합니다. 작업별 시스템 지침을 자동으로 추가하고, 형식이 지정된 프롬프트를 언어 모델로 전송한 뒤 향상된 텍스트를 반환합니다. 선택적 참조 이미지가 제공되면" +description: "TextGenerateLTX2Prompt 노드는 짧은 사용자 프롬프트를 LTX-2 시리즈 비디오 모델로 비디오를 생성하는 데 적합한 상세한 시청각 설명으로 확장합니다. 작업별 시스템 지침을 자동으로 추가하고, 형식이 지정된 프롬프트를 언어 모델로 전송한 뒤 향상된 텍스트를 반환합니다. 선택적 참조 이미지가 제공되면 노드는" sidebarTitle: "TextGenerateLTX2Prompt" icon: "circle" mode: wide --- -TextGenerateLTX2Prompt 노드는 짧은 사용자 프롬프트를 LTX-2 시리즈 비디오 모델로 비디오를 생성하는 데 적합한 상세한 오디오-비주얼 설명으로 확장합니다. 작업별 시스템 지침을 자동으로 추가하고, 형식이 지정된 프롬프트를 언어 모델로 전송한 뒤 향상된 텍스트를 반환합니다. 선택적 참조 이미지가 제공되면 노드는 이미지-투-비디오 모드로 전환하고 해당 이미지의 콘텐츠를 시작점으로 프롬프트를 확장합니다. +TextGenerateLTX2Prompt 노드는 짧은 사용자 프롬프트를 LTX-2 시리즈 비디오 모델로 비디오를 생성하는 데 적합한 상세한 시청각 설명으로 확장합니다. 작업별 시스템 지침을 자동으로 추가하고, 형식이 지정된 프롬프트를 언어 모델로 전송한 뒤 향상된 텍스트를 반환합니다. 선택적 참조 이미지가 제공되면 노드는 이미지-투-비디오 모드로 전환하고 해당 이미지의 내용에서 시작하여 프롬프트를 확장합니다. ## 입력 +### 공통 입력 + | 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | | --- | --- | --- | --- | --- | -| `clip` | 텍스트 인코딩에 사용되는 CLIP 모델입니다. 노드는 모델의 토크나이저 이름을 확인하여 일치하는 지침을 선택합니다. Gemma 4 기반 모델은 LTX-2.4 형식을 사용하고, 다른 모델은 LTX-2 (Gemma 3) 형식을 사용합니다. | CLIP | 예 | | -| `프롬프트` | 상세한 비디오 생성 프롬프트로 확장할 장면이나 개념을 설명하는 원시 텍스트 입력입니다. | STRING | 예 | | -| `최대 길이` | 언어 모델이 생성하도록 허용되는 최대 토큰 수입니다. | INT | 예 | | -| `샘플링 모드` | 텍스트 생성 중 다음 토큰을 선택하는 데 사용되는 샘플링 전략입니다. | COMBO | 예 | `"greedy"`
`"top_k"`
`"top_p"`
`"temperature"` | -| `이미지` | 비디오의 첫 프레임으로 사용되는 선택적 입력 이미지입니다. 제공되면 노드는 이미지-투-비디오 모드로 전환하고 이미지의 콘텐츠를 기반으로 사용자 프롬프트를 확장하는 시스템 프롬프트를 사용합니다. | IMAGE | 아니요 | | -| `생각 중` | 활성화하면 모델이 답변하기 전에 추론하도록 지시합니다. 추론 블록은 반환되는 출력에서 제거됩니다(기본값: False). | BOOLEAN | 아니요 | | -| `use_default_template` | 활성화하면 노드가 형식 지정을 위해 기본 채팅 템플릿을 사용합니다(기본값: True). | BOOLEAN | 아니요 | | -| `비디오` | 생성을 위한 추가 컨텍스트로 사용할 수 있는 선택적 비디오 입력입니다. | VIDEO | 아니요 | | -| `오디오` | 생성을 위한 추가 컨텍스트로 사용할 수 있는 선택적 오디오 입력입니다. | AUDIO | 아니요 | | +| `clip` | 텍스트 인코딩에 사용되는 CLIP 모델입니다. 노드는 모델의 토크나이저 이름을 확인하여 일치하는 지침을 선택합니다. Gemma 4 기반 모델은 LTX-2.4 형식을 사용하고, 다른 모델은 LTX-2(Gemma 3) 형식을 사용합니다. | CLIP | 예 | - | +| `프롬프트` | 장면이나 개념을 설명하는 원시 텍스트 입력으로, 상세한 비디오 생성 프롬프트로 확장됩니다. | STRING | 예 | - | +| `이미지` | 비디오의 첫 프레임으로 사용되는 선택적 입력 이미지입니다. 제공되면 노드는 이미지-투-비디오 모드로 전환하고 이미지 내용을 기반으로 사용자 프롬프트를 확장하는 시스템 프롬프트를 사용합니다. | IMAGE | 아니요 | - | +| `비디오` | 추가 컨텍스트로 사용되는 선택적 비디오 입력입니다. 언어 모델에 이미지 배치로 전달되며, 24 FPS로 가정하고 내부적으로 1 FPS로 서브샘플링됩니다. | IMAGE | 아니요 | - | +| `오디오` | 생성을 위한 추가 컨텍스트로 사용할 수 있는 선택적 오디오 입력입니다. | AUDIO | 아니요 | - | +| `최대 길이` | 언어 모델이 생성할 수 있는 최대 토큰 수입니다(기본값: 512). | INT | 예 | 1 ~ 32768 | +| `샘플링 모드` | 텍스트 생성 중 무작위 샘플링 사용 여부를 제어합니다. `"on"`으로 설정하면 아래 샘플링 매개변수를 사용할 수 있습니다. `"off"`이면 노드는 무작위 샘플링 없이 텍스트를 생성합니다. | DYNAMIC_COMBO | 예 | `"on"`
`"off"` | +| `생각 중` | 활성화하면 모델이 답변하기 전에 추론하도록 지시합니다. 모든 추론 블록은 반환된 출력에서 제거됩니다(기본값: False). | BOOLEAN | 아니요 | True/False | +| `use_default_template` | 활성화하면 노드가 서식을 지정할 때 기본 채팅 템플릿을 사용합니다(기본값: True). 고급 설정입니다. | BOOLEAN | 아니요 | True/False | +| `mtp` | 체크포인트의 다중 토큰 예측 헤드를 사용하는 추측 디코딩입니다. MTP 가중치가 없으면 효과가 없습니다. `"auto"`는 드래프트 깊이를 조정하고, `"2"`부터 `"5"`는 고정합니다. 샘플링된 출력은 분포가 올바르게 유지되지만 동일한 시드에 대해 비-MTP 출력과 다릅니다(기본값: `"auto"`). | COMBO | 아니요 | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | + +### 샘플링 매개변수 (`sampling_mode`가 "on"일 때) + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `temperature` | 출력의 무작위성을 제어합니다. 값이 낮을수록 출력이 더 예측 가능해지고, 높을수록 더 창의적이 됩니다(기본값: 0.7). | FLOAT | 예 | 0.01 ~ 2.0 | +| `top_k` | 가장 가능성이 높은 상위 K개의 다음 토큰으로 샘플링 풀을 제한합니다. 값이 0이면 이 필터를 비활성화합니다(기본값: 64). | INT | 예 | 0 ~ 1000 | +| `top_p` | 뉴클리어스 샘플링을 사용하여 누적 확률이 이 값에 도달하는 가장 가능성이 높은 토큰의 최소 집합을 유지합니다.(기본값: 0.95) | FLOAT | 예 | 0.0 ~ 1.0 | +| `min_p` | 토큰이 고려되기 위한 최소 확률 임계값을 설정합니다(기본값: 0.05). | FLOAT | 예 | 0.0 ~ 1.0 | +| `repetition_penalty` | 이미 생성된 토큰에 페널티를 부여하여 반복을 줄입니다. 값이 1.0이면 페널티를 적용하지 않습니다(기본값: 1.05). | FLOAT | 예 | 0.0 ~ 5.0 | +| `seed` | 재현 가능한 결과를 위해 난수 생성기를 초기화하는 데 사용되는 숫자입니다(기본값: 0). | INT | 예 | 0 ~ 18446744073709551615 | +| `presence_penalty` | 지금까지 텍스트에 등장했는지 여부에 따라 새 토큰에 페널티를 부여하여 모델이 새로운 주제에 대해 이야기하도록 장려합니다(기본값: 0.0). | FLOAT | 아니요 | 0.0 ~ 5.0 | + +**참고:** 위 샘플링 매개변수는 `sampling_mode`가 "on"으로 설정된 경우에만 노드 인터페이스에서 활성화되고 표시됩니다. "off"로 설정하면 사용 가능한 샘플링 매개변수가 없으며 노드는 무작위 샘플링 없이 텍스트를 생성합니다. **참고:** 노드의 동작은 입력에 따라 달라집니다: -- `image`가 제공되면 생성된 프롬프트는 이미지의 콘텐츠를 기반으로 프롬프트를 확장하는 방법을 설명하는 시스템 프롬프트를 사용하여 이미지-투-비디오 작업용으로 형식이 지정됩니다. 이미지가 제공되지 않으면 프롬프트를 상세한 비디오 생성 설명으로 확장하는 시스템 프롬프트를 사용하여 텍스트-투-비디오 작업용으로 형식이 지정됩니다. -- CLIP 토크나이저의 이름에 "gemma4"가 포함되어 있으면 노드는 LTX-2.4 시스템 프롬프트와 Gemma 4 채팅 형식을 사용합니다. 그렇지 않으면 LTX-2 (Gemma 3) 시스템 프롬프트와 채팅 형식을 사용합니다. -- Gemma 4 모델에서 `thinking`이 활성화되면 모델은 추론 채널에서 열립니다. 비활성화되면 모델은 최종 답변 채널에서 직접 열립니다. Gemma 4가 아닌 모델의 경우 `thinking`은 기본 생성 단계로 전달됩니다. -- 언어 모델이 추론 블록을 제거한 후 사용 가능한 텍스트를 생성하지 않으면 노드는 원래 `prompt`를 반환합니다. +- `image`가 제공되면 생성된 프롬프트는 이미지 내용을 기반으로 프롬프트를 확장하는 방법을 설명하는 시스템 프롬프트를 사용하여 이미지-투-비디오 작업에 맞게 형식이 지정됩니다. 이미지가 제공되지 않으면 텍스트-투-비디오 작업에 맞게 형식이 지정되며, 시스템 프롬프트를 사용하여 프롬프트를 상세한 비디오 생성 설명으로 확장합니다. +- CLIP 토크나이저의 이름에 "gemma4"가 포함되어 있으면 노드는 LTX-2.4 시스템 프롬프트와 Gemma 4 채팅 형식을 사용합니다. 그렇지 않으면 LTX-2(Gemma 3) 시스템 프롬프트와 채팅 형식을 사용합니다. +- Gemma 4 모델에서 `thinking`이 활성화되면 모델은 추론 채널에서 열리고, 비활성화되면 최종 답변 채널에서 직접 열립니다. Gemma 4가 아닌 모델의 경우 `thinking`은 기본 생성 단계로 전달됩니다. +- 언어 모델이 추론 블록을 제거한 후 사용 가능한 텍스트를 생성하지 않으면 노드는 대신 원래 `prompt`를 반환합니다. ## 출력 | 출력 이름 | 설명 | 데이터 타입 | | --- | --- | --- | -| `output` | 언어 모델이 생성한 향상된 비디오 생성 프롬프트이며, 추론 블록은 제거됩니다. 결과가 비어 있으면 원래 사용자 프롬프트가 반환됩니다. | STRING | +| `generated_text` | 언어 모델이 생성한 향상된 비디오 생성 프롬프트이며, 모든 추론 블록이 제거되어 있습니다. 결과가 비어 있으면 원래 사용자 프롬프트가 반환됩니다. | STRING | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/ko.md) --- -**Source fingerprint (SHA-256):** `8f524ea60a247217dde8a1edaf7a689e253ae05acc9eb52ad47b91e879dba1df` +**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943` diff --git a/ko/built-in-nodes/TripoPSeriesImageToModelNode.mdx b/ko/built-in-nodes/TripoPSeriesImageToModelNode.mdx new file mode 100644 index 0000000000..c9567ee9cd --- /dev/null +++ b/ko/built-in-nodes/TripoPSeriesImageToModelNode.mdx @@ -0,0 +1,56 @@ +--- +title: "TripoPSeriesImageToModelNode - ComfyUI Built-in Node Documentation" +description: "Tripo의 P2 모델을 사용하여 단일 이미지로부터 깔끔한 토폴로지를 가진 로우폴리 3D 모델을 생성합니다. 결과는 삼각형 메시(GLB)로 반환되며, model.quad가 활성화된 경우에는 쿼드 중심 메시(FBX)로 반환됩니다." +sidebarTitle: "TripoPSeriesImageToModelNode" +icon: "circle" +mode: wide +--- + +Tripo의 P2 모델을 사용하여 단일 이미지로부터 깔끔한 토폴로지를 가진 로우폴리 3D 모델을 생성합니다. 결과는 삼각형 메시(GLB)로 반환되며, `model.quad`가 활성화된 경우에는 쿼드 중심 메시(FBX)로 반환됩니다. + +## 입력 + +### 공통 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `모델` | 사용할 Tripo P-시리즈 모델입니다. 모델을 선택하면 아래에 해당 모델의 입력이 표시됩니다. | DYNAMIC_COMBO | 예 | `"P2"` | + +### P2 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `model.image` | 모델을 생성하는 데 사용할 이미지입니다. | IMAGE | 예 | - | +| `쿼드` | GLB 출력의 삼각형 메시 대신 FBX 출력에 쿼드 중심 메시를 반환합니다(기본값: False). | BOOLEAN | 예 | True/False | +| `face_limit` | 목표 면 수입니다. `-1`은 Tripo가 선택하도록 합니다. `model.quad`가 활성화된 경우 제한은 48~25,000이며, 그렇지 않으면 48~50,000입니다(기본값: -1). | INT | 예 | -1 또는 48 ~ 50000 | +| `텍스처` | 기본 색상 텍스처 해상도: standard는 2K, detailed는 4K, extreme은 8K입니다. `"none"`은 텍스처가 없는 메시를 반환합니다(기본값: `"standard"`). | COMBO | 예 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 기본 색상에 메탈릭, 러프니스 및 노멀 맵을 추가합니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: True). | BOOLEAN | 예 | True/False | +| `model_seed` | 지오메트리용 시드입니다(기본값: 42). | INT | 예 | 0 ~ 2147483647 | +| `texture_alignment` | 입력 이미지의 색상과 일치시키거나 생성된 지오메트리에 텍스처를 맞춥니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: `"original_image"`). 고급 설정입니다. | COMBO | 예 | `"original_image"`
`"geometry"` | +| `방향` | `"align_image"`는 모델을 입력 이미지의 시점에 맞게 회전합니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: `"default"`). 고급 설정입니다. | COMBO | 예 | `"default"`
`"align_image"` | +| `enable_image_autofix` | 모델링 전에 Tripo가 저해상도 또는 저품질 이미지를 개선하도록 합니다(기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `texture_seed` | 텍스처용 시드입니다(기본값: 42). 고급 설정입니다. | INT | 예 | 0 ~ 2147483647 | +| `auto_size` | 씬 변환을 통해 모델을 실제 크기(미터)로 조정합니다. `model.texture`가 `"none"`일 때는 무시됩니다 (기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `export_uv` | 메시에 텍스처가 없을 때 UV 언랩합니다. 텍스처가 있는 메시는 항상 언랩됩니다(기본값: True). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `compress_geometry` | meshopt 지오메트리 압축을 적용합니다. 파일 크기가 훨씬 작아지지만 ComfyUI의 3D 미리보기에서는 표시할 수 없습니다. 쿼드 메시에는 무시됩니다(기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | + +**참고:** + +- `model.image`는 필수이며, 배치의 첫 번째 이미지만 사용됩니다. +- `model.face_limit`는 엄격한 상한이 아니라 목표값이므로, 결과가 요청한 것보다 더 많은 면을 포함할 수 있습니다. `-1`은 선택을 Tripo에 맡깁니다. +- `model.quad`는 어느 출력이 메시를 전달할지 결정합니다. 활성화하면 모델은 FBX 출력으로 전달되고 GLB 출력은 비어 있습니다. 비활성화하면 모델은 GLB로 전달되고 FBX는 비어 있습니다. 연결한 출력이 비어 있는 출력인 경우 노드에서 오류를 발생시킵니다. +- `model.texture`, `model.pbr`, `model.texture_seed`, `model.auto_size`, `model.texture_alignment` 및 `model.orientation`은 텍스처가 있는 모델에만 적용됩니다. `"none"`인 경우 노드는 텍스처 설정을 전송하지 않고 텍스처 없는 지오메트리만 반환합니다. +- `model.compress_geometry`는 쿼드 메시에 아무런 영향을 주지 않습니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +| --- | --- | --- | +| `model task_id` | 모델 생성 요청의 고유 작업 ID입니다. | MODEL_TASK_ID | +| `GLB` | GLB 형식의 생성된 3D 모델입니다. `model.quad`가 활성화된 경우 비어 있습니다. | FILE3DGLB | +| `FBX` | FBX 형식의 생성된 3D 모델입니다. `model.quad`가 활성화된 경우에만 채워집니다. | FILE3DFBX | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesImageToModelNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `9bfad31ee00546d0603ce3273502cfc93c79e3b125941fed255866aa83f770a5` diff --git a/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx b/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx new file mode 100644 index 0000000000..f83a4496ed --- /dev/null +++ b/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx @@ -0,0 +1,59 @@ +--- +title: "TripoPSeriesMultiviewToModelNode - ComfyUI Built-in Node Documentation" +description: "동일한 대상의 여러 뷰에서 Tripo의 P2 모델을 사용하여 깔끔한 토폴로지를 가진 로우 폴리 3D 모델을 생성합니다. 정면 뷰는 필수이며, 결과를 개선하기 위해 왼쪽, 뒤, 오른쪽 뷰 중 1개에서 3개까지 추가할 수 있습니다. 모델은 삼각형 메시(GLB)로 반환되거나, model.quad가 활성화된 경우 쿼드 우세" +sidebarTitle: "TripoPSeriesMultiviewToModelNode" +icon: "circle" +mode: wide +--- + +동일한 대상의 여러 뷰에서 Tripo의 P2 모델을 사용하여 깔끔한 토폴로지를 가진 로우 폴리 3D 모델을 생성합니다. 정면 뷰는 필수이며, 결과를 개선하기 위해 왼쪽, 뒤, 오른쪽 뷰 중 1개에서 3개까지 추가할 수 있습니다. 모델은 삼각형 메시(GLB)로 반환되거나, `model.quad`가 활성화된 경우 쿼드 우세 메시(FBX)로 반환됩니다. + +## 입력 + +### 공통 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `모델` | 사용할 Tripo P 시리즈 모델입니다. 모델을 선택하면 아래에 해당 모델의 입력이 나타납니다. | DYNAMIC_COMBO | 예 | `"P2"` | + +### P2 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `model.image` | 대상의 정면 뷰(0°)입니다. | IMAGE | 예 | - | +| `model.image_left` | 왼쪽 뷰(90°), 대상 자체의 왼쪽 면입니다. | IMAGE | 아니요 | - | +| `model.image_back` | 후면 뷰(180°)입니다. | IMAGE | 아니요 | - | +| `model.image_right` | 오른쪽 뷰(270°), 대상 자체의 오른쪽 면입니다. | IMAGE | 아니요 | - | +| `쿼드` | GLB 출력의 삼각형 메시 대신 FBX 출력에 쿼드 우세 메시를 반환합니다(기본값: False). | BOOLEAN | 예 | True/False | +| `face_limit` | 목표 면 수입니다. `-1`은 Tripo가 선택하도록 합니다. `model.quad`가 활성화된 경우 제한은 48~25,000이고, 그렇지 않으면 48~50,000입니다(기본값: -1). | INT | 예 | -1 또는 48~50000 | +| `텍스처` | 베이스 컬러 텍스처 해상도입니다. standard는 2K, detailed는 4K, extreme은 8K입니다. `"none"`은 텍스처 없는 메시를 반환합니다(기본값: `"standard"`). | COMBO | 예 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 베이스 컬러에 메탈릭, 러프니스 및 노멀 맵을 추가합니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: True). | BOOLEAN | 예 | True/False | +| `model_seed` | 지오메트리용 시드입니다(기본값: 42). | INT | 예 | 0~2147483647 | +| `texture_alignment` | 입력 이미지의 색상과 일치시키거나 생성된 지오메트리에 텍스처를 맞춥니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: `"original_image"`). 고급 설정입니다. | COMBO | 예 | `"original_image"`
`"geometry"` | +| `방향` | `"align_image"`는 입력 이미지의 시점에 맞게 모델을 회전합니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: `"default"`). 고급 설정입니다. | COMBO | 예 | `"default"`
`"align_image"` | +| `texture_seed` | 텍스처용 시드입니다(기본값: 42). 고급 설정입니다. | INT | 예 | 0~2147483647 | +| `auto_size` | 씬 변환을 통해 모델을 실제 크기(미터)로 조정합니다. `model.texture`가 `"none"`일 때는 무시됩니다 (기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `export_uv` | 메시에 텍스처가 없을 때 UV 언랩합니다. 텍스처가 있는 메시는 항상 언랩됩니다(기본값: True). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `compress_geometry` | meshopt 지오메트리 압축을 적용합니다. 파일 크기가 훨씬 작아지지만 ComfyUI의 3D 미리보기에서는 표시할 수 없습니다. 쿼드 메시에는 무시됩니다(기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | + +**참고:** + +- `model.image`는 필수이며, `model.image_left`, `model.image_back` 또는 `model.image_right` 중 최소 하나도 연결해야 합니다. 정면 뷰 이미지만 있는 경우 노드에서 오류를 발생시킵니다. +- 각 배치의 첫 번째 이미지만 사용됩니다. +- `model.face_limit`는 엄격한 상한이 아니라 목표이므로 결과에 요청한 것보다 더 많은 면이 포함될 수 있습니다. `-1`은 선택을 Tripo에 맡깁니다. +- `model.quad`는 어느 출력이 메시를 전달할지 결정합니다. 활성화하면 모델은 FBX 출력으로 나오고 GLB 출력은 비어 있습니다. 비활성화하면 모델은 GLB로 나오고 FBX는 비어 있습니다. 연결한 출력이 빈 출력인 경우 노드에서 오류를 발생시킵니다. +- `model.texture`, `model.pbr`, `model.texture_seed`, `model.auto_size`, `model.texture_alignment` 및 `model.orientation`은 텍스처가 있는 모델에만 적용됩니다. `"none"`인 경우 노드는 텍스처 설정을 보내지 않고 순수 지오메트리를 반환합니다. +- `model.compress_geometry`는 쿼드 메시에 영향을 주지 않습니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +| --- | --- | --- | +| `model task_id` | 모델 생성 요청의 고유 작업 ID입니다. | MODEL_TASK_ID | +| `GLB` | GLB 형식의 생성된 3D 모델입니다. `model.quad`가 활성화되면 비어 있습니다. | FILE3DGLB | +| `FBX` | FBX 형식의 생성된 3D 모델입니다. `model.quad`가 활성화된 경우에만 채워집니다. | FILE3DFBX | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesMultiviewToModelNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `cea0a65ca001bc8298af9fbe2a83f592abf497987e634b0126482f3d2a18571c` diff --git a/ko/built-in-nodes/TripoPSeriesTextToModelNode.mdx b/ko/built-in-nodes/TripoPSeriesTextToModelNode.mdx new file mode 100644 index 0000000000..04b1e079cd --- /dev/null +++ b/ko/built-in-nodes/TripoPSeriesTextToModelNode.mdx @@ -0,0 +1,55 @@ +--- +title: "TripoPSeriesTextToModelNode - ComfyUI Built-in Node Documentation" +description: "Tripo의 P2 모델을 사용하여 텍스트 프롬프트로부터 깔끔한 토폴로지를 가진 로우폴리 3D 모델을 생성합니다. 결과는 삼각형 메시(GLB)로 반환되거나, model.quad가 활성화된 경우 쿼드 중심 메시(FBX)로 반환됩니다." +sidebarTitle: "TripoPSeriesTextToModelNode" +icon: "circle" +mode: wide +--- + +Tripo의 P2 모델을 사용하여 텍스트 프롬프트로부터 깔끔한 토폴로지를 가진 로우폴리 3D 모델을 생성합니다. 결과는 삼각형 메시(GLB)로 반환되거나, `model.quad`가 활성화된 경우 쿼드 중심 메시(FBX)로 반환됩니다. + +## 입력 + +### 공통 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `모델` | 사용할 Tripo P 시리즈 모델입니다. 모델을 선택하면 아래에 해당 모델의 입력이 표시됩니다. | DYNAMIC_COMBO | 예 | `"P2"` | + +### P2 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| --- | --- | --- | --- | --- | +| `프롬프트` | 생성할 3D 모델에 대한 텍스트 설명입니다. 비워 둘 수 없으며 최대 1024자입니다(기본값: 비어 있음). | STRING | 예 | 최대 1024자 | +| `negative_prompt` | 생성된 모델에서 피해야 할 요소에 대한 텍스트 설명입니다(기본값: 비어 있음). | STRING | 아니요 | 최대 255자 | +| `quad` | GLB 출력의 삼각형 메시 대신 FBX 출력에 쿼드 중심 메시를 반환합니다(기본값: False). | BOOLEAN | 예 | True/False | +| `face_limit` | 목표 면 수입니다. `-1`은 Tripo가 선택하도록 합니다. `model.quad`가 활성화된 경우 제한은 48~25,000이고, 그렇지 않으면 48~50,000입니다(기본값: -1). | INT | 예 | -1 또는 48~50000 | +| `텍스처` | 베이스 컬러 텍스처 해상도입니다. standard는 2K, detailed는 4K, extreme은 8K입니다. `"none"`은 텍스처가 없는 메시를 반환합니다(기본값: `"standard"`). | COMBO | 예 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 베이스 컬러에 메탈릭, 러프니스 및 노멀 맵을 추가합니다. `model.texture`가 `"none"`일 때는 무시됩니다(기본값: True). | BOOLEAN | 예 | True/False | +| `model_seed` | 지오메트리용 시드입니다(기본값: 42). | INT | 예 | 0~2147483647 | +| `image_seed` | 모델링 전에 Tripo가 프롬프트로부터 생성하는 이미지용 시드입니다(기본값: 42). 고급 설정입니다. | INT | 예 | 0~2147483647 | +| `texture_seed` | 텍스처용 시드입니다(기본값: 42). 고급 설정입니다. | INT | 예 | 0~2147483647 | +| `auto_size` | 씬 변환을 통해 모델을 실제 크기(미터)로 조정합니다. `model.texture`가 `"none"`일 때는 무시됩니다 (기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `export_uv` | 텍스처가 없는 메시의 경우 UV 언랩을 수행합니다. 텍스처가 있는 메시는 항상 언랩됩니다(기본값: True). 고급 설정입니다. | BOOLEAN | 예 | True/False | +| `compress_geometry` | meshopt 지오메트리 압축을 적용합니다. 파일 크기가 훨씬 작아지지만 ComfyUI의 3D 미리보기에서는 표시할 수 없습니다. 쿼드 메시에는 무시됩니다(기본값: False). 고급 설정입니다. | BOOLEAN | 예 | True/False | + +**참고:** + +- `model.prompt`는 필수이며, `model.negative_prompt`는 선택 사항이고 255자로 제한됩니다. +- `model.face_limit`은 하드 제한이 아니라 목표치이므로, 결과에 요청한 것보다 더 많은 면이 포함될 수 있습니다. `-1`은 선택을 Tripo에 맡깁니다. +- `model.quad`는 어느 출력으로 메시가 전달되는지 결정합니다. 활성화하면 모델은 FBX 출력으로 전달되고 GLB 출력은 비어 있습니다. 비활성화하면 모델은 GLB로 전달되고 FBX는 비어 있습니다. 연결한 출력이 비어 있는 출력인 경우 노드에서 오류가 발생합니다. +- `model.texture`, `model.pbr`, `model.texture_seed` 및 `model.auto_size`는 텍스처가 있는 모델에만 적용됩니다. `"none"`인 경우 노드는 텍스처 설정을 보내지 않고 순수 지오메트리만 반환합니다. +- `model.compress_geometry`는 쿼드 메시에 영향을 주지 않습니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +| --- | --- | --- | +| `model task_id` | 모델 생성 요청의 고유 작업 ID입니다. | MODEL_TASK_ID | +| `GLB` | GLB 형식의 생성된 3D 모델입니다. `model.quad`가 활성화된 경우 비어 있습니다. | FILE3DGLB | +| `FBX` | FBX 형식의 생성된 3D 모델입니다. `model.quad`가 활성화된 경우에만 채워집니다. | FILE3DFBX | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesTextToModelNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `e55596c1a237cf6b92e3bdead4359f380c6cba60992dcc61b5ee4e6b1bdd843b` diff --git a/ko/built-in-nodes/YuE2GenerateMusic.mdx b/ko/built-in-nodes/YuE2GenerateMusic.mdx index 6fa8cef252..7475aca3bf 100644 --- a/ko/built-in-nodes/YuE2GenerateMusic.mdx +++ b/ko/built-in-nodes/YuE2GenerateMusic.mdx @@ -1,39 +1,40 @@ --- title: "YuE2GenerateMusic - ComfyUI Built-in Node Documentation" -description: "스타일, 가사, ABC 표기법으로부터 음악 토큰과 어쿠스틱 컨디셔닝을 생성합니다. 컨디셔닝과 생성된 길이(초)를 반환하며, 이 값은 Empty YuE2 Latent Audio 노드에 제공해야 합니다. abc 입력을 비워 두면 선택한 모드가 무시되고 자동으로 off 모드가 사용됩니다." +description: "스타일, 가사, ABC 표기법으로부터 음악 토큰과 음향 컨디셔닝을 생성합니다. 컨디셔닝과 생성된 길이(초)를 반환하며, 이는 Empty YuE2 Latent Audio 노드에 제공해야 합니다. abc 입력을 비워 두면 선택한 mode는 무시되고 off 모드가 자동으로 사용됩니다." sidebarTitle: "YuE2GenerateMusic" icon: "circle" mode: wide --- -스타일, 가사, ABC 표기법으로부터 음악 토큰과 어쿠스틱 컨디셔닝을 생성합니다. 컨디셔닝과 생성된 길이(초)를 반환하며, 이 값은 Empty YuE2 Latent Audio 노드에 제공해야 합니다. `abc` 입력을 비워 두면 선택한 모드가 무시되고 자동으로 off 모드가 사용됩니다. +스타일, 가사, ABC 표기법으로부터 음악 토큰과 음향 컨디셔닝을 생성합니다. 컨디셔닝과 생성된 길이(초)를 반환하며, 이는 Empty YuE2 Latent Audio 노드에 제공해야 합니다. `abc` 입력을 비워 두면 선택한 `mode`는 무시되고 off 모드가 자동으로 사용됩니다. ## 입력 -| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +| 매개변수 | 설명 | 데이터 유형 | 필수 | 범위 | |-----------|-------------|-----------|----------|-------| | `clip` | 음악 입력을 토큰화하고 인코딩하는 데 사용되는 CLIP 모델입니다. | CLIP | 예 | - | | `스타일` | 음악 스타일을 설명하는 텍스트입니다. 여러 줄 입력과 동적 프롬프트를 지원합니다. | STRING | 예 | 여러 줄 텍스트 | -| `가사` | 생성될 음악의 가사입니다. 여러 줄 입력과 동적 프롬프트를 지원합니다. | STRING | 예 | 여러 줄 텍스트 | -| `abc` | ABC 생성기를 연결하거나 편집된 악보를 제공합니다. 자동으로 off 모드를 사용하려면 비워 두십시오. 기본값: "" | STRING | 예 | 여러 줄 텍스트 | -| `시드` | 생성을 위한 무작위 시드입니다. 기본값: 0 | INT | 예 | 0 ~ 18446744073709551615 | -| `모드` | full: 멜로디와 코드를 생성합니다. melody: 멜로디만 생성하며 커버곡에 권장됩니다. 기본값: "full" | COMBO | 예 | "full"
"melody" | -| `max_duration` | 최대 길이(초)입니다. 긴 프롬프트에서는 자동으로 줄어들며, 생성이 더 일찍 중지될 수 있습니다. 기본값: 360.0 | FLOAT | 예 | 0.04 ~ 900.0 | -| `온도` | 생성을 위한 샘플링 온도입니다. 기본값: 1.0 (고급) | FLOAT | 예 | 0.0 ~ 5.0 | -| `top_p` | 뉴클리어스 샘플링 확률 임계값입니다. 기본값: 0.95 (고급) | FLOAT | 예 | 0.01 ~ 1.0 | +| `가사` | 생성된 음악의 가사입니다. 여러 줄 입력과 동적 프롬프트를 지원합니다. | STRING | 예 | 여러 줄 텍스트 | +| `abc` | ABC 생성기를 연결하거나 편집한 악보를 제공합니다. off 모드를 자동으로 사용하려면 비워 두세요. 기본값: "" | STRING | 예 | 여러 줄 텍스트 | +| `시드` | 생성용 무작위 시드입니다. 기본값: 0 | INT | 예 | 0 ~ 18446744073709551615 | +| `모드` | full: 멜로디와 코드를 생성합니다. melody: 멜로디만 생성하며, 커버곡에 권장합니다. 기본값: "full" | COMBO | 예 | "full"
"melody" | +| `max_duration` | 최대 길이(초)입니다. 긴 프롬프트에서는 자동으로 줄어들며, 생성이 더 일찍 중단될 수 있습니다. 기본값: 360.0 | FLOAT | 예 | 0.04 ~ 900.0 | +| `온도` | 생성용 샘플링 온도입니다. 기본값: 1.0 (고급) | FLOAT | 예 | 0.0 ~ 5.0 | +| `top_p` | Nucleus 샘플링 확률 임계값입니다. 기본값: 0.95 (고급) | FLOAT | 예 | 0.01 ~ 1.0 | | `top_k` | Top-k 샘플링 제한입니다. 기본값: 100 (고급) | INT | 예 | 1 ~ 32768 | -| `repetition_penalty` | 반복된 토큰에 적용되는 페널티입니다. 기본값: 1.2 (고급) | FLOAT | 예 | 0.01 ~ 10.0 | +| `repetition_penalty` | 반복되는 토큰에 적용되는 페널티입니다. 기본값: 1.2 (고급) | FLOAT | 예 | 0.01 ~ 10.0 | +| `cfg_scale` | 스타일과 가사에 대한 자기회귀 가이던스입니다. 1.0은 CFG를 비활성화하여 ABC 워크플로와 일치합니다. 원래 off 모드 가이던스와 맞추려면 1.01을 사용하세요. 기본값: 1.0 (고급, 선택 사항) | FLOAT | 아니요 | 0.0 ~ 100.0 | -참고: `abc`가 비어 있거나 공백만 포함하는 경우, `mode` 선택이 무시되고 off 모드가 자동으로 사용됩니다. +참고: `abc`가 비어 있거나 공백만 포함하는 경우, `mode` 선택은 무시되고 off 모드가 자동으로 사용됩니다. ## 출력 -| 출력 이름 | 설명 | 데이터 타입 | +| 출력 이름 | 설명 | 데이터 유형 | |-------------|-------------|-----------| -| `CONDITIONING` | 음악 토큰으로부터 생성된 어쿠스틱 컨디셔닝입니다. | CONDITIONING | -| `seconds` | 생성된 오디오 길이(초)입니다. 이 값을 Empty YuE2 Latent Audio 노드에 제공하십시오. | FLOAT | +| `CONDITIONING` | 음악 토큰에서 생성된 음향 컨디셔닝입니다. | CONDITIONING | +| `seconds` | 생성된 오디오 길이(초)입니다. 이 값을 Empty YuE2 Latent Audio 노드에 제공하세요. | FLOAT | > 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/YuE2GenerateMusic/ko.md) --- -**Source fingerprint (SHA-256):** `54f5d46cf083726bdf97c86e5683b2727840f75bb553bddf9525cfbf5affa44c` +**Source fingerprint (SHA-256):** `5a88e185d2998c51acff7f0c76c8c35ca30b80b88cb541d97f9ab91566b5a3ed` diff --git a/zh/built-in-nodes/MoGeInference.mdx b/zh/built-in-nodes/MoGeInference.mdx index 47224c5426..5d1264099f 100644 --- a/zh/built-in-nodes/MoGeInference.mdx +++ b/zh/built-in-nodes/MoGeInference.mdx @@ -1,34 +1,35 @@ --- title: "MoGeInference - ComfyUI Built-in Node Documentation" -description: "在单张图像上运行 MoGe,以估算深度和几何结构。" +description: "对图像运行 MoGe 以估计深度和几何。" sidebarTitle: "MoGeInference" icon: "circle" mode: wide --- -在单张图像上运行 MoGe,以估算深度和几何结构。此节点通过 MoGe 模型处理输入图像,生成 3D 点云、深度图、相机内参、掩码和表面法线。 +对图像运行 MoGe 以估计深度和几何。此节点通过 MoGe 模型处理输入图像,以生成 3D 点云、深度图、相机内参、掩码和表面法线。 ## 输入 | 参数 | 描述 | 数据类型 | 必需 | 范围 | | --- | --- | --- | --- | --- | | `moge_model` | 用于推理的 MoGe 模型。 | MOGE_MODEL | 是 | N/A | -| `image` | 用于深度和几何估计的输入图像。仅使用前三个颜色通道(RGB)。 | IMAGE | 是 | N/A | -| `resolution_level` | 控制处理分辨率。0 最快,9 提供最多细节。(默认值:9) | INT | 是 | 0 到 9 | -| `fov_x_degrees` | (高级)源相机在水平方向上的视场角(单位:度)。设置用于将深度图反投影到 3D 空间的焦距。设置为 0.0 时会根据预测点自动恢复视场角。(默认值:0.0) | FLOAT | 是 | 0.0 到 170.0 | -| `batch_size` | 每次推理调用处理的图像数量。在长视频或大量图像上遇到内存不足时,请降低此值。(默认值:4) | INT | 是 | 1 到 64 | -| `force_projection` | (高级)强制对预测点进行投影。(默认值:True) | BOOLEAN | 是 | True/False | -| `apply_mask` | (高级)将掩码覆盖(天空或无效)像素在点云和深度输出中设置为无穷大,以便网格化工具可以忽略这些像素。禁用以在所有位置保留原始预测几何结构;掩码仍会单独返回。(默认值:True) | BOOLEAN | 是 | True/False | +| `image` | 用于深度和几何估计的输入图像。仅使用前三个颜色通道 (RGB)。 | IMAGE | 是 | N/A | +| `resolution_level` | 控制处理分辨率。0 = 最快,9 = 最精细。(默认:9) | INT | 是 | 0 到 9 | +| `fov_x_degrees` | (高级)源相机的水平视场角。设置用于将深度图反投影到 3D 的焦距。0 = 从预测点自动恢复。(默认:0.0) | FLOAT | 是 | 0.0 到 170.0 (步长 0.1) | +| `batch_size` | 每次推理调用的图像数量。如果在长视频/图像集上遇到 OOM,请降低该值。(默认:4) | INT | 是 | 1 到 64 | +| `force_projection` | (高级)强制投影预测点。(默认:True) | BOOLEAN | 是 | True/False | +| `apply_mask` | (高级)将被掩码排除(天空/无效)的像素在点和深度中设为 inf,以便网格化时将其剔除。禁用以在所有位置保留原始预测几何;掩码仍会单独返回。(默认:True) | BOOLEAN | 是 | True/False | +| `refine_steps` | (高级)仅 MoGe-3:对预测深度执行稀疏体积精修多遍处理。更多遍处理能以大致线性的成本锐化细节和边缘。0 禁用精修。MoGe-1 / MoGe-2 忽略此项。(默认:3) | INT | 是 | 0 到 8 | -注意:当输入 `image` 包含的帧数超过 `batch_size` 时,节点会通过多次推理调用处理这些帧,并将结果合并为单个输出几何结构。 +注意:当输入 `image` 包含的帧数多于 `batch_size` 时,节点会通过多次推理调用处理它们,并将结果合并为单个输出几何。 ## 输出 | 输出名称 | 描述 | 数据类型 | | --- | --- | --- | -| `moge_geometry` | 包含估计几何结构的字典。其中包含原始 `image`,并可能包含 `points`(3D 点云)、`depth`(深度图)、`intrinsics`(相机内参矩阵)、`mask`(标识有效像素的掩码)和 `normal`(表面法线)。 | MOGE_GEOMETRY | +| `moge_geometry` | 包含估计几何的字典。它包括原始 `image`,并且可能包含 `points`(3D 点云)、`depth`(深度图)、`intrinsics`(相机内参矩阵)、`mask`(标识有效像素的掩码)和 `normal`(表面法线)。 | MOGE_GEOMETRY | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGeInference/zh.md) --- -**Source fingerprint (SHA-256):** `59f6b8b1ab65147a47f5dc7ebee7b965a5ab37c6a0843a2c80d50c767ad98db4` +**Source fingerprint (SHA-256):** `10f3399d9b6bc4ff8a940c940f538a8ec8f38a15e7d65f162499c5ab264fad65` diff --git a/zh/built-in-nodes/MoGePanoramaInference.mdx b/zh/built-in-nodes/MoGePanoramaInference.mdx index 6bef16bf64..3f89f41156 100644 --- a/zh/built-in-nodes/MoGePanoramaInference.mdx +++ b/zh/built-in-nodes/MoGePanoramaInference.mdx @@ -1,36 +1,37 @@ --- title: "MoGePanoramaInference - ComfyUI Built-in Node Documentation" -description: "此节点对等距柱状全景图(equirectangular panorama)执行深度估计。" +description: "此节点对等距柱状全景图执行深度估计。" sidebarTitle: "MoGePanoramaInference" icon: "circle" mode: wide --- -此节点对等距柱状全景图(equirectangular panorama)执行深度估计。它将全景图拆分为 12 个透视视图,对每个视图运行 MoGe 深度估计模型,再将各视图的结果合并回一张覆盖完整全景的深度图。每个视图预测的法线和度量尺度会被忽略,因为各视图的尺度在重叠接缝处无法对齐。 +此节点对等距柱状全景图执行深度估计。它将全景图分割为 12 个透视视图,在每个视图上运行 MoGe 深度估计模型,然后将各视图结果合并回覆盖完整全景图的单张深度图。每个视图预测的法线和度量尺度会被忽略,因为各视图的尺度无法在重叠接缝处对齐。 ## 输入 -| Parameter | Description | Data Type | Required | Range | +| 参数 | 描述 | 数据类型 | 必需 | 范围 | |-----------|-------------|-----------|----------|-------| | `moge_model` | 用于推理的 MoGe 模型。 | MOGE_MODEL | 是 | | | `image` | 等距柱状全景图(任意宽高比)。此节点仅接受单张图像;传入一批图像会引发错误。仅使用前 3 个颜色通道(RGB)。 | IMAGE | 是 | | -| `resolution_level` | 每个视图的细节程度(0 = 最快,9 = 最详细)(默认:9)。 | INT | 是 | 0 到 9 | -| `split_resolution` | 每个透视拆分的分辨率(默认:512)。 | INT | 是 | 256 到 1024 | -| `merge_resolution` | 合并后的等距柱状距离图的长边分辨率(默认:1920)。 | INT | 是 | 256 到 8192 | -| `batch_size` | 每个推理批次的视图数量(共 12 个拆分)(默认:4)。 | INT | 是 | 1 到 12 | +| `resolution_level` | 每个视图的细节级别(0 = 最快,9 = 最详细)(默认值:9)。 | INT | 是 | 0 到 9 | +| `split_resolution` | 每个透视分割的分辨率(默认值:512)。 | INT | 是 | 256 到 1024 | +| `merge_resolution` | 合并后的等距柱状距离图的长边分辨率(默认值:1920)。 | INT | 是 | 256 到 8192 | +| `batch_size` | 每批推理处理的视图数(总共 12 个分割视图)(默认值:4)。 | INT | 是 | 1 到 12 | +| `refine_steps` | 仅适用于 MoGe-3:对预测深度执行稀疏体积细化遍数。更多遍数可锐化精细细节和边缘,成本大致呈线性增长。0 表示禁用细化。MoGe-1 / MoGe-2 会忽略此项(默认值:3)。 | INT | 是 | 0 到 8 | **注意:** -- 输入必须是单张图像。如果 `image` 的批次中包含多张图像,此节点会引发错误。 -- `merge_resolution` 被视为最大长边尺寸。如果全景图小于该值,则合并后的图会按照全景图的原始尺寸生成,而不会被放大。合并结果在返回前会被缩放回全景图的原始分辨率。 +- 输入必须是单张图像。如果 `image` 的批次中包含多于一张图像,节点会引发错误。 +- `merge_resolution` 被视为最大长边尺寸。如果全景图小于此值,合并后的图会按原始全景图尺寸生成,而不会进行放大。返回前,合并结果会缩放回原始全景图分辨率。 ## 输出 -| Output Name | Description | Data Type | +| 输出名称 | 描述 | 数据类型 | |-------------|-------------|-----------| -| `moge_geometry` | 包含估计几何信息的字典:`points`(3D 点云)、`depth`(深度图)、`mask`(有效区域掩码)以及 `image`(输入图像)。 | MOGE_GEOMETRY | +| `moge_geometry` | 包含估计几何信息的字典:`points`(3D 点云)、`depth`(深度图)、`mask`(有效区域掩码)和 `image`(输入图像)。 | MOGE_GEOMETRY | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MoGePanoramaInference/zh.md) --- -**Source fingerprint (SHA-256):** `d35b6d42a5bb17c184bc56fe3867d3a183017084dc81649c0663a9fba2362770` +**Source fingerprint (SHA-256):** `7f21452d035b2fe9d30b0cd15ddad10916439492b1d682a8b28f1a79e375df58` diff --git a/zh/built-in-nodes/OpenAIGPTImage1.mdx b/zh/built-in-nodes/OpenAIGPTImage1.mdx index 125ede7393..be28390985 100644 --- a/zh/built-in-nodes/OpenAIGPTImage1.mdx +++ b/zh/built-in-nodes/OpenAIGPTImage1.mdx @@ -6,45 +6,44 @@ icon: "circle" mode: wide --- -通过 OpenAI 的 GPT Image 端点同步生成图像。它可以根据文本提示词创建新图像,也可以在提供输入图像和可选 `mask` 时编辑现有图像。该节点支持 `gpt-image-1`、`gpt-image-1.5` 和 `gpt-image-2` 模型,并已标记为弃用。 +通过 OpenAI 的 GPT Image 端点同步生成图像。它可以根据文本提示创建新图像,或者在提供输入图像和可选蒙版时编辑现有图像。该节点支持 `gpt-image-1`、`gpt-image-1.5` 和 `gpt-image-2` 模型,并已标记为弃用。 ## 输入 | 参数 | 描述 | 数据类型 | 必需 | 范围 | |-----------|-------------|-----------|----------|-------| -| `提示词` | GPT Image 的文本提示词(默认值:"") | STRING | 是 | - | +| `提示词` | GPT Image 的文本提示(默认值:"") | STRING | 是 | - | | `种子` | 用于生成的随机种子;后端尚未实现(默认值:0) | INT | 否 | 0 到 2147483647 | -| `质量` | 图像质量,影响费用和生成时间(默认值:"low") | COMBO | 否 | "low"
"medium"
"high" | -| `背景` | 返回图像时是否包含背景(默认值:"auto") | COMBO | 否 | "auto"
"opaque"
"transparent" | -| `尺寸` | 图像尺寸。选择 "Custom" 以使用自定义宽度和高度(仅 GPT Image 2)(默认值:"auto") | COMBO | 否 | "auto"
"1024x1024"
"1024x1536"
"1536x1024"
"2048x2048"
"2048x1152"
"1152x2048"
"3840x2160"
"2160x3840"
"Custom" | -| `数量` | 要生成的图像数量(默认值:1) | INT | 否 | 1 到 8 | +| `质量` | 图像质量,影响成本和生成时间(默认值:"low") | COMBO | 否 | "low"
"medium"
"high" | +| `背景` | 返回带背景或不带背景的图像(默认值:"auto") | COMBO | 否 | "auto"
"opaque"
"transparent" | +| `尺寸` | 图像尺寸。选择 "Custom" 以使用自定义宽度和高度(仅限 GPT Image 2)(默认值:"auto") | COMBO | 否 | "auto"
"1024x1024"
"1024x1536"
"1536x1024"
"2048x2048"
"2048x1152"
"1152x2048"
"3840x2160"
"2160x3840"
"Custom" | +| `数量` | 要生成多少张图像(默认值:1) | INT | 否 | 1 到 8 | | `参考图像` | 用于图像编辑的可选参考图像 | IMAGE | 否 | - | -| `遮罩` | 用于图像修复的可选遮罩(白色区域将被替换) | MASK | 否 | - | +| `遮罩` | 用于修复的可选蒙版(白色区域将被替换) | MASK | 否 | - | | `模型` | 要使用的 GPT Image 模型(默认值:"gpt-image-2") | COMBO | 否 | "gpt-image-1"
"gpt-image-1.5"
"gpt-image-2" | -| `custom_width` | 仅当 `size` 为 "Custom" 时使用。必须是 16 的倍数(仅 GPT Image 2)(默认值:1024) | INT | 否 | 1024 到 3840, step 16 | -| `custom_height` | 仅当 `size` 为 "Custom" 时使用。必须是 16 的倍数(仅 GPT Image 2)(默认值:1024) | INT | 否 | 1024 到 3840, step 16 | +| `custom_width` | 仅当 `size` 为 "Custom" 时使用。必须是 16 的倍数(仅限 GPT Image 2)(默认值:1024) | INT | 否 | 1024 到 3840,步长 16 | +| `custom_height` | 仅当 `size` 为 "Custom" 时使用。必须是 16 的倍数(仅限 GPT Image 2)(默认值:1024) | INT | 否 | 1024 到 3840,步长 16 | **参数约束:** - 当提供 `image` 时,节点使用图像编辑端点。 - `mask` 只能在提供 `image` 时使用。 -- 使用 `mask` 时,仅支持单张图像(批大小必须为 1)。 -- `mask` 和 `image` 必须尺寸相同。 +- 使用 `mask` 时,仅支持单张图像(批次大小必须为 1)。 +- `mask` 和 `image` 的尺寸必须相同。 - 自定义分辨率(`size` = "Custom")仅受 `gpt-image-2` 模型支持。 - 自定义宽度和高度必须是 16 的倍数。 -- 自定义分辨率的最长边必须小于或等于 3840。 +- 自定义分辨率的最长边必须为 3840 或更小。 - 自定义分辨率的宽高比不得超过 3:1。 - 自定义分辨率的总像素数必须在 655,360 到 8,294,400 之间。 -- `gpt-image-2` 模型不支持透明背景。 -- `gpt-image-1` 和 `gpt-image-1.5` 模型仅支持 `auto`、`1024x1024`、`1024x1536` 和 `1536x1024` 这些尺寸。其他尺寸仅受 `gpt-image-2` 模型支持。 +- `gpt-image-1` 和 `gpt-image-1.5` 模型仅支持尺寸 `auto`、`1024x1024`、`1024x1536` 和 `1536x1024`。其他尺寸仅受 `gpt-image-2` 模型支持。 ## 输出 | 输出名称 | 描述 | 数据类型 | |-------------|-------------|-----------| -| `IMAGE` | 生成或编辑后的图像。多张图像会作为批次返回;如果返回的图像尺寸不同,它们会被调整为与第一张图像匹配。 | IMAGE | +| `IMAGE` | 生成或编辑后的图像。多张图像作为批次返回;如果返回的图像尺寸不同,它们会被调整大小以匹配第一张图像。 | IMAGE | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImage1/zh.md) --- -**Source fingerprint (SHA-256):** `bf588bffced6e66536b4cb54655ef6ebb9cf988d9739e3c379a8ebda1486e20a` +**Source fingerprint (SHA-256):** `f0f0db7fd2cdf8efd2155522b289aa8f3f939fa79a6e9060b0ffbb2dd20efa1e` diff --git a/zh/built-in-nodes/OpenAIGPTImageNodeV2.mdx b/zh/built-in-nodes/OpenAIGPTImageNodeV2.mdx index 7551c7622c..66c151e926 100644 --- a/zh/built-in-nodes/OpenAIGPTImageNodeV2.mdx +++ b/zh/built-in-nodes/OpenAIGPTImageNodeV2.mdx @@ -6,7 +6,7 @@ icon: "circle" mode: wide --- -此节点使用 OpenAI 的 GPT Image API 生成图像。它支持五种模型 — `gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-2`、`gpt-image-1.5` 和 `gpt-image-1` — 允许附加参考图像进行图像编辑,并可使用蒙版指定图像中需要替换的部分。 +此节点使用 OpenAI 的 GPT Image API 生成图像。它支持五个模型——`gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-2`、`gpt-image-1.5` 和 `gpt-image-1`——可以附加参考图像进行图像编辑,并可使用蒙版指定要替换图像的哪些部分。 ## 输入 @@ -16,76 +16,75 @@ mode: wide | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `模型` | 要使用的 OpenAI GPT Image 模型。选择模型后会显示该模型特有的其他参数。 | DYNAMIC_COMBO | 是 | `"gpt-image-2.5-flare"`
`"gpt-image-2.5-sunburst"`
`"gpt-image-2"`
`"gpt-image-1.5"`
`"gpt-image-1"` | +| `模型` | 要使用的 OpenAI GPT Image 模型。选择模型后会显示该模型特有的附加参数。 | DYNAMIC_COMBO | 是 | `"gpt-image-2.5-flare"`
`"gpt-image-2.5-sunburst"`
`"gpt-image-2"`
`"gpt-image-1.5"`
`"gpt-image-1"` | | `提示词` | GPT Image 的文本提示词(默认值:`""`)。 | STRING | 是 | N/A | -| `数量` | 要生成的图像数量(默认值:`1`)。 | INT | 是 | 1到8 | -| `种子` | 用于结果可复现的随机种子(默认值:`0`)。后端尚未实现此参数。 | INT | 是 | 0到2147483647 | +| `数量` | 要生成的图像数量(默认值:`1`)。 | INT | 是 | 1 到 8 | +| `种子` | 用于可复现性的种子(默认值:`0`)。后端尚未实现。 | INT | 是 | 0 到 2147483647 | ### gpt-image-2.5-flare 和 gpt-image-2.5-sunburst 输入 -当 `model` 设置为 `gpt-image-2.5-flare` 或 `gpt-image-2.5-sunburst` 时显示这些输入。两个模型共享同一组参数。 +当 `model` 设置为 `gpt-image-2.5-flare` 或 `gpt-image-2.5-sunburst` 时,这些输入会出现。两个模型共享相同的参数集。 | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `尺寸` | 图像尺寸。选择“Custom”可使用自定义宽度和高度(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `自定义宽度` | 仅当 `model.size` 为“Custom”时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480到3840(步长 16) | -| `自定义高度` | 仅当 `model.size` 为“Custom”时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480到3840(步长 16) | -| `背景` | 返回带或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"`
`"transparent"` | +| `尺寸` | 图像尺寸。选择 "Custom" 以使用自定义宽度和高度(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `自定义宽度` | 仅当 `model.size` 为 "Custom" 时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480 到 3840 (步长 16) | +| `自定义高度` | 仅当 `model.size` 为 "Custom" 时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480 到 3840 (步长 16) | +| `背景` | 返回带背景或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"`
`"transparent"` | | `质量` | 图像质量,影响成本和生成时间(默认值:`"low"`)。 | COMBO | 是 | `"low"`
`"medium"`
`"high"`
`"xhigh"`
`"max"` | -| `model.images` | 用于图像编辑的可选参考图像。最多 16 张。详见“参考输入”。 | IMAGE | 否 | 0到16 | -| `model.mask` | 用于局部重绘的可选蒙版(白色区域将被替换)。必须恰好有一张参考图像。 | MASK | 否 | N/A | +| `model.images` | 用于图像编辑的可选参考图像。最多 16 张图像。详情请参阅参考输入。 | IMAGE | 否 | 0 到 16 | +| `model.mask` | 用于修复的可选蒙版(白色区域将被替换)。需要恰好一张参考图像。 | MASK | 否 | N/A | ### gpt-image-2 输入 -当 `model` 设置为 `gpt-image-2` 时显示这些输入。 +当 `model` 设置为 `gpt-image-2` 时,这些输入会出现。 | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `尺寸` | 图像尺寸。选择“Custom”可使用自定义宽度和高度(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | -| `自定义宽度` | 仅当 `model.size` 为“Custom”时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480到3840(步长 16) | -| `自定义高度` | 仅当 `model.size` 为“Custom”时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480到3840(步长 16) | -| `背景` | 返回带或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"` | +| `尺寸` | 图像尺寸。选择 "Custom" 以使用自定义宽度和高度(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"`
`"2048x2048"`
`"2048x1152"`
`"1152x2048"`
`"3840x2160"`
`"2160x3840"`
`"Custom"` | +| `自定义宽度` | 仅当 `model.size` 为 "Custom" 时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480 到 3840 (步长 16) | +| `自定义高度` | 仅当 `model.size` 为 "Custom" 时使用。必须是 16 的倍数(默认值:`1024`)。 | INT | 否 | 480 到 3840 (步长 16) | +| `背景` | 返回带背景或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"`
`"transparent"` | | `质量` | 图像质量,影响成本和生成时间(默认值:`"low"`)。 | COMBO | 是 | `"low"`
`"medium"`
`"high"` | -| `model.images` | 用于图像编辑的可选参考图像。最多 16 张。详见“参考输入”。 | IMAGE | 否 | 0到16 | -| `model.mask` | 用于局部重绘的可选蒙版(白色区域将被替换)。必须恰好有一张参考图像。 | MASK | 否 | N/A | +| `model.images` | 用于图像编辑的可选参考图像。最多 16 张图像。详情请参阅参考输入。 | IMAGE | 否 | 0 到 16 | +| `model.mask` | 用于修复的可选蒙版(白色区域将被替换)。需要恰好一张参考图像。 | MASK | 否 | N/A | ### gpt-image-1.5 和 gpt-image-1 输入 -当 `model` 设置为 `gpt-image-1.5` 或 `gpt-image-1` 时显示这些输入。两个模型共享同一组参数。 +当 `model` 设置为 `gpt-image-1.5` 或 `gpt-image-1` 时,这些输入会出现。两个模型共享相同的参数集。 | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | | `尺寸` | 图像尺寸(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"1024x1024"`
`"1024x1536"`
`"1536x1024"` | -| `背景` | 返回带或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"`
`"transparent"` | +| `背景` | 返回带背景或不带背景的图像(默认值:`"auto"`)。 | COMBO | 是 | `"auto"`
`"opaque"`
`"transparent"` | | `质量` | 图像质量,影响成本和生成时间(默认值:`"low"`)。 | COMBO | 是 | `"low"`
`"medium"`
`"high"` | -| `model.images` | 用于图像编辑的可选参考图像。最多 16 张。详见“参考输入”。 | IMAGE | 否 | 0到16 | -| `model.mask` | 用于局部重绘的可选蒙版(白色区域将被替换)。必须恰好有一张参考图像。 | MASK | 否 | N/A | +| `model.images` | 用于图像编辑的可选参考图像。最多 16 张图像。详情请参阅参考输入。 | IMAGE | 否 | 0 到 16 | +| `model.mask` | 用于修复的可选蒙版(白色区域将被替换)。需要恰好一张参考图像。 | MASK | 否 | N/A | ### 参考输入 | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `model.images` | 可扩展插槽:连接 1..N 个项目(例如 `image_1`...`image_16`);所有模型最多支持 16 张参考图像。 | IMAGE | 否 | 1到16 | -| `model.mask` | 用于局部重绘的可选蒙版(白色区域将被替换)。必须恰好有一张参考图像。 | MASK | 否 | N/A | +| `model.images` | 可扩展槽:连接 1..N 个项目(例如 `image_1`...`image_16`);所有模型最多支持 16 张参考图像。 | IMAGE | 否 | 0 到 16 | +| `model.mask` | 用于修复的可选蒙版(白色区域将被替换)。需要恰好一张参考图像。 | MASK | 否 | N/A | -**参数约束与限制:** +**参数约束和限制:** -- 当 `model.size` 为“Custom”时(仅限 `gpt-image-2.5-flare`、`gpt-image-2.5-sunburst` 和 `gpt-image-2`),`model.custom_width` 和 `model.custom_height` 都必须为 16 的倍数,最长边不得超过 3840,宽高比不得超过 3:1,总像素数必须在 655,360到8,294,400 之间。 -- `model.mask` 要求在 `model.images` 中恰好有一张参考图像:没有图像时不能使用,有多个图像时也不能使用。 -- 使用 `model.mask` 时,其高度和宽度必须与参考图像的高度和宽度一致。 -- 提供 `model.images` 时,节点会以图像编辑模式运行;未提供 `model.images` 时,仅根据提示词生成图像。 +- 当 `model.size` 为 "Custom"(仅 `gpt-image-2.5-flare`、`gpt-image-2.5-sunburst` 和 `gpt-image-2`)时,`model.custom_width` 和 `model.custom_height` 都必须是 16 的倍数,最长边不得超过 3840,宽高比不得超过 3:1,总像素数必须在 655,360 到 8,294,400 之间。 +- `model.mask` 需要 `model.images` 中恰好有一张参考图像:没有图像时不能使用,超过一张图像时也不能使用。 +- 使用 `model.mask` 时,其高度和宽度必须与参考图像的高度和宽度匹配。 +- 提供 `model.images` 时,节点以图像编辑模式运行;不提供 `model.images` 时,则仅根据提示词生成图像。 - 参考图像和蒙版在发送到 API 之前会被缩小。 -- `"xhigh"` 和 `"max"` 质量等级仅适用于 `gpt-image-2.5-flare` 和 `gpt-image-2.5-sunburst`。 -- `"transparent"` 背景选项可用于 `gpt-image-2.5-flare`、`gpt-image-2.5-sunburst`、`gpt-image-1.5` 和 `gpt-image-1`,但不适用于 `gpt-image-2`。 -- `seed` 当前尚未在后端实现。 +- `"xhigh"` 和 `"max"` 质量级别仅适用于 `gpt-image-2.5-flare` 和 `gpt-image-2.5-sunburst`。 +- `seed` 目前在后端尚未实现。 ## 输出 -| 输出名称 | 描述 | 数据类型 | +| 输出名 | 描述 | 数据类型 | | --- | --- | --- | -| `image` | 生成的图像。所有返回的图像会被堆叠为一个批次;如果尺寸不同,则会调整大小以匹配第一张图像。 | IMAGE | +| `image` | 生成的图像。所有返回的图像会堆叠成一个批次;如果它们的尺寸不同,则会调整为与第一张图像匹配。 | IMAGE | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/OpenAIGPTImageNodeV2/zh.md) --- -**Source fingerprint (SHA-256):** `4f77b79f9f432a1f2e0fd814012aebe7cc42a8aa983ee9a61f3b32984bf65148` +**Source fingerprint (SHA-256):** `804ea35d0e2aa0b2993a293cb10cb41e2f9c6a3732304306253f7f7b1eb59b8a` diff --git a/zh/built-in-nodes/PrunaImageToVideoNode.mdx b/zh/built-in-nodes/PrunaImageToVideoNode.mdx new file mode 100644 index 0000000000..5b07ccde35 --- /dev/null +++ b/zh/built-in-nodes/PrunaImageToVideoNode.mdx @@ -0,0 +1,53 @@ +--- +title: "PrunaImageToVideoNode - ComfyUI Built-in Node Documentation" +description: "使用 Pruna 的 P-Video-2 模型将图像动画化为视频。" +sidebarTitle: "PrunaImageToVideoNode" +icon: "circle" +mode: wide +--- + +使用 Pruna 的 P-Video-2 模型将图像动画化为视频。首帧为必填项,并决定输出的宽高比;可选的尾帧为视频提供插值趋近的终点。提示词描述场景如何运动,此节点要么自行生成音轨,要么接收一段驱动运动的音频片段。 + +## 输入 + +### 通用输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `model` | 要使用的 Pruna 视频模型。选择模型后,下方会显示其各自的输入。 | DYNAMIC_COMBO | 是 | `"p-video-2"` | + +### P-Video-2 输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `model.first_frame` | 视频起始图像。输出会保持此图像的宽高比。 | IMAGE | 是 | - | +| `model.last_frame` | 视频结束图像。其宽高比必须接近首帧的宽高比。 | IMAGE | 否 | - | +| `prompt` | 描述场景如何运动和发声。必须包含至少一个非空白字符,最多 5000 个字符(默认:空)。 | STRING | 是 | 最多 5000 个字符 | +| `duration` | 视频长度(秒)。`"auto"` 让模型根据提示词选择长度。连接 `model.audio` 时忽略:视频随后跟随音频长度,向上取整到整秒,最长 20 秒(默认:`"5"`)。 | COMBO | 是 | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `resolution` | 输出分辨率。720p 渲染约 0.9 兆像素(16:9 时为 1280x704),1080p 约 2 兆像素(16:9 时为 1920x1088)(默认:`"720p"`)。 | COMBO | 是 | `"720p"`
`"1080p"` | +| `fps` | 帧每秒。1080p 下使用 draft 时无法使用 48 fps(默认:`"24"`)。 | COMBO | 是 | `"24"`
`"48"` | +| `draft` | 更快、细节更少的渲染,计费低于标准渲染(默认:False)。 | BOOLEAN | 是 | True/False | +| `generate_audio` | 为视频生成音轨。连接 `model.audio` 时忽略,此时音频将成为音轨(默认:True)。 | BOOLEAN | 是 | True/False | +| `enhance_prompt` | 在生成前用更多细节重写提示词;较短的提示词需要它。关闭此选项才能使用相同种子精确复现结果(默认:True)。高级设置。 | BOOLEAN | 是 | True/False | +| `model.audio` | 驱动运动并成为音轨的音频。至少 1 秒长;超过 20 秒的音频会被截断。它会替代 `model.duration` 设置视频长度。 | AUDIO | 否 | - | +| `seed` | 生成种子。仅当 `model.enhance_prompt` 关闭时,相同种子才能精确复现结果(默认:42)。 | INT | 是 | 0 到 2147483647 | + +**说明:** + +- `model.first_frame` 为必填项,并决定输出宽高比,因此此节点没有宽高比输入。 +- `model.last_frame` 为可选项,但其宽高比必须接近首帧,否则节点会报错。 +- `model.prompt` 为必填项,限制为 5000 个字符。 +- 1080p 下的 draft 不能与 48 fps 组合使用:节点会报错,因此要么关闭 draft,要么使用 24 fps。 +- 连接的音频必须至少 1 秒长;超过 20 秒的部分会被忽略。 +- 连接 `model.audio` 时,音频决定视频长度,因此 `model.duration` 和 `model.generate_audio` 均无效。 + +## 输出 + +| 输出名称 | 描述 | 数据类型 | +| --- | --- | --- | +| `video` | 带音轨的生成视频。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaImageToVideoNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `da8952e478eee593543fa7ae1aa329ad5bd5078024f905cdba185d18e76db130` diff --git a/zh/built-in-nodes/PrunaTextToVideoNode.mdx b/zh/built-in-nodes/PrunaTextToVideoNode.mdx new file mode 100644 index 0000000000..c197f405ef --- /dev/null +++ b/zh/built-in-nodes/PrunaTextToVideoNode.mdx @@ -0,0 +1,50 @@ +--- +title: "PrunaTextToVideoNode - ComfyUI Built-in Node Documentation" +description: "使用 Pruna 的 P-Video-2 模型根据文本提示生成视频。" +sidebarTitle: "PrunaTextToVideoNode" +icon: "circle" +mode: wide +--- + +使用 Pruna 的 P-Video-2 模型根据文本提示生成视频。提示词描述场景、其动作和声音,该节点既可以自行生成配乐,也可以接收一段音频片段,由该音频驱动动作并作为配乐。 + +## 输入 + +### 通用输入 + +| 参数 | 描述 | 数据类型 | 必填 | 取值范围 | +| --- | --- | --- | --- | --- | +| `model` | 要使用的 Pruna 视频模型。选择某个模型后,会在下方显示该模型自身的输入。 | DYNAMIC_COMBO | 是 | `"p-video-2"` | + +### P-Video-2 输入 + +| 参数 | 描述 | 数据类型 | 必填 | 取值范围 | +| --- | --- | --- | --- | --- | +| `prompt` | 描述视频内容、其动作和声音。必须包含至少一个非空白字符,最多 5000 个字符(默认:空)。 | STRING | 是 | 最多 5000 个字符 | +| `aspect_ratio` | 输出视频的宽高比(默认:`"16:9"`)。 | COMBO | 是 | `"16:9"`
`"9:16"`
`"4:3"`
`"3:4"`
`"3:2"`
`"2:3"`
`"1:1"` | +| `duration` | 视频长度,单位为秒。`"auto"` 表示由模型根据提示词自行选择长度。当连接了 `model.audio` 时此项被忽略:此时视频长度跟随音频长度,向上取整到整秒,最长 20 秒(默认:`"5"`)。 | COMBO | 是 | `"auto"`
`"1"`
`"2"`
`"3"`
`"4"`
`"5"`
`"6"`
`"7"`
`"8"`
`"9"`
`"10"`
`"11"`
`"12"`
`"13"`
`"14"`
`"15"`
`"16"`
`"17"`
`"18"`
`"19"`
`"20"` | +| `resolution` | 输出分辨率。720p 约渲染 0.9 兆像素(16:9 时为 1280x704),1080p 约 2 兆像素(16:9 时为 1920x1088)(默认:`"720p"`)。 | COMBO | 是 | `"720p"`
`"1080p"` | +| `fps` | 每秒帧数。在 1080p 下启用 draft 时无法使用 48 fps(默认:`"24"`)。 | COMBO | 是 | `"24"`
`"48"` | +| `draft` | 更快速、细节更少的渲染,计费标准低于标准渲染(默认:False)。 | BOOLEAN | 是 | True/False | +| `generate_audio` | 为视频生成配乐。当连接了 `model.audio` 时此项被忽略,此时由该音频作为配乐(默认:True)。 | BOOLEAN | 是 | True/False | +| `enhance_prompt` | 在生成前将提示词改写得更详细;简短的提示词需要开启此项。关闭后可使用相同的 seed 精确复现结果(默认:True)。高级设置。 | BOOLEAN | 是 | True/False | +| `model.audio` | 用于驱动动作并作为配乐的音频。长度至少 1 秒;超过 20 秒的音频会被截断。由它决定视频长度,而不再使用 `model.duration`。 | AUDIO | 否 | - | +| `seed` | 生成所使用的随机种子。只有在 `model.enhance_prompt` 关闭时,相同的 seed 才能精确复现结果(默认:42)。 | INT | 是 | 0 到 2147483647 | + +**注意:** + +- `model.prompt` 为必填项,且限制为 5000 个字符。 +- 1080p 下的 draft 不能与 48 fps 组合使用:节点会报错,因此请关闭 draft 或改用 24 fps。 +- 连接的音频长度必须至少为 1 秒;超过 20 秒的部分会被忽略。 +- 连接 `model.audio` 后,由音频决定视频长度,因此 `model.duration` 和 `model.generate_audio` 均不起作用。 + +## 输出 + +| 输出名称 | 描述 | 数据类型 | +| --- | --- | --- | +| `video` | 生成的视频及其配乐。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/PrunaTextToVideoNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `bb7bacf2591618220c72525c1e32382174abe3a55069720adbc84fc1d8081718` diff --git a/zh/built-in-nodes/TextGenerate.mdx b/zh/built-in-nodes/TextGenerate.mdx index a844df2259..59b30f8645 100644 --- a/zh/built-in-nodes/TextGenerate.mdx +++ b/zh/built-in-nodes/TextGenerate.mdx @@ -1,12 +1,12 @@ --- title: "TextGenerate - ComfyUI Built-in Node Documentation" -description: "TextGenerate 节点使用 CLIP 模型根据用户的提示生成文本。" +description: "TextGenerate 节点使用 CLIP 模型根据用户提示词生成文本。" sidebarTitle: "TextGenerate" icon: "circle" mode: wide --- -TextGenerate 节点使用 CLIP 模型根据用户的提示生成文本。它可以选择性地使用图像、视频或音频作为附加上下文来引导文本生成。您可以控制输出的长度,为支持的模型启用思考模式,并选择是使用具有各种设置的随机采样,还是不使用采样来生成文本。 +TextGenerate 节点使用 CLIP 模型根据用户提示词生成文本。它可以选择性地使用图像、视频或音频作为额外上下文来引导文本生成。你可以控制输出长度,为支持的模型启用思考模式,并选择使用带有各种设置的随机采样,还是不使用采样生成文本。 ## 输入 @@ -14,37 +14,38 @@ TextGenerate 节点使用 CLIP 模型根据用户的提示生成文本。它可 | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `采样模式` | 控制文本生成过程中是否使用随机采样。设置为 "on" 时,额外的采样参数将可用。设置为 "off" 时,节点将不使用随机采样生成文本。 | DYNAMIC_COMBO | 是 | `"on"`
`"off"` | -| `clip` | 用于对提示进行分词并生成文本的 CLIP 模型。 | CLIP | 是 | 不适用 | -| `提示词` | 引导生成的文本提示。此字段支持多行和动态提示。默认值为空字符串。 | STRING | 是 | 不适用 | -| `图像` | 可选的图像,可与文本提示一起使用以影响生成的文本。 | IMAGE | 否 | 不适用 | -| `视频` | 视频帧作为图像批次。假定为 24 FPS;内部子采样为 1 FPS。 | IMAGE | 否 | 不适用 | -| `音频` | 可选的音频输入,可与文本提示一起使用以影响生成的文本。 | AUDIO | 否 | 不适用 | +| `采样模式` | 控制文本生成过程中是否使用随机采样。设置为 "on" 时,将提供额外的采样参数。设置为 "off" 时,节点将在不使用随机采样的情况下生成文本。 | DYNAMIC_COMBO | 是 | `"on"`
`"off"` | +| `clip` | 用于对提示词进行分词并生成文本的 CLIP 模型。 | CLIP | 是 | N/A | +| `提示词` | 用于引导生成的文本提示词。此字段支持多行和动态提示词。默认值为空字符串。 | STRING | 是 | N/A | +| `图像` | 可选图像,可与文本提示词一起使用,以影响生成的文本。 | IMAGE | 否 | N/A | +| `视频` | 以图像批次形式提供的视频帧。假定为 24 FPS;内部会下采样到 1 FPS。 | IMAGE | 否 | N/A | +| `音频` | 可选音频输入,可与文本提示词一起使用,以影响生成的文本。 | AUDIO | 否 | N/A | | `最大长度` | 模型将生成的最大 token 数量。默认值为 512。 | INT | 是 | 1 至 32768 | -| `思考模式` | 如果模型支持,则以思考模式运行。默认值为 False。 | BOOLEAN | 否 | True 或 False | -| `use_default_template` | 如果模型有内置系统提示/模板,则使用它。默认值为 True。这是一个高级参数。 | BOOLEAN | 否 | True 或 False | +| `思考模式` | 如果模型支持,则在思考模式下运行。默认值为 False。 | BOOLEAN | 否 | True or False | +| `use_default_template` | 如果模型有内置系统提示词/模板,则使用它。默认值为 True。这是一个高级参数。 | BOOLEAN | 否 | True or False | +| `mtp` | 使用 checkpoint 的多 token 预测头进行投机解码。没有 MTP 权重时没有效果。`"auto"` 会自适应草稿深度,`"2"` 到 `"5"` 会将其固定。采样输出仍保持正确分布,但在相同 `seed` 下会与非 MTP 输出不同(默认值:`"auto"`)。 | COMBO | 否 | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | ### 采样参数(当 `sampling_mode` 为 "on" 时) | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | | `temperature` | 控制输出的随机性。较低的值使输出更可预测,较高的值使其更具创造性。默认值为 0.7。 | FLOAT | 是 | 0.01 至 2.0 | -| `top_k` | 将采样池限制为最可能的 K 个下一个 token。值为 0 时禁用此过滤器。默认值为 64。 | INT | 是 | 0 至 1000 | -| `top_p` | 使用核采样,将选择限制为累积概率小于此值的 token。默认值为 0.95。 | FLOAT | 是 | 0.0 至 1.0 | -| `min_p` | 为要考虑的 token 设置最小概率阈值。默认值为 0.05。 | FLOAT | 是 | 0.0 至 1.0 | -| `repetition_penalty` | 对已生成的 token 进行惩罚以减少重复。值为 1.0 时不施加惩罚。默认值为 1.05。 | FLOAT | 是 | 0.0 至 5.0 | -| `seed` | 用于初始化随机数生成器以获得可重现结果的数字。默认值为 0。 | INT | 是 | 0 至 18446744073709551615 | -| `presence_penalty` | 根据新 token 是否已出现在当前文本中来对其进行惩罚,鼓励模型讨论新主题。默认值为 0.0。 | FLOAT | 否 | 0.0 至 5.0 | +| `top_k` | 将采样池限制为最可能的下一个 token 中的前 K 个。值为 0 时禁用此过滤器。默认值为 64。 | INT | 是 | 0 至 1000 | +| `top_p` | 使用核采样:保留累计概率达到该值的最小一组最可能 token。默认值为 0.95。 | FLOAT | 是 | 0.0 至 1.0 | +| `min_p` | 设置 token 被考虑的最低概率阈值。默认值为 0.05。 | FLOAT | 是 | 0.0 至 1.0 | +| `repetition_penalty` | 对已经生成的 token 进行惩罚,以减少重复。值为 1.0 时不施加惩罚。默认值为 1.05。 | FLOAT | 是 | 0.0 至 5.0 | +| `seed` | 用于初始化随机数生成器以获得可复现结果的数字。默认值为 0。 | INT | 是 | 0 至 18446744073709551615 | +| `presence_penalty` | 根据新 token 是否已在当前文本中出现过对其进行惩罚,鼓励模型讨论新主题。默认值为 0.0。 | FLOAT | 否 | 0.0 至 5.0 | -**注意:** 上述采样参数仅在 `sampling_mode` 设置为 "on" 时才会在节点界面中激活并可见。当 `sampling_mode` 设置为 "off" 时,没有任何采样参数可用,节点将不使用随机采样生成文本。 +**注意:** 仅当 `sampling_mode` 设置为 "on" 时,上述采样参数才会在节点界面中生效并可见。当 `sampling_mode` 设置为 "off" 时,没有可用的采样参数,节点将在不使用随机采样的情况下生成文本。 ## 输出 | 输出名称 | 描述 | 数据类型 | | --- | --- | --- | -| `生成文本` | 模型根据输入提示以及可选的图像、视频或音频生成的文本。 | STRING | +| `generated_text` | 模型根据输入提示词以及可选图像、视频或音频生成的文本。 | STRING | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerate/zh.md) --- -**Source fingerprint (SHA-256):** `6274a2db7c9a963304daf6df494b2b20879155e918d73429fd2ce7f3b5b9da02` +**Source fingerprint (SHA-256):** `7d9f6aee19e076aa0afb4d57060b09474206ecf2492c0944762965fabac92c51` diff --git a/zh/built-in-nodes/TextGenerateLTX2Prompt.mdx b/zh/built-in-nodes/TextGenerateLTX2Prompt.mdx index ba8a186034..417f679dbf 100644 --- a/zh/built-in-nodes/TextGenerateLTX2Prompt.mdx +++ b/zh/built-in-nodes/TextGenerateLTX2Prompt.mdx @@ -1,41 +1,58 @@ --- title: "TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation" -description: "TextGenerateLTX2Prompt 节点将简短的用户提示词扩展为详细的、适合使用 LTX-2 系列视频模型生成视频的音视频描述。" +description: "TextGenerateLTX2Prompt 节点可将简短的用户提示词扩展为详细的音视频描述,适用于使用 LTX-2 系列视频模型生成视频。" sidebarTitle: "TextGenerateLTX2Prompt" icon: "circle" mode: wide --- -TextGenerateLTX2Prompt 节点将简短的用户提示词扩展为详细的、适合使用 LTX-2 系列视频模型生成视频的音视频描述。它会自动添加特定于任务的系统指令,将格式化后的提示词发送给语言模型,并返回增强后的文本。当提供可选的参考图像时,该节点会切换到图像到视频模式,并从该图像的内容出发扩展提示词。 +TextGenerateLTX2Prompt 节点可将简短的用户提示词扩展为详细的音视频描述,适用于使用 LTX-2 系列视频模型生成视频。它会自动添加针对具体任务的系统指令,将格式化后的提示词发送给语言模型,并返回增强后的文本。当提供可选的参考图像时,节点会切换到图生视频模式,并以该图像的内容为起点来扩展提示词。 ## 输入 +### 通用输入 + | 参数 | 描述 | 数据类型 | 必填 | 范围 | | --- | --- | --- | --- | --- | -| `clip` | 用于文本编码的 CLIP 模型。该节点会检查模型的 tokenizer 名称以选择匹配的指令:基于 Gemma 4 的模型使用 LTX-2.4 格式,而其他模型使用 LTX-2(Gemma 3)格式。 | CLIP | 是 | | -| `提示词` | 原始文本输入,用于描述要扩展为详细视频生成提示词的场景或概念。 | STRING | 是 | | -| `最大长度` | 允许语言模型生成的 token 最大数量。 | INT | 是 | | -| `采样模式` | 文本生成过程中用于选择下一个 token 的采样策略。 | COMBO | 是 | `"greedy"`
`"top_k"`
`"top_p"`
`"temperature"` | -| `图像` | 可选的输入图像,用作视频的第一帧。提供后,节点会切换到图像到视频模式,并使用基于图像内容扩展用户提示词的系统提示词。 | IMAGE | 否 | | -| `思考模式` | 启用后,模型会先进行推理再作答。返回的输出中会移除任何推理块(默认值:False)。 | BOOLEAN | 否 | | -| `use_default_template` | 启用后,节点使用默认的聊天模板进行格式化(默认值:True)。 | BOOLEAN | 否 | | -| `视频` | 可选的视频输入,可用作生成的额外上下文。 | VIDEO | 否 | | -| `音频` | 可选的音频输入,可用作生成的额外上下文。 | AUDIO | 否 | | +| `clip` | 用于文本编码的 CLIP 模型。节点会检查模型的 tokenizer 名称以选择匹配的指令:基于 Gemma 4 的模型使用 LTX-2.4 格式,其他模型使用 LTX-2 (Gemma 3) 格式。 | CLIP | 是 | - | +| `提示词` | 描述场景或概念的原始文本输入,将扩展为详细的视频生成提示词。 | STRING | 是 | - | +| `图像` | 可选输入图像,用作视频的第一帧。提供后,节点会切换到图生视频模式,并使用根据图像内容扩展用户提示词的系统提示。 | IMAGE | 否 | - | +| `视频` | 可选的视频输入,用作额外上下文。作为图像批次传递给语言模型;假定为 24 FPS,并在内部下采样至 1 FPS。 | IMAGE | 否 | - | +| `音频` | 可选的音频输入,可用作生成的额外上下文。 | AUDIO | 否 | - | +| `最大长度` | 语言模型允许生成的最大 token 数(默认:512)。 | INT | 是 | 1 到 32768 | +| `采样模式` | 控制文本生成期间是否使用随机采样。设置为 `"on"` 时,下方的采样参数可用;设置为 `"off"` 时,节点在不进行随机采样的情况下生成文本。 | DYNAMIC_COMBO | 是 | `"on"`
`"off"` | +| `思考模式` | 启用后,模型会被指示在回答前先进行推理。返回的输出中会移除任何推理块(默认:False)。 | BOOLEAN | 否 | True/False | +| `use_default_template` | 启用后,节点使用默认聊天模板进行格式化(默认:True)。高级设置。 | BOOLEAN | 否 | True/False | +| `mtp` | 使用检查点的多 token 预测头进行投机解码。没有 MTP 权重时无效。`"auto"` 会自适应草稿深度,`"2"` 到 `"5"` 则固定草稿深度。采样输出仍保持正确分布,但对于相同种子与非 MTP 输出不同(默认:`"auto"`)。 | COMBO | 否 | `"auto"`
`"off"`
`"2"`
`"3"`
`"4"`
`"5"` | + +### 采样参数(当 `sampling_mode` 为 "on" 时) + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `temperature` | 控制输出的随机性。较低的值使输出更可预测,较高的值使其更具创造性(默认:0.7)。 | FLOAT | 是 | 0.01 到 2.0 | +| `top_k` | 将采样池限制为最有可能的下一个 token 中排名前 K 的 token。值为 0 时禁用此过滤(默认:64)。 | INT | 是 | 0 到 1000 | +| `top_p` | 使用核采样:保留累计概率达到该值的最小一组最可能 token。(默认:0.95) | FLOAT | 是 | 0.0 到 1.0 | +| `min_p` | 设置 token 被考虑的最小概率阈值(默认:0.05)。 | FLOAT | 是 | 0.0 到 1.0 | +| `repetition_penalty` | 对已生成的 token 施加惩罚,以减少重复。值为 1.0 时不施加惩罚(默认:1.05)。 | FLOAT | 是 | 0.0 到 5.0 | +| `seed` | 用于初始化随机数生成器以获得可复现结果的数字(默认:0)。 | INT | 是 | 0 到 18446744073709551615 | +| `presence_penalty` | 根据新 token 是否已在文本中出现过对其施加惩罚,鼓励模型讨论新话题(默认:0.0)。 | FLOAT | 否 | 0.0 到 5.0 | + +**注意:** 仅当 `sampling_mode` 设置为 "on" 时,上述采样参数才会在节点界面中生效并可见。设置为 "off" 时,没有任何采样参数可用,节点在不进行随机采样的情况下生成文本。 **注意:** 节点的行为会根据其输入而变化: -- 如果提供了 `image`,生成的提示词会按图像到视频任务进行格式化,使用描述如何基于图像内容扩展提示词的系统提示词。如果未提供图像,则按文本到视频任务进行格式化,使用将提示词扩展为详细视频生成描述的系统提示词。 -- 如果 CLIP tokenizer 的名称包含 "gemma4",节点使用 LTX-2.4 系统提示词和 Gemma 4 聊天格式。否则,使用 LTX-2(Gemma 3)系统提示词和聊天格式。 -- 当对 Gemma 4 模型启用 `thinking` 时,模型会在其推理通道上打开;禁用时,模型直接在最终答案通道上打开。对于非 Gemma 4 模型,`thinking` 会传递到底层生成步骤。 +- 如果提供了 `image`,生成的提示词会针对图生视频任务进行格式化,使用描述如何根据图像内容扩展提示词的系统提示。如果未提供图像,则针对文生视频任务进行格式化,使用将提示词扩展为详细视频生成描述的系统提示。 +- 如果 CLIP tokenizer 的名称包含 "gemma4",节点使用 LTX-2.4 系统提示和 Gemma 4 聊天格式。否则,使用 LTX-2 (Gemma 3) 系统提示和聊天格式。 +- 当 `thinking` 在 Gemma 4 模型上启用时,模型会在其推理通道上开启;禁用时,模型会直接在最终答案通道上开启。对于非 Gemma 4 模型,`thinking` 会传递到基础生成步骤。 - 如果语言模型在移除推理块后没有产生可用文本,节点会返回原始 `prompt`。 ## 输出 | 输出名称 | 描述 | 数据类型 | | --- | --- | --- | -| `output` | 语言模型生成的增强视频生成提示词,已移除任何推理块。如果结果为空,则返回原始用户提示词。 | STRING | +| `generated_text` | 由语言模型生成的增强视频生成提示词,已移除任何推理块。如果结果为空,则返回原始用户提示词。 | STRING | > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/zh.md) --- -**Source fingerprint (SHA-256):** `8f524ea60a247217dde8a1edaf7a689e253ae05acc9eb52ad47b91e879dba1df` +**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943` diff --git a/zh/built-in-nodes/TripoPSeriesImageToModelNode.mdx b/zh/built-in-nodes/TripoPSeriesImageToModelNode.mdx new file mode 100644 index 0000000000..5a5eeef753 --- /dev/null +++ b/zh/built-in-nodes/TripoPSeriesImageToModelNode.mdx @@ -0,0 +1,56 @@ +--- +title: "TripoPSeriesImageToModelNode - ComfyUI Built-in Node Documentation" +description: "使用 Tripo 的 P2 模型,从单张图像生成具有干净拓扑的低多边形 3D 模型。" +sidebarTitle: "TripoPSeriesImageToModelNode" +icon: "circle" +mode: wide +--- + +使用 Tripo 的 P2 模型,从单张图像生成具有干净拓扑的低多边形 3D 模型。结果以三角网格(GLB)返回;当启用 `model.quad` 时,则以四边形为主的网格(FBX)返回。 + +## Inputs + +### 通用输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `model` | 要使用的 Tripo P 系列模型。选择模型后,下方会显示该模型自身的输入。 | DYNAMIC_COMBO | 是 | `"P2"` | + +### P2 输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `model.image` | 用于生成模型的图像。 | IMAGE | 是 | - | +| `quad` | 在 FBX 输出上返回以四边形为主的网格,而不是在 GLB 输出上返回三角网格(默认:False)。 | BOOLEAN | 是 | True/False | +| `face_limit` | 目标面数。`-1` 表示由 Tripo 选择。启用 `model.quad` 时,限制为 48 到 25,000,否则为 48 到 50,000(默认:-1)。 | INT | 是 | -1,或 48 到 50000 | +| `texture` | 基础颜色纹理分辨率:standard 为 2K,detailed 为 4K,extreme 为 8K。`"none"` 返回无纹理网格(默认:`"standard"`)。 | COMBO | 是 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 为基础颜色添加金属度、粗糙度和法线贴图。当 `model.texture` 为 `"none"` 时忽略(默认:True)。 | BOOLEAN | 是 | True/False | +| `model_seed` | 几何体的种子(默认:42)。 | INT | 是 | 0 到 2147483647 | +| `texture_alignment` | 匹配输入图像的颜色,或将纹理适配到生成的几何体。当 `model.texture` 为 `"none"` 时忽略(默认:`"original_image"`)。高级设置。 | COMBO | 是 | `"original_image"`
`"geometry"` | +| `orientation` | `"align_image"` 将模型旋转到输入图像的视角。当 `model.texture` 为 `"none"` 时忽略(默认:`"default"`)。高级设置。 | COMBO | 是 | `"default"`
`"align_image"` | +| `enable_image_autofix` | 让 Tripo 在建模前增强低分辨率或低质量图像(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | +| `texture_seed` | 纹理的种子(默认:42)。高级设置。 | INT | 是 | 0 到 2147483647 | +| `auto_size` | 通过场景变换将模型缩放到其以米为单位的真实世界尺寸,当 `model.texture` 为 `"none"` 时忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | +| `export_uv` | 当网格无纹理时对其进行 UV 展开。带纹理的网格始终会展开 UV(默认:True)。高级设置。 | BOOLEAN | 是 | True/False | +| `compress_geometry` | 应用 meshopt 几何压缩:文件会小很多,但 ComfyUI 的 3D 预览无法显示它们。对四边形网格忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | + +**注意:** + +- `model.image` 为必填项,且仅使用批次中的第一张图像。 +- `model.face_limit` 是目标值而非硬性上限,因此结果可能包含比请求更多的面。`-1` 表示由 Tripo 决定。 +- `model.quad` 决定网格由哪个输出承载。启用时,模型从 FBX 输出返回,GLB 输出保持为空;禁用时,模型从 GLB 输出返回,FBX 保持为空。如果连接的是为空的输出,节点会报错。 +- `model.texture`、`model.pbr`、`model.texture_seed`、`model.auto_size`、`model.texture_alignment` 和 `model.orientation` 仅适用于带纹理的模型:当为 `"none"` 时,节点不发送纹理设置,并返回裸几何体。 +- `model.compress_geometry` 对四边形网格没有效果。 + +## Outputs + +| 输出名称 | 描述 | 数据类型 | +| --- | --- | --- | +| `model task_id` | 模型生成请求的唯一任务 ID。 | MODEL_TASK_ID | +| `GLB` | 生成的 GLB 格式 3D 模型。启用 `model.quad` 时为空。 | FILE3DGLB | +| `FBX` | 生成的 FBX 格式 3D 模型。仅在启用 `model.quad` 时填充。 | FILE3DFBX | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesImageToModelNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `9bfad31ee00546d0603ce3273502cfc93c79e3b125941fed255866aa83f770a5` diff --git a/zh/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx b/zh/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx new file mode 100644 index 0000000000..3e884145f0 --- /dev/null +++ b/zh/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx @@ -0,0 +1,59 @@ +--- +title: "TripoPSeriesMultiviewToModelNode - ComfyUI Built-in Node Documentation" +description: "使用 Tripo 的 P2 模型,根据同一主体的多个视图生成具有干净拓扑的低多边形 3D 模型。" +sidebarTitle: "TripoPSeriesMultiviewToModelNode" +icon: "circle" +mode: wide +--- + +使用 Tripo 的 P2 模型,根据同一主体的多个视图生成具有干净拓扑的低多边形 3D 模型。正面视图是必需的,并且可以添加左视图、后视图和右视图中的一到三个来改善结果。模型会以三角网格(GLB)返回,或者当启用 `model.quad` 时,以四边形为主的网格(FBX)返回。 + +## 输入 + +### 通用输入 + +| 参数 | 描述 | 数据类型 | 必需 | 范围 | +| --- | --- | --- | --- | --- | +| `model` | 要使用的 Tripo P 系列模型。选择模型后会在下方显示其各自的输入。 | DYNAMIC_COMBO | 是 | `"P2"` | + +### P2 输入 + +| 参数 | 描述 | 数据类型 | 必需 | 范围 | +| --- | --- | --- | --- | --- | +| `model.image` | 主体的正面视图(0°)。 | IMAGE | 是 | - | +| `model.image_left` | 左视图(90°),主体自身的左侧。 | IMAGE | 否 | - | +| `model.image_back` | 背面视图(180°)。 | IMAGE | 否 | - | +| `model.image_right` | 右视图(270°),主体自身的右侧。 | IMAGE | 否 | - | +| `quad` | 在 FBX 输出上返回以四边形为主的网格,而不是在 GLB 输出上返回三角网格(默认:False)。 | BOOLEAN | 是 | True/False | +| `face_limit` | 目标面数。`-1` 让 Tripo 自行选择。启用 `model.quad` 时,限制为 48 到 25,000;否则为 48 到 50,000(默认:-1)。 | INT | 是 | -1,或 48 到 50000 | +| `纹理` | 基础颜色纹理分辨率:standard 为 2K,detailed 为 4K,extreme 为 8K。`"none"` 返回无纹理网格(默认:`"standard"`)。 | COMBO | 是 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 为基础颜色添加金属度、粗糙度和法线贴图。当 `model.texture` 为 `"none"` 时忽略(默认:True)。 | BOOLEAN | 是 | True/False | +| `model_seed` | 几何体种子(默认:42)。 | INT | 是 | 0 到 2147483647 | +| `texture_alignment` | 匹配输入图像的颜色,或使纹理适配生成的几何体。当 `model.texture` 为 `"none"` 时忽略(默认:`"original_image"`)。高级设置。 | COMBO | 是 | `"original_image"`
`"geometry"` | +| `orientation` | `"align_image"` 将模型旋转到输入图像的视角。当 `model.texture` 为 `"none"` 时忽略(默认:`"default"`)。高级设置。 | COMBO | 是 | `"default"`
`"align_image"` | +| `texture_seed` | 纹理种子(默认:42)。高级设置。 | INT | 是 | 0 到 2147483647 | +| `auto_size` | 通过其场景变换将模型缩放为其以米为单位的真实世界尺寸,当 `model.texture` 为 `"none"` 时忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | +| `export_uv` | 当网格无纹理时对其进行 UV 展开。有纹理的网格始终会展开(默认:True)。高级设置。 | BOOLEAN | 是 | True/False | +| `compress_geometry` | 应用 meshopt 几何压缩:文件小得多,但 ComfyUI 的 3D 预览无法显示它们。对四边形网格忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | + +**备注:** + +- `model.image` 是必需的,并且还必须连接 `model.image_left`、`model.image_back` 或 `model.image_right` 中的至少一个;如果正面视图是唯一图像,该节点会报错。 +- 仅使用每个批次中的第一张图像。 +- `model.face_limit` 是目标值而非硬性上限,因此结果可能包含比要求更多的面。`-1` 将选择权留给 Tripo。 +- `model.quad` 决定哪个输出携带网格。启用它时,模型会出现在 FBX 输出上,而 GLB 输出保持为空;禁用它时,模型会出现在 GLB 上,而 FBX 保持为空。如果连接的是空输出,该节点会报错。 +- `model.texture`、`model.pbr`、`model.texture_seed`、`model.auto_size`、`model.texture_alignment` 和 `model.orientation` 仅适用于有纹理的模型:当为 `"none"` 时,节点不发送任何纹理设置,并返回裸几何体。 +- `model.compress_geometry` 对四边形网格没有效果。 + +## 输出 + +| 输出名 | 描述 | 数据类型 | +| --- | --- | --- | +| `model task_id` | 模型生成请求的唯一任务 ID。 | MODEL_TASK_ID | +| `GLB` | 以 GLB 格式生成的 3D 模型。启用 `model.quad` 时为空。 | FILE3DGLB | +| `FBX` | 以 FBX 格式生成的 3D 模型。仅在启用 `model.quad` 时填充。 | FILE3DFBX | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesMultiviewToModelNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `cea0a65ca001bc8298af9fbe2a83f592abf497987e634b0126482f3d2a18571c` diff --git a/zh/built-in-nodes/TripoPSeriesTextToModelNode.mdx b/zh/built-in-nodes/TripoPSeriesTextToModelNode.mdx new file mode 100644 index 0000000000..00a5d59a22 --- /dev/null +++ b/zh/built-in-nodes/TripoPSeriesTextToModelNode.mdx @@ -0,0 +1,55 @@ +--- +title: "TripoPSeriesTextToModelNode - ComfyUI Built-in Node Documentation" +description: "使用 Tripo 的 P2 模型,根据文本提示生成具有干净拓扑的低多边形 3D 模型。" +sidebarTitle: "TripoPSeriesTextToModelNode" +icon: "circle" +mode: wide +--- + +使用 Tripo 的 P2 模型,根据文本提示生成具有干净拓扑的低多边形 3D 模型。结果会以三角网格 (GLB) 返回;当启用 `model.quad` 时,则以四边形为主的网格 (FBX) 返回。 + +## 输入 + +### 通用输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `模型` | 要使用的 Tripo P 系列模型。选择模型后,会在下方显示其对应的输入。 | DYNAMIC_COMBO | 是 | `"P2"` | + +### P2 输入 + +| 参数 | 描述 | 数据类型 | 必填 | 范围 | +| --- | --- | --- | --- | --- | +| `提示词` | 要生成的 3D 模型的文本描述。不能为空,最多 1024 个字符(默认:空)。 | STRING | 是 | 最多 1024 个字符 | +| `negative_prompt` | 生成模型中要避免的内容的文本描述(默认:空)。 | STRING | 否 | 最多 255 个字符 | +| `quad` | 返回以四边形为主的网格,并输出到 FBX 输出,而不是输出到 GLB 输出的三角网格(默认:False)。 | BOOLEAN | 是 | True/False | +| `face_limit` | 目标面数。`-1` 表示让 Tripo 自行选择。启用 `model.quad` 时,限制为 48 到 25,000;否则为 48 到 50,000(默认:-1)。 | INT | 是 | -1,或 48 到 50000 | +| `纹理` | 基础颜色纹理分辨率:standard 为 2K,detailed 为 4K,extreme 为 8K。`"none"` 返回不带纹理的网格(默认:`"standard"`)。 | COMBO | 是 | `"standard"`
`"detailed"`
`"extreme"`
`"none"` | +| `pbr` | 为基础颜色添加金属度、粗糙度和法线贴图。当 `model.texture` 为 `"none"` 时忽略(默认:True)。 | BOOLEAN | 是 | True/False | +| `model_seed` | 几何体的种子(默认:42)。 | INT | 是 | 0 到 2147483647 | +| `image_seed` | 建模前 Tripo 根据提示绘制图像的种子(默认:42)。高级设置。 | INT | 是 | 0 到 2147483647 | +| `texture_seed` | 纹理的种子(默认:42)。高级设置。 | INT | 是 | 0 到 2147483647 | +| `auto_size` | 通过场景变换将模型缩放到其真实世界尺寸(以米为单位),当 `model.texture` 为 `"none"` 时忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | +| `export_uv` | 当网格不带纹理时对其进行 UV 展开。带纹理的网格始终会展开(默认:True)。高级设置。 | BOOLEAN | 是 | True/False | +| `compress_geometry` | 应用 meshopt 几何压缩:文件会小很多,但 ComfyUI 的 3D 预览无法显示它们。对四边形网格忽略(默认:False)。高级设置。 | BOOLEAN | 是 | True/False | + +**注意:** + +- `model.prompt` 为必填项;`model.negative_prompt` 为可选项,限制为 255 个字符。 +- `model.face_limit` 是目标值而非硬性上限,因此结果可能包含比请求更多的面。`-1` 表示交由 Tripo 选择。 +- `model.quad` 决定由哪个输出承载网格。启用它时,模型会出现在 FBX 输出上,而 GLB 输出保持为空;禁用它时,模型会出现在 GLB 上,而 FBX 保持为空。如果空输出正是你连接的那个,节点会报错。 +- `model.texture`、`model.pbr`、`model.texture_seed` 和 `model.auto_size` 仅适用于带纹理的模型:使用 `"none"` 时,节点不发送纹理设置,并返回裸几何体。 +- `model.compress_geometry` 对四边形网格没有效果。 + +## 输出 + +| 输出名称 | 描述 | 数据类型 | +| --- | --- | --- | +| `model task_id` | 模型生成请求的唯一任务 ID。 | MODEL_TASK_ID | +| `GLB` | 生成的 3D 模型,采用 GLB 格式。启用 `model.quad` 时为空。 | FILE3DGLB | +| `FBX` | 生成的 3D 模型,采用 FBX 格式。仅在启用 `model.quad` 时填充。 | FILE3DFBX | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TripoPSeriesTextToModelNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `e55596c1a237cf6b92e3bdead4359f380c6cba60992dcc61b5ee4e6b1bdd843b` diff --git a/zh/built-in-nodes/YuE2GenerateMusic.mdx b/zh/built-in-nodes/YuE2GenerateMusic.mdx index 76709ff437..06dc3f762d 100644 --- a/zh/built-in-nodes/YuE2GenerateMusic.mdx +++ b/zh/built-in-nodes/YuE2GenerateMusic.mdx @@ -6,25 +6,26 @@ icon: "circle" mode: wide --- -从风格、歌词和 ABC 记谱生成音乐 token 和声学条件。它返回条件以及生成的时长(秒),该时长应提供给 Empty YuE2 Latent Audio 节点。如果 ABC 输入留空,则忽略选定的模式,并自动使用 off 模式。 +从风格、歌词和 ABC 记谱生成音乐 token 和声学条件。它返回条件数据以及生成的时长(秒),应将其提供给 Empty YuE2 Latent Audio 节点。如果 ABC 输入留空,则忽略所选模式并自动使用 off 模式。 ## 输入 -| 参数 | 描述 | 数据类型 | 必需 | 范围 | +| 参数 | 描述 | 数据类型 | 必填 | 范围 | |-----------|-------------|-----------|----------|-------| -| `clip` | 用于对音乐输入进行 token 化和编码的 CLIP 模型。 | CLIP | 是 | - | -| `风格` | 描述音乐风格的文本。支持多行输入和动态提示词。 | STRING | 是 | 多行文本 | -| `歌词` | 生成音乐所用的歌词。支持多行输入和动态提示词。 | STRING | 是 | 多行文本 | -| `abc` | 连接 ABC 生成器或提供编辑过的乐谱。留空以自动使用 off 模式。默认值:"" | STRING | 是 | 多行文本 | +| `clip` | 用于对音乐输入进行分词和编码的 CLIP 模型。 | CLIP | 是 | - | +| `风格` | 描述音乐风格的文本。支持多行输入和动态提示。 | STRING | 是 | 多行文本 | +| `歌词` | 生成音乐的歌词。支持多行输入和动态提示。 | STRING | 是 | 多行文本 | +| `abc` | 连接 ABC 生成器或提供编辑后的乐谱。留空则自动使用 off 模式。默认值:"" | STRING | 是 | 多行文本 | | `种子` | 用于生成的随机种子。默认值:0 | INT | 是 | 0 到 18446744073709551615 | | `模式` | full:生成旋律和和弦;melody:仅生成旋律,推荐用于翻唱。默认值:"full" | COMBO | 是 | "full"
"melody" | -| `max_duration` | 最大时长(秒)。对于长提示词会自动缩短;生成可能会提前停止。默认值:360.0 | FLOAT | 是 | 0.04 到 900.0 | -| `温度` | 用于生成的采样温度。默认值:1.0(高级) | FLOAT | 是 | 0.0 到 5.0 | +| `max_duration` | 最大时长(秒)。对于长提示会自动缩短;生成可能会提前停止。默认值:360.0 | FLOAT | 是 | 0.04 到 900.0 | +| `温度` | 生成的采样温度。默认值:1.0(高级) | FLOAT | 是 | 0.0 到 5.0 | | `top_p` | 核采样概率阈值。默认值:0.95(高级) | FLOAT | 是 | 0.01 到 1.0 | | `top_k` | Top-k 采样限制。默认值:100(高级) | INT | 是 | 1 到 32768 | | `repetition_penalty` | 应用于重复 token 的惩罚。默认值:1.2(高级) | FLOAT | 是 | 0.01 到 10.0 | +| `cfg_scale` | 风格和歌词的自回归引导。1.0 禁用 CFG,与 ABC 工作流匹配。使用 1.01 匹配原始的 off 模式引导。默认值:1.0(高级,可选) | FLOAT | 否 | 0.0 到 100.0 | -注意:如果 `abc` 为空或仅包含空白字符,则忽略 `mode` 选择,并自动使用 off 模式。 +注意:如果 `abc` 为空或仅包含空白字符,则忽略 `mode` 选择并自动使用 off 模式。 ## 输出 @@ -36,4 +37,4 @@ mode: wide > 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/YuE2GenerateMusic/zh.md) --- -**Source fingerprint (SHA-256):** `54f5d46cf083726bdf97c86e5683b2727840f75bb553bddf9525cfbf5affa44c` +**Source fingerprint (SHA-256):** `5a88e185d2998c51acff7f0c76c8c35ca30b80b88cb541d97f9ab91566b5a3ed` From 0bf48518dd655f694d68c427f5acb6dc6960cc65 Mon Sep 17 00:00:00 2001 From: lin-bot23 Date: Sun, 20 Sep 2026 05:23:16 +0800 Subject: [PATCH 2/2] fix(ko): complete truncated frontmatter descriptions for Pruna and Tripo P-series node pages --- ko/built-in-nodes/PrunaImageToVideoNode.mdx | 2 +- ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx | 2 +- 2 files changed, 2 insertions(+), 2 deletions(-) diff --git a/ko/built-in-nodes/PrunaImageToVideoNode.mdx b/ko/built-in-nodes/PrunaImageToVideoNode.mdx index 14e9d758cc..28008acfdf 100644 --- a/ko/built-in-nodes/PrunaImageToVideoNode.mdx +++ b/ko/built-in-nodes/PrunaImageToVideoNode.mdx @@ -1,6 +1,6 @@ --- title: "PrunaImageToVideoNode - ComfyUI Built-in Node Documentation" -description: "Pruna의 P-Video-2 모델을 사용하여 이미지를 비디오로 애니메이션합니다. 첫 번째 프레임은 필수이며 출력의 화면 비율을 고정합니다. 선택적 마지막 프레임은 비디오가 보간되어 도달할 끝 지점을 제공합니다. 프롬프트는 장면이 어떻게 움직이는지 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 모션을 구동하는 오디오" +description: "Pruna의 P-Video-2 모델을 사용하여 이미지를 비디오로 애니메이션합니다. 첫 번째 프레임은 필수이며 출력의 화면 비율을 고정합니다. 선택적 마지막 프레임은 비디오가 보간되어 도달할 끝 지점을 제공합니다. 프롬프트는 장면이 어떻게 움직이는지 설명하며, 이 노드는 자체 사운드트랙을 생성하거나 모션을 구동하는 오디오 클립을 받습니다." sidebarTitle: "PrunaImageToVideoNode" icon: "circle" mode: wide diff --git a/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx b/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx index f83a4496ed..74b910f572 100644 --- a/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx +++ b/ko/built-in-nodes/TripoPSeriesMultiviewToModelNode.mdx @@ -1,6 +1,6 @@ --- title: "TripoPSeriesMultiviewToModelNode - ComfyUI Built-in Node Documentation" -description: "동일한 대상의 여러 뷰에서 Tripo의 P2 모델을 사용하여 깔끔한 토폴로지를 가진 로우 폴리 3D 모델을 생성합니다. 정면 뷰는 필수이며, 결과를 개선하기 위해 왼쪽, 뒤, 오른쪽 뷰 중 1개에서 3개까지 추가할 수 있습니다. 모델은 삼각형 메시(GLB)로 반환되거나, model.quad가 활성화된 경우 쿼드 우세" +description: "동일한 대상의 여러 뷰에서 Tripo의 P2 모델을 사용하여 깔끔한 토폴로지를 가진 로우 폴리 3D 모델을 생성합니다. 정면 뷰는 필수이며, 결과를 개선하기 위해 왼쪽, 뒤, 오른쪽 뷰 중 1개에서 3개까지 추가할 수 있습니다. 모델은 삼각형 메시(GLB)로 반환되거나, model.quad가 활성화된 경우 쿼드 우세 메시(FBX)로 반환됩니다." sidebarTitle: "TripoPSeriesMultiviewToModelNode" icon: "circle" mode: wide