diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/ar.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ar.md new file mode 100644 index 000000000..59713a4a5 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ar.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +هذه العقدة تطبق تصحيحًا متحركًا خفيفًا على نموذج الانتشار، مما يتيح توليدًا متحكمًا به من صورة إلى أخرى مع قوة وتوقيت قابلين للتعديل. تقوم بدمج تصحيح نموذج مُعد مسبقًا مع صورة إدخال وقناع اختياري، لتعديل طبقات الانتباه و MLP في النموذج للتأثير على عملية التوليد. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|--------|---------| +| `model` | نموذج الانتشار الأساسي الذي سيتم تطبيق التصحيح عليه | MODEL | نعم | | +| `model_patch` | تصحيح الحركة المُعد مسبقًا الذي سيتم تطبيقه | MODEL_PATCH | نعم | | +| `image` | الصورة المرجعية لتوجيه عملية التوليد | IMAGE | نعم | | +| `strength` | قوة تأثير التصحيح (القيمة الافتراضية: 1.0) | FLOAT | نعم | -10.0 إلى 10.0 | +| `start_percent` | النسبة المئوية من عملية إزالة التشويش التي يبدأ عندها التصحيح في التأثير (القيمة الافتراضية: 0.0) | FLOAT | نعم | 0.0 إلى 1.0 | +| `end_percent` | النسبة المئوية من عملية إزالة التشويش التي يتوقف عندها التصحيح عن التأثير (القيمة الافتراضية: 1.0) | FLOAT | نعم | 0.0 إلى 1.0 | +| `mask` | قناع اختياري لتحديد تأثير التصحيح في مناطق محددة من الصورة | MASK | لا | | + +**ملاحظة حول قيود المعاملات:** إذا كان `model_patch` يحتوي على 4 قنوات إدخال ولم يتم توفير `mask`، يتم إنشاء قناع صفري تلقائيًا ليتناسب مع أبعاد الصورة. إذا كان `model_patch` لا يحتوي على 4 قنوات إدخال، يتم تجاهل معامل `mask` وتعيينه على `None`. + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|-------------|-------|---------------| +| `MODEL` | نموذج الانتشار المُصحح مع تطبيق تصحيح الحركة | MODEL | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/ar.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/en.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/en.md new file mode 100644 index 000000000..2465a1b3f --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/en.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +This node applies a lightweight animation patch to a diffusion model, enabling controlled image-to-image generation with adjustable strength and timing. It integrates a pre-configured model patch with an input image and optional mask, modifying the model's attention and MLP layers to influence the generation process. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `model` | The base diffusion model to apply the patch to | MODEL | Yes | | +| `model_patch` | The pre-configured animation patch to apply | MODEL_PATCH | Yes | | +| `image` | The reference image to guide the generation | IMAGE | Yes | | +| `strength` | The strength of the patch effect (default: 1.0) | FLOAT | Yes | -10.0 to 10.0 | +| `start_percent` | The percentage of the denoising process at which the patch starts taking effect (default: 0.0) | FLOAT | Yes | 0.0 to 1.0 | +| `end_percent` | The percentage of the denoising process at which the patch stops taking effect (default: 1.0) | FLOAT | Yes | 0.0 to 1.0 | +| `mask` | An optional mask to limit the patch effect to specific areas of the image | MASK | No | | + +**Note on parameter constraints:** If the `model_patch` has 4 input channels and no `mask` is provided, a zero mask is automatically created to match the image dimensions. If the `model_patch` does not have 4 input channels, the `mask` parameter is ignored and set to `None`. + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `MODEL` | The patched diffusion model with the animation patch applied | MODEL | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/en.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/es.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/es.md new file mode 100644 index 000000000..1e732cf97 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/es.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +Este nodo aplica un parche de animación ligero a un modelo de difusión, permitiendo la generación controlada de imagen a imagen con intensidad y temporización ajustables. Integra un parche de modelo preconfigurado con una imagen de entrada y una máscara opcional, modificando las capas de atención y MLP del modelo para influir en el proceso de generación. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Requerido | Rango | +|-----------|-------------|--------------|-----------|-------| +| `model` | El modelo de difusión base al que aplicar el parche | MODEL | Sí | | +| `model_patch` | El parche de animación preconfigurado a aplicar | MODEL_PATCH | Sí | | +| `image` | La imagen de referencia para guiar la generación | IMAGE | Sí | | +| `strength` | La intensidad del efecto del parche (predeterminado: 1.0) | FLOAT | Sí | -10.0 a 10.0 | +| `start_percent` | El porcentaje del proceso de eliminación de ruido en el que el parche comienza a hacer efecto (predeterminado: 0.0) | FLOAT | Sí | 0.0 a 1.0 | +| `end_percent` | El porcentaje del proceso de eliminación de ruido en el que el parche deja de hacer efecto (predeterminado: 1.0) | FLOAT | Sí | 0.0 a 1.0 | +| `mask` | Una máscara opcional para limitar el efecto del parche a áreas específicas de la imagen | MASK | No | | + +**Nota sobre restricciones de parámetros:** Si el `model_patch` tiene 4 canales de entrada y no se proporciona una `mask`, se crea automáticamente una máscara cero que coincide con las dimensiones de la imagen. Si el `model_patch` no tiene 4 canales de entrada, el parámetro `mask` se ignora y se establece en `None`. + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `MODEL` | El modelo de difusión parcheado con el parche de animación aplicado | MODEL | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/es.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/fa.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/fa.md new file mode 100644 index 000000000..141790dc8 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/fa.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +این گره یک وصله (پچ) انیمیشن سبک‌وزن را به یک مدل انتشار (diffusion model) اعمال می‌کند و تولید کنترل‌شده تصویربه‌تصویر را با قدرت و زمان‌بندی قابل تنظیم امکان‌پذیر می‌سازد. این گره یک وصله مدل از پیش پیکربندی‌شده را با یک تصویر ورودی و ماسک اختیاری ادغام می‌کند و لایه‌های توجه (attention) و MLP مدل را برای تأثیرگذاری بر فرایند تولید تغییر می‌دهد. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | الزامی | محدوده | +|---------|---------|----------|--------|--------| +| `model` | مدل انتشار پایه که وصله به آن اعمال می‌شود | MODEL | بله | | +| `model_patch` | وصله انیمیشن از پیش پیکربندی‌شده برای اعمال | MODEL_PATCH | بله | | +| `image` | تصویر مرجع برای هدایت تولید | IMAGE | بله | | +| `strength` | قدرت اثر وصله (پیش‌فرض: 1.0) | FLOAT | بله | 10.0- تا 10.0 | +| `start_percent` | درصدی از فرایند نویززدایی که وصله شروع به اثرگذاری می‌کند (پیش‌فرض: 0.0) | FLOAT | بله | 0.0 تا 1.0 | +| `end_percent` | درصدی از فرایند نویززدایی که وصله اثرگذاری را متوقف می‌کند (پیش‌فرض: 1.0) | FLOAT | بله | 0.0 تا 1.0 | +| `mask` | یک ماسک اختیاری برای محدود کردن اثر وصله به نواحی خاصی از تصویر | MASK | خیر | | + +**نکته درباره محدودیت‌های پارامتر:** اگر `model_patch` دارای ۴ کانال ورودی باشد و `mask` ارائه نشود، یک ماسک صفر به‌طور خودکار برای مطابقت با ابعاد تصویر ایجاد می‌شود. اگر `model_patch` دارای ۴ کانال ورودی نباشد، پارامتر `mask` نادیده گرفته شده و روی `None` تنظیم می‌شود. + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `MODEL` | مدل انتشار وصله‌خورده با وصله انیمیشن اعمال‌شده | MODEL | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/fa.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/fr.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/fr.md new file mode 100644 index 000000000..1ae0ca18d --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/fr.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +Ce nœud applique un patch d'animation léger à un modèle de diffusion, permettant une génération contrôlée d'image à image avec une force et un timing ajustables. Il intègre un patch de modèle préconfiguré avec une image d'entrée et un masque optionnel, modifiant les couches d'attention et MLP du modèle pour influencer le processus de génération. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `model` | Le modèle de diffusion de base auquel appliquer le patch | MODEL | Oui | | +| `model_patch` | Le patch d'animation préconfiguré à appliquer | MODEL_PATCH | Oui | | +| `image` | L'image de référence pour guider la génération | IMAGE | Oui | | +| `strength` | La force de l'effet du patch (par défaut : 1.0) | FLOAT | Oui | -10.0 à 10.0 | +| `start_percent` | Le pourcentage du processus de débruitage à partir duquel le patch commence à agir (par défaut : 0.0) | FLOAT | Oui | 0.0 à 1.0 | +| `end_percent` | Le pourcentage du processus de débruitage auquel le patch cesse d'agir (par défaut : 1.0) | FLOAT | Oui | 0.0 à 1.0 | +| `mask` | Un masque optionnel pour limiter l'effet du patch à des zones spécifiques de l'image | MASK | Non | | + +**Remarque sur les contraintes des paramètres :** Si le `model_patch` possède 4 canaux d'entrée et qu'aucun `mask` n'est fourni, un masque nul est automatiquement créé pour correspondre aux dimensions de l'image. Si le `model_patch` ne possède pas 4 canaux d'entrée, le paramètre `mask` est ignoré et défini sur `None`. + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `MODEL` | Le modèle de diffusion patché avec le patch d'animation appliqué | MODEL | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/fr.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/ja.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ja.md new file mode 100644 index 000000000..9a3f000c0 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ja.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +このノードは、拡散モデルに軽量なアニメーションパッチを適用し、調整可能な強度とタイミングで制御された画像間生成を可能にします。事前設定されたモデルパッチを入力画像とオプションのマスクと統合し、モデルのアテンション層とMLP層を変更して生成プロセスに影響を与えます。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `model` | パッチを適用するベースの拡散モデル | MODEL | はい | | +| `model_patch` | 適用する事前設定済みのアニメーションパッチ | MODEL_PATCH | はい | | +| `image` | 生成をガイドする参照画像 | IMAGE | はい | | +| `strength` | パッチ効果の強度(デフォルト:1.0) | FLOAT | はい | -10.0 ~ 10.0 | +| `start_percent` | パッチが効果を発揮し始めるノイズ除去プロセスの割合(デフォルト:0.0) | FLOAT | はい | 0.0 ~ 1.0 | +| `end_percent` | パッチが効果を停止するノイズ除去プロセスの割合(デフォルト:1.0) | FLOAT | はい | 0.0 ~ 1.0 | +| `mask` | パッチ効果を画像の特定領域に制限するオプションのマスク | MASK | いいえ | | + +**パラメータ制約に関する注意:** `model_patch` が4つの入力チャンネルを持ち、`mask` が提供されていない場合、画像の寸法に合わせてゼロマスクが自動的に作成されます。`model_patch` が4つの入力チャンネルを持たない場合、`mask` パラメータは無視され、`None` に設定されます。 + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `MODEL` | アニメーションパッチが適用されたパッチ済み拡散モデル | MODEL | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/ja.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/ko.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ko.md new file mode 100644 index 000000000..e58b5c37b --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ko.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +이 노드는 확산 모델에 경량 애니메이션 패치를 적용하여, 조정 가능한 강도와 타이밍으로 제어된 이미지 간 생성을 가능하게 합니다. 사전 구성된 모델 패치를 입력 이미지 및 선택적 마스크와 통합하여, 모델의 어텐션 및 MLP 레이어를 수정함으로써 생성 과정에 영향을 줍니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `model` | 패치를 적용할 기본 확산 모델 | MODEL | 예 | | +| `model_patch` | 적용할 사전 구성된 애니메이션 패치 | MODEL_PATCH | 예 | | +| `image` | 생성을 안내할 참조 이미지 | IMAGE | 예 | | +| `strength` | 패치 효과의 강도 (기본값: 1.0) | FLOAT | 예 | -10.0 ~ 10.0 | +| `start_percent` | 패치가 적용되기 시작하는 노이즈 제거 과정의 백분율 (기본값: 0.0) | FLOAT | 예 | 0.0 ~ 1.0 | +| `end_percent` | 패치 적용이 중단되는 노이즈 제거 과정의 백분율 (기본값: 1.0) | FLOAT | 예 | 0.0 ~ 1.0 | +| `mask` | 패치 효과를 이미지의 특정 영역으로 제한하는 선택적 마스크 | MASK | 아니요 | | + +**매개변수 제약 조건 참고:** `model_patch`에 4개의 입력 채널이 있고 `mask`가 제공되지 않은 경우, 이미지 크기에 맞춰 0 마스크가 자동으로 생성됩니다. `model_patch`에 4개의 입력 채널이 없는 경우, `mask` 매개변수는 무시되고 `None`으로 설정됩니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `MODEL` | 애니메이션 패치가 적용된 패치된 확산 모델 | MODEL | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/ko.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/pt-BR.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/pt-BR.md new file mode 100644 index 000000000..a98566819 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/pt-BR.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +Este nó aplica um patch de animação leve a um modelo de difusão, permitindo a geração controlada de imagem para imagem com intensidade e temporização ajustáveis. Ele integra um patch de modelo pré-configurado com uma imagem de entrada e uma máscara opcional, modificando as camadas de atenção e MLP do modelo para influenciar o processo de geração. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|--------------|-------------|-------| +| `model` | O modelo de difusão base no qual aplicar o patch | MODEL | Sim | | +| `model_patch` | O patch de animação pré-configurado a ser aplicado | MODEL_PATCH | Sim | | +| `image` | A imagem de referência para guiar a geração | IMAGE | Sim | | +| `strength` | A intensidade do efeito do patch (padrão: 1.0) | FLOAT | Sim | -10.0 a 10.0 | +| `start_percent` | A porcentagem do processo de remoção de ruído na qual o patch começa a fazer efeito (padrão: 0.0) | FLOAT | Sim | 0.0 a 1.0 | +| `end_percent` | A porcentagem do processo de remoção de ruído na qual o patch para de fazer efeito (padrão: 1.0) | FLOAT | Sim | 0.0 a 1.0 | +| `mask` | Uma máscara opcional para limitar o efeito do patch a áreas específicas da imagem | MASK | Não | | + +**Observação sobre restrições de parâmetros:** Se o `model_patch` tiver 4 canais de entrada e nenhuma `mask` for fornecida, uma máscara zero é criada automaticamente para corresponder às dimensões da imagem. Se o `model_patch` não tiver 4 canais de entrada, o parâmetro `mask` é ignorado e definido como `None`. + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|---------------|-------------|--------------| +| `MODEL` | O modelo de difusão com patch aplicado, contendo o patch de animação | MODEL | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/ru.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ru.md new file mode 100644 index 000000000..bbe2cc91b --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/ru.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +Этот узел применяет легковесный патч анимации к диффузионной модели, обеспечивая управляемую генерацию изображения на основе изображения с регулируемой силой и временем применения. Он интегрирует предварительно настроенный патч модели с входным изображением и опциональной маской, модифицируя слои внимания и MLP модели для влияния на процесс генерации. + +## Входы + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|----------|----------|------------|--------------|----------| +| `model` | Базовая диффузионная модель, к которой применяется патч | MODEL | Да | | +| `model_patch` | Предварительно настроенный патч анимации для применения | MODEL_PATCH | Да | | +| `image` | Эталонное изображение для направления генерации | IMAGE | Да | | +| `strength` | Сила эффекта патча (по умолчанию: 1.0) | FLOAT | Да | -10.0 до 10.0 | +| `start_percent` | Процент процесса шумоподавления, на котором патч начинает действовать (по умолчанию: 0.0) | FLOAT | Да | 0.0 до 1.0 | +| `end_percent` | Процент процесса шумоподавления, на котором патч перестает действовать (по умолчанию: 1.0) | FLOAT | Да | 0.0 до 1.0 | +| `mask` | Опциональная маска для ограничения эффекта патча определенными областями изображения | MASK | Нет | | + +**Примечание об ограничениях параметров:** Если `model_patch` имеет 4 входных канала и `mask` не предоставлена, автоматически создается нулевая маска, соответствующая размерам изображения. Если `model_patch` не имеет 4 входных канала, параметр `mask` игнорируется и устанавливается в `None`. + +## Выходы + +| Имя выхода | Описание | Тип данных | +|------------|----------|------------| +| `MODEL` | Модифицированная диффузионная модель с примененным патчем анимации | MODEL | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/ru.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/tr.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/tr.md new file mode 100644 index 000000000..cf104fd43 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/tr.md @@ -0,0 +1,28 @@ +# AnimaLLLiteApply + +Bu düğüm, bir difüzyon modeline hafif bir animasyon yaması uygulayarak, ayarlanabilir güç ve zamanlama ile kontrollü görüntüden görüntüye üretim sağlar. Önceden yapılandırılmış bir model yamasını, bir giriş görüntüsü ve isteğe bağlı bir maske ile entegre ederek, modelin dikkat ve MLP katmanlarını değiştirir ve üretim sürecini etkiler. + +## Girişler + +| Parametre | Açıklama | Veri Türü | Gerekli | Aralık | +|-----------|-------------|-----------|----------|-------| +| `model` | Yamanın uygulanacağı temel difüzyon modeli | MODEL | Evet | | +| `model_patch` | Uygulanacak önceden yapılandırılmış animasyon yaması | MODEL_PATCH | Evet | | +| `image` | Üretime rehberlik edecek referans görüntü | IMAGE | Evet | | +| `strength` | Yama efektinin gücü (varsayılan: 1.0) | FLOAT | Evet | -10.0 ile 10.0 arası | +| `start_percent` | Yamanın etkisini göstermeye başladığı gürültü giderme sürecinin yüzdesi (varsayılan: 0.0) | FLOAT | Evet | 0.0 ile 1.0 arası | +| `end_percent` | Yamanın etkisini göstermeyi bıraktığı gürültü giderme sürecinin yüzdesi (varsayılan: 1.0) | FLOAT | Evet | 0.0 ile 1.0 arası | +| `mask` | Yama efektini görüntünün belirli alanlarıyla sınırlamak için isteğe bağlı bir maske | MASK | Hayır | | + +**Parametre kısıtlamaları hakkında not:** `model_patch` 4 giriş kanalına sahipse ve `mask` sağlanmamışsa, görüntü boyutlarıyla eşleşecek şekilde otomatik olarak sıfır maskesi oluşturulur. `model_patch` 4 giriş kanalına sahip değilse, `mask` parametresi yok sayılır ve `None` olarak ayarlanır. + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `MODEL` | Animasyon yaması uygulanmış, yamalı difüzyon modeli | MODEL | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/tr.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh-TW.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh-TW.md new file mode 100644 index 000000000..1c8fa4d35 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh-TW.md @@ -0,0 +1,26 @@ +# AnimaLLLiteApply + +此節點對擴散模型應用輕量級動畫修補程式,實現具有可調整強度與時序控制的受控影像生成。它將預先配置的模型修補程式與輸入影像及可選遮罩整合,修改模型的注意力層與 MLP 層以影響生成過程。 + +## 輸入 +| 參數 | 說明 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `model` | 要套用修補程式的基础擴散模型 | MODEL | 是 | | +| `model_patch` | 預先配置的動畫修補程式 | MODEL_PATCH | 是 | | +| `image` | 用於引導生成的參考影像 | IMAGE | 是 | | +| `strength` | 修補程式的效果強度(預設值:1.0) | FLOAT | 是 | -10.0 至 10.0 | +| `start_percent` | 修補程式開始生效的降噪過程百分比(預設值:0.0) | FLOAT | 是 | 0.0 至 1.0 | +| `end_percent` | 修補程式停止生效的降噪過程百分比(預設值:1.0) | FLOAT | 是 | 0.0 至 1.0 | +| `mask` | 可選遮罩,用於將修補程式效果限制在影像的特定區域 | MASK | 否 | | + +**參數限制說明:** 若 `model_patch` 具有 4 個輸入通道且未提供 `mask`,系統會自動建立與影像尺寸相符的零遮罩。若 `model_patch` 不具有 4 個輸入通道,則 `mask` 參數會被忽略並設為 `None`。 + +## 輸出 +| 輸出名稱 | 說明 | 資料類型 | +|-------------|-------------|-----------| +| `MODEL` | 已套用動畫修補程式的修補後擴散模型 | MODEL | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh.md b/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh.md new file mode 100644 index 000000000..4f5192e37 --- /dev/null +++ b/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh.md @@ -0,0 +1,26 @@ +# AnimaLLLiteApply + +此节点对扩散模型应用轻量级动画补丁,通过可调节的强度和时序实现受控的图像到图像生成。它将预配置的模型补丁与输入图像及可选遮罩集成,修改模型的注意力层和 MLP 层以影响生成过程。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `model` | 要应用补丁的基础扩散模型 | MODEL | 是 | | +| `model_patch` | 要应用的预配置动画补丁 | MODEL_PATCH | 是 | | +| `image` | 用于引导生成的参考图像 | IMAGE | 是 | | +| `strength` | 补丁效果的强度(默认值:1.0) | FLOAT | 是 | -10.0 至 10.0 | +| `start_percent` | 补丁开始生效的降噪过程百分比(默认值:0.0) | FLOAT | 是 | 0.0 至 1.0 | +| `end_percent` | 补丁停止生效的降噪过程百分比(默认值:1.0) | FLOAT | 是 | 0.0 至 1.0 | +| `mask` | 可选遮罩,用于将补丁效果限制在图像的特定区域 | MASK | 否 | | + +**参数约束说明:** 如果 `model_patch` 具有 4 个输入通道且未提供 `mask`,则会自动创建一个与图像尺寸匹配的零遮罩。如果 `model_patch` 不具有 4 个输入通道,则 `mask` 参数将被忽略并设置为 `None`。 + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `MODEL` | 已应用动画补丁的扩散模型 | MODEL | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/AnimaLLLiteApply/zh.md) + +--- +**Source fingerprint (SHA-256):** `291dc6a6619faab1c1100110c71c47381addcd80dbaf933dd8025a376bc2bee7` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ar.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ar.md new file mode 100644 index 000000000..2d2083555 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ar.md @@ -0,0 +1,69 @@ +# HeyGenAvatarVideoNode + +## قواعد الترجمة + +1. **المحتوى الذي يجب عدم ترجمته:** + - أسماء المعاملات بين علامات الاقتباس الخلفية: `image`, `seed`, `model` + - أنواع البيانات بالأحرف الكبيرة: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, إلخ + - القيم في عمود Range: الأرقام، "auto"، أسماء الخيارات + - الكود، مسارات الملفات + +2. **المحتوى الذي يجب ترجمته:** + - عناوين الأقسام: ## نظرة عامة, ## المدخلات, ## المخرجات + - جميع النصوص الوصفية والتوضيحية + - أوصاف المعاملات + +3. **جودة الترجمة:** + - استخدام اللغة العربية الفصحى المعاصرة + - الحفاظ على نبرة احترافية ولكن سهلة الفهم + - ضمان الدقة التقنية + - استخدام المصطلحات التقنية العربية القياسية + +4. **التنسيق:** + - الحفاظ على جميع تنسيقات Markdown + - الحفاظ على بنية الجداول + - عدم إضافة أي ملاحظة أو رابط في بداية الوثيقة (سيتم إضافتها تلقائيًا) + +الرجاء ترجمة الوثيقة التالية إلى العربية، دون تضمين الملاحظة الأولية للوثيقة: + +5. **قاعدة حاسمة - أسماء المخرجات:** العمود الأول من جدول المخرجات يحتوي على أسماء مخرجات (مثل `positive`، `negative`، `latent`، `image`، `model`، `conditioning`) التي يجب أن تبقى بالإنجليزية. ترجمة هذه الأسماء يؤدي إلى تكرار الإدخالات وكسر بنية المستند. + +إنشاء فيديو لمقدم عرض متحدث باستخدام صورة رمزية من HeyGen. تنشئ هذه العقدة فيديو لصورة رمزية ذكاء اصطناعي تتحدث بالنص الذي تقدمه أو تقوم بمزامنة الشفاه مع الصوت الخاص بك، باستخدام محركات العرض من HeyGen. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|-----------|-------------|-----------|----------|-------| +| `engine` | محرك العرض؛ كل خيار يعرض فقط الصور الرمزية التي تدعمه. خيار 'auto' يعرض كل الصور الرمزية ويختار أفضل محرك لها (يُفضل Avatar IV). Avatar V هي الأعلى دقة، Avatar III هي الأقل تكلفة. | COMBO | نعم | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | معرف مظهر الصورة الرمزية الاختياري من HeyGen. عند تعيينه، يتجاوز الصورة الرمزية المحددة أعلاه. يمكن استخدام أي من المظاهر العامة البالغ عددها 3000+ من HeyGen (أو صورك الرمزية الخاصة). | STRING | لا | | +| `speech` | تشغيل الصورة الرمزية باستخدام نص برمجي (تحويل النص إلى كلام من HeyGen) أو الصوت الخاص بك. | COMBO | نعم | `"script"`
`"audio"` | +| `resolution` | دقة فيديو الإخراج (الافتراضي: "1080p"). | COMBO | لا | `"720p"`
`"1080p"` | +| `aspect_ratio` | نسبة العرض إلى الارتفاع للإخراج. خيار 'auto' يتبع لقطات المصدر للصورة الرمزية (الافتراضي: "auto"). | COMBO | لا | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | لون خلفية ثابت اختياري كرمز سداسي عشري (مثل '#00ff00'). اتركه فارغًا لاستخدام خلفية الصورة الرمزية الخاصة بها. | STRING | لا | | +| `seed` | لا يتم إرساله إلى HeyGen؛ قم بتغييره لفرض إعادة التشغيل (الافتراضي: 42). | INT | لا | الحد الأدنى: 0
الحد الأقصى: 2147483647 | + +عندما يتم تعيين `speech` إلى `"script"`، تتوفر المعاملات الفرعية التالية: + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|-----------|-------------|-----------|----------|-------| +| `text` | النص الذي ستتحدث به الصورة الرمزية (حتى 5000 حرف). يجب أن يكون الكلام المُنشأ بطول ثانية واحدة على الأقل. | STRING | نعم | | +| `voice` | الصوت المستخدم للنص البرمجي. الخيار الافتراضي يستخدم الصوت الذي خصصته HeyGen للصورة الرمزية. | COMBO | نعم | تتوفر خيارات متعددة | +| `custom_voice_id` | معرف صوت اختياري من HeyGen. عند تعيينه، يتجاوز الصوت المحدد أعلاه. يمكن استخدام أي صوت من مكتبة HeyGen (2000+ صوت). | STRING | لا | | +| `voice_speed` | مضاعف سرعة الكلام (الافتراضي: 1.0). | FLOAT | لا | الحد الأدنى: 0.5
الحد الأقصى: 1.5
الخطوة: 0.05 | + +عندما يتم تعيين `speech` إلى `"audio"`، يتوفر المعامل الفرعي التالي: + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|-----------|-------------|-----------|----------|-------| +| `audio` | الصوت الذي ستقوم الصورة الرمزية بمزامنة الشفاه معه، حتى 10 دقائق. | AUDIO | نعم | | + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|-------------|-------------|-----------| +| `VIDEO` | فيديو المقدم الرمزي المُنشأ. | VIDEO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/en.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/en.md new file mode 100644 index 000000000..c90949349 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/en.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +Generate a talking-presenter video from a HeyGen avatar. This node creates a video of an AI avatar speaking your provided text or lip-syncing to your own audio, using HeyGen's rendering engines. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `engine` | Rendering engine; each choice lists only the avatars that support it. 'auto' offers every avatar and picks its best engine (Avatar IV preferred). Avatar V is highest fidelity, Avatar III is the most affordable. | COMBO | Yes | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | Optional HeyGen avatar look ID. When set, overrides the avatar selected above. Any of HeyGen's 3000+ public looks (or your private avatars) can be used. | STRING | No | | +| `speech` | Drive the avatar with a text script (HeyGen text-to-speech) or your own audio. | COMBO | Yes | `"script"`
`"audio"` | +| `resolution` | Output video resolution (default: "1080p"). | COMBO | No | `"720p"`
`"1080p"` | +| `aspect_ratio` | Output aspect ratio. 'auto' follows the avatar's source footage (default: "auto"). | COMBO | No | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Optional solid background color as a hex code (e.g. '#00ff00'). Leave empty for the avatar's own background. | STRING | No | | +| `seed` | Not sent to HeyGen; change it to force a re-run (default: 42). | INT | No | Min: 0
Max: 2147483647 | + +When `speech` is set to `"script"`, the following sub-parameters are available: + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `text` | Text for the avatar to speak (up to 5000 characters). The generated speech must be at least 1 second long. | STRING | Yes | | +| `voice` | Voice for the script. The default option uses the voice HeyGen assigned to the avatar. | COMBO | Yes | Multiple options available | +| `custom_voice_id` | Optional HeyGen voice ID. When set, overrides the voice selected above. Any voice from HeyGen's library (2000+) can be used. | STRING | No | | +| `voice_speed` | Speech speed multiplier (default: 1.0). | FLOAT | No | Min: 0.5
Max: 1.5
Step: 0.05 | + +When `speech` is set to `"audio"`, the following sub-parameter is available: + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `audio` | Audio for the avatar to lip-sync, up to 10 minutes. | AUDIO | Yes | | + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `VIDEO` | The generated avatar presenter video. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/en.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/es.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/es.md new file mode 100644 index 000000000..d1f466ba0 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/es.md @@ -0,0 +1,71 @@ +# HeyGenAvatarVideoNode + +Eres un experto en traducción técnica especializado en documentación de nodos ComfyUI del inglés al español. + +## Reglas de Traducción + +1. **Contenido que NO debe traducirse:** + - Nombres de parámetros entre comillas invertidas: `image`, `seed`, `model` + - Tipos de datos en MAYÚSCULAS: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, etc. + - Valores en columna Range: números, "auto", nombres de opciones + - Código, rutas de archivos + +2. **Contenido que SÍ debe traducirse:** + - Títulos de secciones: ## Descripción general, ## Entradas, ## Salidas + - Todo el texto descriptivo y explicativo + - Descripciones de parámetros + +3. **Calidad de traducción:** + - Usar español estándar y neutral + - Mantener tono profesional pero accesible + - Asegurar precisión técnica + - Usar terminología técnica estándar en español + +4. **Formato:** + - Mantener todo el formato Markdown + - Preservar estructura de tablas + - No agregar ninguna nota o enlace al inicio del documento (será agregado automáticamente) + +Por favor traduce la siguiente documentación al español, sin incluir la aviso de IA: + +5. **CRÍTICO - Nombres de salida:** La primera columna de la tabla de Salidas contiene nombres de salida (ej. `positive`, `negative`, `latent`, `image`, `model`, `conditioning`) que DEBEN permanecer en inglés. Traducir estos nombres crea entradas duplicadas y rompe la estructura del documento. + +Genera un video de presentador parlante a partir de un avatar de HeyGen. Este nodo crea un video de un avatar de IA que habla el texto proporcionado o sincroniza los labios con tu propio audio, utilizando los motores de renderizado de HeyGen. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|--------------|-------------|-------| +| `engine` | Motor de renderizado; cada opción muestra solo los avatares que lo soportan. 'auto' ofrece todos los avatares y selecciona su mejor motor (Avatar IV preferido). Avatar V es la máxima fidelidad, Avatar III es el más económico. | COMBO | Sí | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | ID opcional de apariencia de avatar de HeyGen. Cuando se establece, anula el avatar seleccionado anteriormente. Se puede usar cualquiera de las más de 3000 apariencias públicas de HeyGen (o tus avatares privados). | STRING | No | | +| `speech` | Controla el avatar con un guion de texto (texto a voz de HeyGen) o con tu propio audio. | COMBO | Sí | `"script"`
`"audio"` | +| `resolution` | Resolución del video de salida (predeterminado: "1080p"). | COMBO | No | `"720p"`
`"1080p"` | +| `aspect_ratio` | Relación de aspecto de salida. 'auto' sigue el metraje original del avatar (predeterminado: "auto"). | COMBO | No | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Color de fondo sólido opcional como código hexadecimal (ej. '#00ff00'). Déjalo vacío para usar el fondo propio del avatar. | STRING | No | | +| `seed` | No se envía a HeyGen; cámbialo para forzar una nueva ejecución (predeterminado: 42). | INT | No | Mín: 0
Máx: 2147483647 | + +Cuando `speech` está configurado como `"script"`, están disponibles los siguientes subparámetros: + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|--------------|-------------|-------| +| `text` | Texto que debe hablar el avatar (hasta 5000 caracteres). El discurso generado debe tener al menos 1 segundo de duración. | STRING | Sí | | +| `voice` | Voz para el guion. La opción predeterminada usa la voz que HeyGen asignó al avatar. | COMBO | Sí | Múltiples opciones disponibles | +| `custom_voice_id` | ID de voz opcional de HeyGen. Cuando se establece, anula la voz seleccionada anteriormente. Se puede usar cualquier voz de la biblioteca de HeyGen (más de 2000). | STRING | No | | +| `voice_speed` | Multiplicador de velocidad del habla (predeterminado: 1.0). | FLOAT | No | Mín: 0.5
Máx: 1.5
Paso: 0.05 | + +Cuando `speech` está configurado como `"audio"`, está disponible el siguiente subparámetro: + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|--------------|-------------|-------| +| `audio` | Audio para que el avatar sincronice los labios, hasta 10 minutos. | AUDIO | Sí | | + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `VIDEO` | El video de presentador avatar generado. | VIDEO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/es.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fa.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fa.md new file mode 100644 index 000000000..dab05912d --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fa.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +ویدئوی ارائه‌دهنده سخنگو با آواتار HeyGen. این گره یک ویدئو از آواتار هوش مصنوعی می‌سازد که متن ارائه‌شده را می‌گوید یا با صدای شما هم‌لب می‌شود، با استفاده از موتورهای رندرینگ HeyGen. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | ضروری | محدوده | +|---------|---------|----------|-------|--------| +| `engine` | موتور رندرینگ؛ هر گزینه فقط آواتارهایی را فهرست می‌کند که از آن پشتیبانی می‌کنند. گزینه 'auto' همه آواتارها را ارائه می‌دهد و بهترین موتور آن‌ها را انتخاب می‌کند (ترجیحاً Avatar IV). Avatar V بالاترین کیفیت را دارد و Avatar III مقرون‌به‌صرفه‌ترین است. | COMBO | بله | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | شناسه ظاهری آواتار HeyGen (اختیاری). در صورت تنظیم، آواتار انتخاب‌شده در بالا را نادیده می‌گیرد. می‌توان از هر یک از بیش از 3000 ظاهر عمومی HeyGen (یا آواتارهای خصوصی شما) استفاده کرد. | STRING | خیر | | +| `speech` | آواتار را با یک متن اسکریپت (متن‌به‌گفتار HeyGen) یا صدای خودتان هدایت کنید. | COMBO | بله | `"script"`
`"audio"` | +| `resolution` | وضوح ویدئوی خروجی (پیش‌فرض: "1080p"). | COMBO | خیر | `"720p"`
`"1080p"` | +| `aspect_ratio` | نسبت ابعاد خروجی. گزینه 'auto' از فیلم منبع آواتار پیروی می‌کند (پیش‌فرض: "auto"). | COMBO | خیر | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | رنگ پس‌زمینه ثابت به صورت کد هگزادسیمال (مثلاً '#00ff00') (اختیاری). برای استفاده از پس‌زمینه خود آواتار خالی بگذارید. | STRING | خیر | | +| `seed` | به HeyGen ارسال نمی‌شود؛ آن را تغییر دهید تا اجرای مجدد اجباری شود (پیش‌فرض: 42). | INT | خیر | حداقل: 0
حداکثر: 2147483647 | + +وقتی `speech` روی `"script"` تنظیم شود، پارامترهای فرعی زیر در دسترس هستند: + +| پارامتر | توضیحات | نوع داده | ضروری | محدوده | +|---------|---------|----------|-------|--------| +| `text` | متنی که آواتار باید بگوید (تا 5000 کاراکتر). گفتار تولیدشده باید حداقل 1 ثانیه طول داشته باشد. | STRING | بله | | +| `voice` | صدا برای اسکریپت. گزینه پیش‌فرض از صدایی استفاده می‌کند که HeyGen به آواتار اختصاص داده است. | COMBO | بله | گزینه‌های متعدد موجود است | +| `custom_voice_id` | شناسه صدای HeyGen (اختیاری). در صورت تنظیم، صدای انتخاب‌شده در بالا را نادیده می‌گیرد. می‌توان از هر صدایی از کتابخانه HeyGen (بیش از 2000 صدا) استفاده کرد. | STRING | خیر | | +| `voice_speed` | ضریب سرعت گفتار (پیش‌فرض: 1.0). | FLOAT | خیر | حداقل: 0.5
حداکثر: 1.5
گام: 0.05 | + +وقتی `speech` روی `"audio"` تنظیم شود، پارامتر فرعی زیر در دسترس است: + +| پارامتر | توضیحات | نوع داده | ضروری | محدوده | +|---------|---------|----------|-------|--------| +| `audio` | صدا برای هم‌لب شدن آواتار، تا 10 دقیقه. | AUDIO | بله | | + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `VIDEO` | ویدئوی ارائه‌دهنده آواتار تولیدشده. | VIDEO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fr.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fr.md new file mode 100644 index 000000000..1c4778d46 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fr.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +Générer une vidéo de présentateur parlant à partir d'un avatar HeyGen. Ce nœud crée une vidéo d'un avatar IA récitant le texte que vous fournissez ou synchronisant les lèvres sur votre propre audio, en utilisant les moteurs de rendu de HeyGen. + +## Entrées + +| Paramètre | Description | Type de Données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `engine` | Moteur de rendu ; chaque choix liste uniquement les avatars qui le prennent en charge. 'auto' propose tous les avatars et sélectionne son meilleur moteur (Avatar IV privilégié). Avatar V offre la plus haute fidélité, Avatar III est le plus abordable. | COMBO | Oui | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | Identifiant optionnel d'apparence d'avatar HeyGen. Lorsqu'il est défini, il remplace l'avatar sélectionné ci-dessus. N'importe laquelle des 3000+ apparences publiques de HeyGen (ou vos avatars privés) peut être utilisée. | STRING | Non | | +| `speech` | Pilote l'avatar avec un script textuel (synthèse vocale HeyGen) ou votre propre audio. | COMBO | Oui | `"script"`
`"audio"` | +| `resolution` | Résolution de la vidéo de sortie (par défaut : "1080p"). | COMBO | Non | `"720p"`
`"1080p"` | +| `aspect_ratio` | Format d'image de sortie. 'auto' suit le format de la source de l'avatar (par défaut : "auto"). | COMBO | Non | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Couleur de fond unie optionnelle sous forme de code hexadécimal (ex. '#00ff00'). Laissez vide pour conserver le fond d'origine de l'avatar. | STRING | Non | | +| `seed` | N'est pas envoyé à HeyGen ; modifiez-le pour forcer une nouvelle exécution (par défaut : 42). | INT | Non | Min : 0
Max : 2147483647 | + +Lorsque `speech` est réglé sur `"script"`, les sous-paramètres suivants sont disponibles : + +| Paramètre | Description | Type de Données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `text` | Texte que l'avatar doit prononcer (jusqu'à 5000 caractères). La parole générée doit durer au moins 1 seconde. | STRING | Oui | | +| `voice` | Voix pour le script. L'option par défaut utilise la voix que HeyGen a attribuée à l'avatar. | COMBO | Oui | Plusieurs options disponibles | +| `custom_voice_id` | Identifiant vocal HeyGen optionnel. Lorsqu'il est défini, il remplace la voix sélectionnée ci-dessus. N'importe quelle voix de la bibliothèque HeyGen (2000+) peut être utilisée. | STRING | Non | | +| `voice_speed` | Multiplicateur de vitesse de parole (par défaut : 1.0). | FLOAT | Non | Min : 0.5
Max : 1.5
Pas : 0.05 | + +Lorsque `speech` est réglé sur `"audio"`, le sous-paramètre suivant est disponible : + +| Paramètre | Description | Type de Données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `audio` | Audio pour la synchronisation labiale de l'avatar, jusqu'à 10 minutes. | AUDIO | Oui | | + +## Sorties + +| Nom de Sortie | Description | Type de Données | +|---------------|-------------|-----------------| +| `VIDEO` | La vidéo générée du présentateur avatar. | VIDEO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ja.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ja.md new file mode 100644 index 000000000..392021106 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ja.md @@ -0,0 +1,71 @@ +# HeyGenAvatarVideoNode + +あなたは ComfyUI ノードドキュメントを英語から日本語に翻訳する技術翻訳の専門家です。 + +## 翻訳ルール + +1. **翻訳してはいけない内容:** + - バッククォートで囲まれたパラメータ名:`image`、`seed`、`model` + - 大文字のデータ型:IMAGE、STRING、INT、FLOAT、MODEL、CONDITIONING など + - Range列の値:数値、"auto"、オプション名 + - コード、ファイルパス + +2. **翻訳する内容:** + - セクション見出し:## 概要、## 入力、## 出力 + - すべての説明文 + - パラメータの説明 + +3. **翻訳品質:** + - 丁寧語(です・ます体)を使用 + - 専門的でありながらわかりやすい表現 + - 技術的な正確性を保つ + - 標準的な日本語技術用語を使用 + +4. **フォーマット:** + - すべての Markdown フォーマットを保持 + - 表の構造を維持 + - 免責事項は追加しないでください(システムが文書末尾に自動追加します) + +以下の英語ドキュメントを日本語に翻訳してください(免責事項は含めないでください): + +5. **重要ルール - 出力名:** 出力テーブルの最初の列には出力名(例:`positive`、`negative`、`latent`、`image`、`model`、`conditioning`)が含まれています。これらは**英語のままにしてください**。出力名を翻訳すると重複エントリが発生し、文書構造が壊れます。 + +HeyGenのアバターを使用して、トーキングプレゼンタービデオを生成します。このノードは、HeyGenのレンダリングエンジンを使用して、提供されたテキストを話すAIアバターのビデオ、またはご自身のオーディオにリップシンクするビデオを作成します。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `engine` | レンダリングエンジン。各選択肢は、それをサポートするアバターのみをリスト表示します。'auto' はすべてのアバターを提供し、最適なエンジンを選択します(Avatar IV 優先)。Avatar V は最高忠実度、Avatar III は最も低コストです。 | COMBO | はい | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | オプションのHeyGenアバタールックID。設定すると、上記で選択したアバターを上書きします。HeyGenの3000以上の公開ルック(またはプライベートアバター)を使用できます。 | STRING | いいえ | | +| `speech` | テキストスクリプト(HeyGenテキスト読み上げ)またはご自身のオーディオでアバターを駆動します。 | COMBO | はい | `"script"`
`"audio"` | +| `resolution` | 出力ビデオの解像度(デフォルト:"1080p")。 | COMBO | いいえ | `"720p"`
`"1080p"` | +| `aspect_ratio` | 出力のアスペクト比。'auto' はアバターのソース映像に従います(デフォルト:"auto")。 | COMBO | いいえ | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | オプションの単色背景色(16進数コード例:'#00ff00')。アバターの元の背景を使用する場合は空欄にします。 | STRING | いいえ | | +| `seed` | HeyGenには送信されません。値を変更して再実行を強制します(デフォルト:42)。 | INT | いいえ | 最小: 0
最大: 2147483647 | + +`s speech` が `"script"` に設定されている場合、以下のサブパラメータが利用可能です: + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `text` | アバターに話させるテキスト(最大5000文字)。生成される音声は少なくとも1秒以上である必要があります。 | STRING | はい | | +| `voice` | スクリプト用の音声。デフォルトオプションは、HeyGenがアバターに割り当てた音声を使用します。 | COMBO | はい | 複数のオプションが利用可能 | +| `custom_voice_id` | オプションのHeyGen音声ID。設定すると、上記で選択した音声を上書きします。HeyGenのライブラリ(2000以上)の任意の音声を使用できます。 | STRING | いいえ | | +| `voice_speed` | 音声速度の倍率(デフォルト:1.0)。 | FLOAT | いいえ | 最小: 0.5
最大: 1.5
ステップ: 0.05 | + +`s speech` が `"audio"` に設定されている場合、以下のサブパラメータが利用可能です: + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `audio` | アバターがリップシンクするためのオーディオ(最大10分)。 | AUDIO | はい | | + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `VIDEO` | 生成されたアバタープレゼンタービデオ。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ko.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ko.md new file mode 100644 index 000000000..68906fa2a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ko.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +HeyGen 아바타로 말하는 프레젠터 동영상을 생성합니다. 이 노드는 HeyGen의 렌더링 엔진을 사용하여 제공된 텍스트를 말하는 AI 아바타 동영상이나 사용자 오디오에 립싱크하는 동영상을 만듭니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +|---------|------|-----------|------|------| +| `engine` | 렌더링 엔진입니다. 각 선택지는 이를 지원하는 아바타만 표시합니다. 'auto'는 모든 아바타를 제공하고 가장 적합한 엔진을 선택합니다(Avatar IV 선호). Avatar V는 가장 높은 충실도를 제공하며, Avatar III는 가장 경제적입니다. | COMBO | 예 | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | 선택적 HeyGen 아바타 룩 ID입니다. 설정 시 위에서 선택한 아바타를 재정의합니다. HeyGen의 3000개 이상 공개 룩(또는 개인 아바타)을 사용할 수 있습니다. | STRING | 아니요 | | +| `speech` | 텍스트 스크립트(HeyGen 텍스트 음성 변환) 또는 사용자 오디오로 아바타를 구동합니다. | COMBO | 예 | `"script"`
`"audio"` | +| `resolution` | 출력 동영상 해상도입니다(기본값: "1080p"). | COMBO | 아니요 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 출력 화면 비율입니다. 'auto'는 아바타의 원본 영상을 따릅니다(기본값: "auto"). | COMBO | 아니요 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | 선택적 단색 배경색으로 16진수 코드입니다(예: '#00ff00'). 아바타 자체 배경을 사용하려면 비워 둡니다. | STRING | 아니요 | | +| `seed` | HeyGen으로 전송되지 않습니다. 변경하여 재실행을 강제합니다(기본값: 42). | INT | 아니요 | 최소: 0
최대: 2147483647 | + +`speech`가 `"script"`로 설정된 경우 다음 하위 매개변수를 사용할 수 있습니다: + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +|---------|------|-----------|------|------| +| `text` | 아바타가 말할 텍스트입니다(최대 5000자). 생성된 음성은 최소 1초 이상이어야 합니다. | STRING | 예 | | +| `voice` | 스크립트의 음성입니다. 기본 옵션은 HeyGen이 아바타에 할당한 음성을 사용합니다. | COMBO | 예 | 여러 옵션 사용 가능 | +| `custom_voice_id` | 선택적 HeyGen 음성 ID입니다. 설정 시 위에서 선택한 음성을 재정의합니다. HeyGen 라이브러리(2000개 이상)의 모든 음성을 사용할 수 있습니다. | STRING | 아니요 | | +| `voice_speed` | 음성 속도 배수입니다(기본값: 1.0). | FLOAT | 아니요 | 최소: 0.5
최대: 1.5
단계: 0.05 | + +`speech`가 `"audio"`로 설정된 경우 다음 하위 매개변수를 사용할 수 있습니다: + +| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 | +|---------|------|-----------|------|------| +| `audio` | 아바타가 립싱크할 오디오입니다(최대 10분). | AUDIO | 예 | | + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|----------|------|-----------| +| `VIDEO` | 생성된 아바타 프레젠터 동영상입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/pt-BR.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/pt-BR.md new file mode 100644 index 000000000..7f11771a5 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/pt-BR.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +Gere um vídeo de apresentador falante a partir de um avatar HeyGen. Este nó cria um vídeo de um avatar de IA falando o texto fornecido ou sincronizando os lábios com seu próprio áudio, usando os mecanismos de renderização da HeyGen. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|--------------|-------------|-------| +| `engine` | Mecanismo de renderização; cada opção lista apenas os avatares que o suportam. 'auto' oferece todos os avatares e escolhe seu melhor mecanismo (Avatar IV preferido). Avatar V é o de maior fidelidade, Avatar III é o mais acessível. | COMBO | Sim | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | ID opcional de aparência do avatar HeyGen. Quando definido, substitui o avatar selecionado acima. Qualquer uma das mais de 3000 aparências públicas da HeyGen (ou seus avatares privados) pode ser usada. | STRING | Não | | +| `speech` | Controla o avatar com um roteiro de texto (texto-para-fala da HeyGen) ou seu próprio áudio. | COMBO | Sim | `"script"`
`"audio"` | +| `resolution` | Resolução do vídeo de saída (padrão: "1080p"). | COMBO | Não | `"720p"`
`"1080p"` | +| `aspect_ratio` | Proporção de tela da saída. 'auto' segue a filmagem de origem do avatar (padrão: "auto"). | COMBO | Não | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Cor de fundo sólida opcional como código hexadecimal (ex: '#00ff00'). Deixe vazio para usar o fundo original do avatar. | STRING | Não | | +| `seed` | Não é enviado para a HeyGen; altere-o para forçar uma nova execução (padrão: 42). | INT | Não | Mín: 0
Máx: 2147483647 | + +Quando `speech` está definido como `"script"`, os seguintes subparâmetros estão disponíveis: + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|--------------|-------------|-------| +| `text` | Texto para o avatar falar (até 5000 caracteres). A fala gerada deve ter pelo menos 1 segundo de duração. | STRING | Sim | | +| `voice` | Voz para o roteiro. A opção padrão usa a voz que a HeyGen atribuiu ao avatar. | COMBO | Sim | Múltiplas opções disponíveis | +| `custom_voice_id` | ID opcional de voz HeyGen. Quando definido, substitui a voz selecionada acima. Qualquer voz da biblioteca da HeyGen (mais de 2000) pode ser usada. | STRING | Não | | +| `voice_speed` | Multiplicador de velocidade da fala (padrão: 1.0). | FLOAT | Não | Mín: 0.5
Máx: 1.5
Passo: 0.05 | + +Quando `speech` está definido como `"audio"`, o seguinte subparâmetro está disponível: + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|--------------|-------------|-------| +| `audio` | Áudio para o avatar sincronizar os lábios, com até 10 minutos de duração. | AUDIO | Sim | | + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|---------------|-----------|--------------| +| `VIDEO` | O vídeo do apresentador avatar gerado. | VIDEO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ru.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ru.md new file mode 100644 index 000000000..c8230bbf2 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ru.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +Создайте видео с ведущим-аватаром из HeyGen. Этот узел создает видео с AI-аватаром, произносящим ваш текст или синхронизирующим губы с вашей аудиодорожкой, используя рендеринговые движки HeyGen. + +## Входы + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `engine` | Движок рендеринга; каждый вариант отображает только те аватары, которые его поддерживают. 'auto' предлагает всех аватаров и выбирает для них лучший движок (предпочтительно Avatar IV). Avatar V — наивысшее качество, Avatar III — самый доступный. | COMBO | Да | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | Необязательный идентификатор внешности аватара HeyGen. Если задан, переопределяет аватара, выбранного выше. Можно использовать любую из 3000+ публичных внешностей HeyGen (или ваших приватных аватаров). | STRING | Нет | | +| `speech` | Управление аватаром с помощью текстового сценария (HeyGen text-to-speech) или собственной аудиодорожки. | COMBO | Да | `"script"`
`"audio"` | +| `resolution` | Разрешение выходного видео (по умолчанию: "1080p"). | COMBO | Нет | `"720p"`
`"1080p"` | +| `aspect_ratio` | Соотношение сторон выходного видео. 'auto' соответствует исходному видео аватара (по умолчанию: "auto"). | COMBO | Нет | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Необязательный сплошной цвет фона в виде шестнадцатеричного кода (например, '#00ff00'). Оставьте пустым для использования собственного фона аватара. | STRING | Нет | | +| `seed` | Не отправляется в HeyGen; измените его, чтобы принудительно перезапустить (по умолчанию: 42). | INT | Нет | Мин: 0
Макс: 2147483647 | + +Когда `speech` установлен в `"script"`, доступны следующие подпараметры: + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `text` | Текст для произнесения аватаром (до 5000 символов). Сгенерированная речь должна быть длиной не менее 1 секунды. | STRING | Да | | +| `voice` | Голос для сценария. Вариант по умолчанию использует голос, назначенный аватару в HeyGen. | COMBO | Да | Доступно несколько вариантов | +| `custom_voice_id` | Необязательный идентификатор голоса HeyGen. Если задан, переопределяет голос, выбранный выше. Можно использовать любой голос из библиотеки HeyGen (2000+). | STRING | Нет | | +| `voice_speed` | Множитель скорости речи (по умолчанию: 1.0). | FLOAT | Нет | Мин: 0.5
Макс: 1.5
Шаг: 0.05 | + +Когда `speech` установлен в `"audio"`, доступен следующий подпараметр: + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `audio` | Аудиодорожка для синхронизации губ аватара, длительностью до 10 минут. | AUDIO | Да | | + +## Выходы + +| Имя выхода | Описание | Тип данных | +|-------------|-------------|-----------| +| `VIDEO` | Сгенерированное видео с ведущим-аватаром. | VIDEO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/tr.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/tr.md new file mode 100644 index 000000000..2eeb521df --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/tr.md @@ -0,0 +1,41 @@ +# HeyGenAvatarVideoNode + +Bir HeyGen avatarından konuşan sunucu videosu oluşturun. Bu düğüm, HeyGen'in işleme motorlarını kullanarak, sağladığınız metni okuyan veya kendi sesinize dudak senkronizasyonu yapan bir yapay zeka avatar videosu oluşturur. + +## Girişler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `engine` | İşleme motoru; her seçenek yalnızca onu destekleyen avatarları listeler. 'auto' tüm avatarları sunar ve bunlar için en iyi motoru seçer (Avatar IV tercih edilir). Avatar V en yüksek kalitedir, Avatar III ise en uygun fiyatlıdır. | COMBO | Evet | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | İsteğe bağlı HeyGen avatar görünüm kimliği. Ayarlandığında, yukarıda seçilen avatarı geçersiz kılar. HeyGen'in 3000'den fazla herkese açık görünümünden (veya özel avatarlarınızdan) herhangi biri kullanılabilir. | STRING | Hayır | | +| `speech` | Avatara bir metin komut dosyası (HeyGen metinden sese) veya kendi sesinizle yön verin. | COMBO | Evet | `"script"`
`"audio"` | +| `resolution` | Çıktı video çözünürlüğü (varsayılan: "1080p"). | COMBO | Hayır | `"720p"`
`"1080p"` | +| `aspect_ratio` | Çıktı en boy oranı. 'auto', avatarın kaynak görüntüsünü takip eder (varsayılan: "auto"). | COMBO | Hayır | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | Onaltılık kod olarak isteğe bağlı düz arka plan rengi (örn. '#00ff00'). Avatarın kendi arka planı için boş bırakın. | STRING | Hayır | | +| `seed` | HeyGen'e gönderilmez; yeniden çalıştırmayı zorlamak için değiştirin (varsayılan: 42). | INT | Hayır | Min: 0
Maks: 2147483647 | + +`speech` parametresi `"script"` olarak ayarlandığında, aşağıdaki alt parametreler kullanılabilir: + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `text` | Avatarın konuşması için metin (en fazla 5000 karakter). Oluşturulan konuşma en az 1 saniye uzunluğunda olmalıdır. | STRING | Evet | | +| `voice` | Komut dosyası için ses. Varsayılan seçenek, HeyGen'in avatara atadığı sesi kullanır. | COMBO | Evet | Birden çok seçenek mevcut | +| `custom_voice_id` | İsteğe bağlı HeyGen ses kimliği. Ayarlanırsa, yukarıda seçilen sesi geçersiz kılar. HeyGen'in kütüphanesindeki (2000'den fazla) herhangi bir ses kullanılabilir. | STRING | Hayır | | +| `voice_speed` | Konuşma hızı çarpanı (varsayılan: 1.0). | FLOAT | Hayır | Min: 0.5
Maks: 1.5
Adım: 0.05 | + +`speech` parametresi `"audio"` olarak ayarlandığında, aşağıdaki alt parametre kullanılabilir: + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `audio` | Avatarın dudak senkronizasyonu yapacağı, en fazla 10 dakikalık ses. | AUDIO | Evet | | + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `VIDEO` | Oluşturulan avatar sunucu videosu. | VIDEO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh-TW.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh-TW.md new file mode 100644 index 000000000..e73f589dc --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh-TW.md @@ -0,0 +1,39 @@ +# HeyGenAvatarVideoNode + +此節點使用 HeyGen 的渲染引擎,建立一個 AI 虛擬角色朗讀您提供的文字,或與您自己的音訊進行嘴型同步的影片。 + +## 輸入 +| 參數 | 說明 | 資料類型 | 必填 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `engine` | 渲染引擎;每個選項僅列出支援該引擎的虛擬角色。'auto' 提供所有虛擬角色並選取最佳引擎(優先使用 Avatar IV)。Avatar V 為最高保真度,Avatar III 為最經濟實惠的選項。 | COMBO | 是 | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | 可選的 HeyGen 虛擬角色外觀 ID。設定後將覆蓋上方選取的虛擬角色。可使用 HeyGen 超過 3000 個公開外觀(或您的私人虛擬角色)中的任何一個。 | STRING | 否 | | +| `speech` | 使用文字腳本(HeyGen 文字轉語音)或您自己的音訊來驅動虛擬角色。 | COMBO | 是 | `"script"`
`"audio"` | +| `resolution` | 輸出影片解析度(預設:"1080p")。 | COMBO | 否 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 輸出影片長寬比。'auto' 跟隨虛擬角色的原始素材(預設:"auto")。 | COMBO | 否 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | 可選的純色背景,以十六進位色碼表示(例如 '#00ff00')。留空則使用虛擬角色自身的背景。 | STRING | 否 | | +| `seed` | 不會發送至 HeyGen;變更此值可強制重新執行(預設:42)。 | INT | 否 | 最小值:0
最大值:2147483647 | + +當 `speech` 設定為 `"script"` 時,可使用以下子參數: + +| 參數 | 說明 | 資料類型 | 必填 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `text` | 虛擬角色要朗讀的文字(最多 5000 個字元)。生成的語音長度必須至少 1 秒。 | STRING | 是 | | +| `voice` | 腳本使用的語音。預設選項使用 HeyGen 分配給虛擬角色的語音。 | COMBO | 是 | 多個選項可用 | +| `custom_voice_id` | 可選的 HeyGen 語音 ID。設定後將覆蓋上方選取的語音。可使用 HeyGen 語音庫(超過 2000 種)中的任何一種語音。 | STRING | 否 | | +| `voice_speed` | 語音速度倍率(預設:1.0)。 | FLOAT | 否 | 最小值:0.5
最大值:1.5
步進:0.05 | + +當 `speech` 設定為 `"audio"` 時,可使用以下子參數: + +| 參數 | 說明 | 資料類型 | 必填 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `audio` | 虛擬角色進行嘴型同步的音訊,最長 10 分鐘。 | AUDIO | 是 | | + +## 輸出 +| 輸出名稱 | 說明 | 資料類型 | +|-------------|-------------|-----------| +| `VIDEO` | 生成的虛擬角色主持人影片。 | VIDEO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh.md b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh.md new file mode 100644 index 000000000..e7f6fd4fd --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh.md @@ -0,0 +1,39 @@ +# HeyGenAvatarVideoNode + +根据 HeyGen 虚拟形象生成一段主播式讲话视频。此节点利用 HeyGen 的渲染引擎,创建 AI 虚拟形象朗读您提供的文本或根据您自己的音频进行口型同步的视频。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `engine` | 渲染引擎;每个选项仅列出支持该引擎的虚拟形象。'auto' 会提供所有虚拟形象并为其选择最佳引擎(优先选择 Avatar IV)。Avatar V 保真度最高,Avatar III 性价比最高。 | COMBO | 是 | `"auto"`
`"avatar_iv"`
`"avatar_iii"`
`"avatar_v"` | +| `custom_avatar_id` | 可选的 HeyGen 虚拟形象外观 ID。设置后,将覆盖上方选择的虚拟形象。可以使用 HeyGen 的 3000 多个公共外观(或您的私人虚拟形象)中的任意一个。 | STRING | 否 | | +| `speech` | 通过文本脚本(HeyGen 文本转语音)或您自己的音频来驱动虚拟形象。 | COMBO | 是 | `"script"`
`"audio"` | +| `resolution` | 输出视频分辨率(默认值:"1080p")。 | COMBO | 否 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 输出宽高比。'auto' 跟随虚拟形象的源素材(默认值:"auto")。 | COMBO | 否 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `background_color` | 可选的纯色背景色,使用十六进制代码(例如 '#00ff00')。留空则使用虚拟形象自身的背景。 | STRING | 否 | | +| `seed` | 不会发送给 HeyGen;更改此值可强制重新运行(默认值:42)。 | INT | 否 | 最小值:0
最大值:2147483647 | + +当 `speech` 设置为 `"script"` 时,可使用以下子参数: + +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `text` | 虚拟形象要朗读的文本(最多 5000 个字符)。生成的语音时长至少为 1 秒。 | STRING | 是 | | +| `voice` | 脚本使用的语音。默认选项使用 HeyGen 分配给该虚拟形象的语音。 | COMBO | 是 | 提供多个选项 | +| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后,将覆盖上方选择的语音。可以使用 HeyGen 语音库(2000+)中的任意语音。 | STRING | 否 | | +| `voice_speed` | 语速倍数(默认值:1.0)。 | FLOAT | 否 | 最小值:0.5
最大值:1.5
步长:0.05 | + +当 `speech` 设置为 `"audio"` 时,可使用以下子参数: + +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `audio` | 用于虚拟形象进行口型同步的音频,最长 10 分钟。 | AUDIO | 是 | | + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `VIDEO` | 生成的虚拟形象主播视频。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenAvatarVideoNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `009bc72b841ca273af83fe6f80fb24d4b11c2efd96c011795b1ff1cf8e66ee61` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ar.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ar.md new file mode 100644 index 000000000..0da3225bc --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ar.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +أنشئ صورة رمزية (أفاتار) قابلة لإعادة الاستخدام من HeyGen باستخدام صورة شخص أو من خلال وصف نصي لشخصية لتوليدها. يمكن استخدام معرف الصورة الرمزية الناتج مع عقدة فيديو الصورة الرمزية من HeyGen لإنشاء مقاطع فيديو تعرض هذه الصورة الرمزية. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|---------|--------| +| `source` | توليد شخصية جديدة من وصف نصي، أو إنشاء الصورة الرمزية من صورة متصلة لشخص. | COMBO | نعم | `"prompt"`
`"photo"` | + +عند تعيين `source` إلى `"prompt"`، تصبح المعاملات الإضافية التالية متاحة: + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|---------|--------| +| `prompt` | وصف الصورة الرمزية المراد توليدها (حتى 1000 حرف). | STRING | نعم | من 1 إلى 1000 حرف | +| `reference_images` | ما يصل إلى 3 صور مرجعية لتوجيه الشكل المُنشأ. | IMAGE | لا | من 0 إلى 3 صور | + +عند تعيين `source` إلى `"photo"`، يصبح المعامل الإضافي التالي متاحًا: + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|---------|--------| +| `identity_photo` | صورة الشخص المراد تحويله إلى صورة رمزية. يتم تصغيرها تلقائيًا إذا كانت أكبر من 2K. | IMAGE | نعم | صورة واحدة | + +**ملاحظة:** يقوم معامل `source` بالتبديل بين وضعين. في وضع `"prompt"`، تقدم وصفًا نصيًا واختياريًا ما يصل إلى 3 صور مرجعية. في وضع `"photo"`، تقدم صورة واحدة لشخص. هذان الوضعان متنافيان. + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|---------------| +| `avatar_id` | معرف شكل الصورة الرمزية. مرره إلى `custom_avatar_id` في عقدة فيديو الصورة الرمزية من HeyGen؛ واحفظه لإعادة استخدام الصورة الرمزية لاحقًا. | STRING | +| `preview` | صورة معاينة للصورة الرمزية المُنشأة. | IMAGE | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/en.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/en.md new file mode 100644 index 000000000..4e87e99cc --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/en.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Create a reusable HeyGen avatar from a photo of a person or from a text prompt that describes a character to generate. The resulting avatar ID can be used with the HeyGen Avatar Video node to create videos featuring this avatar. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `source` | Generate a new character from a text prompt, or create the avatar from a connected photo of a person. | COMBO | Yes | `"prompt"`
`"photo"` | + +When `source` is set to `"prompt"`, the following additional parameters become available: + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `prompt` | Description of the avatar to generate (up to 1000 characters). | STRING | Yes | 1 to 1000 characters | +| `reference_images` | Up to 3 reference images guiding the generated look. | IMAGE | No | 0 to 3 images | + +When `source` is set to `"photo"`, the following additional parameter becomes available: + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | Photo of the person to turn into an avatar. Downscaled automatically if larger than 2K. | IMAGE | Yes | Single image | + +**Note:** The `source` parameter switches between two modes. In `"prompt"` mode, you provide a text description and optionally up to 3 reference images. In `"photo"` mode, you provide a single photo of a person. These modes are mutually exclusive. + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `avatar_id` | Avatar look ID. Pass it to HeyGen Avatar Video's `custom_avatar_id`; save it to reuse the avatar later. | STRING | +| `preview` | Preview image of the generated avatar. | IMAGE | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/en.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/es.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/es.md new file mode 100644 index 000000000..6c615413c --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/es.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Crea un avatar reutilizable de HeyGen a partir de una foto de una persona o de una instrucción de texto que describa un personaje para generar. El ID del avatar resultante se puede usar con el nodo Video de Avatar de HeyGen para crear videos con este avatar. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|-----------|----------|-------| +| `source` | Genera un nuevo personaje a partir de una instrucción de texto, o crea el avatar desde una foto conectada de una persona. | COMBO | Sí | `"prompt"`
`"photo"` | + +Cuando `source` está configurado en `"prompt"`, los siguientes parámetros adicionales están disponibles: + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|-----------|----------|-------| +| `prompt` | Descripción del avatar a generar (hasta 1000 caracteres). | STRING | Sí | 1 a 1000 caracteres | +| `reference_images` | Hasta 3 imágenes de referencia que guían la apariencia generada. | IMAGE | No | 0 a 3 imágenes | + +Cuando `source` está configurado en `"photo"`, el siguiente parámetro adicional está disponible: + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | Foto de la persona para convertir en avatar. Se reduce automáticamente si es mayor a 2K. | IMAGE | Sí | Imagen única | + +**Nota:** El parámetro `source` cambia entre dos modos. En el modo `"prompt"`, proporcionas una descripción de texto y opcionalmente hasta 3 imágenes de referencia. En el modo `"photo"`, proporcionas una sola foto de una persona. Estos modos son mutuamente excluyentes. + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|-------------|-------------|-----------| +| `avatar_id` | ID de apariencia del avatar. Pásalo al `custom_avatar_id` de Video de Avatar de HeyGen; guárdalo para reutilizar el avatar más tarde. | STRING | +| `preview` | Imagen de vista previa del avatar generado. | IMAGE | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/es.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fa.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fa.md new file mode 100644 index 000000000..97a154e21 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fa.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +یک آواتار HeyGen قابل استفاده مجدد از عکس یک شخص یا از یک پرامپت متنی که شخصیت مورد نظر را توصیف می‌کند، ایجاد کنید. شناسه آواتار حاصل را می‌توان با گره HeyGen Avatar Video برای ساخت ویدیوهایی با این آواتار استفاده کرد. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | اجباری | محدوده | +|---------|---------|----------|--------|--------| +| `source` | یک شخصیت جدید از یک پرامپت متنی تولید کنید، یا آواتار را از یک عکس متصل از یک شخص ایجاد کنید. | COMBO | بله | `"prompt"`
`"photo"` | + +هنگامی که `source` روی `"prompt"` تنظیم شده باشد، پارامترهای اضافی زیر در دسترس قرار می‌گیرند: + +| پارامتر | توضیحات | نوع داده | اجباری | محدوده | +|---------|---------|----------|--------|--------| +| `prompt` | توضیحات آواتار برای تولید (حداکثر ۱۰۰۰ کاراکتر). | STRING | بله | ۱ تا ۱۰۰۰ کاراکتر | +| `reference_images` | حداکثر ۳ تصویر مرجع برای هدایت ظاهر تولیدشده. | IMAGE | خیر | ۰ تا ۳ تصویر | + +هنگامی که `source` روی `"photo"` تنظیم شده باشد، پارامتر اضافی زیر در دسترس قرار می‌گیرد: + +| پارامتر | توضیحات | نوع داده | اجباری | محدوده | +|---------|---------|----------|--------|--------| +| `identity_photo` | عکس شخصی که به آواتار تبدیل می‌شود. اگر بزرگ‌تر از ۲K باشد، به‌طور خودکار کوچک‌سازی می‌شود. | IMAGE | بله | یک تصویر | + +**توجه:** پارامتر `source` بین دو حالت جابه‌جا می‌شود. در حالت `"prompt"`، شما یک توضیح متنی و به‌صورت اختیاری حداکثر ۳ تصویر مرجع ارائه می‌دهید. در حالت `"photo"`، شما یک عکس از یک شخص ارائه می‌دهید. این حالت‌ها متقابلاً انحصاری هستند. + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `avatar_id` | شناسه ظاهر آواتار. آن را به `custom_avatar_id` در HeyGen Avatar Video ارسال کنید؛ برای استفاده مجدد بعدی از آواتار آن را ذخیره کنید. | STRING | +| `preview` | تصویر پیش‌نمایش آواتار تولیدشده. | IMAGE | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fr.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fr.md new file mode 100644 index 000000000..5622e157b --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fr.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Créez un avatar HeyGen réutilisable à partir d'une photo d'une personne ou d'une invite textuelle décrivant un personnage à générer. L'identifiant de l'avatar obtenu peut être utilisé avec le nœud Vidéo d'avatar HeyGen pour créer des vidéos mettant en scène cet avatar. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `source` | Générer un nouveau personnage à partir d'une invite textuelle, ou créer l'avatar à partir d'une photo connectée d'une personne. | COMBO | Oui | `"prompt"`
`"photo"` | + +Lorsque `source` est défini sur `"prompt"`, les paramètres supplémentaires suivants deviennent disponibles : + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `prompt` | Description de l'avatar à générer (jusqu'à 1000 caractères). | STRING | Oui | 1 à 1000 caractères | +| `reference_images` | Jusqu'à 3 images de référence guidant l'apparence générée. | IMAGE | Non | 0 à 3 images | + +Lorsque `source` est défini sur `"photo"`, le paramètre supplémentaire suivant devient disponible : + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `identity_photo` | Photo de la personne à transformer en avatar. Réduite automatiquement si elle dépasse 2K. | IMAGE | Oui | Image unique | + +**Remarque :** Le paramètre `source` bascule entre deux modes. En mode `"prompt"`, vous fournissez une description textuelle et éventuellement jusqu'à 3 images de référence. En mode `"photo"`, vous fournissez une seule photo d'une personne. Ces modes sont mutuellement exclusifs. + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `avatar_id` | Identifiant de l'apparence de l'avatar. Transmettez-le au paramètre `custom_avatar_id` du nœud Vidéo d'avatar HeyGen ; sauvegardez-le pour réutiliser l'avatar ultérieurement. | STRING | +| `preview` | Image d'aperçu de l'avatar généré. | IMAGE | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ja.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ja.md new file mode 100644 index 000000000..18bf46b1b --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ja.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +人物の写真、または生成するキャラクターを説明するテキストプロンプトから、再利用可能なHeyGenアバターを作成します。生成されたアバターIDは、HeyGenアバタービデオノードで使用して、このアバターを特徴とする動画を作成できます。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `source` | テキストプロンプトから新しいキャラクターを生成するか、接続された人物の写真からアバターを作成します。 | COMBO | はい | `"prompt"`
`"photo"` | + +`source`が`"prompt"`に設定されている場合、以下の追加パラメータが使用可能になります: + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `prompt` | 生成するアバターの説明(最大1000文字)。 | STRING | はい | 1~1000文字 | +| `reference_images` | 生成される外観をガイドする最大3枚の参照画像。 | IMAGE | いいえ | 0~3枚の画像 | + +`source`が`"photo"`に設定されている場合、以下の追加パラメータが使用可能になります: + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | アバターに変換する人物の写真。2Kより大きい場合は自動的にダウンスケールされます。 | IMAGE | はい | 単一画像 | + +**注記:** `source`パラメータは2つのモードを切り替えます。`"prompt"`モードでは、テキストによる説明と、オプションで最大3枚の参照画像を提供します。`"photo"`モードでは、人物の写真1枚を提供します。これらのモードは相互に排他的です。 + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `avatar_id` | アバターのルックID。HeyGenアバタービデオの`custom_avatar_id`に渡します。後でアバターを再利用するために保存します。 | STRING | +| `preview` | 生成されたアバターのプレビュー画像。 | IMAGE | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ko.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ko.md new file mode 100644 index 000000000..15d53e644 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ko.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +사람의 사진이나 캐릭터를 설명하는 텍스트 프롬프트로부터 재사용 가능한 HeyGen 아바타를 생성합니다. 생성된 아바타 ID는 HeyGen 아바타 비디오 노드와 함께 사용하여 이 아바타가 등장하는 비디오를 제작할 수 있습니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `source` | 텍스트 프롬프트로 새 캐릭터를 생성하거나, 연결된 사람 사진으로 아바타를 만듭니다. | COMBO | 예 | `"prompt"`
`"photo"` | + +`source`가 `"prompt"`로 설정된 경우, 다음 추가 매개변수를 사용할 수 있습니다: + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `prompt` | 생성할 아바타에 대한 설명입니다 (최대 1000자). | STRING | 예 | 1~1000자 | +| `reference_images` | 생성될 외형을 안내하는 최대 3개의 참조 이미지입니다. | IMAGE | 아니요 | 0~3개 이미지 | + +`source`가 `"photo"`로 설정된 경우, 다음 추가 매개변수를 사용할 수 있습니다: + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | 아바타로 변환할 사람의 사진입니다. 2K보다 클 경우 자동으로 축소됩니다. | IMAGE | 예 | 단일 이미지 | + +**참고:** `source` 매개변수는 두 가지 모드 사이를 전환합니다. `"prompt"` 모드에서는 텍스트 설명과 선택적으로 최대 3개의 참조 이미지를 제공합니다. `"photo"` 모드에서는 사람의 단일 사진을 제공합니다. 이 두 모드는 상호 배타적입니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `avatar_id` | 아바타 외형 ID입니다. HeyGen 아바타 비디오의 `custom_avatar_id`에 전달하거나 저장하여 나중에 아바타를 재사용하세요. | STRING | +| `preview` | 생성된 아바타의 미리보기 이미지입니다. | IMAGE | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/pt-BR.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/pt-BR.md new file mode 100644 index 000000000..51b1cb0e0 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/pt-BR.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Crie um avatar HeyGen reutilizável a partir de uma foto de uma pessoa ou de um prompt de texto que descreva um personagem a ser gerado. O ID do avatar resultante pode ser usado com o nó HeyGen Avatar Video para criar vídeos com este avatar. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Intervalo | +|-----------|-------------|-----------|----------|-------| +| `source` | Gere um novo personagem a partir de um prompt de texto ou crie o avatar a partir de uma foto conectada de uma pessoa. | COMBO | Sim | `"prompt"`
`"photo"` | + +Quando `source` estiver definido como `"prompt"`, os seguintes parâmetros adicionais ficam disponíveis: + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Intervalo | +|-----------|-------------|-----------|----------|-------| +| `prompt` | Descrição do avatar a ser gerado (até 1000 caracteres). | STRING | Sim | 1 a 1000 caracteres | +| `reference_images` | Até 3 imagens de referência para orientar a aparência gerada. | IMAGE | Não | 0 a 3 imagens | + +Quando `source` estiver definido como `"photo"`, o seguinte parâmetro adicional fica disponível: + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Intervalo | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | Foto da pessoa a ser transformada em avatar. Redimensionada automaticamente se for maior que 2K. | IMAGE | Sim | Imagem única | + +**Observação:** O parâmetro `source` alterna entre dois modos. No modo `"prompt"`, você fornece uma descrição em texto e, opcionalmente, até 3 imagens de referência. No modo `"photo"`, você fornece uma única foto de uma pessoa. Esses modos são mutuamente exclusivos. + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|-------------|-------------|-----------| +| `avatar_id` | ID da aparência do avatar. Passe-o para o campo `custom_avatar_id` do nó HeyGen Avatar Video; salve-o para reutilizar o avatar posteriormente. | STRING | +| `preview` | Imagem de pré-visualização do avatar gerado. | IMAGE | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ru.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ru.md new file mode 100644 index 000000000..c7873667a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ru.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Создайте многоразового аватара HeyGen на основе фотографии человека или текстового запроса, описывающего персонажа для генерации. Полученный идентификатор аватара можно использовать с узлом HeyGen Avatar Video для создания видео с этим аватаром. + +## Входные данные + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `source` | Сгенерировать нового персонажа из текстового запроса или создать аватара на основе подключенной фотографии человека. | COMBO | Да | `"prompt"`
`"photo"` | + +Когда для параметра `source` установлено значение `"prompt"`, становятся доступны следующие дополнительные параметры: + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `prompt` | Описание аватара для генерации (до 1000 символов). | STRING | Да | от 1 до 1000 символов | +| `reference_images` | До 3 референсных изображений, направляющих генерируемый внешний вид. | IMAGE | Нет | от 0 до 3 изображений | + +Когда для параметра `source` установлено значение `"photo"`, становится доступен следующий дополнительный параметр: + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | Фотография человека для превращения в аватара. Автоматически уменьшается, если размер превышает 2K. | IMAGE | Да | Одно изображение | + +**Примечание:** Параметр `source` переключается между двумя режимами. В режиме `"prompt"` вы предоставляете текстовое описание и, опционально, до 3 референсных изображений. В режиме `"photo"` вы предоставляете одну фотографию человека. Эти режимы являются взаимоисключающими. + +## Выходные данные + +| Имя выхода | Описание | Тип данных | +|-------------|-------------|-----------| +| `avatar_id` | Идентификатор внешнего вида аватара. Передайте его в параметр `custom_avatar_id` узла HeyGen Avatar Video; сохраните его для повторного использования аватара в будущем. | STRING | +| `preview` | Превью-изображение сгенерированного аватара. | IMAGE | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/tr.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/tr.md new file mode 100644 index 000000000..f891bd47a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/tr.md @@ -0,0 +1,36 @@ +# HeyGenCreateAvatarNode + +Bir kişinin fotoğrafından veya bir karakteri tanımlayan metin isteminden yeniden kullanılabilir bir HeyGen avatarı oluşturun. Ortaya çıkan avatar kimliği, bu avatarı kullanarak videolar oluşturmak için HeyGen Avatar Video düğümüyle kullanılabilir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `source` | Bir metin isteminden yeni bir karakter oluşturun veya bağlı bir kişi fotoğrafından avatar oluşturun. | COMBO | Evet | `"prompt"`
`"photo"` | + +`source` parametresi `"prompt"` olarak ayarlandığında aşağıdaki ek parametreler kullanılabilir: + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `prompt` | Oluşturulacak avatarın açıklaması (en fazla 1000 karakter). | STRING | Evet | 1 ila 1000 karakter | +| `reference_images` | Oluşturulacak görünüme yön veren en fazla 3 referans görseli. | IMAGE | Hayır | 0 ila 3 görsel | + +`source` parametresi `"photo"` olarak ayarlandığında aşağıdaki ek parametre kullanılabilir: + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | Avatara dönüştürülecek kişinin fotoğrafı. 2K'dan büyükse otomatik olarak küçültülür. | IMAGE | Evet | Tek görsel | + +**Not:** `source` parametresi iki mod arasında geçiş yapar. `"prompt"` modunda, bir metin açıklaması ve isteğe bağlı olarak en fazla 3 referans görseli sağlarsınız. `"photo"` modunda, bir kişinin tek bir fotoğrafını sağlarsınız. Bu modlar birbirini dışlar. + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `avatar_id` | Avatar görünüm kimliği. Bunu HeyGen Avatar Video'nun `custom_avatar_id` parametresine iletin; avatarı daha sonra yeniden kullanmak için kaydedin. | STRING | +| `preview` | Oluşturulan avatarın önizleme görseli. | IMAGE | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh-TW.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh-TW.md new file mode 100644 index 000000000..baeb57005 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh-TW.md @@ -0,0 +1,34 @@ +# HeyGenCreateAvatarNode + +從人物照片或描述角色的文字提示建立可重複使用的 HeyGen 頭像。產生的頭像 ID 可與 HeyGen 頭像影片節點搭配使用,建立以該頭像為特色的影片。 + +## 輸入 +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `source` | 從文字提示產生新角色,或從連接的人物照片建立頭像。 | COMBO | 是 | `"prompt"`
`"photo"` | + +當 `source` 設定為 `"prompt"` 時,以下額外參數將可用: + +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `prompt` | 要產生的頭像描述(最多 1000 個字元)。 | STRING | 是 | 1 到 1000 個字元 | +| `reference_images` | 最多 3 張引導產生外觀的參考圖片。 | IMAGE | 否 | 0 到 3 張圖片 | + +當 `source` 設定為 `"photo"` 時,以下額外參數將可用: + +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | 要轉換為頭像的人物照片。若大於 2K 會自動縮小。 | IMAGE | 是 | 單張圖片 | + +**注意:** `source` 參數可在兩種模式之間切換。在 `"prompt"` 模式下,您提供文字描述並可選擇提供最多 3 張參考圖片。在 `"photo"` 模式下,您提供單張人物照片。這兩種模式互斥。 + +## 輸出 +| 輸出名稱 | 描述 | 資料類型 | +|-------------|-------------|-----------| +| `avatar_id` | 頭像外觀 ID。將其傳遞給 HeyGen 頭像影片的 `custom_avatar_id`;儲存以便日後重複使用該頭像。 | STRING | +| `preview` | 所產生頭像的預覽圖片。 | IMAGE | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh.md b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh.md new file mode 100644 index 000000000..fd54e5d86 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh.md @@ -0,0 +1,34 @@ +# HeyGenCreateAvatarNode + +根据人物照片或文本提示描述的角色,创建一个可复用的 HeyGen 虚拟形象。生成的虚拟形象 ID 可与 HeyGen 虚拟形象视频节点配合使用,制作包含该虚拟形象的视频。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `source` | 通过文本提示生成新角色,或根据连接的人物照片创建虚拟形象。 | COMBO | 是 | `"prompt"`
`"photo"` | + +当 `source` 设置为 `"prompt"` 时,将显示以下额外参数: + +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `prompt` | 要生成的虚拟形象描述(最多 1000 个字符)。 | STRING | 是 | 1 至 1000 个字符 | +| `reference_images` | 最多 3 张参考图像,用于指导生成的外观。 | IMAGE | 否 | 0 至 3 张图像 | + +当 `source` 设置为 `"photo"` 时,将显示以下额外参数: + +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `identity_photo` | 要转化为虚拟形象的人物照片。若分辨率大于 2K,将自动缩小。 | IMAGE | 是 | 单张图像 | + +**注意:** `source` 参数可在两种模式间切换。在 `"prompt"` 模式下,您需提供文本描述,并可选择提供最多 3 张参考图像。在 `"photo"` 模式下,您需提供一张人物照片。这两种模式互斥。 + +## 输出 +| 输出名 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `avatar_id` | 虚拟形象外观 ID。将其传递给 HeyGen 虚拟形象视频的 `custom_avatar_id`;保存后可后续复用该虚拟形象。 | STRING | +| `preview` | 生成的虚拟形象预览图像。 | IMAGE | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenCreateAvatarNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `c60e9cdb0d91fb5ec6ea83b503b9aa10c978ce065a16c751a52e90c12e70a5e2` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ar.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ar.md new file mode 100644 index 000000000..eaf8b1369 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ar.md @@ -0,0 +1,58 @@ +# HeyGenTalkingPhotoNode + +## قواعد الترجمة + +1. **المحتوى الذي يجب عدم ترجمته:** + - أسماء المعاملات بين علامات الاقتباس الخلفية: `image`, `seed`, `model` + - أنواع البيانات بالأحرف الكبيرة: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, إلخ + - القيم في عمود Range: الأرقام، "auto"، أسماء الخيارات + - الكود، مسارات الملفات + +2. **المحتوى الذي يجب ترجمته:** + - عناوين الأقسام: ## نظرة عامة, ## المدخلات, ## المخرجات + - جميع النصوص الوصفية والتوضيحية + - أوصاف المعاملات + +3. **جودة الترجمة:** + - استخدام اللغة العربية الفصحى المعاصرة + - الحفاظ على نبرة احترافية ولكن سهلة الفهم + - ضمان الدقة التقنية + - استخدام المصطلحات التقنية العربية القياسية + +4. **التنسيق:** + - الحفاظ على جميع تنسيقات Markdown + - الحفاظ على بنية الجداول + - عدم إضافة أي ملاحظة أو رابط في بداية الوثيقة (سيتم إضافتها تلقائيًا) + +الرجاء ترجمة الوثيقة التالية إلى العربية، دون تضمين الملاحظة الأولية للوثيقة: + +5. **قاعدة حاسمة - أسماء المخرجات:** العمود الأول من جدول المخرجات يحتوي على أسماء مخرجات (مثل `positive`، `negative`، `latent`، `image`، `model`، `conditioning`) التي يجب أن تبقى بالإنجليزية. ترجمة هذه الأسماء يؤدي إلى تكرار الإدخالات وكسر بنية المستند. + +قم بتحريك صورة ثابتة لشخص ما لتصبح فيديو حديث متزامن مع الشفاه باستخدام تقنية الصورة الرمزية من HeyGen. يمكنك تشغيل الحركة باستخدام نص برمجي يقوم HeyGen بتحويله إلى كلام، أو تقديم ملف صوتي خاص بك لتقوم الصورة الرمزية بمزامنة الشفاه معه. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|--------|--------| +| `image` | صورة الشخص المراد تحريكه. يتم تصغيرها تلقائياً إذا كان حجمها أكبر من 2K. | IMAGE | نعم | - | +| `speech` | تشغيل الصورة الرمزية باستخدام نص برمجي (تحويل النص إلى كلام من HeyGen) أو ملف صوتي خاص بك. | COMBO | نعم | `"script"`
`"audio"` | +| `text` | النص الذي ستتحدث به الصورة الرمزية (حتى 5000 حرف). يجب أن يكون الكلام المُنشأ بطول ثانية واحدة على الأقل. | STRING | نعم (عندما يكون speech هو "script") | - | +| `voice` | الصوت المستخدم للنص البرمجي (أشهر الأصوات من HeyGen). | COMBO | نعم (عندما يكون speech هو "script") | تتوفر خيارات متعددة | +| `custom_voice_id` | معرف صوت HeyGen اختياري. عند تعيينه، يتجاوز الصوت المحدد أعلاه. يمكن استخدام أي صوت من مكتبة HeyGen (أكثر من 2000 صوت). | STRING | لا | - | +| `voice_speed` | مضاعف سرعة الكلام (الافتراضي: 1.0). | FLOAT | لا | 0.5 إلى 1.5 | +| `audio` | ملف صوتي لمزامنة الشفاه مع الصورة الرمزية، حتى 10 دقائق. | AUDIO | نعم (عندما يكون speech هو "audio") | - | +| `resolution` | دقة فيديو الإخراج (الافتراضي: "1080p"). | COMBO | لا | `"720p"`
`"1080p"` | +| `aspect_ratio` | نسبة أبعاد الإخراج. 'auto' يتبع الصورة المدخلة (الافتراضي: "auto"). | COMBO | لا | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | مدى تعبيرية الوجه والإيماءات المتحركة (الافتراضي: "low"). | COMBO | لا | `"low"`
`"medium"`
`"high"` | +| `seed` | لا يُرسل إلى HeyGen؛ قم بتغييره لفرض إعادة التشغيل (الافتراضي: 42). | INT | لا | 0 إلى 2147483647 | + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|--------------| +| `video` | الفيديو المُنشأ للصورة المتحركة الناطقة مع الكلام المتزامن مع الشفاه. | VIDEO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/en.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/en.md new file mode 100644 index 000000000..6bd1ae0db --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/en.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Animate a still image of a person into a lip-synced talking video using HeyGen's Avatar IV technology. You can drive the animation with a text script that HeyGen converts to speech, or provide your own audio for the avatar to lip-sync. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `image` | Image of a person to animate. Downscaled automatically if larger than 2K. | IMAGE | Yes | - | +| `speech` | Drive the avatar with a text script (HeyGen text-to-speech) or your own audio. | COMBO | Yes | `"script"`
`"audio"` | +| `text` | Text for the avatar to speak (up to 5000 characters). The generated speech must be at least 1 second long. | STRING | Yes (when speech is "script") | - | +| `voice` | Voice for the script (HeyGen's most popular voices). | COMBO | Yes (when speech is "script") | Multiple options available | +| `custom_voice_id` | Optional HeyGen voice ID. When set, overrides the voice selected above. Any voice from HeyGen's library (2000+) can be used. | STRING | No | - | +| `voice_speed` | Speech speed multiplier (default: 1.0). | FLOAT | No | 0.5 to 1.5 | +| `audio` | Audio for the avatar to lip-sync, up to 10 minutes. | AUDIO | Yes (when speech is "audio") | - | +| `resolution` | Output video resolution (default: "1080p"). | COMBO | No | `"720p"`
`"1080p"` | +| `aspect_ratio` | Output aspect ratio. 'auto' follows the input image (default: "auto"). | COMBO | No | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | How expressive the animated face and gestures are (default: "low"). | COMBO | No | `"low"`
`"medium"`
`"high"` | +| `seed` | Not sent to HeyGen; change it to force a re-run (default: 42). | INT | No | 0 to 2147483647 | + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `video` | Generated video of the animated talking photo with lip-synced speech. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/en.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/es.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/es.md new file mode 100644 index 000000000..63d3dcd8a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/es.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Transforma una imagen estática de una persona en un video parlante con sincronización labial utilizando la tecnología Avatar IV de HeyGen. Puedes controlar la animación con un guion de texto que HeyGen convierte en voz, o proporcionar tu propio audio para que el avatar sincronice los labios. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Requerido | Rango | +|-----------|-------------|--------------|-----------|-------| +| `image` | Imagen de una persona para animar. Se reduce automáticamente si es mayor a 2K. | IMAGE | Sí | - | +| `speech` | Controla el avatar con un guion de texto (texto a voz de HeyGen) o tu propio audio. | COMBO | Sí | `"script"`
`"audio"` | +| `text` | Texto que el avatar debe decir (hasta 5000 caracteres). El discurso generado debe tener al menos 1 segundo de duración. | STRING | Sí (cuando speech es "script") | - | +| `voice` | Voz para el guion (las voces más populares de HeyGen). | COMBO | Sí (cuando speech es "script") | Múltiples opciones disponibles | +| `custom_voice_id` | ID de voz opcional de HeyGen. Cuando se establece, anula la voz seleccionada anteriormente. Se puede usar cualquier voz de la biblioteca de HeyGen (más de 2000). | STRING | No | - | +| `voice_speed` | Multiplicador de velocidad del habla (predeterminado: 1.0). | FLOAT | No | 0.5 a 1.5 | +| `audio` | Audio para que el avatar sincronice los labios, hasta 10 minutos. | AUDIO | Sí (cuando speech es "audio") | - | +| `resolution` | Resolución del video de salida (predeterminado: "1080p"). | COMBO | No | `"720p"`
`"1080p"` | +| `aspect_ratio` | Relación de aspecto de salida. 'auto' sigue la imagen de entrada (predeterminado: "auto"). | COMBO | No | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | Qué tan expresivos son el rostro y los gestos animados (predeterminado: "low"). | COMBO | No | `"low"`
`"medium"`
`"high"` | +| `seed` | No se envía a HeyGen; cámbialo para forzar una nueva ejecución (predeterminado: 42). | INT | No | 0 a 2147483647 | + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `video` | Video generado de la foto parlante animada con discurso sincronizado con los labios. | VIDEO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/es.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fa.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fa.md new file mode 100644 index 000000000..d6dfc1927 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fa.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +یک تصویر ثابت از یک شخص را با استفاده از فناوری Avatar IV شرکت HeyGen به یک ویدیوی گفتاری با هماهنگی لب (lip-sync) تبدیل کنید. می‌توانید انیمیشن را با یک متن که HeyGen آن را به گفتار تبدیل می‌کند هدایت کنید، یا صدای خود را برای هماهنگی لب آواتار ارائه دهید. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | الزامی | محدوده | +|---------|---------|----------|--------|--------| +| `image` | تصویر یک شخص برای انیمیشن. اگر بزرگ‌تر از 2K باشد، به‌طور خودکار کاهش اندازه می‌یابد. | IMAGE | بله | - | +| `speech` | آواتار را با یک متن (تبدیل متن به گفتار HeyGen) یا صدای خود هدایت کنید. | COMBO | بله | `"script"`
`"audio"` | +| `text` | متنی که آواتار باید بگوید (حداکثر 5000 کاراکتر). گفتار تولیدشده باید حداقل 1 ثانیه طول داشته باشد. | STRING | بله (زمانی که speech برابر "script" باشد) | - | +| `voice` | صدا برای متن (محبوب‌ترین صداهای HeyGen). | COMBO | بله (زمانی که speech برابر "script" باشد) | گزینه‌های متعدد موجود است | +| `custom_voice_id` | شناسه صدای اختیاری HeyGen. وقتی تنظیم شود، صدای انتخاب‌شده در بالا را لغو می‌کند. می‌توان از هر صدایی از کتابخانه HeyGen (بیش از 2000 صدا) استفاده کرد. | STRING | خیر | - | +| `voice_speed` | ضریب سرعت گفتار (پیش‌فرض: 1.0). | FLOAT | خیر | 0.5 تا 1.5 | +| `audio` | صدایی برای هماهنگی لب آواتار، تا 10 دقیقه. | AUDIO | بله (زمانی که speech برابر "audio" باشد) | - | +| `resolution` | وضوح ویدیوی خروجی (پیش‌فرض: "1080p"). | COMBO | خیر | `"720p"`
`"1080p"` | +| `aspect_ratio` | نسبت ابعاد خروجی. 'auto' از تصویر ورودی پیروی می‌کند (پیش‌فرض: "auto"). | COMBO | خیر | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | میزان حالت‌های چهره و حرکات انیمیشن (پیش‌فرض: "low"). | COMBO | خیر | `"low"`
`"medium"`
`"high"` | +| `seed` | به HeyGen ارسال نمی‌شود؛ آن را تغییر دهید تا اجرای مجدد强制执行 شود (پیش‌فرض: 42). | INT | خیر | 0 تا 2147483647 | + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `video` | ویدیوی تولیدشده از عکس متحرک با گفتار هماهنگ با لب. | VIDEO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fr.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fr.md new file mode 100644 index 000000000..ddb4d8e32 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fr.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Animez une image fixe d'une personne en une vidéo parlante synchronisée labialement grâce à la technologie Avatar IV de HeyGen. Vous pouvez piloter l'animation avec un script textuel que HeyGen convertit en parole, ou fournir votre propre audio pour que l'avatar effectue le lip-sync. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `image` | Image d'une personne à animer. Réduite automatiquement si elle dépasse 2K. | IMAGE | Oui | - | +| `speech` | Piloter l'avatar avec un script textuel (synthèse vocale HeyGen) ou votre propre audio. | COMBO | Oui | `"script"`
`"audio"` | +| `text` | Texte que l'avatar doit prononcer (jusqu'à 5000 caractères). La parole générée doit durer au moins 1 seconde. | STRING | Oui (lorsque speech est "script") | - | +| `voice` | Voix pour le script (les voix les plus populaires de HeyGen). | COMBO | Oui (lorsque speech est "script") | Plusieurs options disponibles | +| `custom_voice_id` | Identifiant de voix HeyGen optionnel. Lorsqu'il est défini, il remplace la voix sélectionnée ci-dessus. N'importe quelle voix de la bibliothèque HeyGen (2000+) peut être utilisée. | STRING | Non | - | +| `voice_speed` | Multiplicateur de vitesse de parole (par défaut : 1.0). | FLOAT | Non | 0.5 à 1.5 | +| `audio` | Audio pour le lip-sync de l'avatar, jusqu'à 10 minutes. | AUDIO | Oui (lorsque speech est "audio") | - | +| `resolution` | Résolution vidéo de sortie (par défaut : "1080p"). | COMBO | Non | `"720p"`
`"1080p"` | +| `aspect_ratio` | Format d'image de sortie. 'auto' suit l'image d'entrée (par défaut : "auto"). | COMBO | Non | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | Degré d'expressivité du visage et des gestes animés (par défaut : "low"). | COMBO | Non | `"low"`
`"medium"`
`"high"` | +| `seed` | Non envoyé à HeyGen ; modifiez-le pour forcer une nouvelle exécution (par défaut : 42). | INT | Non | 0 à 2147483647 | + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `video` | Vidéo générée de la photo parlante animée avec parole synchronisée labialement. | VIDEO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ja.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ja.md new file mode 100644 index 000000000..115ed3265 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ja.md @@ -0,0 +1,60 @@ +# HeyGenTalkingPhotoNode + +あなたは ComfyUI ノードドキュメントを英語から日本語に翻訳する技術翻訳の専門家です。 + +## 翻訳ルール + +1. **翻訳してはいけない内容:** + - バッククォートで囲まれたパラメータ名:`image`、`seed`、`model` + - 大文字のデータ型:IMAGE、STRING、INT、FLOAT、MODEL、CONDITIONING など + - Range列の値:数値、"auto"、オプション名 + - コード、ファイルパス + +2. **翻訳する内容:** + - セクション見出し:## 概要、## 入力、## 出力 + - すべての説明文 + - パラメータの説明 + +3. **翻訳品質:** + - 丁寧語(です・ます体)を使用 + - 専門的でありながらわかりやすい表現 + - 技術的な正確性を保つ + - 標準的な日本語技術用語を使用 + +4. **フォーマット:** + - すべての Markdown フォーマットを保持 + - 表の構造を維持 + - 免責事項は追加しないでください(システムが文書末尾に自動追加します) + +以下の英語ドキュメントを日本語に翻訳してください(免責事項は含めないでください): + +5. **重要ルール - 出力名:** 出力テーブルの最初の列には出力名(例:`positive`、`negative`、`latent`、`image`、`model`、`conditioning`)が含まれています。これらは**英語のままにしてください**。出力名を翻訳すると重複エントリが発生し、文書構造が壊れます。 + +HeyGenのアバターIV技術を使用して、人物の静止画像をリップシンク対応のトーキングビデオにアニメーション化します。HeyGenが音声に変換するテキストスクリプトでアニメーションを駆動することも、アバターにリップシンクさせる独自の音声を提供することもできます。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `image` | アニメーション化する人物の画像。2Kより大きい場合は自動的にダウンスケールされます。 | IMAGE | はい | - | +| `speech` | テキストスクリプト(HeyGenテキスト読み上げ)または独自の音声でアバターを駆動します。 | COMBO | はい | `"script"`
`"audio"` | +| `text` | アバターに話させるテキスト(最大5000文字)。生成される音声は少なくとも1秒の長さが必要です。 | STRING | はい(speechが"script"の場合) | - | +| `voice` | スクリプト用の音声(HeyGenで最も人気のある音声)。 | COMBO | はい(speechが"script"の場合) | 複数のオプションが利用可能 | +| `custom_voice_id` | オプションのHeyGen音声ID。設定すると、上記で選択した音声が上書きされます。HeyGenのライブラリ(2000以上)の任意の音声を使用できます。 | STRING | いいえ | - | +| `voice_speed` | 音声速度の倍率(デフォルト:1.0)。 | FLOAT | いいえ | 0.5 から 1.5 | +| `audio` | アバターがリップシンクする音声(最大10分)。 | AUDIO | はい(speechが"audio"の場合) | - | +| `resolution` | 出力ビデオの解像度(デフォルト:"1080p")。 | COMBO | いいえ | `"720p"`
`"1080p"` | +| `aspect_ratio` | 出力のアスペクト比。「auto」は入力画像に従います(デフォルト:"auto")。 | COMBO | いいえ | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | アニメーション化された顔とジェスチャーの表現力(デフォルト:"low")。 | COMBO | いいえ | `"low"`
`"medium"`
`"high"` | +| `seed` | HeyGenには送信されません。変更して再実行を強制します(デフォルト:42)。 | INT | いいえ | 0 から 2147483647 | + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `video` | リップシンクされた音声付きのアニメーション化されたトーキングフォトの生成ビデオ。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ko.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ko.md new file mode 100644 index 000000000..ee1331413 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ko.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +정지된 인물 사진을 HeyGen의 Avatar IV 기술을 사용하여 립싱크가 적용된 말하는 동영상으로 애니메이션화합니다. HeyGen이 음성으로 변환하는 텍스트 스크립트로 애니메이션을 구동하거나, 아바타가 립싱크할 자체 오디오를 제공할 수 있습니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `image` | 애니메이션화할 인물의 이미지입니다. 2K보다 큰 경우 자동으로 축소됩니다. | IMAGE | 예 | - | +| `speech` | 텍스트 스크립트(HeyGen 텍스트 음성 변환) 또는 자체 오디오로 아바타를 구동합니다. | COMBO | 예 | `"script"`
`"audio"` | +| `text` | 아바타가 말할 텍스트입니다(최대 5000자). 생성된 음성은 최소 1초 이상이어야 합니다. | STRING | 예(speech가 "script"인 경우) | - | +| `voice` | 스크립트에 사용할 음성입니다(HeyGen의 가장 인기 있는 음성). | COMBO | 예(speech가 "script"인 경우) | 여러 옵션 사용 가능 | +| `custom_voice_id` | 선택적 HeyGen 음성 ID입니다. 설정 시 위에서 선택한 음성을 재정의합니다. HeyGen 라이브러리(2000개 이상)의 모든 음성을 사용할 수 있습니다. | STRING | 아니요 | - | +| `voice_speed` | 음성 속도 배율입니다(기본값: 1.0). | FLOAT | 아니요 | 0.5 ~ 1.5 | +| `audio` | 아바타가 립싱크할 오디오로, 최대 10분까지 가능합니다. | AUDIO | 예(speech가 "audio"인 경우) | - | +| `resolution` | 출력 동영상 해상도입니다(기본값: "1080p"). | COMBO | 아니요 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 출력 화면 비율입니다. 'auto'는 입력 이미지를 따릅니다(기본값: "auto"). | COMBO | 아니요 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | 애니메이션 얼굴과 제스처의 표현력 정도입니다(기본값: "low"). | COMBO | 아니요 | `"low"`
`"medium"`
`"high"` | +| `seed` | HeyGen으로 전송되지 않습니다. 값을 변경하여 재실행을 강제합니다(기본값: 42). | INT | 아니요 | 0 ~ 2147483647 | + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `video` | 립싱크된 음성이 포함된 애니메이션 말하는 사진의 생성된 동영상입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/pt-BR.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/pt-BR.md new file mode 100644 index 000000000..2be40ed84 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/pt-BR.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Anime uma imagem estática de uma pessoa em um vídeo de conversa com sincronização labial usando a tecnologia Avatar IV da HeyGen. Você pode conduzir a animação com um roteiro de texto que a HeyGen converte em fala, ou fornecer seu próprio áudio para o avatar sincronizar os lábios. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|-----------|----------|-------| +| `image` | Imagem de uma pessoa para animar. Redimensionada automaticamente se for maior que 2K. | IMAGE | Sim | - | +| `speech` | Conduza o avatar com um roteiro de texto (texto-para-fala da HeyGen) ou seu próprio áudio. | COMBO | Sim | `"script"`
`"audio"` | +| `text` | Texto para o avatar falar (até 5000 caracteres). A fala gerada deve ter pelo menos 1 segundo de duração. | STRING | Sim (quando speech é "script") | - | +| `voice` | Voz para o roteiro (as vozes mais populares da HeyGen). | COMBO | Sim (quando speech é "script") | Múltiplas opções disponíveis | +| `custom_voice_id` | ID de voz opcional da HeyGen. Quando definido, substitui a voz selecionada acima. Qualquer voz da biblioteca da HeyGen (mais de 2000) pode ser usada. | STRING | Não | - | +| `voice_speed` | Multiplicador de velocidade da fala (padrão: 1.0). | FLOAT | Não | 0.5 a 1.5 | +| `audio` | Áudio para o avatar sincronizar os lábios, até 10 minutos. | AUDIO | Sim (quando speech é "audio") | - | +| `resolution` | Resolução do vídeo de saída (padrão: "1080p"). | COMBO | Não | `"720p"`
`"1080p"` | +| `aspect_ratio` | Proporção de tela da saída. 'auto' segue a imagem de entrada (padrão: "auto"). | COMBO | Não | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | O quão expressivo é o rosto animado e os gestos (padrão: "low"). | COMBO | Não | `"low"`
`"medium"`
`"high"` | +| `seed` | Não enviado para a HeyGen; altere-o para forçar uma nova execução (padrão: 42). | INT | Não | 0 a 2147483647 | + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|-------------|-------------|-----------| +| `video` | Vídeo gerado da foto falante animada com fala sincronizada com os lábios. | VIDEO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ru.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ru.md new file mode 100644 index 000000000..55d9ac02a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ru.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Анимируйте статичное изображение человека в синхронизированное по губам видео с речью, используя технологию HeyGen Avatar IV. Вы можете управлять анимацией с помощью текстового сценария, который HeyGen преобразует в речь, или предоставить собственную аудиодорожку для синхронизации губ аватара. + +## Входные данные + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `image` | Изображение человека для анимации. Автоматически уменьшается, если размер превышает 2K. | IMAGE | Да | - | +| `speech` | Управление аватаром с помощью текстового сценария (HeyGen text-to-speech) или собственной аудиодорожки. | COMBO | Да | `"script"`
`"audio"` | +| `text` | Текст для озвучивания аватаром (до 5000 символов). Сгенерированная речь должна быть длительностью не менее 1 секунды. | STRING | Да (если speech = "script") | - | +| `voice` | Голос для сценария (самые популярные голоса HeyGen). | COMBO | Да (если speech = "script") | Доступно несколько вариантов | +| `custom_voice_id` | Необязательный идентификатор голоса HeyGen. При установке переопределяет выбранный выше голос. Можно использовать любой голос из библиотеки HeyGen (2000+). | STRING | Нет | - | +| `voice_speed` | Множитель скорости речи (по умолчанию: 1.0). | FLOAT | Нет | от 0.5 до 1.5 | +| `audio` | Аудиодорожка для синхронизации губ аватара, длительностью до 10 минут. | AUDIO | Да (если speech = "audio") | - | +| `resolution` | Разрешение выходного видео (по умолчанию: "1080p"). | COMBO | Нет | `"720p"`
`"1080p"` | +| `aspect_ratio` | Соотношение сторон выходного видео. 'auto' соответствует исходному изображению (по умолчанию: "auto"). | COMBO | Нет | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | Степень выразительности анимированного лица и жестов (по умолчанию: "low"). | COMBO | Нет | `"low"`
`"medium"`
`"high"` | +| `seed` | Не отправляется в HeyGen; измените его, чтобы принудительно перезапустить выполнение (по умолчанию: 42). | INT | Нет | от 0 до 2147483647 | + +## Выходные данные + +| Имя выхода | Описание | Тип данных | +|-------------|-------------|-----------| +| `video` | Сгенерированное видео анимированного говорящего фото с синхронизированной по губам речью. | VIDEO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/tr.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/tr.md new file mode 100644 index 000000000..c5e5d0873 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/tr.md @@ -0,0 +1,30 @@ +# HeyGenTalkingPhotoNode + +Bir kişinin durağan fotoğrafını, HeyGen'in Avatar IV teknolojisini kullanarak dudak senkronizasyonlu konuşan bir videoya dönüştürün. Animasyonu, HeyGen'in sese dönüştürdüğü bir metin komut dosyasıyla yönlendirebilir veya avatarın dudak senkronizasyonu yapması için kendi sesinizi sağlayabilirsiniz. + +## Girişler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `image` | Canlandırılacak kişinin görüntüsü. 2K'dan büyükse otomatik olarak küçültülür. | IMAGE | Evet | - | +| `speech` | Avatari bir metin komut dosyası (HeyGen metinden sese) veya kendi sesinizle yönlendirin. | COMBO | Evet | `"script"`
`"audio"` | +| `text` | Avatarın söyleyeceği metin (en fazla 5000 karakter). Oluşturulan konuşma en az 1 saniye uzunluğunda olmalıdır. | STRING | Evet (konuşma "script" olduğunda) | - | +| `voice` | Komut dosyası için ses (HeyGen'in en popüler sesleri). | COMBO | Evet (konuşma "script" olduğunda) | Birden çok seçenek mevcut | +| `custom_voice_id` | İsteğe bağlı HeyGen ses kimliği. Ayarlandığında, yukarıda seçilen sesi geçersiz kılar. HeyGen'in kitaplığındaki (2000+) herhangi bir ses kullanılabilir. | STRING | Hayır | - | +| `voice_speed` | Konuşma hızı çarpanı (varsayılan: 1.0). | FLOAT | Hayır | 0.5 ila 1.5 | +| `audio` | Avatarın dudak senkronizasyonu yapacağı, en fazla 10 dakikalık ses. | AUDIO | Evet (konuşma "audio" olduğunda) | - | +| `resolution` | Çıktı video çözünürlüğü (varsayılan: "1080p"). | COMBO | Hayır | `"720p"`
`"1080p"` | +| `aspect_ratio` | Çıktı en boy oranı. 'auto', giriş görüntüsünü takip eder (varsayılan: "auto"). | COMBO | Hayır | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | Canlandırılan yüzün ve jestlerin ne kadar ifade dolu olduğu (varsayılan: "low"). | COMBO | Hayır | `"low"`
`"medium"`
`"high"` | +| `seed` | HeyGen'e gönderilmez; yeniden çalıştırmayı zorlamak için değiştirin (varsayılan: 42). | INT | Hayır | 0 ila 2147483647 | + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `video` | Dudak senkronizasyonlu konuşma ile canlandırılmış konuşan fotoğrafın oluşturulan videosu. | VIDEO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh-TW.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh-TW.md new file mode 100644 index 000000000..1191e357e --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh-TW.md @@ -0,0 +1,28 @@ +# HeyGenTalkingPhotoNode + +使用 HeyGen 的 Avatar IV 技術,將靜態人物照片動畫化為唇形同步的說話影片。您可以透過 HeyGen 轉換為語音的文字腳本驅動動畫,或提供自訂音訊讓虛擬人物進行唇形同步。 + +## 輸入 +| 參數 | 說明 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `image` | 要動畫化的人物圖片。若大於 2K 會自動縮小。 | IMAGE | 是 | - | +| `speech` | 使用文字腳本(HeyGen 文字轉語音)或自訂音訊驅動虛擬人物。 | COMBO | 是 | `"script"`
`"audio"` | +| `text` | 虛擬人物要說的文字(最多 5000 個字元)。生成的語音長度至少需 1 秒。 | STRING | 是(當 speech 為 "script" 時) | - | +| `voice` | 腳本使用的語音(HeyGen 最受歡迎的語音選項)。 | COMBO | 是(當 speech 為 "script" 時) | 提供多種選項 | +| `custom_voice_id` | 可選的 HeyGen 語音 ID。設定後會覆蓋上方選擇的語音。可使用 HeyGen 資料庫中超過 2000 種語音。 | STRING | 否 | - | +| `voice_speed` | 語速倍率(預設值:1.0)。 | FLOAT | 否 | 0.5 至 1.5 | +| `audio` | 供虛擬人物唇形同步的音訊,最長 10 分鐘。 | AUDIO | 是(當 speech 為 "audio" 時) | - | +| `resolution` | 輸出影片解析度(預設值:"1080p")。 | COMBO | 否 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 輸出畫面比例。'auto' 會跟隨輸入圖片(預設值:"auto")。 | COMBO | 否 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | 動畫臉部與手勢的表達程度(預設值:"low")。 | COMBO | 否 | `"low"`
`"medium"`
`"high"` | +| `seed` | 不會發送至 HeyGen;變更此值可強制重新執行(預設值:42)。 | INT | 否 | 0 至 2147483647 | + +## 輸出 +| 輸出名稱 | 說明 | 資料類型 | +|-------------|-------------|-----------| +| `video` | 生成的動畫說話照片影片,包含唇形同步的語音。 | VIDEO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md new file mode 100644 index 000000000..d8d8100c2 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md @@ -0,0 +1,29 @@ +# HeyGenTalkingPhotoNode + +## 概述 +使用 HeyGen 的 Avatar IV 技术,将人物静态图像动画化为唇形同步的说话视频。您可以通过 HeyGen 转换为语音的文本来驱动动画,也可以提供自己的音频让虚拟形象进行唇形同步。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 取值范围 | +|-----------|-------------|-----------|----------|-------| +| `image` | 要动画化的人物图像。如果大于 2K 将自动缩小。 | IMAGE | 是 | - | +| `speech` | 通过文本脚本(HeyGen 文本转语音)或您自己的音频驱动虚拟形象。 | COMBO | 是 | `"script"`
`"audio"` | +| `text` | 虚拟形象要说的文本(最多 5000 个字符)。生成的语音必须至少 1 秒长。 | STRING | 是(当 speech 为 "script" 时) | - | +| `voice` | 脚本使用的语音(HeyGen 最受欢迎的语音)。 | COMBO | 是(当 speech 为 "script" 时) | 提供多个选项 | +| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后将覆盖上面选择的语音。可以使用 HeyGen 库中的任何语音(2000+)。 | STRING | 否 | - | +| `voice_speed` | 语速倍率(默认值:1.0)。 | FLOAT | 否 | 0.5 至 1.5 | +| `audio` | 虚拟形象唇形同步的音频,最长 10 分钟。 | AUDIO | 是(当 speech 为 "audio" 时) | - | +| `resolution` | 输出视频分辨率(默认值:"1080p")。 | COMBO | 否 | `"720p"`
`"1080p"` | +| `aspect_ratio` | 输出宽高比。'auto' 跟随输入图像(默认值:"auto")。 | COMBO | 否 | `"auto"`
`"16:9"`
`"9:16"`
`"1:1"`
`"4:5"`
`"5:4"` | +| `expressiveness` | 动画面部和手势的表现力程度(默认值:"low")。 | COMBO | 否 | `"low"`
`"medium"`
`"high"` | +| `seed` | 不会发送到 HeyGen;更改它以强制重新运行(默认值:42)。 | INT | 否 | 0 至 2147483647 | + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `video` | 生成的动画说话照片视频,包含唇形同步的语音。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ar.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ar.md new file mode 100644 index 000000000..0fc4ac886 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ar.md @@ -0,0 +1,53 @@ +# HeyGenTextToSpeechNode + +## قواعد الترجمة + +1. **المحتوى الذي يجب عدم ترجمته:** + - أسماء المعاملات بين علامات الاقتباس الخلفية: `image`, `seed`, `model` + - أنواع البيانات بالأحرف الكبيرة: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, إلخ + - القيم في عمود Range: الأرقام، "auto"، أسماء الخيارات + - الكود، مسارات الملفات + +2. **المحتوى الذي يجب ترجمته:** + - عناوين الأقسام: ## نظرة عامة, ## المدخلات, ## المخرجات + - جميع النصوص الوصفية والتوضيحية + - أوصاف المعاملات + +3. **جودة الترجمة:** + - استخدام اللغة العربية الفصحى المعاصرة + - الحفاظ على نبرة احترافية ولكن سهلة الفهم + - ضمان الدقة التقنية + - استخدام المصطلحات التقنية العربية القياسية + +4. **التنسيق:** + - الحفاظ على جميع تنسيقات Markdown + - الحفاظ على بنية الجداول + - عدم إضافة أي ملاحظة أو رابط في بداية الوثيقة (سيتم إضافتها تلقائيًا) + +الرجاء ترجمة الوثيقة التالية إلى العربية، دون تضمين الملاحظة الأولية للوثيقة: + +5. **قاعدة حاسمة - أسماء المخرجات:** العمود الأول من جدول المخرجات يحتوي على أسماء مخرجات (مثل `positive`، `negative`، `latent`، `image`، `model`، `conditioning`) التي يجب أن تبقى بالإنجليزية. ترجمة هذه الأسماء يؤدي إلى تكرار الإدخالات وكسر بنية المستند. + +توليد صوت كلامي من النص باستخدام محرك Starfish TTS من HeyGen. تشمل هذه العقدة أشهر الأصوات من HeyGen عبر 17 لغة. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|--------------|--------|--------| +| `text` | النص المراد تركيبه (حتى 5000 حرف). يجب أن يكون مدة الكلام المُولَّد ثانية واحدة على الأقل. | STRING | نعم | 1 إلى 5000 حرف | +| `voice` | الصوت المراد استخدامه (منتقي من أشهر الأصوات المتوافقة مع Starfish من HeyGen). | STRING | نعم | خيارات متعددة متاحة | +| `custom_voice_id` | معرف صوت HeyGen اختياري. عند تعيينه، يتجاوز الصوت المحدد أعلاه. يجب أن يدعم الصوت محرك Starfish. | STRING | لا | أي معرف صوت صالح من HeyGen | +| `speed` | مضاعف سرعة الكلام (الافتراضي: 1.0). | FLOAT | لا | 0.5 إلى 2.0 (الخطوة: 0.05) | +| `ssml` | معاملة النص كترميز SSML (للتحكم في التوقفات، والتوكيد، والنطق) (الافتراضي: False). | BOOLEAN | لا | True / False | +| `seed` | لا يُرسل إلى HeyGen؛ قم بتغييره لفرض إعادة التشغيل (الافتراضي: 42). | INT | لا | 0 إلى 2147483647 | + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|--------------| +| `AUDIO` | الصوت الكلامي المُركَّب المُولَّد من النص المُدخل. | AUDIO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/en.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/en.md new file mode 100644 index 000000000..6364e15a2 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/en.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Generate speech audio from text using HeyGen's Starfish TTS engine. This node includes HeyGen's most popular voices across 17 languages. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `text` | Text to synthesize (up to 5000 characters). The generated speech must be at least 1 second long. | STRING | Yes | 1 to 5000 characters | +| `voice` | Voice to use (curated from HeyGen's most popular Starfish-compatible voices). | STRING | Yes | Multiple options available | +| `custom_voice_id` | Optional HeyGen voice ID. When set, overrides the voice selected above. The voice must support the Starfish engine. | STRING | No | Any valid HeyGen voice ID | +| `speed` | Speech speed multiplier (default: 1.0). | FLOAT | No | 0.5 to 2.0 (step: 0.05) | +| `ssml` | Treat the text as SSML markup (for pauses, emphasis, and pronunciation control) (default: False). | BOOLEAN | No | True / False | +| `seed` | Not sent to HeyGen; change it to force a re-run (default: 42). | INT | No | 0 to 2147483647 | + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `AUDIO` | The synthesized speech audio generated from the input text. | AUDIO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/en.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/es.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/es.md new file mode 100644 index 000000000..2ceac1c55 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/es.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Genera audio de voz a partir de texto utilizando el motor TTS Starfish de HeyGen. Este nodo incluye las voces más populares de HeyGen en 17 idiomas. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|-----------|----------|-------| +| `text` | Texto a sintetizar (hasta 5000 caracteres). El audio generado debe tener al menos 1 segundo de duración. | STRING | Sí | 1 a 5000 caracteres | +| `voice` | Voz a utilizar (seleccionada entre las voces compatibles con Starfish más populares de HeyGen). | STRING | Sí | Múltiples opciones disponibles | +| `custom_voice_id` | ID de voz opcional de HeyGen. Cuando se define, anula la voz seleccionada anteriormente. La voz debe ser compatible con el motor Starfish. | STRING | No | Cualquier ID de voz válido de HeyGen | +| `speed` | Multiplicador de velocidad del habla (predeterminado: 1.0). | FLOAT | No | 0.5 a 2.0 (incremento: 0.05) | +| `ssml` | Tratar el texto como marcado SSML (para pausas, énfasis y control de pronunciación) (predeterminado: Falso). | BOOLEAN | No | Verdadero / Falso | +| `seed` | No se envía a HeyGen; cámbielo para forzar una nueva ejecución (predeterminado: 42). | INT | No | 0 a 2147483647 | + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|-------------|-------------|-----------| +| `AUDIO` | El audio de voz sintetizado generado a partir del texto de entrada. | AUDIO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/es.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fa.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fa.md new file mode 100644 index 000000000..3f1ca0f46 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fa.md @@ -0,0 +1,27 @@ +# HeyGenTextToSpeechNode + +### مرور کلی + +صدای گفتار را با استفاده از موتور TTS Starfish شرکت HeyGen از متن تولید کنید. این گره شامل محبوب‌ترین صداهای HeyGen در ۱۷ زبان است. + +### ورودی‌ها + +| پارامتر | توضیحات | نوع داده | اجباری | محدوده | +|-----------|-------------|-----------|----------|-------| +| `text` | متنی که باید سنتز شود (حداکثر ۵۰۰۰ کاراکتر). گفتار تولیدشده باید حداقل ۱ ثانیه طول داشته باشد. | STRING | بله | ۱ تا ۵۰۰۰ کاراکتر | +| `voice` | صدای مورد استفاده (انتخاب شده از محبوب‌ترین صداهای HeyGen سازگار با Starfish). | STRING | بله | چندین گزینه موجود است | +| `custom_voice_id` | شناسه اختیاری صدای HeyGen. در صورت تنظیم، صدای انتخاب‌شده در بالا را نادیده می‌گیرد. صدا باید از موتور Starfish پشتیبانی کند. | STRING | خیر | هر شناسه معتبر صدای HeyGen | +| `speed` | ضریب سرعت گفتار (پیش‌فرض: ۱.۰). | FLOAT | خیر | ۰.۵ تا ۲.۰ (گام: ۰.۰۵) | +| `ssml` | متن را به عنوان نشانه‌گذاری SSML در نظر بگیرید (برای مکث، تأکید و کنترل تلفظ) (پیش‌فرض: False). | BOOLEAN | خیر | True / False | +| `seed` | به HeyGen ارسال نمی‌شود؛ برای اجرای مجدد آن را تغییر دهید (پیش‌فرض: ۴۲). | INT | خیر | ۰ تا ۲۱۴۷۴۸۳۶۴۷ | + +### خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-------------|-------------|-----------| +| `AUDIO` | صدای گفتار سنتز شده از متن ورودی. | AUDIO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fr.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fr.md new file mode 100644 index 000000000..38e3810fd --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fr.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Générer un fichier audio de synthèse vocale à partir de texte en utilisant le moteur Starfish TTS de HeyGen. Ce nœud inclut les voix les plus populaires de HeyGen dans 17 langues. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `text` | Texte à synthétiser (jusqu'à 5000 caractères). La parole générée doit durer au moins 1 seconde. | STRING | Oui | 1 à 5000 caractères | +| `voice` | Voix à utiliser (sélectionnée parmi les voix Starfish les plus populaires de HeyGen). | STRING | Oui | Plusieurs options disponibles | +| `custom_voice_id` | Identifiant de voix HeyGen optionnel. Lorsqu'il est défini, remplace la voix sélectionnée ci-dessus. La voix doit prendre en charge le moteur Starfish. | STRING | Non | Tout identifiant de voix HeyGen valide | +| `speed` | Multiplicateur de vitesse de parole (par défaut : 1.0). | FLOAT | Non | 0,5 à 2,0 (pas : 0,05) | +| `ssml` | Traiter le texte comme un balisage SSML (pour les pauses, l'emphase et le contrôle de la prononciation) (par défaut : Faux). | BOOLEAN | Non | Vrai / Faux | +| `seed` | N'est pas envoyé à HeyGen ; modifiez-le pour forcer une nouvelle exécution (par défaut : 42). | INT | Non | 0 à 2147483647 | + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `AUDIO` | Le fichier audio de synthèse vocale généré à partir du texte d'entrée. | AUDIO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ja.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ja.md new file mode 100644 index 000000000..9c8f1a04a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ja.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +HeyGen の Starfish TTS エンジンを使用して、テキストから音声を生成します。このノードには、17言語に対応したHeyGenで最も人気のある音声が含まれています。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `text` | 合成するテキスト(最大5000文字)。生成される音声は少なくとも1秒以上の長さが必要です。 | STRING | はい | 1~5000文字 | +| `voice` | 使用する音声(HeyGenで最も人気のあるStarfish対応音声から厳選)。 | STRING | はい | 複数のオプションから選択可能 | +| `custom_voice_id` | オプションのHeyGen音声ID。設定すると、上記で選択した音声が上書きされます。この音声はStarfishエンジンをサポートしている必要があります。 | STRING | いいえ | 任意の有効なHeyGen音声ID | +| `speed` | 音声再生速度の倍率(デフォルト:1.0)。 | FLOAT | いいえ | 0.5~2.0(ステップ:0.05) | +| `ssml` | テキストをSSMLマークアップとして扱います(ポーズ、強調、発音の制御用)(デフォルト:False)。 | BOOLEAN | いいえ | True / False | +| `seed` | HeyGenには送信されません。変更すると再実行が強制されます(デフォルト:42)。 | INT | いいえ | 0~2147483647 | + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `AUDIO` | 入力テキストから生成された合成音声。 | AUDIO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ko.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ko.md new file mode 100644 index 000000000..bfd931ebd --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ko.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +HeyGen의 Starfish TTS 엔진을 사용하여 텍스트에서 음성 오디오를 생성합니다. 이 노드는 17개 언어에 걸쳐 HeyGen의 가장 인기 있는 음성을 포함합니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `text` | 합성할 텍스트(최대 5000자). 생성된 음성은 최소 1초 길이여야 합니다. | STRING | 예 | 1 ~ 5000자 | +| `voice` | 사용할 음성(HeyGen의 가장 인기 있는 Starfish 호환 음성에서 선별). | STRING | 예 | 여러 옵션 사용 가능 | +| `custom_voice_id` | 선택적 HeyGen 음성 ID. 설정 시 위에서 선택한 음성을 재정의합니다. 해당 음성은 Starfish 엔진을 지원해야 합니다. | STRING | 아니요 | 유효한 모든 HeyGen 음성 ID | +| `speed` | 음성 속도 배율(기본값: 1.0). | FLOAT | 아니요 | 0.5 ~ 2.0 (단계: 0.05) | +| `ssml` | 텍스트를 SSML 마크업으로 처리합니다(일시 정지, 강조 및 발음 제어용)(기본값: False). | BOOLEAN | 아니요 | True / False | +| `seed` | HeyGen으로 전송되지 않습니다. 변경하여 재실행을 강제합니다(기본값: 42). | INT | 아니요 | 0 ~ 2147483647 | + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `AUDIO` | 입력 텍스트에서 생성된 합성 음성 오디오입니다. | AUDIO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/pt-BR.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/pt-BR.md new file mode 100644 index 000000000..90323ea22 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/pt-BR.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Gere áudio de fala a partir de texto usando o mecanismo TTS Starfish da HeyGen. Este nó inclui as vozes mais populares da HeyGen em 17 idiomas. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|-----------|----------|-------| +| `text` | Texto a ser sintetizado (até 5000 caracteres). A fala gerada deve ter pelo menos 1 segundo de duração. | STRING | Sim | 1 a 5000 caracteres | +| `voice` | Voz a ser usada (selecionada entre as vozes compatíveis com Starfish mais populares da HeyGen). | STRING | Sim | Múltiplas opções disponíveis | +| `custom_voice_id` | ID de voz opcional da HeyGen. Quando definido, substitui a voz selecionada acima. A voz deve ser compatível com o mecanismo Starfish. | STRING | Não | Qualquer ID de voz válido da HeyGen | +| `speed` | Multiplicador de velocidade da fala (padrão: 1.0). | FLOAT | Não | 0.5 a 2.0 (passo: 0.05) | +| `ssml` | Tratar o texto como marcação SSML (para controle de pausas, ênfase e pronúncia) (padrão: Falso). | BOOLEAN | Não | Verdadeiro / Falso | +| `seed` | Não é enviado para a HeyGen; altere-o para forçar uma nova execução (padrão: 42). | INT | Não | 0 a 2147483647 | + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|-------------|-------------|-----------| +| `AUDIO` | O áudio de fala sintetizado gerado a partir do texto de entrada. | AUDIO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ru.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ru.md new file mode 100644 index 000000000..9ff72e66a --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ru.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Генерирует аудиоречь из текста с помощью TTS-движка Starfish от HeyGen. Этот узел включает самые популярные голоса HeyGen на 17 языках. + +## Входы + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `text` | Текст для синтеза (до 5000 символов). Сгенерированная речь должна быть длиной не менее 1 секунды. | STRING | Да | от 1 до 5000 символов | +| `voice` | Используемый голос (отобран из самых популярных голосов HeyGen, совместимых со Starfish). | STRING | Да | Доступно несколько вариантов | +| `custom_voice_id` | Необязательный идентификатор голоса HeyGen. При установке переопределяет выбранный выше голос. Голос должен поддерживать движок Starfish. | STRING | Нет | Любой действительный идентификатор голоса HeyGen | +| `speed` | Множитель скорости речи (по умолчанию: 1.0). | FLOAT | Нет | от 0.5 до 2.0 (шаг: 0.05) | +| `ssml` | Обрабатывать текст как разметку SSML (для пауз, акцентов и управления произношением) (по умолчанию: False). | BOOLEAN | Нет | True / False | +| `seed` | Не отправляется в HeyGen; измените его, чтобы принудительно перезапустить (по умолчанию: 42). | INT | Нет | от 0 до 2147483647 | + +## Выходы + +| Имя выхода | Описание | Тип данных | +|-------------|-------------|-----------| +| `AUDIO` | Синтезированное аудиоречи, сгенерированное из входного текста. | AUDIO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/tr.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/tr.md new file mode 100644 index 000000000..62c9b428c --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/tr.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +Metin kullanarak HeyGen'in Starfish TTS motoru ile konuşma sesi oluşturun. Bu düğüm, HeyGen'in 17 dildeki en popüler seslerini içerir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `text` | Sentezlenecek metin (en fazla 5000 karakter). Oluşturulan konuşma en az 1 saniye uzunluğunda olmalıdır. | STRING | Evet | 1 ila 5000 karakter | +| `voice` | Kullanılacak ses (HeyGen'in en popüler Starfish uyumlu sesleri arasından seçilmiştir). | STRING | Evet | Birden çok seçenek mevcut | +| `custom_voice_id` | İsteğe bağlı HeyGen ses kimliği. Ayarlandığında, yukarıda seçilen sesi geçersiz kılar. Sesin Starfish motorunu desteklemesi gerekir. | STRING | Hayır | Geçerli herhangi bir HeyGen ses kimliği | +| `speed` | Konuşma hızı çarpanı (varsayılan: 1.0). | FLOAT | Hayır | 0.5 ila 2.0 (adım: 0.05) | +| `ssml` | Metni SSML işaretlemesi olarak ele al (duraklamalar, vurgu ve telaffuz kontrolü için) (varsayılan: Yanlış). | BOOLEAN | Hayır | Doğru / Yanlış | +| `seed` | HeyGen'e gönderilmez; yeniden çalıştırmayı zorlamak için değiştirin (varsayılan: 42). | INT | Hayır | 0 ila 2147483647 | + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `AUDIO` | Girdi metninden oluşturulan sentezlenmiş konuşma sesi. | AUDIO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh-TW.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh-TW.md new file mode 100644 index 000000000..4e38d1336 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh-TW.md @@ -0,0 +1,25 @@ +# HeyGenTextToSpeechNode + +使用 HeyGen 的 Starfish TTS 引擎從文字生成語音音頻。此節點包含 HeyGen 最受歡迎的 17 種語言配音。 + +## 輸入 + +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `text` | 要合成的文字(最多 5000 個字元)。生成的語音長度必須至少 1 秒。 | STRING | 是 | 1 到 5000 個字元 | +| `voice` | 要使用的配音(從 HeyGen 最受歡迎的 Starfish 相容配音中精選)。 | STRING | 是 | 提供多個選項 | +| `custom_voice_id` | 可選的 HeyGen 配音 ID。設定後將覆蓋上方選擇的配音。該配音必須支援 Starfish 引擎。 | STRING | 否 | 任何有效的 HeyGen 配音 ID | +| `speed` | 語音速度倍率(預設值:1.0)。 | FLOAT | 否 | 0.5 到 2.0(步長:0.05) | +| `ssml` | 將文字視為 SSML 標記(用於控制停頓、強調和發音)(預設值:False)。 | BOOLEAN | 否 | True / False | +| `seed` | 不會發送到 HeyGen;更改它以強制重新執行(預設值:42)。 | INT | 否 | 0 到 2147483647 | + +## 輸出 + +| 輸出名稱 | 描述 | 資料類型 | +|-------------|-------------|-----------| +| `AUDIO` | 從輸入文字生成的合成語音音頻。 | AUDIO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh.md b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh.md new file mode 100644 index 000000000..9f8774086 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh.md @@ -0,0 +1,23 @@ +# HeyGenTextToSpeechNode + +使用 HeyGen 的 Starfish TTS 引擎从文本生成语音音频。此节点包含 HeyGen 最受欢迎的 17 种语言语音。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `text` | 要合成的文本(最多 5000 个字符)。生成的语音时长必须至少为 1 秒。 | STRING | 是 | 1 到 5000 个字符 | +| `voice` | 要使用的语音(从 HeyGen 最受欢迎的 Starfish 兼容语音中精选)。 | STRING | 是 | 提供多个选项 | +| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后将覆盖上方选择的语音。该语音必须支持 Starfish 引擎。 | STRING | 否 | 任意有效的 HeyGen 语音 ID | +| `speed` | 语速倍率(默认值:1.0)。 | FLOAT | 否 | 0.5 到 2.0(步长:0.05) | +| `ssml` | 将文本视为 SSML 标记(用于控制停顿、强调和发音)(默认值:False)。 | BOOLEAN | 否 | True / False | +| `seed` | 不会发送至 HeyGen;更改此值可强制重新运行(默认值:42)。 | INT | 否 | 0 到 2147483647 | + +## 输出 +| 输出名 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `AUDIO` | 根据输入文本生成的合成语音音频。 | AUDIO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTextToSpeechNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `82300626657db8ab16e96ae96b7dfe3291b77bf75efec35971dc772e5123cce7` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ar.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ar.md new file mode 100644 index 000000000..13651ecd1 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ar.md @@ -0,0 +1,27 @@ +# HeyGenVideoTranslateNode + +## نظرة عامة + +ترجمة فيديو منطوق إلى لغة أخرى مع استنساخ الصوت ومزامنة الشفاه. يقوم هذا العقد باستنساخ صوت المتحدث الأصلي وإعادة تحريك الفم ليتوافق مع الكلام المترجم، مما ينتج نتيجة طبيعية المظهر. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|---------|--------| +| `video` | فيديو يحتوي على كلام للترجمة. | VIDEO | نعم | - | +| `output_language` | اللغة المستهدفة للفيديو المترجم. | STRING | نعم | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | وضع 'speed' أسرع؛ وضع 'precision' ينتج مزامنة شفاه بجودة أعلى بتكلفة مضاعفة. | STRING | نعم | "speed"
"precision" | +| `translate_audio_only` | استبدال المسار الصوتي فقط مع الحفاظ على حركات الفم الأصلية (بدون مزامنة شفاه). (الافتراضي: False) | BOOLEAN | لا | True
False | +| `speaker_count` | عدد المتحدثين في الفيديو. 0 = كشف تلقائي. (الافتراضي: 0) | INT | لا | 0 إلى 10 | +| `seed` | لا يُرسل إلى HeyGen؛ قم بتغييره لفرض إعادة التشغيل. (الافتراضي: 42) | INT | لا | 0 إلى 2147483647 | + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|---------------| +| `video` | الفيديو المترجم مع استنساخ الصوت ومزامنة الشفاه المطبقة. | VIDEO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/en.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/en.md new file mode 100644 index 000000000..82e448ab9 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/en.md @@ -0,0 +1,25 @@ +# HeyGenVideoTranslateNode + +Translate a spoken video into another language with voice cloning and lip sync. This node clones the original speaker's voice and re-animates the mouth to match the translated speech, producing a natural-looking result. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `video` | Video with speech to translate. | VIDEO | Yes | - | +| `output_language` | Target language for the translated video. | STRING | Yes | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' is faster; 'precision' produces higher-quality lip sync at twice the price. | STRING | Yes | "speed"
"precision" | +| `translate_audio_only` | Only swap the audio track, keeping the original mouth movements (no lip sync). (default: False) | BOOLEAN | No | True
False | +| `speaker_count` | Number of speakers in the video. 0 = detect automatically. (default: 0) | INT | No | 0 to 10 | +| `seed` | Not sent to HeyGen; change it to force a re-run. (default: 42) | INT | No | 0 to 2147483647 | + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `video` | The translated video with voice cloning and lip sync applied. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/en.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/es.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/es.md new file mode 100644 index 000000000..2df030627 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/es.md @@ -0,0 +1,55 @@ +# HeyGenVideoTranslateNode + +Eres un experto en traducción técnica especializado en documentación de nodos ComfyUI del inglés al español. + +## Reglas de Traducción + +1. **Contenido que NO debe traducirse:** + - Nombres de parámetros entre comillas invertidas: `image`, `seed`, `model` + - Tipos de datos en MAYÚSCULAS: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, etc. + - Valores en columna Range: números, "auto", nombres de opciones + - Código, rutas de archivos + +2. **Contenido que SÍ debe traducirse:** + - Títulos de secciones: ## Descripción general, ## Entradas, ## Salidas + - Todo el texto descriptivo y explicativo + - Descripciones de parámetros + +3. **Calidad de traducción:** + - Usar español estándar y neutral + - Mantener tono profesional pero accesible + - Asegurar precisión técnica + - Usar terminología técnica estándar en español + +4. **Formato:** + - Mantener todo el formato Markdown + - Preservar estructura de tablas + - No agregar ninguna nota o enlace al inicio del documento (será agregado automáticamente) + +Por favor traduce la siguiente documentación al español, sin incluir la aviso de IA: + +5. **CRÍTICO - Nombres de salida:** La primera columna de la tabla de Salidas contiene nombres de salida (ej. `positive`, `negative`, `latent`, `image`, `model`, `conditioning`) que DEBEN permanecer en inglés. Traducir estos nombres crea entradas duplicadas y rompe la estructura del documento. + +Traduce un video hablado a otro idioma con clonación de voz y sincronización de labios. Este nodo clona la voz del hablante original y reanima la boca para que coincida con el discurso traducido, produciendo un resultado de apariencia natural. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Obligatorio | Rango | +|-----------|-------------|-----------|----------|-------| +| `video` | Video con discurso a traducir. | VIDEO | Sí | - | +| `output_language` | Idioma de destino para el video traducido. | STRING | Sí | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' es más rápido; 'precision' produce sincronización de labios de mayor calidad al doble de costo. | STRING | Sí | "speed"
"precision" | +| `translate_audio_only` | Solo reemplazar la pista de audio, manteniendo los movimientos originales de la boca (sin sincronización de labios). (predeterminado: False) | BOOLEAN | No | True
False | +| `speaker_count` | Número de hablantes en el video. 0 = detectar automáticamente. (predeterminado: 0) | INT | No | 0 a 10 | +| `seed` | No se envía a HeyGen; cámbielo para forzar una re-ejecución. (predeterminado: 42) | INT | No | 0 a 2147483647 | + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|-------------|-------------|-----------| +| `video` | El video traducido con clonación de voz y sincronización de labios aplicada. | VIDEO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/es.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fa.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fa.md new file mode 100644 index 000000000..f250912d0 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fa.md @@ -0,0 +1,27 @@ +# HeyGenVideoTranslateNode + +### مرور کلی + +یک ویدیوی گفتاری را به زبانی دیگر با شبیه‌سازی صدا و هماهنگی لب ترجمه می‌کند. این گره صدای گوینده اصلی را شبیه‌سازی کرده و حرکت لب را برای مطابقت با گفتار ترجمه‌شده بازپویایی می‌کند و نتیجه‌ای طبیعی به نظر می‌رساند. + +### ورودی‌ها + +| پارامتر | توضیحات | نوع داده | الزامی | محدوده | +|----------|----------|-----------|----------|-------| +| `video` | ویدیوی حاوی گفتار برای ترجمه. | VIDEO | بله | - | +| `output_language` | زبان هدف برای ویدیوی ترجمه‌شده. | STRING | بله | "عربی"
"بنگالی"
"چینی"
"دانمارکی"
"هلندی"
"انگلیسی"
"فرانسوی"
"آلمانی"
"یونانی"
"هندی"
"اندونزیایی"
"ایتالیایی"
"ژاپنی"
"کره‌ای"
"مالایی"
"لهستانی"
"پرتغالی"
"روسی"
"اسپانیایی"
"سوئدی"
"تامیلی"
"تلوگویی"
"تایلندی"
"ترکی"
"اوکراینی"
"ویتنامی" | +| `mode` | حالت 'speed' سریع‌تر است؛ حالت 'precision' هماهنگی لب با کیفیت بالاتر را با دو برابر هزینه ارائه می‌دهد. | STRING | بله | "speed"
"precision" | +| `translate_audio_only` | فقط آهنگ صوتی را تعویض می‌کند و حرکات اصلی لب را حفظ می‌کند (بدون هماهنگی لب). (پیش‌فرض: False) | BOOLEAN | خیر | True
False | +| `speaker_count` | تعداد گویندگان در ویدیو. 0 = تشخیص خودکار. (پیش‌فرض: 0) | INT | خیر | 0 تا 10 | +| `seed` | به HeyGen ارسال نمی‌شود؛ آن را تغییر دهید تا اجرای مجدد انجام شود. (پیش‌فرض: 42) | INT | خیر | 0 تا 2147483647 | + +### خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|------------|----------|-----------| +| `video` | ویدیوی ترجمه‌شده با شبیه‌سازی صدا و هماهنگی لب اعمال‌شده. | VIDEO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fr.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fr.md new file mode 100644 index 000000000..27f35e4ea --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fr.md @@ -0,0 +1,27 @@ +# HeyGenVideoTranslateNode + +### Traduction + +Traduisez une vidéo parlée dans une autre langue avec clonage vocal et synchronisation labiale. Ce nœud clone la voix du locuteur original et réanime la bouche pour correspondre à la parole traduite, produisant un résultat d'apparence naturelle. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `video` | Vidéo avec parole à traduire. | VIDEO | Oui | - | +| `output_language` | Langue cible pour la vidéo traduite. | STRING | Oui | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' est plus rapide ; 'precision' produit une synchronisation labiale de meilleure qualité au double du coût. | STRING | Oui | "speed"
"precision" | +| `translate_audio_only` | Remplace uniquement la piste audio, en conservant les mouvements de bouche d'origine (pas de synchronisation labiale). (par défaut : False) | BOOLEAN | Non | True
False | +| `speaker_count` | Nombre de locuteurs dans la vidéo. 0 = détection automatique. (par défaut : 0) | INT | Non | 0 à 10 | +| `seed` | N'est pas envoyé à HeyGen ; modifiez-le pour forcer une nouvelle exécution. (par défaut : 42) | INT | Non | 0 à 2147483647 | + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `video` | La vidéo traduite avec clonage vocal et synchronisation labiale appliqués. | VIDEO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ja.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ja.md new file mode 100644 index 000000000..be0bfac2f --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ja.md @@ -0,0 +1,55 @@ +# HeyGenVideoTranslateNode + +あなたは ComfyUI ノードドキュメントを英語から日本語に翻訳する技術翻訳の専門家です。 + +## 翻訳ルール + +1. **翻訳してはいけない内容:** + - バッククォートで囲まれたパラメータ名:`image`、`seed`、`model` + - 大文字のデータ型:IMAGE、STRING、INT、FLOAT、MODEL、CONDITIONING など + - Range列の値:数値、"auto"、オプション名 + - コード、ファイルパス + +2. **翻訳する内容:** + - セクション見出し:## 概要、## 入力、## 出力 + - すべての説明文 + - パラメータの説明 + +3. **翻訳品質:** + - 丁寧語(です・ます体)を使用 + - 専門的でありながらわかりやすい表現 + - 技術的な正確性を保つ + - 標準的な日本語技術用語を使用 + +4. **フォーマット:** + - すべての Markdown フォーマットを保持 + - 表の構造を維持 + - 免責事項は追加しないでください(システムが文書末尾に自動追加します) + +以下の英語ドキュメントを日本語に翻訳してください(免責事項は含めないでください): + +5. **重要ルール - 出力名:** 出力テーブルの最初の列には出力名(例:`positive`、`negative`、`latent`、`image`、`model`、`conditioning`)が含まれています。これらは**英語のままにしてください**。出力名を翻訳すると重複エントリが発生し、文書構造が壊れます。 + +音声付き動画を、音声クローンとリップシンクを用いて別の言語に翻訳します。このノードは、元の話者の声をクローンし、翻訳された音声に合わせて口の動きを再アニメーションすることで、自然な見た目の結果を生成します。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `video` | 翻訳対象の音声付き動画です。 | VIDEO | はい | - | +| `output_language` | 翻訳後の動画のターゲット言語です。 | STRING | はい | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed'は高速処理、'precision'は2倍のコストで高品質なリップシンクを生成します。 | STRING | はい | "speed"
"precision" | +| `translate_audio_only` | 音声トラックのみを差し替え、元の口の動きを維持します(リップシンクなし)。(デフォルト: False) | BOOLEAN | いいえ | True
False | +| `speaker_count` | 動画内の話者の人数です。0を指定すると自動検出されます。(デフォルト: 0) | INT | いいえ | 0 ~ 10 | +| `seed` | HeyGenには送信されません。値を変更すると強制的に再実行されます。(デフォルト: 42) | INT | いいえ | 0 ~ 2147483647 | + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `video` | 音声クローンとリップシンクが適用された翻訳済み動画です。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ko.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ko.md new file mode 100644 index 000000000..04a09c7a1 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ko.md @@ -0,0 +1,27 @@ +# HeyGenVideoTranslateNode + +## 개요 + +음성이 포함된 동영상을 음성 복제 및 립싱크와 함께 다른 언어로 번역합니다. 이 노드는 원래 화자의 음성을 복제하고 번역된 음성에 맞게 입 모양을 다시 애니메이션하여 자연스러운 결과를 생성합니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `video` | 번역할 음성이 포함된 동영상입니다. | VIDEO | 예 | - | +| `output_language` | 번역된 동영상의 대상 언어입니다. | STRING | 예 | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed'는 더 빠르며, 'precision'은 두 배의 비용으로 더 높은 품질의 립싱크를 생성합니다. | STRING | 예 | "speed"
"precision" | +| `translate_audio_only` | 오디오 트랙만 교체하고 원래 입 모양을 유지합니다(립싱크 없음). (기본값: False) | BOOLEAN | 아니요 | True
False | +| `speaker_count` | 동영상에 있는 화자 수입니다. 0 = 자동 감지. (기본값: 0) | INT | 아니요 | 0 ~ 10 | +| `seed` | HeyGen으로 전송되지 않습니다. 변경하면 재실행됩니다. (기본값: 42) | INT | 아니요 | 0 ~ 2147483647 | + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `video` | 음성 복제 및 립싱크가 적용된 번역된 동영상입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/pt-BR.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/pt-BR.md new file mode 100644 index 000000000..6683b237e --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/pt-BR.md @@ -0,0 +1,25 @@ +# HeyGenVideoTranslateNode + +Traduza um vídeo falado para outro idioma com clonagem de voz e sincronização labial. Este nó clona a voz do falante original e reanima a boca para corresponder à fala traduzida, produzindo um resultado de aparência natural. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-----------|--------------|-------------|-------| +| `video` | Vídeo com fala a ser traduzida. | VIDEO | Sim | - | +| `output_language` | Idioma de destino para o vídeo traduzido. | STRING | Sim | "Árabe"
"Bengali"
"Chinês"
"Dinamarquês"
"Holandês"
"Inglês"
"Francês"
"Alemão"
"Grego"
"Hindi"
"Indonésio"
"Italiano"
"Japonês"
"Coreano"
"Malaio"
"Polonês"
"Português"
"Russo"
"Espanhol"
"Sueco"
"Tâmil"
"Telugu"
"Tailandês"
"Turco"
"Ucraniano"
"Vietnamita" | +| `mode` | 'speed' é mais rápido; 'precision' produz sincronização labial de maior qualidade pelo dobro do preço. | STRING | Sim | "speed"
"precision" | +| `translate_audio_only` | Apenas troca a trilha de áudio, mantendo os movimentos originais da boca (sem sincronização labial). (padrão: False) | BOOLEAN | Não | Verdadeiro
Falso | +| `speaker_count` | Número de falantes no vídeo. 0 = detectar automaticamente. (padrão: 0) | INT | Não | 0 a 10 | +| `seed` | Não enviado ao HeyGen; altere-o para forçar uma nova execução. (padrão: 42) | INT | Não | 0 a 2147483647 | + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|---------------|-----------|--------------| +| `video` | O vídeo traduzido com clonagem de voz e sincronização labial aplicadas. | VIDEO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ru.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ru.md new file mode 100644 index 000000000..64d356791 --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ru.md @@ -0,0 +1,25 @@ +# HeyGenVideoTranslateNode + +Переводит видео с речью на другой язык с клонированием голоса и синхронизацией губ. Этот узел клонирует голос исходного говорящего и повторно анимирует рот в соответствии с переведенной речью, создавая естественный результат. + +## Входы + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|----------|----------|------------|--------------|----------| +| `video` | Видео с речью для перевода. | VIDEO | Да | - | +| `output_language` | Целевой язык для переведенного видео. | STRING | Да | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' (скорость) быстрее; 'precision' (точность) обеспечивает более качественную синхронизацию губ по двойной цене. | STRING | Да | "speed"
"precision" | +| `translate_audio_only` | Только заменить аудиодорожку, сохранив исходные движения рта (без синхронизации губ). (по умолчанию: False) | BOOLEAN | Нет | True
False | +| `speaker_count` | Количество говорящих в видео. 0 = определить автоматически. (по умолчанию: 0) | INT | Нет | от 0 до 10 | +| `seed` | Не отправляется в HeyGen; измените его, чтобы принудительно перезапустить. (по умолчанию: 42) | INT | Нет | от 0 до 2147483647 | + +## Выходы + +| Имя выхода | Описание | Тип данных | +|------------|----------|------------| +| `video` | Переведенное видео с клонированием голоса и синхронизацией губ. | VIDEO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/tr.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/tr.md new file mode 100644 index 000000000..000fa819d --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/tr.md @@ -0,0 +1,55 @@ +# HeyGenVideoTranslateNode + +ComfyUI düğüm belgelerini İngilizceden Türkçeye çevirmede uzmanlaşmış teknik çeviri uzmanısınız. + +## Çeviri Kuralları + +1. **Çevrilmemesi gereken içerik:** + - Ters tırnak içindeki parametre adları: `image`, `seed`, `model` + - BÜYÜK harflerle veri türleri: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, vb. + - Range sütunundaki değerler: sayılar, "auto", seçenek adları + - Kod, dosya yolları + +2. **Çevrilmesi gereken içerik:** + - Bölüm başlıkları: ## Genel Bakış, ## Girdiler, ## Çıktılar + - Tüm açıklayıcı metinler + - Parametre açıklamaları + +3. **Çeviri kalitesi:** + - Standart Türkçe kullanın + - Profesyonel ama anlaşılır bir üslup koruyun + - Teknik doğruluğu sağlayın + - Standart Türkçe teknik terminolojiyi kullanın + +4. **Format:** + - Tüm Markdown biçimlendirmesini koruyun + - Tablo yapısını koruyun + - Belgenin başına herhangi bir not veya bağlantı eklemeyin (otomatik olarak eklenecektir) + +Lütfen aşağıdaki belgeyi Türkçeye çevirin (belgenin başlangıç notunu dahil etmeyin): + +5. **KRİTİK KURAL - Çıktı Adları:** Çıktılar tablosunun ilk sütunu, İngilizce kalması ZORUNLU olan çıktı adlarını içerir (örn. `positive`, `negative`, `latent`, `image`, `model`, `conditioning`). Çıktı adlarını çevirmek yinelenen girdilere ve belge yapısının bozulmasına neden olur. + +Sesli bir videoyu, ses klonlama ve dudak senkronizasyonu ile başka bir dile çevirin. Bu düğüm, orijinal konuşmacının sesini klonlar ve çevrilen konuşmaya uyacak şekilde ağzı yeniden canlandırarak doğal görünümlü bir sonuç üretir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Gerekli | Aralık | +|-----------|-------------|-----------|----------|-------| +| `video` | Çevrilecek konuşma içeren video. | VIDEO | Evet | - | +| `output_language` | Çevrilen video için hedef dil. | STRING | Evet | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' daha hızlıdır; 'precision' iki kat fiyata daha yüksek kaliteli dudak senkronizasyonu üretir. | STRING | Evet | "speed"
"precision" | +| `translate_audio_only` | Yalnızca ses parçasını değiştirir, orijinal ağız hareketlerini korur (dudak senkronizasyonu yok). (varsayılan: False) | BOOLEAN | Hayır | True
False | +| `speaker_count` | Videodaki konuşmacı sayısı. 0 = otomatik olarak algıla. (varsayılan: 0) | INT | Hayır | 0 ile 10 arası | +| `seed` | HeyGen'e gönderilmez; yeniden çalıştırmayı zorlamak için değiştirin. (varsayılan: 42) | INT | Hayır | 0 ile 2147483647 arası | + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `video` | Ses klonlama ve dudak senkronizasyonu uygulanmış çevrilmiş video. | VIDEO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh-TW.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh-TW.md new file mode 100644 index 000000000..7718632df --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh-TW.md @@ -0,0 +1,23 @@ +# HeyGenVideoTranslateNode + +將一段含語音的影片翻譯成另一種語言,並進行語音克隆與唇形同步。此節點會克隆原始說話者的聲音,並重新動畫化嘴部動作以匹配翻譯後的語音,產生自然逼真的效果。 + +## 輸入 +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `video` | 含有待翻譯語音的影片。 | VIDEO | 是 | - | +| `output_language` | 翻譯後影片的目標語言。 | STRING | 是 | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' 模式速度較快;'precision' 模式可產生更高品質的唇形同步,但成本為兩倍。 | STRING | 是 | "speed"
"precision" | +| `translate_audio_only` | 僅更換音軌,保留原始嘴部動作(不進行唇形同步)。(預設值:False) | BOOLEAN | 否 | True
False | +| `speaker_count` | 影片中的說話者人數。0 = 自動偵測。(預設值:0) | INT | 否 | 0 至 10 | +| `seed` | 不會發送至 HeyGen;變更此值可強制重新執行。(預設值:42) | INT | 否 | 0 至 2147483647 | + +## 輸出 +| 輸出名稱 | 描述 | 資料類型 | +|-------------|-------------|-----------| +| `video` | 經過語音克隆與唇形同步處理後的翻譯影片。 | VIDEO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh.md b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh.md new file mode 100644 index 000000000..a90c63caa --- /dev/null +++ b/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh.md @@ -0,0 +1,61 @@ +# HeyGenVideoTranslateNode + +你是一位专业的技术文档翻译专家,专门负责将 ComfyUI 节点文档从英文翻译成简体中文。 + +## 翻译规则 + +1. **必须保持不变的内容:** + - 参数名必须保持英文,用反引号包裹:`image`、`seed`、`model` + - 数据类型必须保持英文大写:IMAGE、STRING、INT、FLOAT、MODEL、CONDITIONING 等 + - Range 列中的值保持不变:数字、"auto"、选项名称 + - 不要翻译任何代码、文件路径 + +2. **需要翻译的内容:** + - 章节标题翻译为:## 概述、## 输入、## 输出 + - 所有描述性文字和说明 + - 参数描述 + +3. **翻译质量要求:** + - 使用自然流畅的简体中文 + - 保持专业但易懂的语气 + - 确保技术准确性 + - 使用中文技术文档的标准术语 + +4. **格式要求:** + - 保持所有 Markdown 格式不变 + - 保持表格结构完整 + - 不要添加免责声明(系统将自动添加到文档底部) + +## 翻译示例 + +**英文:** +This node combines two CLIP models by adding the second model to the first. + +**中文:** +此节点通过将第二个 CLIP 模型添加到第一个模型来组合两个 CLIP 模型。 + +请将以下英文文档翻译成简体中文,不要包含免责声明: + +5. **关键规则 - 输出名称:** 输出表(Outputs)的第一列是输出名(如 `positive`、`negative`、`latent`、`image`、`model`、`conditioning`),**必须保持英文不变**。翻译输出名会导致输出表中出现重复名称,破坏文档结构。 + +将带语音的视频翻译成另一种语言,并应用语音克隆和唇形同步。此节点会克隆原始说话者的语音,并重新驱动口型以匹配翻译后的语音,从而产生自然逼真的效果。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必需 | 取值范围 | +|-----------|-------------|-----------|----------|-------| +| `video` | 包含待翻译语音的视频。 | VIDEO | 是 | - | +| `output_language` | 翻译后视频的目标语言。 | STRING | 是 | "Arabic"
"Bengali"
"Chinese"
"Danish"
"Dutch"
"English"
"French"
"German"
"Greek"
"Hindi"
"Indonesian"
"Italian"
"Japanese"
"Korean"
"Malay"
"Polish"
"Portuguese"
"Russian"
"Spanish"
"Swedish"
"Tamil"
"Telugu"
"Thai"
"Turkish"
"Ukrainian"
"Vietnamese" | +| `mode` | 'speed' 模式速度更快;'precision' 模式可生成更高质量的唇形同步,但成本翻倍。 | STRING | 是 | "speed"
"precision" | +| `translate_audio_only` | 仅替换音轨,保留原始口型动作(不进行唇形同步)。(默认值:False) | BOOLEAN | 否 | True
False | +| `speaker_count` | 视频中的说话者数量。0 表示自动检测。(默认值:0) | INT | 否 | 0 到 10 | +| `seed` | 不会发送至 HeyGen;更改此值可强制重新运行。(默认值:42) | INT | 否 | 0 到 2147483647 | + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `video` | 经过语音克隆和唇形同步处理后的翻译视频。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenVideoTranslateNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `31056060b6309b8ec28b37b353322403e173fd2862b56021392dba24e7a15f69` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/ar.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/ar.md new file mode 100644 index 000000000..4bbbd29d9 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/ar.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +هذه العقدة تعيد مزامنة حركة الفم في مقطع فيديو مع ملف صوتي جديد للكلام باستخدام واجهة برمجة تطبيقات sync.so. تتعامل تلقائيًا مع اللقطات القريبة والملفات الجانبية والعوائق مع الحفاظ على تعبير المتحدث. تعتمد التكلفة على مدة المخرجات. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|---------|--------| +| `video` | لقطات المتحدث المراد إعادة مزامنتها. حتى دقة 4K (4096×2160)؛ يعمل معدل الإطارات الثابت 24/25/30 إطارًا في الثانية بشكل أفضل. | VIDEO | نعم | - | +| `audio` | صوت الكلام لمزامنة حركة الفم معه. | AUDIO | نعم | - | +| `seed` | البذرة تتحكم فيما إذا كانت العقدة ستعيد التشغيل؛ النتائج غير حتمية بغض النظر عن البذرة (الافتراضي: 42). | INT | نعم | 0 إلى 2147483647 | +| `model` | نموذج توليد sync.so. | COMBO | نعم | انظر أدناه | + +معامل `model` هو قائمة ديناميكية تتضمن المعاملات الفرعية التالية: + +| المعامل الفرعي | الوصف | نوع البيانات | إلزامي | النطاق | +|----------------|-------|---------------|---------|--------| +| `sync_mode` | كيفية التعامل مع عدم تطابق المدة بين الفيديو والصوت؛ يحدد هذا أيضًا طول المخرجات (الافتراضي: "bounce"). | COMBO | نعم | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | أي وجه سيتم مزامنة الشفاه معه عند ظهور عدة أشخاص (الافتراضي: "default"). | COMBO | نعم | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | إطار الفيديو المستخدم لتحديد موقع المتحدث. يُستخدم فقط عندما يكون `speaker_selection` هو "coordinates" (الافتراضي: 0). | INT | لا | 0 إلى 1000000 | +| `speaker_x` | إحداثي X بالبكسل لوجه المتحدث. يُستخدم فقط عندما يكون `speaker_selection` هو "coordinates" (الافتراضي: 0). | INT | لا | 0 إلى 4096 | +| `speaker_y` | إحداثي Y بالبكسل لوجه المتحدث. يُستخدم فقط عندما يكون `speaker_selection` هو "coordinates" (الافتراضي: 0). | INT | لا | 0 إلى 4096 | + +**خيارات وضع المزامنة:** +- `bounce`: يتم تشغيل الفيديو للأمام ثم للخلف حتى ينتهي الصوت (المخرجات = طول الصوت) +- `loop`: يتم إعادة تشغيل الفيديو حتى ينتهي الصوت (المخرجات = طول الصوت) +- `remap`: يتم تمديد الفيديو زمنيًا لمطابقة الصوت (المخرجات = طول الصوت) +- `cut_off`: يتم قص المسار الأطول (المخرجات = الطول الأقصر) +- `silence`: لا يتم قص أي شيء؛ يتم حشو المسار الأقصر (المخرجات = الطول الأطول) + +**خيارات اختيار المتحدث:** +- `default`: السماح للنموذج بتحديد الوجه المراد مزامنة الشفاه معه +- `auto-detect`: كشف وتتبع المتحدث النشط +- `coordinates`: استهداف الوجه عند البكسل (`speaker_x`, `speaker_y`) في الإطار المختار بواسطة `speaker_frame` + +**القيود:** +- يجب ألا تتجاوز دقة الفيديو 4K (4096×2160). ستؤدي مقاطع الفيديو التي تتجاوز هذا الحد إلى ظهور خطأ. +- يجب ألا تتجاوز مدة الصوت 600 ثانية (10 دقائق). +- تُستخدم معاملات `speaker_frame` و`speaker_x` و`speaker_y` فقط عندما يتم تعيين `speaker_selection` على "coordinates". + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|---------------| +| `video` | الفيديو المعاد مزامنته مع حركة الفم المطابقة للصوت المقدم. | VIDEO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/en.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/en.md new file mode 100644 index 000000000..d6d8e8908 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/en.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +This node re-syncs mouth movement in a video to new speech audio using the sync.so API. It handles close-ups, profiles and obstructions automatically while preserving the speaker's expression. Cost scales with output duration. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `video` | Footage of the speaker to re-sync. Up to 4K (4096x2160); a constant frame rate of 24/25/30 fps works best. | VIDEO | Yes | - | +| `audio` | Speech audio to sync the mouth to. | AUDIO | Yes | - | +| `seed` | Seed controls whether the node should re-run; results are non-deterministic regardless of seed (default: 42). | INT | Yes | 0 to 2147483647 | +| `model` | sync.so generation model. | COMBO | Yes | See below | + +The `model` parameter is a dynamic combo that includes the following sub-parameters: + +| Sub-parameter | Description | Data Type | Required | Range | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | How to handle a duration mismatch between video and audio; this also sets the output length (default: "bounce"). | COMBO | Yes | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Which face to lipsync when several people are visible (default: "default"). | COMBO | Yes | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Video frame used to locate the speaker. Only used when `speaker_selection` is "coordinates" (default: 0). | INT | No | 0 to 1000000 | +| `speaker_x` | X pixel coordinate of the speaker's face. Only used when `speaker_selection` is "coordinates" (default: 0). | INT | No | 0 to 4096 | +| `speaker_y` | Y pixel coordinate of the speaker's face. Only used when `speaker_selection` is "coordinates" (default: 0). | INT | No | 0 to 4096 | + +**Sync mode options:** +- `bounce`: Video plays forward then backward until the audio ends (output = audio length) +- `loop`: Video restarts until the audio ends (output = audio length) +- `remap`: Video is time-stretched to match the audio (output = audio length) +- `cut_off`: The longer track is trimmed (output = shorter length) +- `silence`: Nothing is trimmed; the shorter track is padded (output = longer length) + +**Speaker selection options:** +- `default`: Let the model decide which face to lipsync +- `auto-detect`: Detect and follow the active speaker +- `coordinates`: Target the face at pixel (`speaker_x`, `speaker_y`) in the frame chosen by `speaker_frame` + +**Constraints:** +- Video resolution must not exceed 4K (4096x2160). Videos above this limit will raise an error. +- Audio duration must not exceed 600 seconds (10 minutes). +- The `speaker_frame`, `speaker_x`, and `speaker_y` parameters are only used when `speaker_selection` is set to "coordinates". + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `video` | The re-synced video with mouth movement matched to the provided audio. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/en.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/es.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/es.md new file mode 100644 index 000000000..51c0661aa --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/es.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +Este nodo resincroniza el movimiento de la boca en un video con un nuevo audio de voz utilizando la API de sync.so. Maneja automáticamente primeros planos, perfiles y obstrucciones, preservando la expresión del hablante. El costo se escala según la duración de la salida. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Requerido | Rango | +|-----------|-------------|--------------|-----------|-------| +| `video` | Metraje del hablante a resincronizar. Hasta 4K (4096x2160); una tasa de fotogramas constante de 24/25/30 fps funciona mejor. | VIDEO | Sí | - | +| `audio` | Audio de voz para sincronizar el movimiento de la boca. | AUDIO | Sí | - | +| `seed` | La semilla controla si el nodo debe re-ejecutarse; los resultados no son deterministas independientemente de la semilla (predeterminado: 42). | INT | Sí | 0 a 2147483647 | +| `model` | Modelo de generación de sync.so. | COMBO | Sí | Ver más abajo | + +El parámetro `model` es un combo dinámico que incluye los siguientes subparámetros: + +| Subparámetro | Descripción | Tipo de Dato | Requerido | Rango | +|--------------|-------------|--------------|-----------|-------| +| `sync_mode` | Cómo manejar una discrepancia de duración entre el video y el audio; esto también establece la longitud de la salida (predeterminado: "bounce"). | COMBO | Sí | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Qué rostro sincronizar los labios cuando varias personas son visibles (predeterminado: "default"). | COMBO | Sí | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Fotograma del video utilizado para localizar al hablante. Solo se usa cuando `speaker_selection` es "coordinates" (predeterminado: 0). | INT | No | 0 a 1000000 | +| `speaker_x` | Coordenada X en píxeles del rostro del hablante. Solo se usa cuando `speaker_selection` es "coordinates" (predeterminado: 0). | INT | No | 0 a 4096 | +| `speaker_y` | Coordenada Y en píxeles del rostro del hablante. Solo se usa cuando `speaker_selection` es "coordinates" (predeterminado: 0). | INT | No | 0 a 4096 | + +**Opciones del modo de sincronización:** +- `bounce`: El video se reproduce hacia adelante y luego hacia atrás hasta que el audio termina (salida = duración del audio) +- `loop`: El video se reinicia hasta que el audio termina (salida = duración del audio) +- `remap`: El video se estira en el tiempo para coincidir con el audio (salida = duración del audio) +- `cut_off`: La pista más larga se recorta (salida = duración más corta) +- `silence`: No se recorta nada; la pista más corta se rellena con silencio (salida = duración más larga) + +**Opciones de selección del hablante:** +- `default`: Dejar que el modelo decida qué rostro sincronizar los labios +- `auto-detect`: Detectar y seguir al hablante activo +- `coordinates`: Apuntar al rostro en las coordenadas de píxeles (`speaker_x`, `speaker_y`) en el fotograma elegido por `speaker_frame` + +**Restricciones:** +- La resolución del video no debe exceder 4K (4096x2160). Los videos por encima de este límite generarán un error. +- La duración del audio no debe exceder los 600 segundos (10 minutos). +- Los parámetros `speaker_frame`, `speaker_x` y `speaker_y` solo se utilizan cuando `speaker_selection` está configurado en "coordinates". + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `video` | El video resincronizado con el movimiento de la boca ajustado al audio proporcionado. | VIDEO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/es.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/fa.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/fa.md new file mode 100644 index 000000000..92d441f98 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/fa.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +این گره حرکت لب را در یک ویدیو با صدای گفتار جدید با استفاده از API sync.so همگام‌سازی می‌کند. به‌طور خودکار نماهای نزدیک، نیم‌رخ و موانع را مدیریت کرده و حالت چهره گوینده را حفظ می‌کند. هزینه با توجه به مدت زمان خروجی محاسبه می‌شود. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | الزامی | محدوده | +|---------|---------|----------|--------|--------| +| `video` | فیلم گوینده برای همگام‌سازی مجدد. تا رزولوشن 4K (4096x2160)؛ نرخ فریم ثابت 24/25/30 فریم بر ثانیه بهترین نتیجه را دارد. | VIDEO | بله | - | +| `audio` | صدای گفتار برای همگام‌سازی حرکت لب. | AUDIO | بله | - | +| `seed` | دانه (seed) مشخص می‌کند که گره دوباره اجرا شود یا خیر؛ نتایج صرف‌نظر از دانه غیرقطعی هستند (پیش‌فرض: 42). | INT | بله | 0 تا 2147483647 | +| `model` | مدل تولید sync.so. | COMBO | بله | زیر را ببینید | + +پارامتر `model` یک لیست پویا است که شامل زیرپارامترهای زیر می‌باشد: + +| زیرپارامتر | توضیحات | نوع داده | الزامی | محدوده | +|------------|---------|----------|--------|--------| +| `sync_mode` | نحوه مدیریت عدم تطابق مدت زمان بین ویدیو و صدا؛ همچنین طول خروجی را تعیین می‌کند (پیش‌فرض: "bounce"). | COMBO | بله | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | کدام چهره برای همگام‌سازی لب انتخاب شود وقتی چند نفر قابل مشاهده هستند (پیش‌فرض: "default"). | COMBO | بله | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | فریم ویدیو برای مکان‌یابی گوینده. فقط زمانی استفاده می‌شود که `speaker_selection` روی "coordinates" تنظیم شده باشد (پیش‌فرض: 0). | INT | خیر | 0 تا 1000000 | +| `speaker_x` | مختصات X پیکسلی چهره گوینده. فقط زمانی استفاده می‌شود که `speaker_selection` روی "coordinates" تنظیم شده باشد (پیش‌فرض: 0). | INT | خیر | 0 تا 4096 | +| `speaker_y` | مختصات Y پیکسلی چهره گوینده. فقط زمانی استفاده می‌شود که `speaker_selection` روی "coordinates" تنظیم شده باشد (پیش‌فرض: 0). | INT | خیر | 0 تا 4096 | + +**گزینه‌های حالت همگام‌سازی:** +- `bounce`: ویدیو به جلو و سپس عقب پخش می‌شود تا زمانی که صدا تمام شود (خروجی = طول صدا) +- `loop`: ویدیو دوباره شروع می‌شود تا زمانی که صدا تمام شود (خروجی = طول صدا) +- `remap`: ویدیو برای تطبیق با صدا کشیده می‌شود (خروجی = طول صدا) +- `cut_off`: مسیر طولانی‌تر کوتاه می‌شود (خروجی = طول کوتاه‌تر) +- `silence`: هیچ چیزی کوتاه نمی‌شود؛ مسیر کوتاه‌تر پر می‌شود (خروجی = طول بلندتر) + +**گزینه‌های انتخاب گوینده:** +- `default`: اجازه دهید مدل تصمیم بگیرد کدام چهره را همگام‌سازی کند +- `auto-detect`: گوینده فعال را تشخیص داده و دنبال کند +- `coordinates`: چهره را در مختصات پیکسلی (`speaker_x`, `speaker_y`) در فریم انتخاب‌شده توسط `speaker_frame` هدف قرار دهد + +**محدودیت‌ها:** +- رزولوشن ویدیو نباید از 4K (4096x2160) تجاوز کند. ویدیوهای بالاتر از این حد خطا ایجاد می‌کنند. +- مدت زمان صدا نباید از 600 ثانیه (10 دقیقه) تجاوز کند. +- پارامترهای `speaker_frame`، `speaker_x` و `speaker_y` فقط زمانی استفاده می‌شوند که `speaker_selection` روی "coordinates" تنظیم شده باشد. + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `video` | ویدیوی همگام‌سازی‌شده با حرکت لب مطابق با صدای ارائه‌شده. | VIDEO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/fr.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/fr.md new file mode 100644 index 000000000..7ce695833 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/fr.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +Ce nœud resynchronise les mouvements de la bouche dans une vidéo avec un nouveau fichier audio de parole via l'API sync.so. Il gère automatiquement les gros plans, les profils et les obstructions tout en préservant l'expression de l'orateur. Le coût est proportionnel à la durée de la sortie. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `video` | Séquence vidéo de l'orateur à resynchroniser. Jusqu'en 4K (4096x2160) ; une fréquence d'images constante de 24/25/30 ips donne les meilleurs résultats. | VIDEO | Oui | - | +| `audio` | Audio de la parole pour synchroniser la bouche. | AUDIO | Oui | - | +| `seed` | La graine détermine si le nœud doit être réexécuté ; les résultats sont non déterministes quelle que soit la graine (par défaut : 42). | INT | Oui | 0 à 2147483647 | +| `model` | Modèle de génération sync.so. | COMBO | Oui | Voir ci-dessous | + +Le paramètre `model` est une liste déroulante dynamique qui inclut les sous-paramètres suivants : + +| Sous-paramètre | Description | Type de données | Requis | Plage | +|----------------|-------------|-----------------|--------|-------| +| `sync_mode` | Comment gérer une différence de durée entre la vidéo et l'audio ; cela définit également la longueur de la sortie (par défaut : "bounce"). | COMBO | Oui | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Quel visage synchroniser lorsque plusieurs personnes sont visibles (par défaut : "default"). | COMBO | Oui | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Image vidéo utilisée pour localiser l'orateur. Utilisé uniquement lorsque `speaker_selection` est "coordinates" (par défaut : 0). | INT | Non | 0 à 1000000 | +| `speaker_x` | Coordonnée X en pixels du visage de l'orateur. Utilisé uniquement lorsque `speaker_selection` est "coordinates" (par défaut : 0). | INT | Non | 0 à 4096 | +| `speaker_y` | Coordonnée Y en pixels du visage de l'orateur. Utilisé uniquement lorsque `speaker_selection` est "coordinates" (par défaut : 0). | INT | Non | 0 à 4096 | + +**Options du mode de synchronisation :** +- `bounce` : La vidéo est lue en avant puis en arrière jusqu'à la fin de l'audio (sortie = longueur de l'audio) +- `loop` : La vidéo redémarre jusqu'à la fin de l'audio (sortie = longueur de l'audio) +- `remap` : La vidéo est étirée temporellement pour correspondre à l'audio (sortie = longueur de l'audio) +- `cut_off` : La piste la plus longue est rognée (sortie = longueur la plus courte) +- `silence` : Rien n'est rogné ; la piste la plus courte est complétée par du silence (sortie = longueur la plus longue) + +**Options de sélection de l'orateur :** +- `default` : Laisser le modèle décider quel visage synchroniser +- `auto-detect` : Détecter et suivre l'orateur actif +- `coordinates` : Cibler le visage aux coordonnées en pixels (`speaker_x`, `speaker_y`) dans l'image choisie par `speaker_frame` + +**Contraintes :** +- La résolution vidéo ne doit pas dépasser 4K (4096x2160). Les vidéos dépassant cette limite généreront une erreur. +- La durée audio ne doit pas dépasser 600 secondes (10 minutes). +- Les paramètres `speaker_frame`, `speaker_x` et `speaker_y` sont uniquement utilisés lorsque `speaker_selection` est défini sur "coordinates". + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `video` | La vidéo resynchronisée avec les mouvements de la bouche correspondant à l'audio fourni. | VIDEO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/ja.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/ja.md new file mode 100644 index 000000000..f7221f8c9 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/ja.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +このノードは、sync.so APIを使用して、動画内の口の動きを新しい音声に再同期します。クローズアップ、横向き、遮蔽を自動的に処理しながら、話者の表情を保持します。コストは出力時間に応じて変動します。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `video` | 再同期する話者の映像です。最大4K(4096x2160)まで対応し、24/25/30fpsの固定フレームレートが最適です。 | VIDEO | はい | - | +| `audio` | 口の動きを同期させる音声です。 | AUDIO | はい | - | +| `seed` | シードはノードを再実行するかどうかを制御します。シードに関わらず結果は非決定的です(デフォルト:42)。 | INT | はい | 0 ~ 2147483647 | +| `model` | sync.soの生成モデルです。 | COMBO | はい | 下記参照 | + +`model`パラメータは動的なコンボであり、以下のサブパラメータを含みます: + +| サブパラメータ | 説明 | データ型 | 必須 | 範囲 | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | 動画と音声の長さが一致しない場合の処理方法です。出力の長さも設定します(デフォルト:"bounce")。 | COMBO | はい | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | 複数の人物が映っている場合に、どの顔にリップシンクを行うかを指定します(デフォルト:"default")。 | COMBO | はい | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | 話者を特定するために使用する動画フレームです。`speaker_selection`が"coordinates"の場合のみ使用されます(デフォルト:0)。 | INT | いいえ | 0 ~ 1000000 | +| `speaker_x` | 話者の顔のXピクセル座標です。`speaker_selection`が"coordinates"の場合のみ使用されます(デフォルト:0)。 | INT | いいえ | 0 ~ 4096 | +| `speaker_y` | 話者の顔のYピクセル座標です。`speaker_selection`が"coordinates"の場合のみ使用されます(デフォルト:0)。 | INT | いいえ | 0 ~ 4096 | + +**同期モードのオプション:** +- `bounce`:動画が最後まで再生された後、逆再生され、音声が終了するまで繰り返します(出力 = 音声の長さ) +- `loop`:動画が音声の終了まで再スタートします(出力 = 音声の長さ) +- `remap`:動画が音声に合わせて時間伸縮されます(出力 = 音声の長さ) +- `cut_off`:長い方のトラックがトリミングされます(出力 = 短い方の長さ) +- `silence`:何もトリミングされず、短い方のトラックがパディングされます(出力 = 長い方の長さ) + +**話者選択のオプション:** +- `default`:モデルにリップシンクする顔を決定させます +- `auto-detect`:アクティブな話者を検出して追跡します +- `coordinates`:`speaker_frame`で選択されたフレーム内のピクセル座標(`speaker_x`、`speaker_y`)の顔をターゲットにします + +**制約事項:** +- 動画の解像度は4K(4096x2160)を超えてはなりません。この制限を超える動画はエラーになります。 +- 音声の長さは600秒(10分)を超えてはなりません。 +- `speaker_frame`、`speaker_x`、`speaker_y`パラメータは、`speaker_selection`が"coordinates"に設定されている場合のみ使用されます。 + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `video` | 口の動きが提供された音声に合わせて再同期された動画です。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/ko.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/ko.md new file mode 100644 index 000000000..fbf37c455 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/ko.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +이 노드는 sync.so API를 사용하여 비디오의 입 움직임을 새로운 음성 오디오에 다시 동기화합니다. 클로즈업, 측면 및 장애물을 자동으로 처리하면서 화자의 표정을 유지합니다. 비용은 출력 길이에 따라 달라집니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 유형 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `video` | 다시 동기화할 화자의 영상입니다. 최대 4K(4096x2160)까지 지원되며, 24/25/30fps의 일정한 프레임 속도가 가장 잘 작동합니다. | VIDEO | 예 | - | +| `audio` | 입에 동기화할 음성 오디오입니다. | AUDIO | 예 | - | +| `seed` | 시드는 노드를 다시 실행할지 여부를 제어합니다. 시드와 관계없이 결과는 비결정적입니다(기본값: 42). | INT | 예 | 0 ~ 2147483647 | +| `model` | sync.so 생성 모델입니다. | COMBO | 예 | 아래 참조 | + +`model` 매개변수는 다음과 같은 하위 매개변수를 포함하는 동적 콤보입니다: + +| 하위 매개변수 | 설명 | 데이터 유형 | 필수 여부 | 범위 | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | 비디오와 오디오 간 길이 불일치를 처리하는 방법입니다. 또한 출력 길이를 설정합니다(기본값: "bounce"). | COMBO | 예 | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | 여러 사람이 보일 때 립싱크할 얼굴을 선택합니다(기본값: "default"). | COMBO | 예 | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | 화자를 찾는 데 사용되는 비디오 프레임입니다. `speaker_selection`이 "coordinates"인 경우에만 사용됩니다(기본값: 0). | INT | 아니요 | 0 ~ 1000000 | +| `speaker_x` | 화자 얼굴의 X 픽셀 좌표입니다. `speaker_selection`이 "coordinates"인 경우에만 사용됩니다(기본값: 0). | INT | 아니요 | 0 ~ 4096 | +| `speaker_y` | 화자 얼굴의 Y 픽셀 좌표입니다. `speaker_selection`이 "coordinates"인 경우에만 사용됩니다(기본값: 0). | INT | 아니요 | 0 ~ 4096 | + +**동기화 모드 옵션:** +- `bounce`: 비디오가 오디오가 끝날 때까지 앞뒤로 재생됩니다(출력 = 오디오 길이) +- `loop`: 비디오가 오디오가 끝날 때까지 다시 시작됩니다(출력 = 오디오 길이) +- `remap`: 비디오가 오디오와 일치하도록 시간이 늘어납니다(출력 = 오디오 길이) +- `cut_off`: 더 긴 트랙이 잘립니다(출력 = 더 짧은 길이) +- `silence`: 아무것도 잘리지 않으며, 더 짧은 트랙이 채워집니다(출력 = 더 긴 길이) + +**화자 선택 옵션:** +- `default`: 모델이 립싱크할 얼굴을 결정하도록 합니다 +- `auto-detect`: 활성 화자를 감지하고 추적합니다 +- `coordinates`: `speaker_frame`에서 선택한 프레임의 픽셀(`speaker_x`, `speaker_y`)에 있는 얼굴을 대상으로 합니다 + +**제약 사항:** +- 비디오 해상도는 4K(4096x2160)를 초과할 수 없습니다. 이 제한을 초과하는 비디오는 오류가 발생합니다. +- 오디오 길이는 600초(10분)를 초과할 수 없습니다. +- `speaker_frame`, `speaker_x`, `speaker_y` 매개변수는 `speaker_selection`이 "coordinates"로 설정된 경우에만 사용됩니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 유형 | +|-------------|-------------|-----------| +| `video` | 제공된 오디오와 일치하도록 입 움직임이 다시 동기화된 비디오입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/pt-BR.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/pt-BR.md new file mode 100644 index 000000000..1767da37e --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/pt-BR.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +Este nó ressincroniza o movimento da boca em um vídeo com um novo áudio de fala usando a API sync.so. Ele lida automaticamente com closes, perfis e obstruções, preservando a expressão do falante. O custo é dimensionado de acordo com a duração da saída. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|-----------|----------|-------| +| `video` | Gravação do falante a ser ressincronizada. Até 4K (4096x2160); uma taxa de quadros constante de 24/25/30 fps funciona melhor. | VIDEO | Sim | - | +| `audio` | Áudio de fala para sincronizar a boca. | AUDIO | Sim | - | +| `seed` | A semente controla se o nó deve ser executado novamente; os resultados são não determinísticos independentemente da semente (padrão: 42). | INT | Sim | 0 a 2147483647 | +| `model` | Modelo de geração sync.so. | COMBO | Sim | Veja abaixo | + +O parâmetro `model` é uma combinação dinâmica que inclui os seguintes subparâmetros: + +| Subparâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | Como lidar com uma incompatibilidade de duração entre vídeo e áudio; isso também define o comprimento da saída (padrão: "bounce"). | COMBO | Sim | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Qual rosto sincronizar quando várias pessoas estão visíveis (padrão: "default"). | COMBO | Sim | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Quadro de vídeo usado para localizar o falante. Usado apenas quando `speaker_selection` é "coordinates" (padrão: 0). | INT | Não | 0 a 1000000 | +| `speaker_x` | Coordenada X em pixels do rosto do falante. Usado apenas quando `speaker_selection` é "coordinates" (padrão: 0). | INT | Não | 0 a 4096 | +| `speaker_y` | Coordenada Y em pixels do rosto do falante. Usado apenas quando `speaker_selection` é "coordinates" (padrão: 0). | INT | Não | 0 a 4096 | + +**Opções do modo de sincronização:** +- `bounce`: O vídeo é reproduzido para frente e depois para trás até o áudio terminar (saída = duração do áudio) +- `loop`: O vídeo reinicia até o áudio terminar (saída = duração do áudio) +- `remap`: O vídeo é esticado no tempo para corresponder ao áudio (saída = duração do áudio) +- `cut_off`: A faixa mais longa é cortada (saída = duração mais curta) +- `silence`: Nada é cortado; a faixa mais curta é preenchida (saída = duração mais longa) + +**Opções de seleção do falante:** +- `default`: Deixe o modelo decidir qual rosto sincronizar +- `auto-detect`: Detecta e segue o falante ativo +- `coordinates`: Segmenta o rosto nos pixels (`speaker_x`, `speaker_y`) no quadro escolhido por `speaker_frame` + +**Restrições:** +- A resolução do vídeo não deve exceder 4K (4096x2160). Vídeos acima deste limite gerarão um erro. +- A duração do áudio não deve exceder 600 segundos (10 minutos). +- Os parâmetros `speaker_frame`, `speaker_x` e `speaker_y` são usados apenas quando `speaker_selection` está definido como "coordinates". + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|-------------|-------------|-----------| +| `video` | O vídeo ressincronizado com o movimento da boca correspondente ao áudio fornecido. | VIDEO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/ru.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/ru.md new file mode 100644 index 000000000..0be87204b --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/ru.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +Этот узел повторно синхронизирует движение губ в видео с новой аудиодорожкой речи с помощью API sync.so. Он автоматически обрабатывает крупные планы, профили и препятствия, сохраняя выражение лица говорящего. Стоимость зависит от длительности выходного материала. + +## Входные параметры + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|----------|----------|------------|--------------|----------| +| `video` | Видеоматериал с говорящим для повторной синхронизации. До 4K (4096x2160); оптимальная постоянная частота кадров 24/25/30 кадров/с. | VIDEO | Да | - | +| `audio` | Речевая аудиодорожка для синхронизации движения губ. | AUDIO | Да | - | +| `seed` | Зерно определяет, должен ли узел запускаться заново; результаты недетерминированы независимо от зерна (по умолчанию: 42). | INT | Да | от 0 до 2147483647 | +| `model` | Модель генерации sync.so. | COMBO | Да | См. ниже | + +Параметр `model` представляет собой динамический комбинированный список, включающий следующие подпараметры: + +| Подпараметр | Описание | Тип данных | Обязательный | Диапазон | +|-------------|----------|------------|--------------|----------| +| `sync_mode` | Способ обработки несоответствия длительности видео и аудио; также определяет длину выходного материала (по умолчанию: "bounce"). | COMBO | Да | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Какое лицо синхронизировать, если видно несколько человек (по умолчанию: "default"). | COMBO | Да | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Кадр видео, используемый для поиска говорящего. Используется только когда `speaker_selection` имеет значение "coordinates" (по умолчанию: 0). | INT | Нет | от 0 до 1000000 | +| `speaker_x` | Координата X лица говорящего в пикселях. Используется только когда `speaker_selection` имеет значение "coordinates" (по умолчанию: 0). | INT | Нет | от 0 до 4096 | +| `speaker_y` | Координата Y лица говорящего в пикселях. Используется только когда `speaker_selection` имеет значение "coordinates" (по умолчанию: 0). | INT | Нет | от 0 до 4096 | + +**Варианты режима синхронизации:** +- `bounce`: Видео воспроизводится вперед, затем назад до окончания аудио (выход = длина аудио) +- `loop`: Видео перезапускается до окончания аудио (выход = длина аудио) +- `remap`: Видео растягивается по времени для соответствия аудио (выход = длина аудио) +- `cut_off`: Более длинная дорожка обрезается (выход = длина более короткой) +- `silence`: Ничего не обрезается; более короткая дорожка дополняется тишиной (выход = длина более длинной) + +**Варианты выбора говорящего:** +- `default`: Позволить модели решить, какое лицо синхронизировать +- `auto-detect`: Обнаружить и отслеживать активного говорящего +- `coordinates`: Нацелиться на лицо по пиксельным координатам (`speaker_x`, `speaker_y`) в кадре, выбранном параметром `speaker_frame` + +**Ограничения:** +- Разрешение видео не должно превышать 4K (4096x2160). Видео с разрешением выше этого лимита вызовут ошибку. +- Длительность аудио не должна превышать 600 секунд (10 минут). +- Параметры `speaker_frame`, `speaker_x` и `speaker_y` используются только когда `speaker_selection` имеет значение "coordinates". + +## Выходные параметры + +| Имя выхода | Описание | Тип данных | +|------------|----------|------------| +| `video` | Повторно синхронизированное видео с движением губ, соответствующим предоставленной аудиодорожке. | VIDEO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/tr.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/tr.md new file mode 100644 index 000000000..950f0cc3a --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/tr.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +Bu düğüm, sync.so API'sini kullanarak bir videodaki ağız hareketlerini yeni bir konuşma sesine yeniden senkronize eder. Yakın çekimleri, profilleri ve engelleri otomatik olarak işlerken konuşmacının ifadesini korur. Maliyet, çıktı süresine göre değişir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `video` | Yeniden senkronize edilecek konuşmacının görüntüsü. 4K'ya (4096x2160) kadar; 24/25/30 fps'lik sabit bir kare hızı en iyi sonucu verir. | VIDEO | Evet | - | +| `audio` | Ağzın senkronize edileceği konuşma sesi. | AUDIO | Evet | - | +| `seed` | Tohum, düğümün yeniden çalıştırılıp çalıştırılmayacağını kontrol eder; sonuçlar tohumdan bağımsız olarak deterministik değildir (varsayılan: 42). | INT | Evet | 0 ile 2147483647 arası | +| `model` | sync.so üretim modeli. | COMBO | Evet | Aşağıya bakın | + +`model` parametresi, aşağıdaki alt parametreleri içeren dinamik bir birleşik giriştir: + +| Alt Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | Video ve ses arasındaki süre uyumsuzluğunun nasıl ele alınacağı; bu aynı zamanda çıktı uzunluğunu da belirler (varsayılan: "bounce"). | COMBO | Evet | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | Birden fazla kişi görünür olduğunda hangi yüzün dudak senkronizasyonunun yapılacağı (varsayılan: "default"). | COMBO | Evet | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | Konuşmacıyı bulmak için kullanılan video karesi. Yalnızca `speaker_selection` "coordinates" olduğunda kullanılır (varsayılan: 0). | INT | Hayır | 0 ile 1000000 arası | +| `speaker_x` | Konuşmacının yüzünün X piksel koordinatı. Yalnızca `speaker_selection` "coordinates" olduğunda kullanılır (varsayılan: 0). | INT | Hayır | 0 ile 4096 arası | +| `speaker_y` | Konuşmacının yüzünün Y piksel koordinatı. Yalnızca `speaker_selection` "coordinates" olduğunda kullanılır (varsayılan: 0). | INT | Hayır | 0 ile 4096 arası | + +**Senkronizasyon modu seçenekleri:** +- `bounce`: Video, ses bitene kadar ileri ve geri oynatılır (çıktı = ses uzunluğu) +- `loop`: Video, ses bitene kadar yeniden başlatılır (çıktı = ses uzunluğu) +- `remap`: Videoya sesle eşleşmesi için zaman esnetmesi uygulanır (çıktı = ses uzunluğu) +- `cut_off`: Daha uzun olan parça kırpılır (çıktı = daha kısa uzunluk) +- `silence`: Hiçbir şey kırpılmaz; daha kısa olan parça doldurulur (çıktı = daha uzun uzunluk) + +**Konuşmacı seçimi seçenekleri:** +- `default`: Hangi yüzün dudak senkronizasyonunun yapılacağına modelin karar vermesine izin ver +- `auto-detect`: Etkin konuşmacıyı algıla ve takip et +- `coordinates`: `speaker_frame` tarafından seçilen karedeki piksel (`speaker_x`, `speaker_y`) koordinatlarındaki yüzü hedefle + +**Kısıtlamalar:** +- Video çözünürlüğü 4K'yı (4096x2160) aşmamalıdır. Bu sınırın üzerindeki videolar bir hata verecektir. +- Ses süresi 600 saniyeyi (10 dakika) aşmamalıdır. +- `speaker_frame`, `speaker_x` ve `speaker_y` parametreleri yalnızca `speaker_selection` "coordinates" olarak ayarlandığında kullanılır. + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `video` | Ağız hareketleri sağlanan sesle eşleşecek şekilde yeniden senkronize edilmiş video. | VIDEO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/zh-TW.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/zh-TW.md new file mode 100644 index 000000000..850fd31d2 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/zh-TW.md @@ -0,0 +1,50 @@ +# SyncLipSyncNode + +此節點使用 sync.so API 將影片中的嘴部動作與新的語音音訊重新同步。它會自動處理特寫、側面及遮擋情況,同時保留說話者的表情。費用會根據輸出時長而變化。 + +## 輸入 + +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `video` | 要重新同步的說話者影片素材。最高可達 4K (4096x2160);24/25/30 fps 的固定影格率效果最佳。 | VIDEO | 是 | - | +| `audio` | 用於同步嘴部的語音音訊。 | AUDIO | 是 | - | +| `seed` | 種子控制節點是否應重新執行;無論種子為何,結果皆為非確定性(預設值:42)。 | INT | 是 | 0 到 2147483647 | +| `model` | sync.so 生成模型。 | COMBO | 是 | 請參閱下方 | + +`model` 參數是一個動態組合,包含以下子參數: + +| 子參數 | 描述 | 資料類型 | 必要 | 範圍 | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | 如何處理影片與音訊之間的時長不匹配;此設定也會決定輸出長度(預設值:"bounce")。 | COMBO | 是 | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | 當畫面中有多人時,要對哪張臉進行唇形同步(預設值:"default")。 | COMBO | 是 | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | 用於定位說話者的影片影格。僅在 `speaker_selection` 設為 "coordinates" 時使用(預設值:0)。 | INT | 否 | 0 到 1000000 | +| `speaker_x` | 說話者臉部的 X 像素座標。僅在 `speaker_selection` 設為 "coordinates" 時使用(預設值:0)。 | INT | 否 | 0 到 4096 | +| `speaker_y` | 說話者臉部的 Y 像素座標。僅在 `speaker_selection` 設為 "coordinates" 時使用(預設值:0)。 | INT | 否 | 0 到 4096 | + +**同步模式選項:** +- `bounce`:影片向前播放,然後向後播放,直到音訊結束(輸出長度 = 音訊長度) +- `loop`:影片重新開始播放,直到音訊結束(輸出長度 = 音訊長度) +- `remap`:影片被時間拉伸以匹配音訊(輸出長度 = 音訊長度) +- `cut_off`:較長的軌道會被裁剪(輸出長度 = 較短的長度) +- `silence`:不裁剪任何內容;較短的軌道會被填充靜音(輸出長度 = 較長的長度) + +**說話者選擇選項:** +- `default`:讓模型決定要對哪張臉進行唇形同步 +- `auto-detect`:偵測並跟隨正在說話的人 +- `coordinates`:定位到由 `speaker_frame` 選擇的影格中,像素座標 (`speaker_x`, `speaker_y`) 處的臉部 + +**限制條件:** +- 影片解析度不得超過 4K (4096x2160)。超過此限制的影片將會引發錯誤。 +- 音訊時長不得超過 600 秒(10 分鐘)。 +- `speaker_frame`、`speaker_x` 和 `speaker_y` 參數僅在 `speaker_selection` 設為 "coordinates" 時使用。 + +## 輸出 + +| 輸出名稱 | 描述 | 資料類型 | +|-------------|-------------|-----------| +| `video` | 重新同步後的影片,嘴部動作與提供的音訊相匹配。 | VIDEO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncLipSyncNode/zh.md b/comfyui_embedded_docs/docs/SyncLipSyncNode/zh.md new file mode 100644 index 000000000..5c80dbb7d --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncLipSyncNode/zh.md @@ -0,0 +1,48 @@ +# SyncLipSyncNode + +此节点使用 sync.so API 将视频中的口型动作与新的语音音频重新同步。它能自动处理特写、侧脸和遮挡情况,同时保留说话者的表情。费用按输出时长计算。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必填 | 取值范围 | +|-----------|-------------|-----------|----------|-------| +| `video` | 需要重新同步的说话者视频素材。最高支持 4K(4096x2160);恒定帧率 24/25/30 fps 效果最佳。 | VIDEO | 是 | - | +| `audio` | 用于同步口型的语音音频。 | AUDIO | 是 | - | +| `seed` | 种子控制节点是否重新运行;无论种子如何,结果均非确定性(默认值:42)。 | INT | 是 | 0 至 2147483647 | +| `model` | sync.so 生成模型。 | COMBO | 是 | 见下文 | + +`model` 参数是一个动态组合,包含以下子参数: + +| 子参数 | 描述 | 数据类型 | 是否必填 | 取值范围 | +|---------------|-------------|-----------|----------|-------| +| `sync_mode` | 处理视频与音频时长不匹配的方式;同时决定输出长度(默认值:"bounce")。 | COMBO | 是 | `"bounce"`
`"cut_off"`
`"loop"`
`"silence"`
`"remap"` | +| `speaker_selection` | 当画面中出现多人时,选择要唇形同步的面部(默认值:"default")。 | COMBO | 是 | `"default"`
`"auto-detect"`
`"coordinates"` | +| `speaker_frame` | 用于定位说话者的视频帧。仅在 `speaker_selection` 为 "coordinates" 时使用(默认值:0)。 | INT | 否 | 0 至 1000000 | +| `speaker_x` | 说话者面部的 X 像素坐标。仅在 `speaker_selection` 为 "coordinates" 时使用(默认值:0)。 | INT | 否 | 0 至 4096 | +| `speaker_y` | 说话者面部的 Y 像素坐标。仅在 `speaker_selection` 为 "coordinates" 时使用(默认值:0)。 | INT | 否 | 0 至 4096 | + +**同步模式选项:** +- `bounce`:视频先正向播放再反向播放,直至音频结束(输出 = 音频长度) +- `loop`:视频循环播放直至音频结束(输出 = 音频长度) +- `remap`:视频进行时间拉伸以匹配音频(输出 = 音频长度) +- `cut_off`:较长的轨道被裁剪(输出 = 较短长度) +- `silence`:不裁剪任何内容;较短的轨道用静音填充(输出 = 较长长度) + +**说话者选择选项:** +- `default`:让模型自行决定唇形同步的面部 +- `auto-detect`:检测并跟随当前说话者 +- `coordinates`:定位 `speaker_frame` 所选帧中像素坐标(`speaker_x`,`speaker_y`)处的面部 + +**限制条件:** +- 视频分辨率不得超过 4K(4096x2160)。超出此限制的视频将报错。 +- 音频时长不得超过 600 秒(10 分钟)。 +- `speaker_frame`、`speaker_x` 和 `speaker_y` 参数仅在 `speaker_selection` 设置为 "coordinates" 时使用。 + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `video` | 口型动作与提供的音频匹配后的重新同步视频。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/ar.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ar.md new file mode 100644 index 000000000..046753362 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ar.md @@ -0,0 +1,58 @@ +# SyncTalkingImageNode + +## قواعد الترجمة + +1. **المحتوى الذي يجب عدم ترجمته:** + - أسماء المعاملات بين علامات الاقتباس الخلفية: `image`, `seed`, `model` + - أنواع البيانات بالأحرف الكبيرة: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, إلخ + - القيم في عمود Range: الأرقام، "auto"، أسماء الخيارات + - الكود، مسارات الملفات + +2. **المحتوى الذي يجب ترجمته:** + - عناوين الأقسام: ## نظرة عامة, ## المدخلات, ## المخرجات + - جميع النصوص الوصفية والتوضيحية + - أوصاف المعاملات + +3. **جودة الترجمة:** + - استخدام اللغة العربية الفصحى المعاصرة + - الحفاظ على نبرة احترافية ولكن سهلة الفهم + - ضمان الدقة التقنية + - استخدام المصطلحات التقنية العربية القياسية + +4. **التنسيق:** + - الحفاظ على جميع تنسيقات Markdown + - الحفاظ على بنية الجداول + - عدم إضافة أي ملاحظة أو رابط في بداية الوثيقة (سيتم إضافتها تلقائيًا) + +الرجاء ترجمة الوثيقة التالية إلى العربية، دون تضمين الملاحظة الأولية للوثيقة: + +5. **قاعدة حاسمة - أسماء المخرجات:** العمود الأول من جدول المخرجات يحتوي على أسماء مخرجات (مثل `positive`، `negative`، `latent`، `image`، `model`، `conditioning`) التي يجب أن تبقى بالإنجليزية. ترجمة هذه الأسماء يؤدي إلى تكرار الإدخالات وكسر بنية المستند. + +قم بتحريك صورة شخصية ثابتة إلى فيديو ناطق مدفوع بالصوت الكلامي، باستخدام نموذج sync-3 من sync.so. مدة الإخراج تطابق مدة الصوت، وتتزايد التكلفة مع زيادة مدة الإخراج. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|--------|--------| +| `image` | صورة واحدة ذات وجه واضح الرؤية، بدقة تصل إلى 4K (4096×2160). | IMAGE | نعم | مطلوب صورة واحدة بالضبط | +| `audio` | صوت كلامي يحرك فيديو الحديث؛ مدة الإخراج تطابقه. يمكن ربط أي عقدة TTS هنا لتحريك الرسوم المتحركة من النص. | AUDIO | نعم | أقصى مدة: 600 ثانية | +| `prompt` | توجيه اختياري لكيفية ظهور الصورة الشخصية للحياة، مثل 'اجعل الشخص يبتسم وينظر إلى الكاميرا'. اتركه فارغًا للحركة الطبيعية للحديث. (الافتراضي: "") | STRING | لا | نص متعدد الأسطر | +| `seed` | البذرة تتحكم فيما إذا كانت العقدة ستعيد التشغيل؛ النتائج غير حتمية بغض النظر عن البذرة. (الافتراضي: 0) | INT | لا | 0 إلى 2147483647 | +| `model` | نموذج التوليد من sync.so. إدخال الصورة حصري للنموذج sync-3. | COMBO | نعم | `"sync-3"` | +| `speaker_selection` | أي وجه سيتم تحريكه عند ظهور عدة أشخاص. `default`: دع النموذج يقرر. `coordinates`: استهدف الوجه عند البكسل (speaker_x, speaker_y) في الصورة. الكشف التلقائي غير مدعوم للصور. (الافتراضي: "default") | COMBO | لا | `"default"`
`"coordinates"` | +| `speaker_x` | إحداثي X بالبكسل لوجه المتحدث. يُستخدم فقط عندما يكون speaker_selection هو 'coordinates'. (الافتراضي: 0) | INT | لا | 0 إلى 4096 | +| `speaker_y` | إحداثي Y بالبكسل لوجه المتحدث. يُستخدم فقط عندما يكون speaker_selection هو 'coordinates'. (الافتراضي: 0) | INT | لا | 0 إلى 4096 | +| `auto_downscale` | تقليل حجم الصورة تلقائيًا إذا تجاوزت حد الإدخال 4K (4096×2160)؛ يتم قياس إحداثيات المتحدث لتتناسب. عند تعطيله، تظهر الصورة كبيرة الحجم خطأ بدلاً من ذلك. (الافتراضي: True) | BOOLEAN | لا | True
False | + +**ملاحظة:** يتم استخدام المعاملين `speaker_x` و `speaker_y` فقط عندما يكون `speaker_selection` مضبوطًا على `"coordinates"`. عند تمكين `auto_downscale`، يتم قياس إحداثيات المتحدث تلقائيًا لتتناسب مع أبعاد الصورة المصغرة. + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|---------------| +| `video` | فيديو الحديث المُنشأ مع الصورة الشخصية المتحركة المتزامنة مع الصوت المُدخل. | VIDEO | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/ar.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/en.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/en.md new file mode 100644 index 000000000..8e3fde29a --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/en.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +Animate a still portrait into a talking video driven by speech audio, using sync.so's sync-3 model. The output duration matches the audio duration, and cost scales with output duration. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `image` | A single image with a clearly visible face, up to 4K (4096x2160). | IMAGE | Yes | Exactly one image required | +| `audio` | Speech audio driving the talking video; the output duration matches it. Chain any TTS node here to drive the animation from text. | AUDIO | Yes | Maximum duration: 600 seconds | +| `prompt` | Optional guidance for how the portrait comes to life, e.g. 'make the subject smile and look at the camera'. Leave empty for natural talking motion. (default: "") | STRING | No | Multiline text | +| `seed` | Seed controls whether the node should re-run; results are non-deterministic regardless of seed. (default: 0) | INT | No | 0 to 2147483647 | +| `model` | sync.so generation model. Image input is exclusive to sync-3. | COMBO | Yes | `"sync-3"` | +| `speaker_selection` | Which face to animate when several people are visible. `default`: let the model decide. `coordinates`: target the face at pixel (speaker_x, speaker_y) in the image. Auto-detection is not supported for images. (default: "default") | COMBO | No | `"default"`
`"coordinates"` | +| `speaker_x` | X pixel coordinate of the speaker's face. Only used when speaker_selection is 'coordinates'. (default: 0) | INT | No | 0 to 4096 | +| `speaker_y` | Y pixel coordinate of the speaker's face. Only used when speaker_selection is 'coordinates'. (default: 0) | INT | No | 0 to 4096 | +| `auto_downscale` | Automatically downscale the image if it exceeds the 4K (4096x2160) input limit; speaker coordinates are scaled to match. When disabled, an oversized image raises an error instead. (default: True) | BOOLEAN | No | True
False | + +**Note:** The `speaker_x` and `speaker_y` parameters are only used when `speaker_selection` is set to `"coordinates"`. When `auto_downscale` is enabled, speaker coordinates are automatically scaled to match the downscaled image dimensions. + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `video` | The generated talking video with the animated portrait synchronized to the input audio. | VIDEO | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/en.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/es.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/es.md new file mode 100644 index 000000000..6bf2ad0b5 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/es.md @@ -0,0 +1,60 @@ +# SyncTalkingImageNode + +Eres un experto en traducción técnica especializado en documentación de nodos ComfyUI del inglés al español. + +## Reglas de Traducción + +1. **Contenido que NO debe traducirse:** + - Nombres de parámetros entre comillas invertidas: `image`, `seed`, `model` + - Tipos de datos en MAYÚSCULAS: IMAGE, STRING, INT, FLOAT, MODEL, CONDITIONING, etc. + - Valores en columna Range: números, "auto", nombres de opciones + - Código, rutas de archivos + +2. **Contenido que SÍ debe traducirse:** + - Títulos de secciones: ## Descripción general, ## Entradas, ## Salidas + - Todo el texto descriptivo y explicativo + - Descripciones de parámetros + +3. **Calidad de traducción:** + - Usar español estándar y neutral + - Mantener tono profesional pero accesible + - Asegurar precisión técnica + - Usar terminología técnica estándar en español + +4. **Formato:** + - Mantener todo el formato Markdown + - Preservar estructura de tablas + - No agregar ninguna nota o enlace al inicio del documento (será agregado automáticamente) + +Por favor traduce la siguiente documentación al español, sin incluir la aviso de IA: + +5. **CRÍTICO - Nombres de salida:** La primera columna de la tabla de Salidas contiene nombres de salida (ej. `positive`, `negative`, `latent`, `image`, `model`, `conditioning`) que DEBEN permanecer en inglés. Traducir estos nombres crea entradas duplicadas y rompe la estructura del documento. + +Convierte un retrato estático en un video parlante impulsado por audio de voz, utilizando el modelo sync-3 de sync.so. La duración de salida coincide con la duración del audio, y el costo escala con la duración de la salida. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Requerido | Rango | +|-----------|-------------|--------------|-----------|-------| +| `image` | Una sola imagen con un rostro claramente visible, de hasta 4K (4096x2160). | IMAGE | Sí | Exactamente una imagen requerida | +| `audio` | Audio de voz que impulsa el video parlante; la duración de la salida coincide con él. Conecta cualquier nodo TTS aquí para impulsar la animación desde texto. | AUDIO | Sí | Duración máxima: 600 segundos | +| `prompt` | Guía opcional sobre cómo cobra vida el retrato, ej. 'haz que el sujeto sonría y mire a la cámara'. Déjalo vacío para un movimiento de habla natural. (predeterminado: "") | STRING | No | Texto multilínea | +| `seed` | La semilla controla si el nodo debe re-ejecutarse; los resultados no son deterministas independientemente de la semilla. (predeterminado: 0) | INT | No | 0 a 2147483647 | +| `model` | Modelo de generación de sync.so. La entrada de imagen es exclusiva de sync-3. | COMBO | Sí | `"sync-3"` | +| `speaker_selection` | Qué rostro animar cuando varias personas son visibles. `default`: dejar que el modelo decida. `coordinates`: apuntar al rostro en el píxel (speaker_x, speaker_y) de la imagen. La detección automática no es compatible con imágenes. (predeterminado: "default") | COMBO | No | `"default"`
`"coordinates"` | +| `speaker_x` | Coordenada X en píxeles del rostro del hablante. Solo se usa cuando speaker_selection es 'coordinates'. (predeterminado: 0) | INT | No | 0 a 4096 | +| `speaker_y` | Coordenada Y en píxeles del rostro del hablante. Solo se usa cuando speaker_selection es 'coordinates'. (predeterminado: 0) | INT | No | 0 a 4096 | +| `auto_downscale` | Redimensiona automáticamente la imagen si excede el límite de entrada de 4K (4096x2160); las coordenadas del hablante se escalan para coincidir. Cuando está deshabilitado, una imagen sobredimensionada genera un error. (predeterminado: True) | BOOLEAN | No | True
False | + +**Nota:** Los parámetros `speaker_x` y `speaker_y` solo se utilizan cuando `speaker_selection` está configurado en `"coordinates"`. Cuando `auto_downscale` está habilitado, las coordenadas del hablante se escalan automáticamente para coincidir con las dimensiones de la imagen redimensionada. + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `video` | El video parlante generado con el retrato animado sincronizado con el audio de entrada. | VIDEO | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/es.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/fa.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/fa.md new file mode 100644 index 000000000..fc1b67807 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/fa.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +یک پرتره ثابت را به یک ویدیوی سخنگو متحرک کنید که با صدای گفتار هماهنگ است، با استفاده از مدل sync-3 سرویس sync.so. مدت زمان خروجی با مدت زمان صدا مطابقت دارد و هزینه با توجه به مدت زمان خروجی محاسبه می‌شود. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | الزامی | محدوده | +|---------|---------|----------|--------|--------| +| `image` | یک تصویر تکی با چهره‌ای واضح و قابل مشاهده، تا رزولوشن 4K (4096x2160). | IMAGE | بله | دقیقاً یک تصویر مورد نیاز است | +| `audio` | صدای گفتار که ویدیوی سخنگو را هدایت می‌کند؛ مدت زمان خروجی با آن مطابقت دارد. هر گره TTS را برای هدایت انیمیشن از متن به اینجا متصل کنید. | AUDIO | بله | حداکثر مدت زمان: 600 ثانیه | +| `prompt` | راهنمایی اختیاری برای نحوه جان‌گرفتن پرتره، به عنوان مثال 'باعث لبخند زدن سوژه و نگاه کردن به دوربین شود'. برای حرکت طبیعی گفتار خالی بگذارید. (پیش‌فرض: "") | STRING | خیر | متن چندخطی | +| `seed` | Seed کنترل می‌کند که آیا گره دوباره اجرا شود؛ نتایج بدون توجه به seed غیرقطعی هستند. (پیش‌فرض: 0) | INT | خیر | 0 تا 2147483647 | +| `model` | مدل تولید sync.so. ورودی تصویر منحصراً برای sync-3 است. | COMBO | بله | `"sync-3"` | +| `speaker_selection` | کدام چهره زمانی که چند نفر قابل مشاهده هستند، متحرک شود. `default`: اجازه دهید مدل تصمیم بگیرد. `coordinates`: چهره را در پیکسل (speaker_x, speaker_y) در تصویر هدف قرار دهید. تشخیص خودکار برای تصاویر پشتیبانی نمی‌شود. (پیش‌فرض: "default") | COMBO | خیر | `"default"`
`"coordinates"` | +| `speaker_x` | مختصات X پیکسل چهره گوینده. فقط زمانی استفاده می‌شود که speaker_selection روی 'coordinates' تنظیم شده باشد. (پیش‌فرض: 0) | INT | خیر | 0 تا 4096 | +| `speaker_y` | مختصات Y پیکسل چهره گوینده. فقط زمانی استفاده می‌شود که speaker_selection روی 'coordinates' تنظیم شده باشد. (پیش‌فرض: 0) | INT | خیر | 0 تا 4096 | +| `auto_downscale` | در صورت تجاوز تصویر از محدودیت ورودی 4K (4096x2160)، به طور خودکار آن را کوچک‌نمایی می‌کند؛ مختصات گوینده برای مطابقت مقیاس‌دهی می‌شوند. هنگامی که غیرفعال است، یک تصویر بزرگ‌تر از حد مجاز به جای آن خطا ایجاد می‌کند. (پیش‌فرض: True) | BOOLEAN | خیر | True
False | + +**توجه:** پارامترهای `speaker_x` و `speaker_y` فقط زمانی استفاده می‌شوند که `speaker_selection` روی `"coordinates"` تنظیم شده باشد. هنگامی که `auto_downscale` فعال است، مختصات گوینده به طور خودکار برای مطابقت با ابعاد تصویر کوچک‌نمایی‌شده مقیاس‌دهی می‌شوند. + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-----------|---------|----------| +| `video` | ویدیوی سخنگوی تولیدشده با پرتره متحرک که با صدای ورودی هماهنگ شده است. | VIDEO | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/fa.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/fr.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/fr.md new file mode 100644 index 000000000..bd32f0fc5 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/fr.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +Animez un portrait fixe en une vidéo parlante pilotée par un fichier audio vocal, en utilisant le modèle sync-3 de sync.so. La durée de sortie correspond à la durée audio, et le coût évolue en fonction de la durée de sortie. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `image` | Une seule image avec un visage clairement visible, jusqu'à 4K (4096x2160). | IMAGE | Oui | Une seule image requise | +| `audio` | Audio vocal pilotant la vidéo parlante ; la durée de sortie lui correspond. Enchaînez n'importe quel nœud TTS ici pour piloter l'animation à partir d'un texte. | AUDIO | Oui | Durée maximale : 600 secondes | +| `prompt` | Indication facultative sur la façon dont le portrait prend vie, par exemple « faire sourire le sujet et regarder la caméra ». Laissez vide pour un mouvement de parole naturel. (par défaut : "") | STRING | Non | Texte multiligne | +| `seed` | La graine détermine si le nœud doit être réexécuté ; les résultats sont non déterministes quelle que soit la graine. (par défaut : 0) | INT | Non | 0 à 2147483647 | +| `model` | Modèle de génération sync.so. L'entrée d'image est exclusive à sync-3. | COMBO | Oui | `"sync-3"` | +| `speaker_selection` | Quel visage animer lorsque plusieurs personnes sont visibles. `default` : laisser le modèle décider. `coordinates` : cibler le visage au pixel (speaker_x, speaker_y) dans l'image. La détection automatique n'est pas prise en charge pour les images. (par défaut : "default") | COMBO | Non | `"default"`
`"coordinates"` | +| `speaker_x` | Coordonnée X en pixels du visage de l'orateur. Utilisé uniquement lorsque speaker_selection est 'coordinates'. (par défaut : 0) | INT | Non | 0 à 4096 | +| `speaker_y` | Coordonnée Y en pixels du visage de l'orateur. Utilisé uniquement lorsque speaker_selection est 'coordinates'. (par défaut : 0) | INT | Non | 0 à 4096 | +| `auto_downscale` | Réduire automatiquement l'image si elle dépasse la limite d'entrée 4K (4096x2160) ; les coordonnées de l'orateur sont mises à l'échelle pour correspondre. Lorsque désactivé, une image surdimensionnée génère une erreur à la place. (par défaut : True) | BOOLEAN | Non | True
False | + +**Remarque :** Les paramètres `speaker_x` et `speaker_y` sont utilisés uniquement lorsque `speaker_selection` est défini sur `"coordinates"`. Lorsque `auto_downscale` est activé, les coordonnées de l'orateur sont automatiquement mises à l'échelle pour correspondre aux dimensions de l'image réduite. + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `video` | La vidéo parlante générée avec le portrait animé synchronisé sur l'audio d'entrée. | VIDEO | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/fr.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/ja.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ja.md new file mode 100644 index 000000000..ee3935c0e --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ja.md @@ -0,0 +1,60 @@ +# SyncTalkingImageNode + +あなたは ComfyUI ノードドキュメントを英語から日本語に翻訳する技術翻訳の専門家です。 + +## 翻訳ルール + +1. **翻訳してはいけない内容:** + - バッククォートで囲まれたパラメータ名:`image`、`seed`、`model` + - 大文字のデータ型:IMAGE、STRING、INT、FLOAT、MODEL、CONDITIONING など + - Range列の値:数値、"auto"、オプション名 + - コード、ファイルパス + +2. **翻訳する内容:** + - セクション見出し:## 概要、## 入力、## 出力 + - すべての説明文 + - パラメータの説明 + +3. **翻訳品質:** + - 丁寧語(です・ます体)を使用 + - 専門的でありながらわかりやすい表現 + - 技術的な正確性を保つ + - 標準的な日本語技術用語を使用 + +4. **フォーマット:** + - すべての Markdown フォーマットを保持 + - 表の構造を維持 + - 免責事項は追加しないでください(システムが文書末尾に自動追加します) + +以下の英語ドキュメントを日本語に翻訳してください(免責事項は含めないでください): + +5. **重要ルール - 出力名:** 出力テーブルの最初の列には出力名(例:`positive`、`negative`、`latent`、`image`、`model`、`conditioning`)が含まれています。これらは**英語のままにしてください**。出力名を翻訳すると重複エントリが発生し、文書構造が壊れます。 + +sync.soのsync-3モデルを使用して、静止したポートレートを音声駆動のトーキングビデオにアニメーション化します。出力の長さは音声の長さに一致し、コストは出力の長さに応じて変動します。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `image` | 顔がはっきりと見える単一の画像。最大4K(4096x2160)まで対応します。 | IMAGE | はい | 画像は1枚のみ必須 | +| `audio` | トーキングビデオを駆動する音声。出力の長さはこれに一致します。任意のTTSノードをここにチェーンして、テキストからアニメーションを駆動できます。 | AUDIO | はい | 最大長さ:600秒 | +| `prompt` | ポートレートがどのように動き出すかに関するオプションのガイダンス。例:「被写体を笑顔にしてカメラを見るようにする」。自然な会話の動きの場合は空欄のままにします。(デフォルト:"") | STRING | いいえ | 複数行テキスト | +| `seed` | シードはノードを再実行するかどうかを制御します。シードに関係なく、結果は非決定的です。(デフォルト:0) | INT | いいえ | 0 ~ 2147483647 | +| `model` | sync.soの生成モデル。画像入力はsync-3専用です。 | COMBO | はい | `"sync-3"` | +| `speaker_selection` | 複数の人物が写っている場合に、どの顔をアニメーション化するかを指定します。`default`:モデルに決定させます。`coordinates`:画像内のピクセル座標(speaker_x, speaker_y)の顔を対象とします。画像に対する自動検出はサポートされていません。(デフォルト:"default") | COMBO | いいえ | `"default"`
`"coordinates"` | +| `speaker_x` | 話者の顔のXピクセル座標。speaker_selectionが'coordinates'の場合にのみ使用されます。(デフォルト:0) | INT | いいえ | 0 ~ 4096 | +| `speaker_y` | 話者の顔のYピクセル座標。speaker_selectionが'coordinates'の場合にのみ使用されます。(デフォルト:0) | INT | いいえ | 0 ~ 4096 | +| `auto_downscale` | 画像が4K(4096x2160)の入力制限を超える場合、自動的にダウンスケールします。話者の座標もそれに合わせて拡大縮小されます。無効にすると、サイズ超過の画像はエラーになります。(デフォルト:True) | BOOLEAN | いいえ | True
False | + +**注記:** `speaker_x` および `speaker_y` パラメータは、`speaker_selection` が `"coordinates"` に設定されている場合にのみ使用されます。`auto_downscale` が有効な場合、話者の座標はダウンスケール後の画像サイズに合わせて自動的に拡大縮小されます。 + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `video` | 入力音声に同期してアニメーション化されたポートレートを含む、生成されたトーキングビデオ。 | VIDEO | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/ja.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/ko.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ko.md new file mode 100644 index 000000000..37daeb52b --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ko.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +정지된 초상화를 음성 오디오로 구동되는 말하는 비디오로 애니메이션화합니다. sync.so의 sync-3 모델을 사용합니다. 출력 길이는 오디오 길이와 일치하며, 비용은 출력 길이에 비례합니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `image` | 얼굴이 선명하게 보이는 단일 이미지로, 최대 4K(4096x2160)까지 지원합니다. | IMAGE | 예 | 정확히 하나의 이미지 필요 | +| `audio` | 말하는 비디오를 구동하는 음성 오디오입니다. 출력 길이는 이 오디오와 일치합니다. 여기에 TTS 노드를 연결하여 텍스트로 애니메이션을 구동할 수 있습니다. | AUDIO | 예 | 최대 길이: 600초 | +| `prompt` | 초상화가 살아나는 방식에 대한 선택적 안내입니다. 예: '대상이 미소를 짓고 카메라를 바라보게 하세요'. 자연스러운 말하는 동작을 원하면 비워 둡니다. (기본값: "") | STRING | 아니요 | 여러 줄 텍스트 | +| `seed` | 시드는 노드 재실행 여부를 제어합니다. 시드와 관계없이 결과는 비결정적입니다. (기본값: 0) | INT | 아니요 | 0 ~ 2147483647 | +| `model` | sync.so 생성 모델입니다. 이미지 입력은 sync-3에만 해당됩니다. | COMBO | 예 | `"sync-3"` | +| `speaker_selection` | 여러 사람이 보일 때 애니메이션화할 얼굴을 선택합니다. `default`: 모델이 결정하도록 합니다. `coordinates`: 이미지 내 픽셀 좌표(speaker_x, speaker_y)에 있는 얼굴을 대상으로 합니다. 이미지의 경우 자동 감지는 지원되지 않습니다. (기본값: "default") | COMBO | 아니요 | `"default"`
`"coordinates"` | +| `speaker_x` | 화자의 얼굴 X 픽셀 좌표입니다. speaker_selection이 'coordinates'인 경우에만 사용됩니다. (기본값: 0) | INT | 아니요 | 0 ~ 4096 | +| `speaker_y` | 화자의 얼굴 Y 픽셀 좌표입니다. speaker_selection이 'coordinates'인 경우에만 사용됩니다. (기본값: 0) | INT | 아니요 | 0 ~ 4096 | +| `auto_downscale` | 이미지가 4K(4096x2160) 입력 제한을 초과하는 경우 자동으로 축소합니다. 화자 좌표도 이에 맞게 조정됩니다. 비활성화하면 크기가 초과된 이미지에서 오류가 발생합니다. (기본값: True) | BOOLEAN | 아니요 | True
False | + +**참고:** `speaker_x` 및 `speaker_y` 매개변수는 `speaker_selection`이 `"coordinates"`로 설정된 경우에만 사용됩니다. `auto_downscale`이 활성화되면 화자 좌표가 축소된 이미지 크기에 맞게 자동으로 조정됩니다. + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `video` | 입력 오디오에 동기화된 애니메이션 초상화가 포함된 생성된 말하는 비디오입니다. | VIDEO | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/ko.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/pt-BR.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/pt-BR.md new file mode 100644 index 000000000..3dcf918a2 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/pt-BR.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +Anime um retrato estático em um vídeo falante guiado por áudio de fala, usando o modelo sync-3 da sync.so. A duração da saída corresponde à duração do áudio, e o custo é proporcional à duração da saída. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|---------------|-------------|-------| +| `image` | Uma única imagem com um rosto claramente visível, de até 4K (4096x2160). | IMAGE | Sim | Exatamente uma imagem necessária | +| `audio` | Áudio de fala que guia o vídeo falante; a duração da saída corresponde a ele. Conecte qualquer nó TTS aqui para gerar a animação a partir de texto. | AUDIO | Sim | Duração máxima: 600 segundos | +| `prompt` | Orientação opcional sobre como o retrato ganha vida, ex.: 'faça o sujeito sorrir e olhar para a câmera'. Deixe vazio para movimento natural de fala. (padrão: "") | STRING | Não | Texto multilinha | +| `seed` | A semente controla se o nó deve ser executado novamente; os resultados são não determinísticos independentemente da semente. (padrão: 0) | INT | Não | 0 a 2147483647 | +| `model` | Modelo de geração sync.so. A entrada de imagem é exclusiva do sync-3. | COMBO | Sim | `"sync-3"` | +| `speaker_selection` | Qual rosto animar quando várias pessoas estão visíveis. `default`: deixar o modelo decidir. `coordinates`: direcionar o rosto no pixel (speaker_x, speaker_y) na imagem. A detecção automática não é suportada para imagens. (padrão: "default") | COMBO | Não | `"default"`
`"coordinates"` | +| `speaker_x` | Coordenada X do pixel do rosto do falante. Usado apenas quando speaker_selection é 'coordinates'. (padrão: 0) | INT | Não | 0 a 4096 | +| `speaker_y` | Coordenada Y do pixel do rosto do falante. Usado apenas quando speaker_selection é 'coordinates'. (padrão: 0) | INT | Não | 0 a 4096 | +| `auto_downscale` | Redimensionar automaticamente a imagem se ela exceder o limite de entrada de 4K (4096x2160); as coordenadas do falante são escaladas para corresponder. Quando desabilitado, uma imagem muito grande gera um erro. (padrão: True) | BOOLEAN | Não | True
False | + +**Nota:** Os parâmetros `speaker_x` e `speaker_y` são usados apenas quando `speaker_selection` está definido como `"coordinates"`. Quando `auto_downscale` está habilitado, as coordenadas do falante são automaticamente escaladas para corresponder às dimensões da imagem redimensionada. + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|---------------|-------------|---------------| +| `video` | O vídeo falante gerado com o retrato animado sincronizado com o áudio de entrada. | VIDEO | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/ru.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ru.md new file mode 100644 index 000000000..e6b424eac --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/ru.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +Оживите статичный портрет, превратив его в видео с речью, управляемое аудио, с помощью модели sync-3 от sync.so. Длительность выходного видео соответствует длительности аудио, а стоимость зависит от длительности выходного видео. + +## Входные параметры + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|-----------|-------------|-----------|----------|-------| +| `image` | Одно изображение с четко видимым лицом, разрешением до 4K (4096x2160). | IMAGE | Да | Требуется ровно одно изображение | +| `audio` | Речевое аудио, управляющее видео с речью; длительность выходного видео соответствует ему. Подключите любой TTS-узел сюда, чтобы управлять анимацией из текста. | AUDIO | Да | Максимальная длительность: 600 секунд | +| `prompt` | Необязательная подсказка для того, как портрет оживет, например, 'заставьте субъекта улыбнуться и смотреть в камеру'. Оставьте пустым для естественного речевого движения. (по умолчанию: "") | STRING | Нет | Многострочный текст | +| `seed` | Сид управляет тем, должен ли узел запускаться заново; результаты недетерминированы независимо от сида. (по умолчанию: 0) | INT | Нет | от 0 до 2147483647 | +| `model` | Модель генерации sync.so. Ввод изображения эксклюзивен для sync-3. | COMBO | Да | `"sync-3"` | +| `speaker_selection` | Какое лицо анимировать, если видно несколько человек. `default`: позволить модели решить. `coordinates`: нацелиться на лицо по пиксельным координатам (speaker_x, speaker_y) на изображении. Автоопределение не поддерживается для изображений. (по умолчанию: "default") | COMBO | Нет | `"default"`
`"coordinates"` | +| `speaker_x` | X-координата пикселя лица говорящего. Используется только когда speaker_selection имеет значение 'coordinates'. (по умолчанию: 0) | INT | Нет | от 0 до 4096 | +| `speaker_y` | Y-координата пикселя лица говорящего. Используется только когда speaker_selection имеет значение 'coordinates'. (по умолчанию: 0) | INT | Нет | от 0 до 4096 | +| `auto_downscale` | Автоматически уменьшать изображение, если оно превышает лимит ввода 4K (4096x2160); координаты говорящего масштабируются соответствующим образом. При отключении изображение большего размера вызывает ошибку. (по умолчанию: True) | BOOLEAN | Нет | True
False | + +**Примечание:** Параметры `speaker_x` и `speaker_y` используются только когда `speaker_selection` имеет значение `"coordinates"`. Когда `auto_downscale` включен, координаты говорящего автоматически масштабируются в соответствии с уменьшенными размерами изображения. + +## Выходные параметры + +| Имя выхода | Описание | Тип данных | +|-------------|-------------|-----------| +| `video` | Сгенерированное видео с речью, в котором анимированный портрет синхронизирован с входным аудио. | VIDEO | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/ru.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/tr.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/tr.md new file mode 100644 index 000000000..99d62106b --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/tr.md @@ -0,0 +1,30 @@ +# SyncTalkingImageNode + +Bir portre fotoğrafını, sync.so'nun sync-3 modelini kullanarak konuşma sesiyle yönlendirilen bir konuşan videoya dönüştürün. Çıktı süresi, ses süresiyle eşleşir ve maliyet, çıktı süresine göre ölçeklenir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Zorunlu | Aralık | +|-----------|-------------|-----------|----------|-------| +| `image` | Yüzü net bir şekilde görünen, 4K'ya (4096x2160) kadar tek bir görsel. | IMAGE | Evet | Tam olarak bir görsel gerekli | +| `audio` | Konuşan videoyu yönlendiren konuşma sesi; çıktı süresi bununla eşleşir. Animasyonu metinden yönlendirmek için herhangi bir TTS düğümünü buraya zincirleyin. | AUDIO | Evet | Maksimum süre: 600 saniye | +| `prompt` | Portrenin nasıl canlanacağına dair isteğe bağlı yönlendirme, örn. 'kişinin gülümsemesini ve kameraya bakmasını sağla'. Doğal konuşma hareketi için boş bırakın. (varsayılan: "") | STRING | Hayır | Çok satırlı metin | +| `seed` | Tohum, düğümün yeniden çalıştırılıp çalıştırılmayacağını kontrol eder; sonuçlar tohumdan bağımsız olarak deterministik değildir. (varsayılan: 0) | INT | Hayır | 0 ile 2147483647 arası | +| `model` | sync.so üretim modeli. Görsel girişi yalnızca sync-3'e özeldir. | COMBO | Evet | `"sync-3"` | +| `speaker_selection` | Birden fazla kişi görünür olduğunda hangi yüzün canlandırılacağı. `default`: modelin karar vermesine izin verir. `coordinates`: görseldeki piksel (speaker_x, speaker_y) konumundaki yüzü hedefler. Görseller için otomatik algılama desteklenmez. (varsayılan: "default") | COMBO | Hayır | `"default"`
`"coordinates"` | +| `speaker_x` | Konuşmacının yüzünün X piksel koordinatı. Yalnızca speaker_selection 'coordinates' olduğunda kullanılır. (varsayılan: 0) | INT | Hayır | 0 ile 4096 arası | +| `speaker_y` | Konuşmacının yüzünün Y piksel koordinatı. Yalnızca speaker_selection 'coordinates' olduğunda kullanılır. (varsayılan: 0) | INT | Hayır | 0 ile 4096 arası | +| `auto_downscale` | Görsel 4K (4096x2160) giriş sınırını aşarsa otomatik olarak küçültür; konuşmacı koordinatları buna göre ölçeklenir. Devre dışı bırakıldığında, aşırı büyük bir görsel bunun yerine bir hataya neden olur. (varsayılan: True) | BOOLEAN | Hayır | True
False | + +**Not:** `speaker_x` ve `speaker_y` parametreleri yalnızca `speaker_selection` `"coordinates"` olarak ayarlandığında kullanılır. `auto_downscale` etkinleştirildiğinde, konuşmacı koordinatları, küçültülmüş görsel boyutlarına uyacak şekilde otomatik olarak ölçeklenir. + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `video` | Canlandırılmış portrenin giriş sesiyle senkronize olduğu, oluşturulan konuşan video. | VIDEO | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/tr.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh-TW.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh-TW.md new file mode 100644 index 000000000..f1d0a772d --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh-TW.md @@ -0,0 +1,28 @@ +# SyncTalkingImageNode + +將靜態肖像動畫化為由語音音訊驅動的對話影片,使用 sync.so 的 sync-3 模型。輸出時長與音訊時長相符,費用隨輸出時長增加。 + +## 輸入 +| 參數 | 說明 | 資料類型 | 必填 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `image` | 一張清晰可見臉部的單張圖片,最高支援 4K (4096x2160)。 | IMAGE | 是 | 恰好需要一張圖片 | +| `audio` | 驅動對話影片的語音音訊;輸出時長與其相符。在此鏈接任何 TTS 節點,即可從文字驅動動畫。 | AUDIO | 是 | 最大時長:600 秒 | +| `prompt` | 可選的引導提示,用於控制肖像如何生動呈現,例如「讓主體微笑並看向鏡頭」。留空則產生自然的說話動作。(預設值:"") | STRING | 否 | 多行文字 | +| `seed` | 種子控制節點是否應重新執行;無論種子為何,結果均不具確定性。(預設值:0) | INT | 否 | 0 至 2147483647 | +| `model` | sync.so 生成模型。圖片輸入僅限於 sync-3。 | COMBO | 是 | `"sync-3"` | +| `speaker_selection` | 當畫面中有多人時,選擇要動畫化的臉部。`default`:讓模型決定。`coordinates`:定位圖片中像素座標 (speaker_x, speaker_y) 處的臉部。圖片不支援自動偵測。(預設值:"default") | COMBO | 否 | `"default"`
`"coordinates"` | +| `speaker_x` | 說話者臉部的 X 像素座標。僅在 speaker_selection 設為 'coordinates' 時使用。(預設值:0) | INT | 否 | 0 至 4096 | +| `speaker_y` | 說話者臉部的 Y 像素座標。僅在 speaker_selection 設為 'coordinates' 時使用。(預設值:0) | INT | 否 | 0 至 4096 | +| `auto_downscale` | 當圖片超過 4K (4096x2160) 輸入限制時自動縮小;說話者座標會相應縮放。停用時,超尺寸圖片會引發錯誤。(預設值:True) | BOOLEAN | 否 | True
False | + +**注意:** `speaker_x` 和 `speaker_y` 參數僅在 `speaker_selection` 設為 `"coordinates"` 時使用。啟用 `auto_downscale` 時,說話者座標會自動縮放以匹配縮小後的圖片尺寸。 + +## 輸出 +| 輸出名稱 | 說明 | 資料類型 | +|-------------|-------------|-----------| +| `video` | 生成的對話影片,動畫肖像與輸入音訊同步。 | VIDEO | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh.md b/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh.md new file mode 100644 index 000000000..ae16405d8 --- /dev/null +++ b/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh.md @@ -0,0 +1,28 @@ +# SyncTalkingImageNode + +使用 sync.so 的 sync-3 模型,将静态人像动画化为由语音音频驱动的说话视频。输出时长与音频时长一致,费用随输出时长增加而增加。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必需 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `image` | 一张面部清晰可见的图片,最高支持 4K(4096x2160)分辨率。 | IMAGE | 是 | 仅需一张图片 | +| `audio` | 驱动说话视频的语音音频;输出时长与之匹配。可在此处链接任意 TTS 节点,以通过文本驱动动画。 | AUDIO | 是 | 最大时长:600 秒 | +| `prompt` | 可选提示词,用于指导人像如何生动呈现,例如"让主体微笑并看向镜头"。留空则生成自然的说话动作。(默认值:"") | STRING | 否 | 多行文本 | +| `seed` | 种子控制节点是否应重新运行;无论种子如何,结果均具有非确定性。(默认值:0) | INT | 否 | 0 到 2147483647 | +| `model` | sync.so 生成模型。图片输入仅支持 sync-3。 | COMBO | 是 | `"sync-3"` | +| `speaker_selection` | 当画面中出现多人时,选择对哪张面部进行动画化。`default`:让模型自行决定。`coordinates`:定位图片中像素坐标 (speaker_x, speaker_y) 处的面部。图片不支持自动检测。(默认值:"default") | COMBO | 否 | `"default"`
`"coordinates"` | +| `speaker_x` | 说话者面部的 X 轴像素坐标。仅在 `speaker_selection` 设置为 'coordinates' 时使用。(默认值:0) | INT | 否 | 0 到 4096 | +| `speaker_y` | 说话者面部的 Y 轴像素坐标。仅在 `speaker_selection` 设置为 'coordinates' 时使用。(默认值:0) | INT | 否 | 0 到 4096 | +| `auto_downscale` | 若图片超过 4K(4096x2160)输入限制,自动降低分辨率;说话者坐标会相应缩放。禁用时,超尺寸图片将引发错误。(默认值:True) | BOOLEAN | 否 | True
False | + +**注意:** `speaker_x` 和 `speaker_y` 参数仅在 `speaker_selection` 设置为 `"coordinates"` 时使用。启用 `auto_downscale` 时,说话者坐标会自动缩放以匹配降低后的图片尺寸。 + +## 输出 +| 输出名称 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `video` | 生成的说话视频,其中动画化的人像与输入音频同步。 | VIDEO | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/zh.md) + +--- +**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ar.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ar.md new file mode 100644 index 000000000..56c849517 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ar.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +هذه العقدة تقوم بتشفير موجه نصي وصور اختيارية إلى بيانات تكييف لاستخدامها مع نماذج JoyImage. وهي تجمع بين مشفر نصوص CLIP مع مدخلات صور اختيارية لإنشاء تكييف غني يمكنه توجيه مهام توليد الصور أو تحريرها. + +## المدخلات + +| المعامل | الوصف | نوع البيانات | إلزامي | النطاق | +|---------|-------|---------------|--------|--------| +| `clip` | نموذج CLIP المستخدم لتشفير الموجه النصي | CLIP | نعم | - | +| `prompt` | الموجه النصي المراد تشفيره، ويدعم الإدخال متعدد الأسطر والموجهات الديناميكية | STRING | نعم | - | +| `vae` | نموذج VAE لتشفير الصور إلى الفضاء الكامن (اختياري) | VAE | لا | - | +| `images` | صورة واحدة أو أكثر لتضمينها في التكييف، بحد أقصى 6 صور | IMAGE | لا | من 0 إلى 6 صور | + +## المخرجات + +| اسم المخرج | الوصف | نوع البيانات | +|------------|-------|---------------| +| `CONDITIONING` | بيانات التكييف المشفرة التي تجمع بين الموجه النصي وأي صور مقدمة | CONDITIONING | + +> تم إنشاء هذه الوثيقة بواسطة الذكاء الاصطناعي. إذا وجدت أي أخطاء أو لديك اقتراحات للتحسين، فلا تتردد في المساهمة! [تحرير على GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ar.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/en.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/en.md new file mode 100644 index 000000000..5fdc94066 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/en.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +This node encodes a text prompt and optional images into conditioning data for use with JoyImage models. It combines a CLIP text encoder with optional image inputs to create rich conditioning that can guide image generation or editing tasks. + +## Inputs + +| Parameter | Description | Data Type | Required | Range | +|-----------|-------------|-----------|----------|-------| +| `clip` | The CLIP model used for encoding the text prompt | CLIP | Yes | - | +| `prompt` | The text prompt to encode, supporting multiline input and dynamic prompts | STRING | Yes | - | +| `vae` | A VAE model for encoding images into latent space (optional) | VAE | No | - | +| `images` | One or more images to include in the conditioning, up to a maximum of 6 images | IMAGE | No | 0 to 6 images | + +## Outputs + +| Output Name | Description | Data Type | +|-------------|-------------|-----------| +| `CONDITIONING` | The encoded conditioning data combining the text prompt and any provided images | CONDITIONING | + +> This documentation was AI-generated. If you find any errors or have suggestions for improvement, please feel free to contribute! [Edit on GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/en.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/es.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/es.md new file mode 100644 index 000000000..193f436ba --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/es.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +Este nodo codifica un mensaje de texto e imágenes opcionales en datos de condicionamiento para su uso con modelos JoyImage. Combina un codificador de texto CLIP con entradas de imagen opcionales para crear un condicionamiento enriquecido que puede guiar tareas de generación o edición de imágenes. + +## Entradas + +| Parámetro | Descripción | Tipo de Dato | Requerido | Rango | +|-----------|-------------|--------------|-----------|-------| +| `clip` | El modelo CLIP utilizado para codificar el mensaje de texto | CLIP | Sí | - | +| `prompt` | El mensaje de texto a codificar, compatible con entrada multilínea y mensajes dinámicos | STRING | Sí | - | +| `vae` | Un modelo VAE para codificar imágenes en el espacio latente (opcional) | VAE | No | - | +| `images` | Una o más imágenes para incluir en el condicionamiento, hasta un máximo de 6 imágenes | IMAGE | No | 0 a 6 imágenes | + +## Salidas + +| Nombre de Salida | Descripción | Tipo de Dato | +|------------------|-------------|--------------| +| `CONDITIONING` | Los datos de condicionamiento codificados que combinan el mensaje de texto y cualquier imagen proporcionada | CONDITIONING | + +> Esta documentación fue generada por IA. Si encuentra algún error o tiene sugerencias de mejora, ¡no dude en contribuir! [Editar en GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/es.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fa.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fa.md new file mode 100644 index 000000000..855475421 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fa.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +این گره یک متن prompt و تصاویر اختیاری را به داده‌های شرطی (conditioning) برای استفاده با مدل‌های JoyImage کدگذاری می‌کند. این گره یک رمزگذار متن CLIP را با ورودی‌های تصویری اختیاری ترکیب می‌کند تا شرطی‌سازی غنی‌ای ایجاد کند که می‌تواند وظایف تولید یا ویرایش تصویر را هدایت کند. + +## ورودی‌ها + +| پارامتر | توضیحات | نوع داده | ضروری | محدوده | +|-----------|-------------|-----------|----------|-------| +| `clip` | مدل CLIP مورد استفاده برای کدگذاری متن prompt | CLIP | بله | - | +| `prompt` | متن prompt برای کدگذاری، با پشتیبانی از ورودی چندخطی و promptهای پویا | STRING | بله | - | +| `vae` | یک مدل VAE برای کدگذاری تصاویر به فضای نهان (اختیاری) | VAE | خیر | - | +| `images` | یک یا چند تصویر برای گنجاندن در شرطی‌سازی، حداکثر تا ۶ تصویر | IMAGE | خیر | ۰ تا ۶ تصویر | + +## خروجی‌ها + +| نام خروجی | توضیحات | نوع داده | +|-------------|-------------|-----------| +| `CONDITIONING` | داده‌های شرطی کدگذاری‌شده که متن prompt و هر تصویر ارائه‌شده را ترکیب می‌کند | CONDITIONING | + +> این مستند با هوش مصنوعی تهیه شده است. اگر خطایی دیدید یا پیشنهادی برای بهبود دارید، خوشحال می‌شویم مشارکت کنید! [ویرایش در GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fa.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fr.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fr.md new file mode 100644 index 000000000..d1fa5cbe9 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fr.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +Ce nœud encode un prompt textuel et des images optionnelles en données de conditionnement pour une utilisation avec les modèles JoyImage. Il combine un encodeur textuel CLIP avec des entrées d'images optionnelles pour créer un conditionnement riche pouvant guider des tâches de génération ou d'édition d'images. + +## Entrées + +| Paramètre | Description | Type de données | Requis | Plage | +|-----------|-------------|-----------------|--------|-------| +| `clip` | Le modèle CLIP utilisé pour encoder le prompt textuel | CLIP | Oui | - | +| `prompt` | Le prompt textuel à encoder, prenant en charge les entrées multilignes et les prompts dynamiques | STRING | Oui | - | +| `vae` | Un modèle VAE pour encoder les images dans l'espace latent (optionnel) | VAE | Non | - | +| `images` | Une ou plusieurs images à inclure dans le conditionnement, jusqu'à un maximum de 6 images | IMAGE | Non | 0 à 6 images | + +## Sorties + +| Nom de sortie | Description | Type de données | +|---------------|-------------|-----------------| +| `CONDITIONING` | Les données de conditionnement encodées combinant le prompt textuel et les éventuelles images fournies | CONDITIONING | + +> Cette documentation a été générée par IA. Si vous trouvez des erreurs ou avez des suggestions d'amélioration, n'hésitez pas à contribuer ! [Modifier sur GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/fr.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ja.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ja.md new file mode 100644 index 000000000..2a97642ca --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ja.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +このノードは、テキストプロンプトとオプションの画像を、JoyImageモデルで使用するための条件付けデータにエンコードします。CLIPテキストエンコーダーとオプションの画像入力を組み合わせることで、画像生成や編集タスクをガイドできる豊富な条件付けを作成します。 + +## 入力 + +| パラメータ | 説明 | データ型 | 必須 | 範囲 | +|-----------|-------------|-----------|----------|-------| +| `clip` | テキストプロンプトのエンコードに使用するCLIPモデル | CLIP | はい | - | +| `prompt` | エンコードするテキストプロンプト。複数行入力と動的プロンプトに対応 | STRING | はい | - | +| `vae` | 画像を潜在空間にエンコードするためのVAEモデル(オプション) | VAE | いいえ | - | +| `images` | 条件付けに含める1つ以上の画像。最大6枚まで | IMAGE | いいえ | 0~6枚 | + +## 出力 + +| 出力名 | 説明 | データ型 | +|-------------|-------------|-----------| +| `CONDITIONING` | テキストプロンプトと提供された画像を組み合わせたエンコード済み条件付けデータ | CONDITIONING | + +> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ja.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ko.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ko.md new file mode 100644 index 000000000..69aebe64e --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ko.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +이 노드는 텍스트 프롬프트와 선택적 이미지를 JoyImage 모델과 함께 사용하기 위한 컨디셔닝 데이터로 인코딩합니다. CLIP 텍스트 인코더와 선택적 이미지 입력을 결합하여 이미지 생성 또는 편집 작업을 안내할 수 있는 풍부한 컨디셔닝을 생성합니다. + +## 입력 + +| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 | +|-----------|-------------|-----------|----------|-------| +| `clip` | 텍스트 프롬프트 인코딩에 사용되는 CLIP 모델 | CLIP | 예 | - | +| `prompt` | 인코딩할 텍스트 프롬프트로, 여러 줄 입력 및 동적 프롬프트를 지원합니다 | STRING | 예 | - | +| `vae` | 이미지를 잠재 공간으로 인코딩하기 위한 VAE 모델(선택 사항) | VAE | 아니요 | - | +| `images` | 컨디셔닝에 포함할 하나 이상의 이미지로, 최대 6개까지 지원합니다 | IMAGE | 아니요 | 0~6개 이미지 | + +## 출력 + +| 출력 이름 | 설명 | 데이터 타입 | +|-------------|-------------|-----------| +| `CONDITIONING` | 텍스트 프롬프트와 제공된 모든 이미지를 결합한 인코딩된 컨디셔닝 데이터 | CONDITIONING | + +> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ko.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/pt-BR.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/pt-BR.md new file mode 100644 index 000000000..eb72b1666 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/pt-BR.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +Este nó codifica um prompt de texto e imagens opcionais em dados de condicionamento para uso com modelos JoyImage. Ele combina um codificador de texto CLIP com entradas de imagem opcionais para criar um condicionamento rico que pode guiar tarefas de geração ou edição de imagens. + +## Entradas + +| Parâmetro | Descrição | Tipo de Dado | Obrigatório | Faixa | +|-----------|-------------|--------------|-------------|-------| +| `clip` | O modelo CLIP usado para codificar o prompt de texto | CLIP | Sim | - | +| `prompt` | O prompt de texto a ser codificado, suportando entrada multilinha e prompts dinâmicos | STRING | Sim | - | +| `vae` | Um modelo VAE para codificar imagens no espaço latente (opcional) | VAE | Não | - | +| `images` | Uma ou mais imagens a serem incluídas no condicionamento, até o máximo de 6 imagens | IMAGE | Não | 0 a 6 imagens | + +## Saídas + +| Nome da Saída | Descrição | Tipo de Dado | +|---------------|-----------|--------------| +| `CONDITIONING` | Os dados de condicionamento codificados combinando o prompt de texto e quaisquer imagens fornecidas | CONDITIONING | + +> Esta documentação foi gerada por IA. Se você encontrar erros ou tiver sugestões de melhoria, sinta-se à vontade para contribuir! [Editar no GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/pt-BR.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ru.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ru.md new file mode 100644 index 000000000..1ad877687 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ru.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +Этот узел кодирует текстовый запрос и опциональные изображения в данные кондиционирования для использования с моделями JoyImage. Он объединяет текстовый энкодер CLIP с опциональными входными изображениями для создания расширенного кондиционирования, которое может направлять задачи генерации или редактирования изображений. + +## Входы + +| Параметр | Описание | Тип данных | Обязательный | Диапазон | +|----------|----------|------------|--------------|----------| +| `clip` | Модель CLIP, используемая для кодирования текстового запроса | CLIP | Да | - | +| `prompt` | Текстовый запрос для кодирования, поддерживающий многострочный ввод и динамические запросы | STRING | Да | - | +| `vae` | Модель VAE для кодирования изображений в скрытое пространство (опционально) | VAE | Нет | - | +| `images` | Одно или несколько изображений для включения в кондиционирование, до 6 изображений | IMAGE | Нет | от 0 до 6 изображений | + +## Выходы + +| Имя выхода | Описание | Тип данных | +|------------|----------|------------| +| `CONDITIONING` | Закодированные данные кондиционирования, объединяющие текстовый запрос и любые предоставленные изображения | CONDITIONING | + +> Эта документация была создана с помощью ИИ. Если вы обнаружите ошибки или у вас есть предложения по улучшению, пожалуйста, внесите свой вклад! [Редактировать на GitHub](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/ru.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/tr.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/tr.md new file mode 100644 index 000000000..6efdf7ac8 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/tr.md @@ -0,0 +1,23 @@ +# TextEncodeJoyImageEdit + +Bu düğüm, JoyImage modelleriyle kullanılmak üzere bir metin istemini ve isteğe bağlı görüntüleri koşullandırma verilerine kodlar. Görüntü oluşturma veya düzenleme görevlerine yön verebilecek zengin koşullandırma oluşturmak için bir CLIP metin kodlayıcısını isteğe bağlı görüntü girdileriyle birleştirir. + +## Girdiler + +| Parametre | Açıklama | Veri Türü | Gerekli | Aralık | +|-----------|-------------|-----------|----------|-------| +| `clip` | Metin istemini kodlamak için kullanılan CLIP modeli | CLIP | Evet | - | +| `prompt` | Kodlanacak metin istemi; çok satırlı girdi ve dinamik istemleri destekler | STRING | Evet | - | +| `vae` | Görüntüleri potansiyel uzaya kodlamak için bir VAE modeli (isteğe bağlı) | VAE | Hayır | - | +| `images` | Koşullandırmaya dahil edilecek bir veya daha fazla görüntü; en fazla 6 görüntü | IMAGE | Hayır | 0 ila 6 görüntü | + +## Çıktılar + +| Çıktı Adı | Açıklama | Veri Türü | +|-------------|-------------|-----------| +| `CONDITIONING` | Metin istemi ve sağlanan tüm görüntüleri birleştiren kodlanmış koşullandırma verileri | CONDITIONING | + +> Bu belge yapay zeka tarafından oluşturulmuştur. Herhangi bir hata bulursanız veya iyileştirme önerileriniz varsa, katkıda bulunmaktan çekinmeyin! [GitHub'da Düzenle](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/tr.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh-TW.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh-TW.md new file mode 100644 index 000000000..62f1758c1 --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh-TW.md @@ -0,0 +1,22 @@ +# TextEncodeJoyImageEdit + +## 概述 +此節點將文字提示和可選圖像編碼為條件數據,供 JoyImage 模型使用。它結合了 CLIP 文字編碼器與可選的圖像輸入,以創建豐富的條件數據,從而引導圖像生成或編輯任務。 + +## 輸入 +| 參數 | 描述 | 資料類型 | 必要 | 範圍 | +|-----------|-------------|-----------|----------|-------| +| `clip` | 用於編碼文字提示的 CLIP 模型 | CLIP | 是 | - | +| `prompt` | 要編碼的文字提示,支援多行輸入和動態提示 | STRING | 是 | - | +| `vae` | 用於將圖像編碼為潛在空間的 VAE 模型(可選) | VAE | 否 | - | +| `images` | 要包含在條件數據中的一或多張圖像,最多可達 6 張圖像 | IMAGE | 否 | 0 到 6 張圖像 | + +## 輸出 +| 輸出名稱 | 描述 | 資料類型 | +|-------------|-------------|-----------| +| `CONDITIONING` | 結合文字提示和任何提供的圖像所編碼的條件數據 | CONDITIONING | + +> 本文檔由 AI 生成。如果您發現任何錯誤或有改進建議,歡迎貢獻! [在 GitHub 上編輯](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh-TW.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d` diff --git a/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh.md b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh.md new file mode 100644 index 000000000..f3b65359b --- /dev/null +++ b/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh.md @@ -0,0 +1,21 @@ +# TextEncodeJoyImageEdit + +此节点将文本提示和可选图像编码为条件数据,用于 JoyImage 模型。它结合了 CLIP 文本编码器与可选的图像输入,以创建丰富的条件数据,从而引导图像生成或编辑任务。 + +## 输入 +| 参数 | 描述 | 数据类型 | 是否必需 | 范围 | +|-----------|-------------|-----------|----------|-------| +| `clip` | 用于编码文本提示的 CLIP 模型 | CLIP | 是 | - | +| `prompt` | 要编码的文本提示,支持多行输入和动态提示 | STRING | 是 | - | +| `vae` | 用于将图像编码到潜在空间的 VAE 模型(可选) | VAE | 否 | - | +| `images` | 要包含在条件数据中的一张或多张图像,最多 6 张 | IMAGE | 否 | 0 到 6 张图像 | + +## 输出 +| 输出名 | 描述 | 数据类型 | +|-------------|-------------|-----------| +| `CONDITIONING` | 编码后的条件数据,结合了文本提示和任何提供的图像 | CONDITIONING | + +> 本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextEncodeJoyImageEdit/zh.md) + +--- +**Source fingerprint (SHA-256):** `ef48523aa9fc990b2839d755cef272bcdfbacef5af8d961736fde5200c6f082d`