Centro de Ayuda

Guía de Generación

Cómo usar cada estudio. Imagen, vídeo, audio, música, 3D, avatares.

Cómo funciona la generación

Toda generación en Rhyora sigue un flujo sencillo:

  1. Elige un estudio (Imagen, Vídeo, Audio y Música, 3D, Avatar o Lip Sync).
  2. Pulsa Generar: la IA selecciona automáticamente el mejor modelo y aplica los ajustes óptimos según el contexto de tu toma. Se reservan créditos y el trabajo entra en cola.
  3. Observa el indicador de progreso en tiempo real mientras se crea tu recurso, con el tiempo transcurrido mostrado.
  4. Descarga, itera o aprueba el resultado.

¿Quieres elegir un modelo específico o ajustar los parámetros? Haz clic en “Cambiar modelo / Avanzado” para acceder a la biblioteca completa de modelos y a todos los parámetros.

Si un trabajo falla por cualquier motivo, tus créditos se reembolsan automáticamente en su totalidad.

Selección automática de modelo

Al trabajar dentro de un proyecto, Rhyora elige automáticamente el mejor modelo para cada toma según tu contexto creativo: las referencias que has enlazado, el tipo de toma, el movimiento de cámara y el estilo visual. La IA selecciona entre tres niveles de precio:

  • Económico: Rápido y asequible. Ideal para borradores, iteraciones y exploración rápida de ideas.
  • Estándar: Calidad y coste equilibrados. Lo mejor para la mayoría de trabajos de producción.
  • Premium: Resultado de máxima calidad. Úsalo para recursos clave, renders finales y trabajos para clientes.

Verás qué modelo se ha seleccionado y puedes cambiar a otro en cualquier momento haciendo clic en “Cambiar modelo / Avanzado”. Para generaciones independientes fuera de proyectos, eliges tú mismo el modelo.

Estudio de Imagen

El Estudio de Imagen es el espacio de trabajo más versátil, compatible con dos modos principales:

  • Texto a imagen: Describe lo que quieres en un prompt de texto. Sé específico sobre el estilo, composición, iluminación, ambiente y temática para obtener los mejores resultados.
  • Imagen a imagen: Proporciona una imagen de referencia junto con un prompt. La IA utiliza la referencia como punto de partida y la transforma según tus instrucciones. Ajusta el parámetro de intensidad para controlar cuánto se desvía el resultado de la entrada.

Los parámetros comunes incluyen la relación de aspecto (vertical, horizontal, cuadrado y personalizado), el nivel de calidad, la semilla (para resultados reproducibles) y los prompts negativos (para excluir elementos no deseados). No todos los parámetros están disponibles en todos los modelos; el formulario se adapta dinámicamente a las capacidades de cada modelo.

Estudio de Vídeo

El Estudio de Vídeo soporta múltiples modos de generación para diferentes necesidades creativas:

  • Texto a vídeo: Genera un clip de vídeo directamente a partir de una descripción de texto. Ideal para conceptos rápidos y estudios de movimiento.
  • Imagen a vídeo: Anima un fotograma fijo aprobado en un vídeo. Este es el flujo de trabajo recomendado para resultados de calidad de producción: genera y aprueba primero un fotograma en el Estudio de Imagen, luego llévalo al Estudio de Vídeo.
  • Extensión de video: Extiende un clip de video existente con fotogramas adicionales, continuando el movimiento y la narrativa.
  • Transformación de video: Aplica cambios de estilo a un video existente conservando su movimiento y composición.
  • Efectos visuales: Añade tratamientos de VFX, transiciones y efectos estilísticos a clips de video.
  • Animación de personajes: Anima personajes con movimiento, expresiones y gestos a partir de texto o audio.

Importante: Para la conversión de imagen a video, la imagen de origen debe ser aprobada primero. Esto asegura que inviertes créditos de video en un fotograma con el que estás satisfecho. Aprueba cualquier imagen desde su vista de detalles o el panel de revisión.

Las opciones de duración varían según el modelo. Cada modelo admite longitudes de clip específicas:

  • Clips cortos: 4, 6 u 8 segundos
  • Clips estándar: 5 o 10 segundos
  • Clips largos: 6 o 10 segundos
  • Clips extendidos: 5, 10 o 15 segundos

Al trabajar dentro de un proyecto, las duraciones de las tomas se planifican previamente utilizando estos valores. La duración que selecciones al generar debe coincidir con la duración de la toma planificada para un ritmo consistente en toda tu producción.

Estudio de Audio y Música

Genera audio hablado y efectos de sonido con IA:

  • Texto a voz: Convierte texto escrito en voz de sonido natural. Elige entre múltiples voces con diferentes acentos, géneros y cualidades tonales. Ajusta la velocidad y el énfasis para la entrega que necesitas.
  • Efectos de sonido: Describe un sonido ambiental, efecto foley o textura de audio y la IA lo genera. Útil para añadir atmósfera a proyectos de video.

Los formatos de salida incluyen MP3 y WAV. Los activos de audio se integran directamente en la línea de tiempo de tu proyecto junto con los activos visuales.

Generación de música

El mismo estudio también crea pistas y partituras musicales originales:

  • Texto a música: Describe el estado de ánimo, género, tempo e instrumentación que deseas. La IA genera una pista instrumental original.
  • Audio a música: Proporciona un clip de audio de referencia y la IA genera música que coincide con su estilo, tempo o estado de ánimo.

Los activos de música son geniales para musicalizar proyectos de video, crear pistas de fondo para podcasts o generar música libre de derechos para contenido.

Estudio 3D

Crea objetos 3D a partir de descripciones de texto o imágenes de referencia:

  • Texto a 3D: Describe un objeto y la IA genera un modelo 3D texturizado.
  • Imagen a 3D: Proporciona una imagen de referencia y la IA infiere la estructura 3D y genera un modelo que coincide con ella.

Los formatos de salida incluyen GLB y OBJ, listos para importar en motores de juegos (Unity, Unreal), editores 3D (Blender), aplicaciones AR/VR y visores web.

Estudio de Avatares

Crea animaciones de personajes y videos de cabeza parlante:

  • Sincronización de labios: Proporciona una imagen de retrato y una pista de audio. La IA anima el rostro para que coincida con el habla, produciendo un video realista de cabeza parlante.
  • Animación facial: Anima expresiones faciales y movimientos de cabeza en una imagen de retrato a partir de un video o audio de referencia.
  • Intercambio de caras: Transfiere una cara sobre otra en un video o imagen, manteniendo el movimiento y las expresiones originales.
  • Transferencia de retrato: Aplica el estilo o la semejanza de un retrato en diferentes contextos y poses.

Los modelos de avatar funcionan mejor con imágenes de referencia claras y de frente y audio de alta calidad para la sincronización de labios.

Progreso del pipeline

Al generar dentro de un proyecto, una barra de progreso muestra el pipeline de producción para cada toma: Imagen → Video → Audio. Las etapas completadas se marcan con una marca de verificación, y puedes hacer clic en cualquier etapa para cambiar a ese espacio de trabajo. Cada generación activa muestra el tiempo transcurrido para que siempre sepas cuánto tiempo ha estado en ejecución.

Optimización automática de prompts

Al usar Rhyora Prism (modo Manual o Automático), tus prompts de toma se mejoran automáticamente antes del primer intento de generación. El optimizador agrega términos técnicos de fotografía, detalles de iluminación y guía de composición a los que los modelos de imagen responden mejor.

Esto sucede tras bambalinas: no necesitas escribir prompts perfectos tú mismo. El prompt original se conserva; la versión optimizada se usa solo para la generación. Si la optimización falla por alguna razón, se usa el prompt original tal cual para que la producción nunca se bloquee.

Evaluación de calidad

Después de que cada imagen se genera a través de Rhyora Prism, un modelo de visión AI evalúa el resultado en comparación con tu prompt original. Califica cuatro dimensiones:

  • Adherencia al prompt: ¿La imagen coincide con lo descrito?
  • Composición: ¿El encuadre, el equilibrio y el flujo visual son sólidos?
  • Calidad técnica: Nitidez, iluminación, precisión del color.
  • Ambiente: ¿El tono emocional coincide con el contexto de la escena?

La puntuación combinada (1-10) se compara con tu umbral de calidad. Las imágenes que pasan son aprobadas. Las que no, se reintentan con un prompt refinado que aborda los problemas específicos encontrados. Cada toma tiene hasta dos reintentos de calidad antes de aprobarse automáticamente para mantener la producción en movimiento.

Consejos de prompting

La calidad de tu resultado depende en gran medida de tu prompt. Aquí tienes consejos que se aplican en todos los estudios:

  • Sé específico: En lugar de "un gato", prueba "un gato atigrado sentado en el alféizar de una ventana, luz solar de la tarde, fondo suave con bokeh, fotorrealista".
  • Describe el estilo y el ambiente: Incluye el estilo artístico (cinemático, anime, acuarela), la iluminación (hora dorada, iluminación de estudio, neón) y el ambiente (sereno, dramático, juguetón).
  • Usa prompts negativos: Donde sea compatible, los prompts negativos excluyen elementos no deseados (por ejemplo, "borroso, baja calidad, texto, marca de agua").
  • Itera con modelos económicos: Refina tu prompt usando modelos rápidos y de bajo costo. Una vez que estés satisfecho con la composición y el estilo, cambia a un modelo premium para la renderización final.
  • Usa el optimizador de prompts: El optimizador de prompts AI incorporado reescribe tu prompt para que sea más detallado y amigable para el modelo. Agrega parámetros técnicos que mejoran la calidad del resultado.
  • Usa semillas para la consistencia: Si encuentras un resultado que te gusta, anota su valor de semilla. Usar la misma semilla con el mismo prompt produce un resultado similar, lo que te permite hacer pequeños ajustes al prompt manteniendo la composición general.

Generación paralela

Puedes enviar varios trabajos de generación a la vez. Cada nivel de plan incluye un límite de concurrencia: el número de trabajos que pueden ejecutarse simultáneamente:

  • Gratis: 4 tareas paralelas
  • Starter: 6 tareas paralelas
  • Creator: 7 tareas paralelas
  • Pro: 8 tareas paralelas
  • Estudio — 12 tareas paralelas

Los trabajos de diferentes estudios pueden ejecutarse al mismo tiempo: genera una imagen mientras se renderiza un video o produce audio mientras se crea un modelo 3D.

En el guion gráfico, el botón "Producir todo" muestra cuántos espacios paralelos están disponibles para que sepas cuántas tomas comenzarán de inmediato. Cuando alcanzas el límite, las tomas restantes comienzan a medida que los espacios se liberan. Para aumentar tu límite paralelo, actualiza tu plan.

Preguntas frecuentes

¿Cómo funciona la selección automática de modelos?

Cuando trabajas dentro de un proyecto, la IA analiza tu toma —las referencias vinculadas, el tipo de toma y el movimiento de la cámara— y elige el mejor modelo automáticamente. Siempre puedes cambiar a un modelo diferente haciendo clic en "Cambiar modelo / Avanzado".

¿Puedo generar varios activos a la vez?

Sí. Puedes enviar varios trabajos en paralelo hasta el límite de concurrencia de tu plan. Cada trabajo se ejecuta de forma independiente, por lo que puedes trabajar en varios estudios simultáneamente.

¿Por qué el video requiere un fotograma aprobado?

Aprobar un fotograma primero asegura que estés satisfecho con la dirección visual antes de gastar créditos en la generación de video, que es más costosa. Esto evita el desperdicio de créditos en videos a partir de fotogramas que rechazarías.

¿Necesito escribir indicaciones?

No. Cuando trabajas dentro de un proyecto, las indicaciones se generan automáticamente a partir de las descripciones de tus tomas, el contexto de la escena y las referencias vinculadas. Para generaciones independientes, escribes una descripción y el optimizador incorporado la mejora para obtener mejores resultados.

¿Puedo acceder a la configuración avanzada?

Sí. Haz clic en "Cambiar modelo / Avanzado" para acceder a la biblioteca completa de modelos, ajustar parámetros como la relación de aspecto y la duración, y afinar cada detalle. El modo avanzado te da control total.

¿Puedo producir tomas directamente desde el guion gráfico?

Sí. Haz clic en cualquier tarjeta de toma vacía en el guion gráfico para abrir una ventana modal de producción guiada que te guía a través de la generación de fotogramas, la revisión y la producción de video, todo sin salir del guion gráfico. Usa "Producir todo" para producir lotes de varias tomas a la vez.

¿Rhyora Prism optimiza mis indicaciones?

Sí. En el primer intento para cada toma, el agente mejora tu indicación con términos técnicos de fotografía, detalles de iluminación y guía de composición. Esto sucede automáticamente: tu indicación original se conserva y la versión mejorada se utiliza para la generación.

¿Qué sucede cuando la puerta de calidad rechaza una imagen?

El evaluador de IA proporciona una indicación refinada que aborda los problemas específicos que encontró (por ejemplo, mejor dirección de iluminación, composición mejorada). El agente lo intenta de nuevo con esta indicación refinada. Después de dos reintentos de calidad, la imagen se aprueba automáticamente para que la producción continúe.

Pruébalo

20 créditos gratis. Todos los estudios incluidos.

Comienza gratis