ヘルプセンター

生成ガイド

全スタジオの使い方。画像、動画、音声、音楽、3D、アバター。

生成の仕組み

Rhyoraでの全ての生成は、シンプルなフローに従います:

  1. スタジオを選択します(画像、動画、オーディオ&ミュージック、3D、アバター、またはリップシンク)。
  2. 「生成」をクリック — AIがショットのコンテキストに基づいて最適なモデルを自動選択し、設定を最適化します。クレジットは事前に確保され、ジョブはキューに入ります。
  3. アセットが作成されるリアルタイムの進捗インジケーターをウォッチし、経過時間を表示します。
  4. 結果をダウンロード、反復、または承認します。

特定のモデルを選択したり、設定を調整したりしたいですか?「モデル変更 / 詳細設定」をクリックして、完全なモデルライブラリとすべてのパラメータにアクセスしてください。

何らかの理由でジョブが失敗した場合、クレジットは全額自動的に返金されます。

自動モデル選択

プロジェクト内で作業する場合、Rhyoraはリンクした参照、ショットタイプ、カメラの動き、ビジュアルスタイルなどのクリエイティブコンテキストに基づいて、各ショットに最適なモデルを自動的に選択します。AIは3つの価格帯から選択します:

  • バジェット — 高速で手頃。ドラフト、イテレーション、アイデアの迅速な探求に最適。
  • バリュー — バランスの取れた品質とコスト。ほとんどの制作作業に最適。
  • プレミアム — 最高品質のアウトプット。ヒーローアセット、最終レンダリング、クライアント向け作業に使用。

選択されたモデルが表示され、「モデル変更 / 詳細設定」をクリックすることでいつでも別のモデルに切り替えることができます。プロジェクト外でのスタンドアロン生成の場合は、自分でモデルを選択します。

画像スタジオ

画像スタジオは最も汎用性の高いワークスペースで、2つの主要モードをサポートしています:

  • テキストから画像へ — テキストプロンプトで希望するものを記述します。最良の結果を得るために、スタイル、構成、照明、ムード、被写体について具体的に記述してください。
  • 画像から画像へ — プロンプトと共に参照画像を提供します。AIは参照を起点として、指示に従って変換します。出力が入力からどれだけ逸脱するかを制御するには、強度パラメータを調整します。

一般的なパラメータには、アスペクト比(縦長、横長、正方形、カスタム)、品質レベル、シード(再現可能な結果のため)、ネガティブプロンプト(不要な要素を除外するため)が含まれます。すべてのパラメータがすべてのモデルで利用できるわけではありません — フォームは各モデルの機能に動的に適応します。

動画スタジオ

動画スタジオは、さまざまなクリエイティブニーズに対応する複数の生成モードをサポートしています:

  • テキストから動画へ — テキスト説明から直接動画クリップを生成します。迅速なコンセプトやモーションスタディに最適。
  • 画像から動画へ — 承認された静止フレームをアニメーション化して動画にします。これは制作品質のアウトプットに推奨されるワークフローです:まず画像スタジオでフレームを生成・承認し、次に動画スタジオに持ち込みます。
  • ビデオ延長 — 追加フレームで既存のビデオクリップを延長し、動きと物語を継続させます。
  • ビデオ変換 — 動きと構成を維持しながら、既存のビデオにスタイル変更を適用します。
  • ビジュアルエフェクト — ビデオクリップにVFX処理、トランジション、およびスタイルエフェクトを追加します。
  • キャラクターアニメーション — テキストまたは音声入力から、動き、表情、ジェスチャーでキャラクターをアニメートします。

重要:画像からビデオへの変換の場合、ソース画像は最初に承認される必要があります。これにより、満足のいくフレームにビデオクレジットを投資していることを確認できます。詳細ビューまたはレビューパネルから画像を承認してください。

期間オプションはモデルによって異なります。各モデルは特定のクリップ長をサポートしています:

  • 短いクリップ — 4、6、または8秒
  • 標準クリップ — 5または10秒
  • 長いクリップ — 6または10秒
  • 拡張クリップ — 5、10、または15秒

プロジェクト内で作業する場合、ショットの期間はこれらの値を使用して事前に計画されます。生成時に選択する期間は、プロダクション全体で一貫したペースを保つために、計画されたショットの期間と一致する必要があります。

オーディオ&ミュージックスタジオ

AIで話し言葉のオーディオと効果音を生成します:

  • テキスト読み上げ — テキストを自然に聞こえる音声に変換します。さまざまなアクセント、性別、トーンの品質を持つ複数のボイスから選択します。必要なデリバリーに合わせて速度と強調を調整します。
  • 効果音 — 環境音、フォーリー効果、またはオーディオテクスチャを説明すると、AIがそれを生成します。ビデオプロジェクトに雰囲気を追加するのに役立ちます。

出力フォーマットにはMP3とWAVが含まれます。オーディオアセットは、ビジュアルアセットと並んでプロジェクトタイムラインに直接統合されます。

音楽生成

同じスタジオでオリジナル楽曲やスコアも作成できます:

  • テキストから音楽へ — ムード、ジャンル、テンポ、楽器編成を説明します。AIがオリジナルのインストゥルメンタルトラックを生成します。
  • オーディオから音楽へ — リファレンスオーディオクリップを提供すると、AIがそのスタイル、テンポ、またはムードに一致する音楽を生成します。

音楽アセットは、ビデオプロジェクトのスコアリング、ポッドキャストのバックグラウンドトラックの作成、またはコンテンツ用のロイヤリティフリー音楽の生成に最適です。

3Dスタジオ

テキストの説明または参照画像から3Dオブジェクトを作成します:

  • テキストから3Dへ — オブジェクトを説明すると、AIがテクスチャ付きの3Dモデルを生成します。
  • 画像から3Dへ — リファレンス画像を提供すると、AIが3D構造を推測し、それに一致するモデルを生成します。

出力フォーマットにはGLBとOBJが含まれ、ゲームエンジン(Unity、Unreal)、3Dエディタ(Blender)、AR/VRアプリケーション、およびWebビューアへのインポート準備ができています。

アバタースタジオ

キャラクターアニメーションとトークヘッドビデオを作成します:

  • リップシンク — ポートレート画像とオーディオトラックを提供します。AIがスピーチに合わせて顔をアニメートし、リアルなトークヘッドビデオを生成します。
  • 顔アニメーション — 参考ビデオまたは音声入力から、ポートレート画像で表情や頭の動きをアニメーション化します。
  • 顔交換 — 元の動きや表情を維持しながら、ビデオまたは画像で一方の顔をもう一方の顔に転送します。
  • ポートレート転送 — ポートレートのスタイルや類似性を、さまざまなコンテキストやポーズに適用します。

アバターモデルは、鮮明で正面向きの参考画像と、リップシンク用の高品質な音声入力で最も効果を発揮します。

パイプラインの進捗状況

プロジェクト内で生成する場合、各ショットの制作パイプライン(画像 → 動画 → 音声)が進行状況バーで表示されます。完了したステージにはチェックマークが付いており、いずれかのステージをクリックするとそのワークスペースに切り替わります。アクティブな生成ごとに経過時間が表示されるため、実行時間が常にわかります。

自動プロンプト最適化

Rhyora Prism(手動または自動モード)を使用すると、最初の生成試行前にショットプロンプトが自動的に強化されます。オプティマイザーは、画像モデルが最も応答しやすい技術的な写真用語、照明の詳細、および構成ガイダンスを追加します。

これはバックグラウンドで実行されるため、自分で完璧なプロンプトを作成する必要はありません。元のプロンプトは保持され、最適化されたバージョンは生成にのみ使用されます。何らかの理由で最適化が失敗した場合、元のプロンプトがそのまま使用されるため、制作がブロックされることはありません。

品質評価

Rhyora Prism を介して各画像が生成された後、AI ビジョンモデルが元のプロンプトに対して結果を評価します。次の 4 つの次元でスコアリングされます。

  • プロンプトへの準拠 — 画像は説明どおりですか?
  • 構成 — フレーム、バランス、視覚的な流れは強力ですか?
  • 技術的品質 — シャープネス、照明、色の精度。
  • ムード — 感情的なトーンはシーンのコンテキストと一致していますか?

総合スコア(1〜10)が品質しきい値と比較されます。合格した画像は承認されます。合格しなかった画像は、特定された問題に対処する改良されたプロンプトで再試行されます。各ショットは、制作を円滑に進めるために、自動承認前に最大 2 回の品質再試行が行われます。

プロンプトのヒント

出力の品質はプロンプトに大きく依存します。すべてのスタジオに適用できるヒントを以下に示します。

  • 具体的に — 「猫」の代わりに、「窓辺に座っているトラ猫、午後の太陽光、柔らかなボケ背景、フォトリアル」のように試してください。
  • スタイルとムードを説明する — アートスタイル(シネマティック、アニメ、水彩)、照明(ゴールデンアワー、スタジオ照明、ネオン)、ムード(穏やか、ドラマチック、遊び心のある)を含めます。
  • ネガティブプロンプトを使用する — サポートされている場合、ネガティブプロンプトは不要な要素を除外します(例:「ぼやけた、低品質、テキスト、ウォーターマーク」)。
  • 予算モデルで反復する — 高速で低コストのモデルを使用してプロンプトを改良します。構成とスタイルに満足したら、最終レンダリングのためにプレミアムモデルに切り替えます。
  • プロンプトオプティマイザーを使用する — 内蔵の AI プロンプトオプティマイザーは、プロンプトをより詳細でモデルフレンドリーなものに書き換えます。出力品質を向上させる技術的なパラメータを追加します。
  • シードを使用して一貫性を保つ — 気に入った結果が見つかったら、そのシード値をメモします。同じプロンプトで同じシードを使用すると、同様の出力が得られ、全体的な構成を維持しながらプロンプトをわずかに調整できます。

並列生成

複数の生成ジョブを一度に送信できます。各プランティアには、同時に実行できるジョブの数である同時実行制限が含まれています。

  • 無料 — 4 つの並列タスク
  • スターター — 6 つの並列タスク
  • クリエイター — 7 つの並列タスク
  • プロ — 8 つの並列タスク
  • スタジオ — 12並列タスク

異なるスタジオからのジョブを同時に実行できます。動画のレンダリング中に画像を生成したり、3Dモデル作成中にオーディオを生成したりできます。

ストーリーボードの「すべて生成」ボタンには、利用可能な並列スロット数が表示されるため、すぐに開始されるショットの数がわかります。上限に達すると、スロットが空き次第、残りのショットが開始されます。並列上限を増やすには、プランをアップグレードしてください。

よくある質問

自動モデル選択はどのように機能しますか?

プロジェクト内で作業している場合、AIがショット(リンクされた参照、ショットタイプ、カメラの動き)を分析し、最適なモデルを自動的に選択します。「モデルを変更 / 詳細設定」をクリックすると、いつでも別のモデルに切り替えることができます。

複数のアセットを一度に生成できますか?

はい。プランの同時実行上限まで、複数のジョブを並列で送信できます。各ジョブは独立して実行されるため、複数のスタジオで同時に作業できます。

動画で承認済みのフレームが必要なのはなぜですか?

フレームを事前に承認することで、より高価な動画生成にクレジットを費やす前に、ビジュアルの方向性に満足していることを確認できます。これにより、却下する可能性のあるフレームからの動画でクレジットを無駄にすることを防ぎます。

プロンプトを作成する必要がありますか?

いいえ。プロジェクト内で作業している場合、プロンプトはショットの説明、シーンのコンテキスト、およびリンクされた参照から自動的に生成されます。スタンドアロン生成の場合は、説明を作成すると、組み込みオプティマイザーが結果を向上させるためにそれを強化します。

詳細設定にアクセスできますか?

はい。「モデルを変更 / 詳細設定」をクリックすると、モデルライブラリ全体にアクセスしたり、アスペクト比や期間などのパラメータを調整したり、すべての詳細を微調整したりできます。詳細モードでは、完全に制御できます。

ストーリーボードから直接ショットを生成できますか?

はい。ストーリーボードの空のショットカードをクリックすると、ガイド付き生成モーダルが開きます。フレーム生成、レビュー、動画生成のプロセスが、ストーリーボードを離れることなく案内されます。「すべて生成」を使用して、複数のショットを一度にバッチ生成します。

Rhyora Prismは私のプロンプトを最適化しますか?

はい。各ショットの最初の試行で、エージェントが技術的な写真用語、照明の詳細、および構成ガイダンスでプロンプトを強化します。これは自動的に行われ、元のプロンプトは保持され、強化されたバージョンが生成に使用されます。

品質ゲートが画像を却下した場合、どうなりますか?

AI評価者は、特定された問題(例:より良い照明方向、改善された構成)に対処する調整されたプロンプトを提供します。エージェントはこの調整されたプロンプトで再試行します。2回の品質再試行後、画像は自動承認され、生成が継続されます。

試してみる

無料クレジット20回分。全スタジオが含まれます。

無料で始めよう