本文へスキップ

オンプレミスモデル

バーチャルヒューマンと AI メディア生成プラットフォーム

自社の GPU サーバーで動く生成プラットフォーム。バーチャルヒューマンごとに専用 LoRA があり、シーンや衣装が変わっても同じ顔のまま、日常のショート動画を撮り、複数人のショートドラマを演じ、セリフは本人の声でリップシンクします。テーマ・ニュース・スライドからナレーションと字幕付きの動画を作ったり、インストゥルメンタルのアルバムを丸ごと作ったりもできます。画像・動画・音声・音楽はすべてローカル GPU で生成します。

このシステムでできること

  • バーチャルヒューマン:キャラクターごとに LoRA を 1 つ。シーンや衣装が変わっても同じ顔で、それぞれ声と人物設定あり
  • ショート動画とドラマ:AI が台本、絵コンテ、画像、動画の順に作り、各段階で止めて確認・修正・やり直しが可能
  • 生成ワークベンチ:テキストから画像、画像から画像、レタッチ、着せ替え、画像から動画、リップシンク、音楽、音声。モデルは切り替え可能
  • GPU キューは 1 カットずつ処理し、VRAM をリアルタイム表示。台本は Claude でもローカルの llama.cpp でも作成可能

画面を見る

実際の稼働画面です。お客様の情報が入る欄はマスクしています。 画像をタップすると原寸で表示します。

  • バーチャルヒューマン:キャラクターごとに専用 LoRA、人物設定、SNS アカウントがあり、素材の充足度がひと目でわかります。
    バーチャルヒューマン:キャラクターごとに専用 LoRA、人物設定、SNS アカウントがあり、素材の充足度がひと目でわかります。
  • 日常動画:バーチャルヒューマンを選び、今日撮りたいことを一言伝えると、手持ち撮影風の縦型動画に仕上がります。
    日常動画:バーチャルヒューマンを選び、今日撮りたいことを一言伝えると、手持ち撮影風の縦型動画に仕上がります。
  • ショートドラマ:出演者 2~4 人とアイデアを一つ選ぶと、台本・絵コンテ・画像・動画を段階ごとに確認できます。
    ショートドラマ:出演者 2~4 人とアイデアを一つ選ぶと、台本・絵コンテ・画像・動画を段階ごとに確認できます。
  • 生成ワークベンチ:画像・動画・音楽・音声のタブ。画像モデルを切り替えられ、成果物はメディアライブラリに保存されます。
    生成ワークベンチ:画像・動画・音楽・音声のタブ。画像モデルを切り替えられ、成果物はメディアライブラリに保存されます。
  • AI 動画制作:テーマ、ニュース、ブログから始め、複数の AI エージェントが台本を書き、ナレーションと字幕を付けて仕上げます。
    AI 動画制作:テーマ、ニュース、ブログから始め、複数の AI エージェントが台本を書き、ナレーションと字幕を付けて仕上げます。
  • リラックスアルバム:4 つの AI が緊張から落ち着きへ向かう曲順を組み、ACE-Step で 1 曲ずつ生成します。
    リラックスアルバム:4 つの AI が緊張から落ち着きへ向かう曲順を組み、ACE-Step で 1 曲ずつ生成します。

生成した動画

このプラットフォームで実際に生成した動画です。最初の 1 本は AI 広告、次の 3 本はバーチャルキャラクターが話す動画(キャラクターの声でセリフを読み、口の動きを合わせ、字幕付き)、最後の 3 本はバーチャルヒューマンのキーフレーム 1 枚を最初のフレームにした画像から動画(MiniMax H3)で、各 5 秒・編集なしです。

  • AI 広告:3 歳の子どもと関西を旅する家族旅行の広告。58 秒・11 シーンで、各シーンに見出しと字幕が入り、最後は「旅程表を請求」で締めくくります。
  • あいさつ:レコード店でカメラに向かって自己紹介し、フォローを呼びかける 8 秒のセリフ。字幕も声に合わせて表示されます。
  • リップシンクのアップ:眼鏡の男性がカメラに向かって話します。ここまで寄っても口の動きと声が合っています。
  • 週末の Vlog:公園を歩きながら、ペースを落とす 3 つのコツを話す 37 秒。カットが変わっても顔と声は同じ人のままです。
  • 公園の小道:笑顔でカメラに向かって歩いてきます。顔・服・光は最初のキーフレームと一致しています。
  • 荷造り:スーツケースに手を添え、うつむいて笑ってからカメラを見上げます。部屋と朝の光は最後まで崩れません。
  • カフェ:カップを持ち上げて一口飲み、カメラがゆっくり寄って笑顔に。BGM と環境音もモデルが同時に生成しています。

ほかの実績

同じサービスの事例を先に並べています。

  • 音声トレーニングとファインチューニング

    オンプレミスモデル

    音声トレーニングとファインチューニング

    お預かりした録音から、ローカル GPU 上で専用の声をファインチューニングします。学習済みの声はテキストからそのまま音声を合成でき、安定度・話速・感情を調整できます。台湾華語の読みは修正表で補正します。

    • 声ごとに adapter を学習し、各エポックの版を保存。同じ文で聴き比べてから採用する版を決めます
    • 録音がまだ足りない段階ではゼロショットクローン。3〜15 秒のクリアな音声で最初の試聴版をつくれます

    Qwen3-TTS · CosyVoice3 · LoRA · ローカル GPU · MCP

    詳しく見るオンプレ AI モデル活用サイトを見る
  • eSIM 226 ストア

    EC サイト

    eSIM 226 ストア

    旅行者向け eSIM ストア。8 言語・複数通貨表示、台湾の 2 つの決済に対応。入金後は上流サプライヤーへ自動で発行を依頼し、インストール案内メールまで自動送信します。

    • 8 言語・複数通貨。日本のお客様には円で表示
    • 2 社のサプライヤーへ自動発行、失敗時は自動で切り替え

    Next.js · PostgreSQL · Keycloak · ECPay/NewebPay · Kubernetes

  • eSIM 管理画面

    管理システム

    eSIM 管理画面

    同じ EC の運用側。商品・価格・注文・返金・サプライヤー・決済を一箇所で。「入金済みなのに未発送」のような事故を、聞かれる前に自分から出してきます。

    • 本日の注文、売上、未入金、未発送がひと目で分かる
    • AI による価格提案と一括の公開・非公開

    Next.js · PostgreSQL · Keycloak · GA4 Data API

    詳しく見るEC サイト