流れをつくる
一枚の見栄えではなく、カットの連続性と時間の設計を評価します。
日本語の感性を、生成モデルへ。
Japanese audiovisual model · in development
構図だけでなく、時間、音、静けさ、場の気配まで一つの生成へ。Hokusai は、日本語の指示から映像と音響を編むモデルを目指しています。

翻訳後の日本語ではなく、日本語の文脈を出発点にする。独自データセットでの fine-tune と評価を経て、根拠のある日本語モデルとして公開します。
一枚の見栄えではなく、カットの連続性と時間の設計を評価します。
映像と音声を別工程にせず、同じ演出意図から扱う構成です。
submit、poll、content download のジョブ形式で長い生成を安全に扱います。
Current status
APIの入口は先に整えていますが、fine-tune 済みの immutable checkpoint と推論 backend はまだ公開していません。別モデルの名前替えは行いません。
日本語のモデル開発と、Murakumo の推論基盤をつなぎます。利用できるモデルと提供条件は、各サービスのページでご案内します。