日本語の感性を、生成モデルへ。

Japanese audiovisual model · in development

音と映像に、気配を宿す。

構図だけでなく、時間、音、静けさ、場の気配まで一つの生成へ。Hokusai は、日本語の指示から映像と音響を編むモデルを目指しています。

北斎
生成した和紙の上を、音と時間の流れを思わせる藍と墨の線が横切る抽象画
Hokusai — 音と映像のための生成ビジュアル Generative artwork · awai.network

日本語から、設計する。

翻訳後の日本語ではなく、日本語の文脈を出発点にする。独自データセットでの fine-tune と評価を経て、根拠のある日本語モデルとして公開します。

01 · 構図

流れをつくる

一枚の見栄えではなく、カットの連続性と時間の設計を評価します。

02 · 音景

音まで一つに

映像と音声を別工程にせず、同じ演出意図から扱う構成です。

03 · 非同期

待ち時間を正直に

submit、poll、content download のジョブ形式で長い生成を安全に扱います。

Current status

公開前だからこそ、正直に。

開発中

APIの入口は先に整えていますが、fine-tune 済みの immutable checkpoint と推論 backend はまだ公開していません。別モデルの名前替えは行いません。

Base
MiniMaxAI/MiniMax-H3
API
Async /api/v1/videos
Hosting
Baseten async · scale-to-zero
State
API入口稼働 · モデル推論未公開

日本から、世界のAPIへ。

日本語のモデル開発と、Murakumo の推論基盤をつなぎます。利用できるモデルと提供条件は、各サービスのページでご案内します。

01 · awai.network モデル開発と日本語評価
02 · murakumo.cloud 認証、routing、metering
03 · Baseten scale-to-zero 推論基盤