OpenAlchemyOpenAlchemy
← ブログ
プロダクト2026年10月8日約3分

OpenAlchemy で音声付き動画生成を開始しました

MiniMax H3 が Grid のコンピュート上で動き始めました。テキスト・画像・参照画像から、ネイティブのステレオ音声付きで 4〜15 秒・768P / 24 fps のショットを生成します。

OpenAlchemy で動画生成の提供を開始しました。オープンウェイトの MiniMax H3 モデルを Grid のコンピュート(コミュニティの GPU) 上で動かします。どのショットにも音が付きます。ネイティブのステレオ音声が映像と同時に生成され、後付けの吹き替えではありません。

1 リクエストで得られるもの

1 リクエストで 4〜15 秒のショットを 1 本、768P・24 fps、ステレオ音声付きでレンダリングします。目安として、5 秒・768P のショットは RTX 5090 クラスの GPU で約 2.5 分かかります(実測)。

3 つのモード

テキストから動画(t2v)── プロンプトでショットを記述します。

画像から動画(i2v)── 最初のフレーム、最後のフレーム、またはその両方を指定します。前のショットの最後のフレームでつないでいけば、ショットを積み重ねて長い作品を作れます。

参照画像から動画(ref)── 最大 9 枚の参照画像でショットを導きます。

API

動画生成は非同期です。POST /v1/videos はジョブ ID 付きで 202 を返します。GET /v1/videos/{id} をステータスが succeeded になるまでポーリングし、GET /v1/videos/{id}/content からファイルをダウンロードします。

# 1. Submit a shot — returns 202 with a job id
curl https://api.openalchemy.io/v1/videos   -H "Authorization: Bearer $OPENALCHEMY_API_KEY"   -H "Content-Type: application/json"   -d '{"model":"minimax-h3","mode":"t2v","prompt":"...","duration":5,"resolution":"768P","aspect_ratio":"16:9"}'

# 2. Poll until status is "succeeded"
curl https://api.openalchemy.io/v1/videos/$VIDEO_ID   -H "Authorization: Bearer $OPENALCHEMY_API_KEY"

# 3. Download the finished shot
curl -o shot.mp4 https://api.openalchemy.io/v1/videos/$VIDEO_ID/content   -H "Authorization: Bearer $OPENALCHEMY_API_KEY"

課金は出力 1 秒単位です。レンダリング中は見積額を確保し、失敗した場合は返金されます。

コードを書かずに試したい場合は Grid Playground → Video をどうぞ。

GPU プロバイダーの方へ

32 GB の GPU を持つプロバイダーは動画ジョブを処理できます。また、新しい ヘッドレス Linux ワーカー(CLI のみ、GUI なし)を ダウンロードページ で公開しました。Grid ダッシュボード で取得したコードでペアリングすると、ネットワーク経由でジョブを受け取ります。

試してみる

より少ない VRAM でオープンモデルを動かす

OpenAlchemy はオープンウェイトモデルのための推論レイヤーです。ここで紹介したのと同じエンジニアリングがプラットフォームを支えています。エージェントを API に向けて、今すぐ作り始めましょう。