SeeDance 動画生成
TENSORAXIS を通じて Volcengine Ark Doubao Seedance モデルを呼び出す — テキストから動画、画像から動画、最初/最後のフレーム、動画参照/継続、および metadata の高度なパラメータと課金について。
SeeDance は、Volcengine Ark Doubao Seedance 動画モデル(チャネル doubao-video)を TENSORAXIS に統合したものです。他の動画モデルと同様に非同期で動作します。タスクを送信して task_id を取得し、タスクのステータスをポーリングした後、完了後に動画の URL を読み取ります。共通の送信/ポーリングのフローは 動画生成の概要 にあります。このページでは SeeDance 固有の機能とパラメータのみを扱います。
TENSORAXIS のリクエストフィールド prompt、images、metadata を使用してください。リレーがこれらを Volcengine のコンテンツ生成タスクの形式に変換します。アップストリームのトップレベル content[] ボディを直接 /v1/video/generations に送信しないでください。そうすると TENSORAXIS は prompt を見つけられず、400 prompt is required を返します。
モデルと機能マトリックス
| モデル | テキストから動画 | 画像から動画(最初のフレーム) | 最初/最後のフレーム | マルチモーダル参照(画像/動画/音声) | ネイティブ音声 |
|---|---|---|---|---|---|
doubao-seedance-1-0-lite-t2v | ✅ | — | — | — | — |
doubao-seedance-1-0-lite-i2v | — | ✅ | — | — | — |
doubao-seedance-1-0-pro-250528 | ✅ | ✅ | — | — | — |
doubao-seedance-1-5-pro-251215 | ✅ | ✅ | — | — | — |
doubao-seedance-2-0-260128 | ✅ | ✅ | ✅ | ✅ | ✅ |
doubao-seedance-2-0-fast-260128 | ✅ | ✅ | ✅ | ✅ | ✅ |
2-0-fast は機能面で 2-0 と同等ですが、より高速な生成に最適化されています。機能のサポート状況は最終的にアップストリームのモデルによって定義されます。
リクエストフィールド
POST /v1/video/generations
| フィールド | 型 | 必須 | 説明 |
|---|---|---|---|
model | string | 必須 | SeeDance モデル名(上記の表を参照) |
prompt | string | 必須 | 動画のプロンプト。空の場合は 400 prompt is required を返す |
images | string[] | 任意 | 画像から動画(最初のフレーム)用の参照画像 URL。複数の参照もここに指定する |
image | string | 任意 | 単一の参照画像 URL。images が空の場合は images に正規化される |
seconds | string | 任意 | 秒単位の長さ。正の整数はアップストリームの duration にマッピングされ、metadata.duration と同等 |
metadata | object | 任意 | SeeDance の高度なパラメータ — metadata の高度なパラメータ を参照 |
テキストから動画
prompt のみを指定します。解像度、長さ、アスペクト比などは metadata 経由で追加します。
curl https://api.tensoraxis.com/v1/video/generations \
-H "Authorization: Bearer $TENSORAXIS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2-0-260128",
"prompt": "An old man wearing a hat smiles and walks forward down an autumn street",
"metadata": {
"resolution": "1080p",
"ratio": "16:9",
"duration": 5
}
}'画像から動画
最初のフレーム
images 経由で参照画像を渡すと、それが最初のフレームとして使用されます。その他のパラメータはテキストから動画と同じです。
curl https://api.tensoraxis.com/v1/video/generations \
-H "Authorization: Bearer $TENSORAXIS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-1-0-lite-i2v",
"prompt": "Slow push-in, the subject smiles",
"images": ["https://example.com/first-frame.jpg"],
"metadata": {
"resolution": "1080p",
"duration": 5
}
}'最初/最後のフレーム(Seedance 2.0)
最初/最後のフレームを使うには、metadata.content で各画像に明示的な role(first_frame / last_frame)を付与する必要があります。これは images から生成されるコンテンツリストを上書きします。metadata.content の形式 を参照してください。
{
"model": "doubao-seedance-2-0-260128",
"prompt": "A time-lapse from dawn to sunset",
"metadata": {
"resolution": "1080p",
"duration": 5,
"content": [
{ "type": "image_url", "image_url": { "url": "https://example.com/start.jpg" }, "role": "first_frame" },
{ "type": "image_url", "image_url": { "url": "https://example.com/end.jpg" }, "role": "last_frame" }
]
}
}動画参照/継続(「動画編集」に相当)
SeeDance のバックエンドにはフレームレベル専用の動画編集エンドポイントはありません。Seedance 2.0 の「動画マルチモーダル参照」機能を使うと、動画を参照/継続のソースとして与えることができます — video_url を持つ metadata.content アイテムを渡してください。
{
"model": "doubao-seedance-2-0-260128",
"prompt": "Continue the motion in this clip, the camera keeps panning right",
"metadata": {
"resolution": "1080p",
"content": [
{ "type": "video_url", "video_url": { "url": "https://example.com/source.mp4" } }
]
}
}リクエストに動画入力が含まれる場合、TENSORAXIS は(metadata の宣言ではなく)実際のメディアコンテンツに基づいてそれを「動画入力」として分類し、より安価な階層で課金します — 課金 を参照してください。フレームレベルの動画編集(特定のセグメントの置き換え/再描画)が必要な場合は、代わりに HappyHorse 動画編集(happyhorse-1.0-video-edit)を使用してください。
metadata の高度なパラメータ
metadata 配下のフィールドは、Volcengine タスクのトップレベルフィールドにマッピングされます。「範囲 / デフォルト」列は Volcengine の公式ドキュメントに基づいており、最終的にはアップストリームのモデルによって定義されます。TENSORAXIS はこれらのフィールドを受け取って転送するだけです。
| フィールド | 転送先 | 型 | 範囲 / デフォルト | 説明 |
|---|---|---|---|---|
resolution | resolution | string | 480p / 720p / 1080p / 2k、デフォルト 1080p | 出力解像度 |
ratio | ratio | string | 16:9 / 9:16 / 4:3 / 3:4 / 21:9 / 1:1 / adaptive | アスペクト比 |
duration | duration | integer | 4–15、デフォルト 5 | 秒単位の長さ。トップレベルの seconds と同等 |
frames | frames | integer | モデル定義 | 総フレーム数(fps/長さに連動) |
seed | seed | integer | ランダムシード | ランダム性を固定して結果を再現する |
camera_fixed | camera_fixed | boolean | デフォルト false | カメラを固定するかどうか |
watermark | watermark | boolean | デフォルト false | 透かしを追加するかどうか |
generate_audio | generate_audio | boolean | デフォルト false | ネイティブ音声を生成する(Seedance 2.0) |
return_last_frame | return_last_frame | boolean | デフォルト false | 最後のフレーム画像を返す |
draft | draft | boolean | デフォルト false | ドラフト/プレビューモード |
service_tier | service_tier | string | モデル定義 | サービス階層 |
execution_expires_after | execution_expires_after | integer | モデル定義 | タスクの有効期限(秒) |
callback_url | callback_url | string | — | タスク完了時のコールバック URL |
tools | tools | array | — | ツール設定(例:ウェブ検索) |
content | content | array | — | 高度なコンテンツ配列、詳細は下記参照 |
補足:
metadata.modelは削除され、課金対象のモデルを上書きすることはできません。- 上記のフィールドにマッピングされていない
metadataのキーは、通常アップストリームに転送されません。 secondsとmetadata.durationの両方が送信された場合、metadata.durationが優先されます。
metadata.content の形式
metadata.content は、最初/最後のフレーム、動画参照、音声参照などに使用される高度なコンテンツ配列です。一度指定すると、images から生成されるコンテンツリストを上書きします(type: text のアイテムは無視され、本文は prompt から取得されます)。
| アイテムタイプ | フィールド | 公式の制約(アップストリーム定義) |
|---|---|---|
image_url | image_url.url、任意の role | 画像 ≤30MB、≤9 アイテム。role は最初/最後のフレーム用 |
video_url | video_url.url | 動画 2–15秒、≤3 クリップ |
audio_url | audio_url.url | 音声 ≤15MB、≤3 クリップ |
text | text | 無視される。本文はトップレベルの prompt から取得される |
課金
SeeDance はトークン単位で課金されます。解像度はすでにトークン数に反映されているため、別途解像度係数は適用されません。
- 通常の生成(テキスト/画像から動画)は
generate階層を使用します。 - 動画入力(動画参照/継続)は実際のメディアコンテンツから検出され、より安価な
video_input割引階層に分類されます(通常の生成より単価が低くなります)。
正確な単価はコンソールの「動画料金」設定および料金ページに従います。運営者はデフォルト値を最新の公式レートで上書きできます。
タスクのポーリング
共通の送信/ポーリングフロー、ステータスコード、OpenAI/Sora 互換の取得パスについては、動画生成の概要 を参照してください。