SEEDANCE25APIINDEPENDENT

Seedance 2.5 本番導入前の評価ガイド:API 公開前に準備すること

少量トラフィックでの導入前に複数の AI 動画テスト結果を確認するチーム

Seedance 2.5 の公開動画を見ると、API が開いたらすぐ既存ワークフローを切り替えたくなるかもしれません。しかし、製品を安定して提供するチームにとって、見栄えの良いデモは「評価する価値がある」ことを示すだけで、「本番導入できる」証拠にはなりません。

2026年7月21日時点で、Seedance 2.5 は EvoLink の公開 API ルートとして提供されていません。正式な model ID、料金、利用上限、レイテンシ、成功率、運用品質も未確認です。したがって、現時点の本番トラフィックは 0 のままにし、API 実測を装った結論も公開すべきではありません。

今できるのは、公開後の最初の結果を正しく判断するための評価システムを作ることです。実際の業務ケースを固定し、出力を見る前に合否基準を決め、失敗とコストを含む全試行を記録します。目的は「2.5 が常に優れている」と証明することではなく、対象ワークロードで合格出力の品質と経済性が改善し、ルーティングを変える価値があるかを実測で判断することです。

先に結論:テストは準備できるが、結果は作れない

公開前は、次の証拠を混同しないことが重要です。

証拠の種類今使える目的今は判断できないこと
Dreamina の公式製品ページ検証候補となるワークフローを探す製品機能が将来の API に同じ形で提供されるとは限らない
API ルートの状態現在呼び出せるか、何が未確定かを確認するmodel ID、料金、フィールド、上限、公開日を推測しない
モックや既存ルートの結果データセット、レビュー、記録処理を検証するSeedance 2.5 の実測値として扱わない
将来の Seedance 2.5 実呼び出し品質、速度、失敗、課金を同じ条件で記録する正式ルート公開前には取得できない

Dreamina の公式製品ページはすでに公開されていますが、Seedance 2.5 は現在も「Coming Soon(近日公開)」と表示されています。そこに記載された製品機能は検証項目の参考にはなっても、将来のプロバイダー API 契約を証明しません。EvoLink は、公式 API ドキュメントが公開され、ルートが実際の呼び出しによる検証を通過した後に提供すると説明しています。

一般的なベンチマークではなく、ルーティング判断から始める

「Seedance 2.5 は強いか」ではなく、「現在の製品課題を解決できるか」を問いにします。

たとえば商品動画で、現行ルートが商品の形、色、ロゴを頻繁に変えてしまい、採用できる1本を得るまで何度も再生成しているなら、評価仮説は次のように書けます。

対象ワークロード:参照画像を使う商品動画
現在の基準:ドキュメントがある Seedance 2.0 ルート
課題:商品のドリフトによる不採用が多い
2.5 の仮説:検証済みルートがドリフトを減らし、採用1本あたりのコストを改善する
判断:品質、運用、コスト、ロールバックの全条件を通過した場合のみ小規模なカナリアリリースへ進む

この形なら、新モデルの宣伝で目立つ能力だけを測る失敗を避けられます。現行ルートで十分に合格している短い動画に、より複雑なルートを追加しても、運用リスクが増えるだけかもしれません。

固定・バージョン管理されたテストセットを作る

ケースは実際の注文、サポート問い合わせ、現在の不採用理由から選びます。

評価シーンケース例主な合否質問実ルートで有効にする条件
テキスト主体の短編1人、1動作、1つのカメラ移動指定動作を重大な破綻なく完了したかText-to-Video が文書化されている
人物・商品の参照同一対象の複数の許諾済み画像守るべき外観を維持したか参照入力と対応メディアが文書化されている
時系列シーン時間順に並ぶ明確なイベント順序とタイミングが許容範囲か対応時間とタイミング制御が確認できる
動作参照動きやカメラを示す参照動画主体や背景を壊さず動作を反映したか動画参照がサポートされている
部分編集元動画の一部だけを変更指定部分だけが変わり、他に悪影響がないか編集ルートとフィールドが文書化されている
音声を伴う出力映像イベントと音の合図公開ルートが音声対応なら同期しているか音声生成または音声参照が確認できる

これらは候補テストであり、Seedance 2.5 API の対応モードを示す表ではありません。正式ドキュメントが出たら、対応しない項目を削除します。

各ケースでは、入力ファイルのハッシュと権利情報、プロンプト、文書化された設定、必須合格条件、欠陥レベル、現行ルートの基準結果、ルート名を見せないレビュー手順を固定します。参照画像、プロンプト、時間、判定ルールのどれかを変えたら、新しい評価バージョンとして保存してください。

Seedance 2.5 公開前評価の流れ。固定したテスト素材から反復生成、ブラインドレビュー、証拠保存、小規模なカナリアリリースの判断までを示す

「映画らしさ」ではなく、納品できるかを採点する

1〜10の総合点だけでは、なぜ不採用なのかが分かりません。製品要件と好みを分けて評価します。

評価軸レビュー内容推奨する記録
タスク達成指定した主体、動作、結果が存在するか合格 / 不合格
人物・商品再現守るべき属性が正しいか合否と欠陥メモ
時間的一貫性人物、照明、形状、背景が途中で崩れないか深刻度 0〜3
動作・カメラ追従指定動作を物理破綻なく実行したか深刻度 0〜3
修正可能性人の編集で予算内に直せるか合否と作業分数
音声整合対応ルートの場合、音声が映像に合うか合格 / 不合格
最終採用再生成なしで次工程に進めるか採用 / 不採用

出力を見る前に「重大な欠陥」を定義します。商品広告なら形状やブランド要素の誤りは即不合格でも、アイデア出しでは許容できる場合があります。全業務に共通する万能な重み付けはありません。

各ケースは繰り返し生成し、最良の1本だけを残さないでください。可能ならルート名を隠して順番をランダム化し、高価値または主観的なケースでは独立した複数レビューを行います。意見の不一致は平均で消さず、判定ルールが曖昧なのか、ケースに複数の正解があるのかを確認します。

全試行を証拠として残す

選んだ MP4 だけを保存しても、本番評価にはなりません。失敗、却下、再試行を含む1回ごとの記録を残します。

{
  "evaluation_version": "seedance25-eval-v1",
  "case_id": "product-reference-004",
  "evidence_state": "awaiting_verified_route",
  "route": null,
  "request_hash": "sha256:...",
  "submitted_at": null,
  "completed_at": null,
  "provider_status": null,
  "billable_usage": null,
  "review": {
    "accepted": null,
    "blocking_defects": [],
    "repair_minutes": null,
    "reviewer_ids": []
  },
  "output_snapshot": null
}

null は、検証済みの実呼び出し前には存在しない値を表します。推測した model ID やリクエスト形式で埋めないでください。API 公開前の準備ガイドでは、アダプターを無効のまま保ち、モックの証拠と実契約を分離する方法を説明しています。

本番判断を変える指標を計算する

最高品質だけでなく、対象となる全試行から計算します。

生成成功率 = 完了したプロバイダータスク数 / 送信タスク数
合格率 = 合格出力数 / 完了動画数
合格出力1本あたりの試行回数 = 送信タスク数 / 合格出力数
合格出力1本あたりのコスト = 照合済み総ルート費用 / 合格出力数
合格までの時間 = 生成 + キュー + 再試行 + レビュー + 修正

中央値とテールレイテンシ、失敗分類、レビュー時間、編集が必要な割合も比較します。率にはサンプル数を併記し、1回成功しただけで「合格率100%」と発表してはいけません。合格出力が0本なら、合格出力1本あたりのコストは0ではなく未定義で、そのケースは経済性ゲートを通過していません。

実際の料金は公開後に料金ページで確認し、計算方法はコスト分析を参照してください。このページでは 2.5 の単価を予測しません。

小規模なカナリアリリースの前に5つのゲートを通す

1つの総合点で重大な失敗を隠さず、次を個別に確認します。

ゲート公開後に必要な証拠未達時の対応
アクセスと契約文書化された model ID とフィールド、実アカウントの成功応答ルートを無効のままにする
製品品質対象ケースが事前の合否基準を満たす現行ルートを継続する
運用エラー、タイムアウト、冪等性、監視、テールレイテンシが許容範囲シャドー評価を続ける
経済性課金を照合でき、採用1本あたりのコストが予算内制限または導入見送り
安全性と回復権利、保持、モデレーション、監査、フォールバック、停止スイッチを確認本番トラフィックを送らない

5つすべてを通過してから、対象を限定した小規模なカナリアリリースを検討します。トラフィックと予算に上限を設け、検証済みの基準ルートへ即時に戻せるようにします。どの業務を 2.0 に残し、2.5 の検証対象にするかは Seedance 2.5 と 2.0 のルーティングガイドを参照してください。

API 公開前に完了できること

  1. 実際の業務を一つ選び、現行ルートの測定可能な問題を書く。
  2. ケース、素材、プロンプト、合否基準、レビュー手順を固定する。
  3. 成功、失敗、不採用、レビュー、コストを追跡できる記録を実装する。
  4. モックや文書化済みの Seedance 2.0 ルートで評価基盤を検証する。
  5. Seedance 2.5 の設定は無効にし、未確認の model ID やパラメーターを入れない。
  6. 公開日に実契約を保存し、非対応ケースを削除し、1件の呼び出しと請求を照合してから評価を始める。

公開プロンプト集は評価対象の選定に、マルチモーダル参照素材パイプラインは素材の来歴と取得処理に役立ちます。入力と判断方法を先に整えておけば、ルート公開後に信頼できる結論へ早く到達できます。

情報源と事実の境界

確認日:2026年7月21日。正式な API ルートが文書化され、実アカウントの呼び出しが成功するまでは、Seedance 2.5 を評価候補として扱い、本番依存にはしないでください。

Q&Aクイック回答
Q.01Seedance 2.5 の公開 API はすでに利用できますか?
いいえ。2026年7月21日時点で、EvoLink は Seedance 2.5 の公開 API ルートを提供していません。正式な model ID、料金、利用上限、レイテンシ、安定性も未確認です。
Q.02API 公開前でも Seedance 2.5 の評価準備はできますか?
テストケース、採点基準、レビュー手順、証拠の保存形式、ロールアウト条件は先に準備できます。ただし、正式ドキュメントの公開、アカウント権限の確認、実際の呼び出し成功までは Seedance 2.5 API の実測結果として公開できません。
Q.03Seedance 2.5 の評価で最初に決めるべきことは何ですか?
商品形状の崩れ、長いシーンの不整合、参照素材の再現性など、現在のワークフローで解決したい具体的な問題を一つ決めます。問題が曖昧だと、新しいルートを導入する価値も判断できません。
Q.04公開されているデモ動画をベンチマーク結果として使えますか?
使えません。デモはテストケース作成の参考にはなりますが、API の成功率、レイテンシ、課金、再現性、アカウント単位の利用可否を証明しません。
Q.05各テストケースは何回生成すべきですか?
一度の成功例だけで判断せず、結果のばらつきと失敗パターンが見えるまで繰り返します。最終的な回数は、業務リスク、分散、予算、判断に必要な信頼度に合わせて決めます。
Q.06評価ではどの指標を見るべきですか?
タスク達成度、人物や商品の一貫性、時間的一貫性、重大な破綻、生成成功率、合格率、レイテンシ、レビュー時間、合格出力1本あたりの試行回数と実コストを記録します。
Q.07自動評価で人のレビューを置き換えられますか?
現時点では補助的な検出に使うのが安全です。自動判定がチームの人手による合否判断と継続的に一致すると確認できるまでは、最終的な採用判断を任せるべきではありません。
Q.08Seedance 2.5 に本番トラフィックを送れるのはいつですか?
公開ルートに正式ドキュメントがあり、実アカウントでの呼び出し、品質、運用、課金照合、ロールバックがすべて確認できた後です。それまでは本番トラフィックを送らないでください。