SEEDANCE25APIINDEPENDENT

Seedance 2.5 本番評価:公式公開後の EvoLink 検証

少量トラフィックでの導入前に複数の AI 動画テスト結果を確認するチーム

Seedance 2.5 の公開動画を見ると、API が公開された今、すぐ既存ワークフローを切り替えたくなるかもしれません。しかし、製品を安定して提供するチームにとって、見栄えの良いデモは「評価する価値がある」ことを示すだけで、「本番導入できる」証拠にはなりません。

2026年8月7日時点で、公式 API と EvoLink ルートはいずれも公開済みです。3 workflow model ID、4〜30 秒、480p/720p、R2V 上限を利用できます。本番デフォルトにする前に小規模 canary を実行し、品質、レイテンシ、成功率、実コストを記録してください。

今できるのは、公開後の最初の結果を正しく判断するための評価システムを作ることです。実際の業務ケースを固定し、出力を見る前に合否基準を決め、失敗とコストを含む全試行を記録します。目的は「2.5 が常に優れている」と証明することではなく、対象ワークロードで合格出力の品質と経済性が改善し、ルーティングを変える価値があるかを実測で判断することです。

先に結論:ルートは公開済み、ただし実測は自分で取る

公開後も、次の証拠を混同しないことが重要です。

証拠の種類今使える目的今は判断できないこと
Dreamina の公式製品ページ検証候補となるワークフローを探す製品機能が API に同じ形で提供されるとは限らない
API ルートの状態文書化された model ID、上限、フィールドを確認するドキュメントだけでは自アカウントの利用可否と実課金は分からない
モックや既存ルートの結果データセット、レビュー、記録処理、失敗パスを安価に検証するSeedance 2.5 の実測値として扱わない
Seedance 2.5 の実呼び出し品質、速度、失敗、課金を同じ条件で記録する少数サンプルの成功だけで本番全体を判断しない

2026 年 8 月 7 日の公開状態では、公式 API と EvoLink 統合はいずれも公開済みです。製品デモは評価項目の参考になりますが、品質、遅延、失敗率、実コストは自分の入力で小規模な canary を実行して確認してください。

一般的なベンチマークではなく、ルーティング判断から始める

「Seedance 2.5 は強いか」ではなく、「現在の製品課題を解決できるか」を問いにします。

たとえば商品動画で、現行ルートが商品の形、色、ロゴを頻繁に変えてしまい、採用できる1本を得るまで何度も再生成しているなら、評価仮説は次のように書けます。

対象ワークロード:参照画像を使う商品動画
現在の基準:ドキュメントがある Seedance 2.0 ルート
課題:商品のドリフトによる不採用が多い
2.5 の仮説:検証済みルートがドリフトを減らし、採用1本あたりのコストを改善する
判断:品質、運用、コスト、ロールバックの全条件を通過した場合のみ小規模なカナリアリリースへ進む

この形なら、新モデルの宣伝で目立つ能力だけを測る失敗を避けられます。現行ルートで十分に合格している短い動画に、より複雑なルートを追加しても、運用リスクが増えるだけかもしれません。

固定・バージョン管理されたテストセットを作る

ケースは実際の注文、サポート問い合わせ、現在の不採用理由から選びます。

評価シーンケース例主な合否質問実ルートで有効にする条件
テキスト主体の短編1人、1動作、1つのカメラ移動指定動作を重大な破綻なく完了したかText-to-Video が文書化されている
人物・商品の参照同一対象の複数の許諾済み画像守るべき外観を維持したか参照入力と対応メディアが文書化されている
時系列シーン時間順に並ぶ明確なイベント順序とタイミングが許容範囲か対応時間とタイミング制御が確認できる
動作参照動きやカメラを示す参照動画主体や背景を壊さず動作を反映したか動画参照がサポートされている
部分編集元動画の一部だけを変更指定部分だけが変わり、他に悪影響がないか編集ルートとフィールドが文書化されている
音声を伴う出力映像イベントと音の合図公開ルートが音声対応なら同期しているか音声生成または音声参照が確認できる

これらは候補テストであり、Seedance 2.5 API の対応モードを示す表ではありません。現行の正式ドキュメントと照合し、対応しない項目は削除します。

各ケースでは、入力ファイルのハッシュと権利情報、プロンプト、文書化された設定、必須合格条件、欠陥レベル、現行ルートの基準結果、ルート名を見せないレビュー手順を固定します。参照画像、プロンプト、時間、判定ルールのどれかを変えたら、新しい評価バージョンとして保存してください。

Seedance 2.5 の評価ゲートとカナリアの流れ。固定したテスト素材から反復生成、ブラインドレビュー、証拠保存、小規模なカナリアリリースの判断までを示す

「映画らしさ」ではなく、納品できるかを採点する

1〜10の総合点だけでは、なぜ不採用なのかが分かりません。製品要件と好みを分けて評価します。

評価軸レビュー内容推奨する記録
タスク達成指定した主体、動作、結果が存在するか合格 / 不合格
人物・商品再現守るべき属性が正しいか合否と欠陥メモ
時間的一貫性人物、照明、形状、背景が途中で崩れないか深刻度 0〜3
動作・カメラ追従指定動作を物理破綻なく実行したか深刻度 0〜3
修正可能性人の編集で予算内に直せるか合否と作業分数
音声整合対応ルートの場合、音声が映像に合うか合格 / 不合格
最終採用再生成なしで次工程に進めるか採用 / 不採用

出力を見る前に「重大な欠陥」を定義します。商品広告なら形状やブランド要素の誤りは即不合格でも、アイデア出しでは許容できる場合があります。全業務に共通する万能な重み付けはありません。

各ケースは繰り返し生成し、最良の1本だけを残さないでください。可能ならルート名を隠して順番をランダム化し、高価値または主観的なケースでは独立した複数レビューを行います。意見の不一致は平均で消さず、判定ルールが曖昧なのか、ケースに複数の正解があるのかを確認します。

全試行を証拠として残す

選んだ MP4 だけを保存しても、本番評価にはなりません。失敗、却下、再試行を含む1回ごとの記録を残します。

{
  "evaluation_version": "seedance25-eval-v1",
  "case_id": "product-reference-004",
  "evidence_state": "recorded_live_route",
  "route": "evolink:seedance-2.5-text-to-video",
  "request_hash": "sha256:...",
  "submitted_at": "2026-08-07T09:12:00Z",
  "completed_at": "2026-08-07T09:15:42Z",
  "provider_status": "completed",
  "billable_usage": "コンソール請求記録と照合した値を格納",
  "review": {
    "accepted": null,
    "blocking_defects": [],
    "repair_minutes": null,
    "reviewer_ids": []
  },
  "output_snapshot": null
}

null は、まだ実施していないステップ(レビュー未了など)を表します。推測した値で埋めず、実呼び出しの応答と請求記録から転記してください。API ガイドでは、live ルートと並行してモックで失敗パスを安価にテストし、モックの証拠と実測の証拠を分離する方法を説明しています。

本番判断を変える指標を計算する

最高品質だけでなく、対象となる全試行から計算します。

生成成功率 = 完了したプロバイダータスク数 / 送信タスク数
合格率 = 合格出力数 / 完了動画数
合格出力1本あたりの試行回数 = 送信タスク数 / 合格出力数
合格出力1本あたりのコスト = 照合済み総ルート費用 / 合格出力数
合格までの時間 = 生成 + キュー + 再試行 + レビュー + 修正

中央値とテールレイテンシ、失敗分類、レビュー時間、編集が必要な割合も比較します。率にはサンプル数を併記し、1回成功しただけで「合格率100%」と発表してはいけません。合格出力が0本なら、合格出力1本あたりのコストは0ではなく未定義で、そのケースは経済性ゲートを通過していません。

実際の料金は EvoLink コンソールと料金ページで確認し、計算方法はコスト分析を参照してください。このページでは 2.5 の単価を記載しません。

小規模なカナリアリリースの前に5つのゲートを通す

1つの総合点で重大な失敗を隠さず、次を個別に確認します。

ゲート公開後に必要な証拠未達時の対応
アクセスと契約文書化された model ID とフィールド、実アカウントの成功応答ルートを無効のままにする
製品品質対象ケースが事前の合否基準を満たす現行ルートを継続する
運用エラー、タイムアウト、冪等性、監視、テールレイテンシが許容範囲シャドー評価を続ける
経済性課金を照合でき、採用1本あたりのコストが予算内制限または導入見送り
安全性と回復権利、保持、モデレーション、監査、フォールバック、停止スイッチを確認本番トラフィックを送らない

5つすべてを通過してから、対象を限定した小規模なカナリアリリースを検討します。トラフィックと予算に上限を設け、検証済みの基準ルートへ即時に戻せるようにします。どの業務を 2.0 に残し、2.5 の検証対象にするかは Seedance 2.5 と 2.0 のルーティングガイドを参照してください。

最初のカナリアまでに完了すること

  1. 実際の業務を一つ選び、現行ルートの測定可能な問題を書く。
  2. ケース、素材、プロンプト、合否基準、レビュー手順を固定する。
  3. 成功、失敗、不採用、レビュー、コストを追跡できる記録を実装する。
  4. モックや文書化済みの Seedance 2.0 ルートで評価基盤と失敗パスを検証する。
  5. Seedance 2.5 の流量は canary に限定し、workflow model ID と parameter を設定可能に保つ。
  6. 実契約(model ID、フィールド、上限)を保存し、非対応ケースを削除し、1件の呼び出しと請求を照合してから評価を始める。

公開プロンプト集は評価対象の選定に、マルチモーダル参照素材パイプラインは素材の来歴と取得処理に役立ちます。入力と判断方法を先に整えておけば、公開済みのルート上で信頼できる結論へ早く到達できます。

情報源と事実の境界

確認日:2026年8月7日。公式ルートは文書化・公開済みです。5つの評価ゲートを通過し、小規模カナリアで実測を確認するまでは、Seedance 2.5 を本番デフォルトにしないでください。

Q&Aクイック回答
Q.01Seedance 2.5 の公開 API はすでに利用できますか?
はい。2026年8月7日時点で EvoLink ルートは公開済みです。3 workflow model ID を使い、短い canary で品質、レイテンシ、失敗、実コストを測定してください。
Q.02API を呼び出す前に Seedance 2.5 の評価準備はできますか?
テストケース、採点基準、レビュー手順、証拠の保存形式、ロールアウト条件は呼び出し前に準備できます。ただし、実アカウントでの呼び出し成功と課金照合を確認するまでは、Seedance 2.5 API の実測結果として公開しないでください。
Q.03Seedance 2.5 の評価で最初に決めるべきことは何ですか?
商品形状の崩れ、長いシーンの不整合、参照素材の再現性など、現在のワークフローで解決したい具体的な問題を一つ決めます。問題が曖昧だと、新しいルートを導入する価値も判断できません。
Q.04公開されているデモ動画をベンチマーク結果として使えますか?
使えません。デモはテストケース作成の参考にはなりますが、API の成功率、レイテンシ、課金、再現性、アカウント単位の利用可否を証明しません。
Q.05各テストケースは何回生成すべきですか?
一度の成功例だけで判断せず、結果のばらつきと失敗パターンが見えるまで繰り返します。最終的な回数は、業務リスク、分散、予算、判断に必要な信頼度に合わせて決めます。
Q.06評価ではどの指標を見るべきですか?
タスク達成度、人物や商品の一貫性、時間的一貫性、重大な破綻、生成成功率、合格率、レイテンシ、レビュー時間、合格出力1本あたりの試行回数と実コストを記録します。
Q.07自動評価で人のレビューを置き換えられますか?
現時点では補助的な検出に使うのが安全です。自動判定がチームの人手による合否判断と継続的に一致すると確認できるまでは、最終的な採用判断を任せるべきではありません。
Q.08Seedance 2.5 に本番トラフィックを送れるのはいつですか?
ルートは公開済みです。アクセス、品質、運用、経済性、安全性の 5 つの評価ゲートを自アカウントで通過した後、上限付きの小規模カナリアから始めてください。ゲート通過前に本番デフォルトへ切り替えないでください。