LitMediaがGPT Image 2とSeedance 2.0を統合、画像生成から動画化までブラウザ完結で提供
公開:
株式会社ウィートフィールド・テクノロジーは、総合AIクリエイティブプラットフォーム「LitMedia」に画像生成AIの最高峰モデル「GPT Image 2」と動画生成AIモデル「Seedance 2.0」を統合しました。
個人クリエイターの表現活動から企業の広告制作、マーケティングまで幅広い用途を想定したプラットフォームです。
LitMediaのGPT Image 2が切り拓く静止画生成の新次元
「GPT Image 2」は、画像をレンダリングする前にAI自体が内部で「思考」プロセスを挟む推論能力を実装した画像生成モデルです。ChatGPTの高度な推論アーキテクチャを受け継ぎ、リアルタイムウェブ検索によって最新のトレンドや時事要素を視覚エフェクトに反映できます。
日本語や中国語、韓国語、ヒンディー語、ベンガル語といった複雑な文字のテキストレンダリングにも対応しています。デザイン全体のトーン&マナーに自然に言語を溶け込ませる処理が可能で、ポスターやインフォグラフィックス、ローカライズされたUI(ユーザーインターフェース)素材の制作に活用できます。
戦略的なデザイン面では、レイアウト・余白のバランス・視認性を自ら計算し、商業水準の構図を自動設計します。UI(ユーザーインターフェース)デザインの領域においては、定評のある人気モデル「NanoBanana 2」と比較して、さらに高い完成度が特徴です。また、自己修正機能によってAI自らが描写の正確性をセルフチェックし、破綻を未然に防ぐ設計となっています。
LitMediaのSeedance 2.0が実現する高精度な動画生成
ByteDance社が開発した「Seedance 2.0」は、OpenAI Sora 2やGoogle VEO 3 Proと肩を並べ、特定のダイナミック運動においてはそれらを上回るとされる次世代の動画生成モデルです。
フィギュアスケートの複雑なジャンプや激しいマルチプレイヤーのスポーツなど、従来のAI動画が苦手としてきた複雑な交互作用と激しい運動シーンを、物理法則に則って滑らかに再現します。
入力の多様性も大きな特徴で、最大9枚の画像、3つの動画、3つの音源を同時入力できる「全能リファレンス」機能を搭載しています。クリエイターは、構図やカメラワーク、音響を細部までコントロールでき、映画監督的な演出が可能です。
2チャンネル立体音響技術を搭載し、映像の動きに完璧にシンクロした環境音やBGM、ナレーションを15秒間の高品質多アングル動画として出力します。LitMediaは、ByteDance社の公式パートナーとして「Seedance 2.0」と正式連携しており、公式サーバーへのダイレクト接続によって、安定した高速生成環境を確立しました。
LitMediaのプラットフォーム概要と主な機能
LitMediaは、単一のモデルに依存するツールとは一線を画す設計です。世界トップクラスのAI生成モデルを十数種類統合したプラットフォームであり、対応モデルには次のものが含まれます。
- Seedance
- Happy Horse 1.0
- Veo
- Chatgpt Images 2NanoBanana 2
- Seedream
ユーザーは、目的に応じて最適なAIをブラウザ上で自由に切り替えて利用できる環境が整っています。
主な提供機能・ツールは以下の通りです。
- AI動画生成・AI画像生成・AI音楽制作
- AIデジタルヒューマン(企業の解説動画や海外向けマーケティング向け)
- AIリップシンク(多言語の台詞に合わせた自然な口の動きの再現)
- AI MV(音楽と映像が融合したコンテンツの自動生成)
「GPT Image 2」で生成したキービジュアルを、ブラウザのタブを切り替えることなく「Seedance 2.0」へ引き渡して動画化できる一気通貫のワークフローにより、アイデアの着想から高品質なAI動画の書き出しまでが同一画面上で完結します。ECサイト用のデモ動画量産から広告制作まで、コストと生産周期の削減を目的とした多様な用途に対応しています。
LitMediaのサービス概要
| 項目 | 詳細 |
|---|---|
| 提供元 | 株式会社ウィートフィールド・テクノロジー(Wheatfield Guard Technology Co., Ltd.) |
| プラットフォーム名 | LitMedia |
| カテゴリ | 総合AIクリエイティブプラットフォーム |
| 主要統合モデル | GPT Image 2、Seedance 2.0、Happy Horse 1.0、Veo、Chatgpt Images 2NanoBanana 2、Seedreamほか十数種類 |
| 多入力対応 | 最大9枚の画像、3つの動画、3つの音源の同時入力 |
| 音響技術 | 2チャンネル立体音響技術・15秒間の高品質多アングル動画出力 |
| 連携 | ByteDance社「Seedance 2.0」公式パートナー |
| 利用環境 | ブラウザのみで完結 |
trends編集部の一言
「画像生成ツールで素材を作り、ダウンロードして別の動画ツールにアップロードする」というツール間の往来は、マーケティングの現場でバナーや動画素材を制作する際に、毎回発生する手間です。一つのブラウザ上でキービジュアル生成から動画化まで完結するワークフローは、業界を問わず制作コスト削減の文脈で注目に値します。
最大9枚の画像・3つの動画・3つの音源を同時入力できる多入力設計は、素材の組み合わせによる試行錯誤を前提とした仕様です。広告クリエイティブの複数パターン検証を重視する流れとも重なります。
AIクリエイティブ業界全体としては、単一モデルへの依存から脱却し複数モデルを目的別に使い分ける方向へ移行が進んできました。十数種類のモデルを切り替えられる設計は、特定モデルへの依存リスクを分散するという点でも、企業の間で注目される傾向にあります。
References
- ^ PR TIMES. 「AI生成の頂点へ。画像と動画の最高峰モデル「GPT Image 2」×「Seedance 2.0」がLitMediaで融合! | Wheatfield Guard Technology Co., Ltd.のプレスリリース」. https://prtimes.jp/main/html/rd/p/000000011.000173897.html, (参照 26-05-30).




