自然な動きと、映像に寄り添う音。
Kling 4.0は動作とカメラワークの安定性を高め、表情豊かな演技と音声を自然に同期させます。2チャンネルステレオと精度の高いリップシンクで、会話や歌唱シーンを生き生きと描きます。
商品の登場から連続した物語まで。動き、音、表現のコントロールが進化した新世代のAI動画をご覧ください。
Kling 4.0は動作とカメラワークの安定性を高め、表情豊かな演技と音声を自然に同期させます。2チャンネルステレオと精度の高いリップシンクで、会話や歌唱シーンを生き生きと描きます。
画像、動画、被写体を組み合わせて、見た目や動き、構図を指定できます。既存動画の被写体、背景、ビジュアルスタイルの編集にも対応し、ひとつのアイデアから複数の表現を探れます。
3〜30秒の動画に最大10枚のキーフレーム画像を使い、重要な場面を設定できます。人物の登場、シーンの変化、商品の披露など、物語の展開を視覚的に導きます。
参照素材で商品の外観を導きながら、新たな場面や見せ方を検討できます。
参考動画のテンポやカメラ表現をもとに、異なるアイデアのバリエーションを探れます。
被写体の一貫性、重要な場面の制御、自然な演技を組み合わせ、より長いシーンを検討できます。
さまざまな言語の視聴者に向けて、会話、アクセント、読みやすい画面内テキストを探れます。
フルモデルは、テキストからの動画生成、画像からの動画生成、マルチモーダル参照、動画編集、柔軟なキーフレーム制御を統合しています。
3〜30秒 · 720p / 1080p / 4K
Flashは生成速度とコスト効率を重視し、さまざまなアイデアを素早く繰り返し試す制作に適しています。
3〜20秒 · 720p · 8-bit SDR
Kling 4.0は、映像と音声の品質、マルチモーダル参照、物語の制御性を高めたKling AIの新世代動画モデルです。
商品広告、SNS向け動画、キャラクターの物語、多言語コンテンツに活用できます。参照素材で外観を導き、キーフレームで場面転換を設計し、同期した音声で物語を豊かにできます。
フルモデルはテキスト、画像、最大15項目の組み合わせ参照に対応します。画像は最大10枚、動画は合計30秒以内で最大5本、被写体は最大7つで、そのうち動画由来の被写体は最大3つです。声の参照にも対応し、組み合わせ時も総数の上限が適用されます。
フルモデルは3〜30秒の動画を720p、1080p、4Kで生成でき、最大10枚のキーフレーム画像で重要な場面を導けます。
2チャンネルステレオ、精度を高めたリップシンク、多言語の会話に対応し、動作、発話、歌唱をより自然につなげます。
Flashは高速で頻繁な制作向けに、3〜20秒、720p、8-bit SDRに対応します。フルモデルは3〜30秒、最大4Kに対応し、より長い尺や細部の表現が必要なコンテンツに適しています。
最大30秒・4Kの映像に、マルチモーダル参照、キーフレーム制御、ステレオ音声を組み合わせ、あらゆるアイデアを自然に描き出します。