Seedance 2.5の日本語音声を実測。自分の顔と声でクローンを作りました
onofumi【動画生成AIラボ】
0:00 / 0:00
Seedance 2.5の日本語音声を実測。自分の顔と声でクローンを作りました
71 просмотр · 2 недели назад
onofumi【動画生成AIラボ】
183 подписчика
71 просмотр · 2 недели назад
Seedance 2.5は日本語をどこまで正確に喋れるのか。
ニュース原稿を読ませて、全部のセリフを音声認識にかけて一語ずつ答え合わせしました。
結論、日本語はもう充分に使えます。つまずくのは台本の書き方だけでした。
・六つの文が、ひとつも抜けずに読まれた。言い直しも重複もゼロ
・速さは一秒あたり5.8文字。実際のアナウンサーとほぼ同じ
・秒数もカット割りも指定していないのに、文の切れ目に自分で「間」を置いた
・崩れたのは三つだけ。桐生市 / ダイヤ / 三十九度二分
・共通点は「漢字から読み方を当てる言葉」。かなで書けば直ります(抑揚は直りません)
後半は、自分の顔と声でクローンを作っています。
写真一枚と、自分の声の音声一本。それだけで、顔も声も自分の映像ができました。
・音声の長さ制限は 2.5 でなくなった(29秒の音声を20秒の動画に渡して通る)
・参照素材の数は料金に影響しない。かかるのは動画の長さだけ
・ただし、真顔は一致しても、喋っているときの表情は実物と同じになりません
この動画のナレーションも、同じ仕組みで作ったクローン音声です。
▼ 動画生成を学ぶなら、ZIVU AI
基礎から応用まで、登録不要で無料公開しています
https://zivu-ai.com?utm_source=youtube
━━━━━━━━━━━━━━
📌 チャプター
0:00 オープニング
0:35 顔も声も生成です
1:39 検証①日本語はどこまで正確に喋れるか
3:00 検証②読み間違えた三つ
4:15 対策:崩れる言葉はかなで書く
5:33 検証③声を自分のクローンにする
6:50 検証④顔を自分にする/表情のずれ
8:35 判定とまとめ/次回予告
━━━━━━━━━━━━━━
🧑💻 onofumi(おのふみ)
Kling公式クリエイティブパートナー / AIコンテスト入賞多数
動画生成AIの操作・自動化を、初心者にも分かりやすく実画面で解説します。
▼ SNS
X: https://x.com/onofumi_AI
Instagram: / onofumi.ai
TikTok: / onofumi_ai
Threads: https://www.threads.com/@onofumi_ai