バイトダンス、音声生成AI「Seed Audio 1.0」公開 セリフ・効果音・環境音を一体で生成

バイトダンスのAI研究組織ByteDance Seedは2026年7月20日、音声生成モデル「Seed Audio 1.0」を公開した。セリフ、効果音、環境音といったシーン単位の音声要素を、単一のフレームワーク上でまとめて生成できる。

従来の音声合成が発話の再現に主眼を置いていたのに対し、同モデルは対話、音の合図、背景の音響が噛み合った状態で生成することを狙う。話者の同一性、感情のトーン、セリフの間の取り方、周囲の環境、効果音の配置までを文脈として解釈するという。

対応言語は中国語、英語、日本語、韓国語、スペイン語、インドネシア語、ドイツ語、フランス語、タイ語、ベトナム語など20言語以上に及ぶ。言語ごとのリズムや発音の違いに適応しつつ、同一の声質を保つ。

制御機能としては、プロンプト単位でのキャラクター発話のタイミング指定に対応し、精度は100ミリ秒刻みとなる。声はテキストによる記述、または許諾を得た参照音声から生成できる。

技術面では、創作上の構成を担う言語モデルと、拡散モデルによる音響生成器を組み合わせる構成を採る。提供はBytePlus経由で、同社コンソールから利用できる。

https://seed.bytedance.com/en/seedaudio1_0

関連記事

最新ニュース記事

  1. 試合前日でも「お米じゃなくてパスタ」 長谷川唯が海外生活で身につけた“鈍感力”

  2. NTTドコモビジネス、AIの社会実装を加速 量子・データセンター・自動運転にも言及

  3. 第一興商、委託先PCがマルウェア感染 最大863万件の個人情報漏えいのおそれ

  4. ローソン、「ローソンID」に不正アクセス 215万人分の個人情報漏えい

  5. ニッスイ、グループの日水物流でシステム障害 不正アクセスの可能性、入出荷に影響

  6. 損保ジャパン、委託先に不正アクセス 「SMILING ROAD」問い合わせ情報など約6万件漏えいの可能性

  7. 戸田建設、管理システムに不正アクセス 取引先・従業員の個人情報漏えい

  8. H.I.S.、タイ現地法人に不正アクセス パスポート情報など最大627人分流出

  9. アンソロピック、Claude Coworkをクラウド実行に一本化 ローカルVMオプションを廃止

  10. グーグル、画像生成AI「Nano Banana 2.1」公開 画質向上、料金は半額の0.0336ドルに

365AIニュースセンター最新記事

  1. 不登校からの復学へ!お子様の心を動かす7つのきっかけ

  2. 入学できないことも?「フリースクール入学拒否問題」の現実とその対処法

  3. フリースクール中学校・通信制高校生の卒業後の進路:進学以外の就職という選択肢

  4. 中学生の不登校、30万人突破 – 教育現場の危機と新たな希望

  5. 【専門家が伝える】不登校のお子様を持つ親御様の「心の荷」を軽くする5つのヒント

  6. 不登校脱出への道?フリースクールの魅力と注意点-親子で考える新たな一歩-

  7. Amazonが「プライムデー夏祭り」を六本木で開催!

  8. 甘いとうもろこしとフライドチキンの絶妙コンビ。夏限定!「もろこしチーズバーガー」新登場