AI・先端技術開発

著名人の音声合成AIの開発

声を、未来でも使える資産に。
過去のナレーションなどの音声をもとに、抑揚や感情を含めて声を合成する仕組みをつくりました。

ご相談のはじまり

Challenge

声のデータを資産として残し、将来にわたって使われる形にしたい。そのご要望から、このプロジェクトは始まりました。

私たちがしたこと

Approach

  1. 01

    過去のナレーションなどの音声データをもとに、抑揚や感情を含めた音声合成の仕組みを開発しました。

  2. 02

    著名人の口調や発声を学習し、入力したテキストから、文章と音声を生成します。

数字で見るプロジェクト

Numbers

  • 期間

    2年間

  • 体制

    4

技術構成とポイント

Stack

  • Python
  • Django
  • TypeScript
  • React
  • Docker
音声合成AI
入力したテキストを、学習した声の特徴をもとに音声に変える技術です。声の高さや話す速さに加えて、抑揚や感情の込め方も再現の対象になります。
声のデータの資産化
過去に収録した音声を学習用のデータとして整えておくことで、あらためて収録しなくても、その声で新しいナレーションをつくれるようになります。

進め方

Team

期間
2年間
体制
PM 1名テックリード 1名機械学習エンジニア 2名
こんな会社からのご相談に向いています
芸能事務所や、放送局・出版社など、過去のナレーション音源を持っている企業
近いご相談の例
「音声の資産を活用したい」
「特定の声でナレーションを作りたい」

この事例に近いご相談はこちら

似た課題をお持ちでしたら、まずは状況をお聞かせください。
気軽なご相談で、いま抱えている課題を言葉にするところから始めませんか。

Contact Us