音声合成とは、ソフトウェアなどによって人間の声を模した人工の音声を作ることである。
音声合成をおこなうソフトとして、SofTalk(ゆっくりしていってね!!!)やVOCALOID、VOICEROIDなどがニコニコ内外で有名である。
音声合成ソフトというのは、テキストなどによって入力した言葉を読み上げさせるソフトである。
合成音声を作りだす技術として様々な技法が存在するが、あらかじめ記録されている音声データを入力した文字から呼び出し、それらをつなげることで音声を作り出すものが代表的である。
例えば『こんにちは』と入力すると、それを『こ』『ん』『に』『ち』『は』と分解した単語にする。
これらを分析してソフト内に記録された『こ』、『ん』、『に』、『ち』、『は』の音声を呼び出し、それらを順に並べてくっつけ『こんにちは』という音声を作ち出す。
ただし、ただ単語と単語をくっつけただけの『こんにちは』のままでは音のつなぎ目や強弱、抑揚や発音などが不自然になってしまうので、比較的自然に聞こえるよう内部処理をして『こんにちは』という音を作り出している。
この時の音声を合成する技法や、使用している音源によって各社様々なソフトが存在する。
また、VOCALOIDやUTAUのように歌唱をさせる事だけに特化した専用のソフトウェアも存在する。
※ちなみに、人間の肉声は使用せず、人間の声音に近い音声周波を作り出すフォルマント合成という技法も存在する。
音声合成そのものの歴史は古く、何世紀にも渡る人類の夢であった。
発明への試みの多くは楽器から始まり、西アフリカに代表されるトーキングドラム等といった代物が開発された。その後、複雑な機構が開発できるような技術が発展した文明などの手によって音声合成を試まれ、何度も母音を発音させられる機械等が発明された。1791年になるとヴォルフガング・フォン・ケンペレンの手により、母音だけでなく子音も発音できる機構が発表され、より人間の発音に近い音声合成を求められる時代となってきたことにより、この発表された機構を利用したおもちゃなどの開発や更なる技術開発へと発展した。
1930年代、ベル研究所のホーマー・ダドリーによりヴォコーダーが開発。現在でもレコーディングや映画、アニメなどに用いられている「独特な機械的な声」を演出できる技術、携帯電話をはじめとする通信用の音声圧縮技術として用いられるその源流となった。
ついに1950年代の終盤。コンピューターを用いた音声合成が開発された。
そして、1961年。ベル研究所にてIBM 704を使用し、世界初のコンピューターでの音声合成が行われ、『デイジー・ベル』という曲を歌わせることに成功。この成功はVOCALOIDの祖先の祖先ともいえ、『2001年宇宙の旅』でHAL 9000がこの曲を歌うなど逸話も多い。
その後、1980年代に入ると更にコンピューターへの音声合成の導入・開発が行われ、Mac、AmigaOS、Windowsなどのオペレーションシステム(OS)で使用することができた。
特にこの中でFlash黄金期前後にインターネットを使用していた、インターネット老人会に属するものならば、MacのPlainTalkの音声を聞いたことがないものはいないだろう。2000年代、日本ではゴノレゴをはじめとしたPlainTalkを使用したFlashが有名なものでもいくつか存在し、当時多くの2ちゃんねらーなどを魅力した。
2000年に入ると後に"VOCALOID"と呼ばれるものの開発プロジェクト「DAISYプロジェクト」が始動。
このプロジェクト名も先述のベル研究所にてIBM 704が歌った『デイジー・ベル』になぞらえている。
2003年にはVOCALOIDとして名前が確立し、発表。2004年にはイギリスを皮切りに日本など世界各国での販売をおこなった。この年、日本では『MEIKO』が発売され、バーチャルイスントゥルメント市場では大ヒットと言われる本数を売り上げることができた。
またその影では2003年にプレイステーション2で"くまうた"が登場。VOCALOIDの先駆けとして、個人が作詞をして歌わせる遊びとそのシステムがこの時点で国内で既に確立していた。
喋らせる技術に関しても進歩を続けており、2006年に"AquesTalk"、2007年には"AITalk"が開発される。"AquesTalk"は後にSofTalkや棒読みちゃんの元に、"AITalk"は後にVOICEROIDの元になった。
そして2007年、キャラクター・ボーカル・シリーズの第一弾として『初音ミク』が満を持して登場。黎明期のニコニコ動画でも一躍その名が知られるようになる。動画投稿サイトやSNS等、国内インターネットから始まってその後世界的なVOCALOIDブームを巻き起こした上に、2008年には飴屋P氏により「人力ボーカロイド」を行うための支援ツール"UTAU"も開発され、ここニコニコ動画をはじめとしたインターネットを舞台にプロ/アマ・国内/国外関係無く、オリジナル曲やMVなどを投稿し盛り上がる文化の土壌が形成された。
2009年になると"VOICEROID"がパッケージ化。2009年12月4日に初のVOICEROID『月読ショウタ』が発売された。2010年代に入ると『東北ずん子』『結月ゆかり』『琴葉茜・葵』などのキャラクターが人気となり、先に盛況を得ていたAquesTalk系音声合成ソフトを利用した「ゆっくり」系動画と並んでニコニコ動画にゆっくり実況プレイ、VOICEROID実況プレイなどの人気動画シリーズを生み出すこととなった。
初期の音声合成はまだ「独特な機械的な声」としてしか発声することはできなかったが、IBM 704を用いた実験以降も開発は現在までに続いている。また、近年の新たな研究・開発によりブレス(吐息)やより人間的な抑揚の再現、チューニングの精度向上などが進んでおり、更なる技術の発展が期待される分野である。
2010年3月から株式市況(NHKラジオ第2)、2016年4月1日から気象通報(NHKラジオ第2)にNHK放送技術研究所が開発したソフトウェアを導入した。それまでは生放送でアナウンサーが読み上げるスタイルであった。
ニコニコ動画では、これらの多彩な音声合成ソフトを使った動画が数多く投稿されており、人気ジャンルのひとつとして幅広く親しまれている。
また専用のソフトを介さずにユーザー自身が直接人力で音声加工を手がけて歌唱や読み上げを行っているものや、歌唱用音声合成ソフトを喋っているように見せる調整を行ったり読み上げ用音声合成ソフトに歌唱を行わせた動画も多数存在する。
前者の例→人力VOCALOID / 暴歌ロイド
後者の例→棒歌ロイド / トークロイド / HANASU / 歌うボイスロイド
各音声にはしばしば、VOCALOIDやゆっくりしていってね!!!などのイメージキャラクターが付随しており、他のキャラクターと垣根なく掛け合いをするなど、独自の文化や世界観を構築するに至っている。
歌声合成(SVS)ソフトは【歌声】、読み上げ合成(TTS)ソフトは【読み上げ】と記載。
一定以上の使用規模を誇る系統のみ記載しています。各ソフトの詳細についてはリンク先個別記事へ
開発:ヤマハ株式会社
年度:2004年
主なソフト:VOCALOID(1〜6)、Piapro Studio(クリプトン製、VOCALOID3/4対応エディター)
ヤマハが開発した歌声合成エンジンの総称。実際の歌手の声をサンプリングしたライブラリを基に、メロディーと歌詞から歌声を生成するボーカルシンセサイザー。ライセンスを受けた各企業によって様々な音声データベースが作成され、パッケージ化されている。初音ミクをはじめ豊富なキャラクターが存在し、ボカロ文化の原点かつ中心的存在。世代ごとにエンジンが進化(VOCALOID3〜6)し、6系においてはAI技術も備えた。商用・アマチュア双方で広く使われる歌声合成分野における王道系統。
開発:株式会社アクエスト
年度:2006年
主なソフト:AquesTalk(エンジン)、Softalk、棒読みちゃん、ゆっくりMovieMaker
規則合成ベースの軽量エンジン。少ないリソースで動作し、組み込み用途にも強い。発音がやや機械的でその独特の声質は「ゆっくりしていってね!!!」等に代表されるゆっくりボイスとしてニコニコ文化で広く親しまれた。
最も有名なSoftalkはこのAquesTalkを音声ライブラリとして使用しているフリーソフト。ただし今と昔ではAquesTalk自体のライセンス形態が異なるため、商用利用時は注意が必要である。現在もゆっくりMovieMaker(YMM)等に組み込まれ「ゆっくり」音声・動画の象徴的存在として根強い支持を集めている。
開発:株式会社エーアイ
年度:2007年
主なソフト:AITalk(エンジン)、VOICEROIDシリーズ、A.I.VOICE/A.I.VOICE2シリーズ、ガイノイドTalk、音街ウナTalk Exなど
コーパスベース(波形接続)から始まり、後にDNNを取り入れた高品質エンジン。自然なイントネーションと感情表現が強みで、世代ごとに読み上げ精度や表現力が向上している(AITalk4〜6など)。
VOICEROIDシリーズや現行のA.I.VOICEシリーズの基盤となり、キャラクター付き読み上げソフトの標準的存在としてニコニコにおける所謂「ボイスロイド文化」を支えた中核的技術・製品と言える。
なお誤解されることが多いが、株式会社AHS発売の「VOICEROID」シリーズ・吉本興業株式会社発売の「ガイノイドTalk」シリーズなどは、このAITalkを基幹として個人向け用途としてキャラクター要素を付与しサードパーティ販売された製品。
開発:飴屋/菖蒲(飴屋P)氏
年度:2008年
主なソフト:UTAU、OpenUTAU
特徴:元々は人力VOCALOID支援ツールとして端を発する歌声合成のフリーソフト。ユーザーが録音した音声(50音)を音源としてその張り合わせ(た音声ライブラリ)によって歌唱を行う仕組みが特徴。有志による膨大なコミュニティ製音源が公開・配布されており、それらが全て無料で使える事もあり広義ボカロ文化のサブカル的基盤を支えてきた。連続音の音声ライブラリも配布されており、使用音源とその調整次第では有償の歌声合成ソフトに劣らない歌声合成も可能。
開発:CeVIOプロジェクト / テクノスピーチ(名古屋工業大学研究ベース)
年度:2013年
主なソフト:CeVIO Creative Studio、CeVIO AI、VoiSona(トーク/ソング両対応)
統計的パラメトリック合成(初期HMM、後にDNN)を採用した独自エンジンで、同一キャラクターでトーク(読み上げ)とソング(歌唱)の両方に対応可能な点が最大の特色。音声合成の仕組みとしては、人間が声を出す過程をシミュレートして音声を合成するものであり、口や喉の形、声の大きさや高さなどがパラメータとなる。
CeVIO Creative Studioから始まったその技術は、その後ディープラーニング技術を組み込んだCeVIO AI、VoiSonaへと進化し、更に人間らしい自然さを追求。ボカロ/ボイロとは異なるアプローチからなる技術と調声文化を形成している系統。
開発:Dreamtonics
年度:2018年
主なソフト:Synthesizer V / Studio / AI / 2
Dreamtonicsが開発したAI歌声合成エンジン。Standard版とAI版があり、特にAI版は人間の歌声に極めて近いリアルな歌唱を得意とする。日本語・英語・中国語など多言語に対応しており、ライブラリ数も多い。歌唱合成分野においてVOCALOIDと並ぶ現在の主流の一つ。
設立者・開発者であるKanru Hua(フア・カンル)氏は元々UTAUのプラグイン開発者でもあり、その繋がりかは定かではないがUTAUで活躍していたキャラの音声ライブラリも幾つかみられる。
開発:SHACHI氏
年度:2020年
主なソフト:NEUTRINO(Electron / Muon / Tauなど)
ニューラルネットワークを活用したフリーのDNN歌声合成ソフト。MusicXML形式の楽譜と歌詞を入力するだけで、発声タイミング・ピッチ・声質などをAIが推定して歌声を生成する。初期は名古屋工業大学のSinsyをフレームワークの一つとして活用しており、音声データベース(謡子など)も一部転用されている。名工大の統計的パラメトリック/DNN研究の流れを汲むが、開発主体は別でエンジン自体は独自。後の世代(Muon・Tau)ではDiffusionモデルを導入し、表現力と自然さが更に向上している。無料ながら高品質なことで一世を風靡した独立系統。
開発:ヒホ(ヒロシバ)氏
年度:2021年
主なソフト:VOICEVOX、COEIROINK(初期派生)、SHAREVOXなど
ディープラーニングを全面採用した無料のAI音声合成エンジン。ずんだもんをはじめとした人気キャラクターを多数擁する。オープンソースのため派生ソフト(COEIROINKなど)が生まれやすく、マルチエンジン連携にも対応。インストール後すぐに高品質な音声が得られる手軽さと、商用利用可能なライブラリが多いことで近年の無料読み上げソフトの中心的存在に成長した。
開発:Dreamtonics(エンジン)/ 株式会社AHS(製品)
年度:2022年
主なソフト:Syllaflow(エンジン)、VOICEPEAK
Synthesizer Vと同じDreamtonicsが開発した最新のAI音声合成エンジン。文章の意味を解析して速度・抑揚・感情を自動調整するため、入力しただけで非常に自然な読み上げになる。エンジン単体のSDKも提供されており、Raspberry Piなどへの組み込み用途にも対応。
「VOICEPEAK」はSyllaflowを核にDreamtonicsとAHSが共同開発を行った製品で、ナレーター向けからキャラクター製品まで展開している。キャラクターシリーズにおいては個人用途での非営利利用が前提であるため、商用利用の可否はキャラクターごとに要確認。
| ア行 | カ行 | サ行 |
|---|---|---|
| タ行 | ナ行 | ハ行 |
| マ行 | ヤ行 | ラ行 |
|
||
| ワ行 | その他 | ※ハードウェア |
|
掲示板
183 ななしのよっしん
2026/05/28(木) 20:16:36 ID: VMP4EW+7ld
melismaエンジンとライブラリデモ
>>sm46359209
184 ななしのよっしん
2026/07/15(水) 08:14:29 ID: VMP4EW+7ld
「勝手に声を使われる前に公式で作る」 声優・浪川大輔に本人監修の“公認AI合成音声”を開発した理由を聞いてみた
2026/07/14 18:15
https://
185 霊地王生路
2026/09/02(水) 07:17:24 ID: WqpEdGNSUx
>>184
まあ、これがけじめを超える誠意ってもんだわな、と思う。
急上昇ワード改
最終更新:2026/09/09(水) 12:00
最終更新:2026/09/09(水) 12:00
ウォッチリストに追加しました!
すでにウォッチリストに
入っています。
追加に失敗しました。
ほめた!
ほめるを取消しました。
ほめるに失敗しました。
ほめるの取消しに失敗しました。