進化するヒトと機械の音声コミュニケーション Vol.2「AIの活用と感情に寄り添う音声認識・合成の新展開」
発売日:2025年4月
- 巻の著者
- 伊藤彰則/〔ほか〕執筆
- 巻の書名
- AIの活用と感情に寄り添う音声認識・合成の新展開
- ページ数
- 254,6p 図版5枚
- ISBN
- 978-4-86043-936-1
セブン-イレブン受取り(送料無料)
発送目安
発売日(発売日以降は当日)~2日で発送
宅配(送料¥550税込)
発送目安
発売日(発売日以降は当日)~2日で発送
交通状況・天候の影響や注文が集中した場合等、お届けにお時間をいただく場合がございます。
商品説明
◆人工知能の発展に伴い、飛躍的に進歩している音声認識・合成技術!
◆聴覚・発声のメカニズムから音声の認識・合成の最新技術、今後の展望まで網羅&詳解!
◆娯楽・情報・福祉等、実用化事例も満載!より豊かな生活に向けたコミュニケーションの実現へ?
【主な目次】
序論 音声処理研究の動向と今後の展望
第1編 聴覚・発声のメカニズムと音声認識・合成の最新技術
第1章 聴覚・発声のメカニズム
第2章 音声認識の最新技術
第3章 音声合成の最新技術
第2編 音声認識・合成・コミュニケーションの応用技術
第1章 音声認識の応用技術
第2章 音声合成の応用技術
第3章 音声によるコミュニケーション技術
目次
序論 音声処理研究の動向と今後の展望
1. 音声処理研究の変遷の概観
2. 音声の分析合成
3. 音声認識
4. 音声合成
5. 今後の展望
第1編 聴覚・発声のメカニズムと音声認識・合成の最新技術
第1章 聴覚・発声のメカニズム
第1節 聴覚のメカニズム
1. はじめに
2. 振動の伝達と電気信号への変換
3. 情報の抽出
4. 情報の統合
5. まとめ
第2節 音声生成のメカニズム
1. 音声生成のメカニズムの基礎
2. 発声
3. 調音運動
4. 言語情報・パラ言語情報・非言語情報
第2章 音声認識の最新技術
第1節 End-to-Endモデルによる音声認識
1. はじめに
2. 音声認識のための End-to-Endモデルの分類
3. Connectionist Temporal Classification(CTC)
4. RNN トランスデューサ(RNN transducer)
5. アテンションモデル(Attention model)
6. トランスフォーマ(Transformer)
7. 自己教師付き学習に基づく大規模事前学習モデル
8. 主な大規模事前学習モデル
9. おわりに
第2節 骨導デバイスを利用した音声コミュニケーション:人と機械による音声認識
1. はじめに
2. 骨導音声の伝搬
3. 集音した骨導音声の認識
4. 骨導提示した音声の認識
5. おわりに
第3節 読唇技術:音声情報を利用せずに映像情報のみを用いた音声認識技術
1. はじめに
2. 関連研究
3. 基本モデル
4. 検討モデル
5. 評価実験
6. おわりに
ほか
商品詳細
- 出版社名
- エヌ・ティー・エス
- サイズ
- 26cm
- 対象年齢
- 一般
- フォーマット
- 単行本
注意事項
- 本の帯に関して
- 帯つきでの出荷はお約束しておりません。
商品ページに、帯のみに付与される特典物等の表記がある場合でも、確実に帯つきでの出荷はお約束しておりません。
また、帯は商品の一部ではなく「広告扱い」のため、帯の有無・破損による交換や返品は承っておりません。 - 版・表紙について
- 版・表紙(カバー)のご指定は承っておりません。ご注文いただくタイミングによっては、お届けする商品の版や表紙が商品ページ上のものとは異なる場合がございます。
また、初版にのみにお付けしている特典(初回特典、初回仕様特典)がある商品は、商品ページに特典の表記がされている場合でも、無くなり次第終了となります。