正弦波合成

正弦波合成(または正弦波音声)は、フォルマント(主要なエネルギー帯域)を純音ホイッスルに置き換えることで音声を合成する技術である。知覚実験のための刺激を自動生成する最初の正弦波合成プログラム( SWS )は、1970年代にハスキンズ研究所フィリップ・ルービンによって開発された。このプログラムはその後、ロバート・レメズフィリップ・ルービン、デビッド・ピゾーニらの同僚によって使用され、聞き手はピッチ、強勢、イントネーションといった従来の音声の手がかりなしに連続音声を知覚できることが示された。この研究は、音声を調音音響空間を通る動的な軌跡パターンと捉える見方への道を開いた。 [ 1 ]

参考文献

  • ルビン,PE「正弦波合成」ハスキンズ研究所社内メモ、コネチカット州ニューヘイブン、1980年[1]
  • Remez, RE, Rubin, PE, Pisoni, DB, & Carrell, TD「従来の音声手がかりを用いない音声知覚」Science , 1981, 212, 947-950.
  • ベスト, CT, モロンギエロ, B. & ロブソン, R. 音声と非音声の知覚における音響手がかりの知覚的等価性.知覚と心理物理学, 1981, 29, 191-211.
  • Remez, RE, Rubin, PE, Berns, SM, Pardo, JS & Lang, JM「言語の知覚的組織化について」心理学評論、1994年、101、129-156。
  • Remez, RE, Fellowes, JM, & Rubin, PE「音声情報に基づく話者識別」実験心理学ジャーナル:人間の知覚とパフォーマンス、1997年、23、651-666。

参考文献

  1. ^人間行動における非線形ダイナミクス. Huys, Raoul., Jirsa, VK (Viktor K.). ベルリン: Springer. 2010. ISBN 9783642162626. OCLC  700199659 .{{cite book}}: CS1 メンテナンス: その他 (リンク)