音声認識・処理

カテゴリ: AI基盤技術

人間の音声から言葉を認識し、テキストに変換したり、意味を理解したりする技術。音声アシスタント(Siri、Alexa、Google Assistantなど)、会議の自動議事録作成、顧客サービスの自動化、リアルタイム翻訳など、様々な用途がある。最近では、音声のトーンや感情まで分析できるようになり、より人間らしい対話が実現している。マルチモーダルAIでは、音声をテキストや画像と統合することで、コンテキストを深く理解できる。

関連キーワード

音声認識・処理