視覚障害者のための音声解析手法
国立研究開発法人産業技術総合研究所と筑波技術大学、東京大学の研究チームは、視覚障害者の音声理解能力を定量化する新たな手法を開発しました。この手法は、視覚障害者が使用するスクリーンリーダーの音声理解を個別に評価し、各ユーザーにとって最も適した読み上げ速度を提供することで、デジタル情報へのアクセスをよりスムーズにします。
スクリーンリーダーの重要性
スクリーンリーダーは、パソコンやスマートフォンの画面に表示された情報を合成音声で読み上げるソフトウェアであり、視覚障害者の日常生活に欠かせないツールとなっています。これにより、就学や就職、社会参加が促進され、視覚障害者がデジタル情報を正しく理解する手助けを行います。しかし、これまで発表されていた音声理解の研究では、個々のユーザーがどの速度まで理解できるのかについての適切な評価が行われていなかったのが実情です。
研究の方法と結果
本研究では、項目反応理論を応用して、理解度を測定する手法を構築しました。このアプローチにより、読み上げ速度が速すぎて理解できないのか、文章が難解だからなのかを明確に区別できるようになり、音声読み上げの難易度と個々の理解能力を同じ尺度で評価できるようになりました。
実際、全盲の利用者は、視覚に何らかの障害を持つ利用者と比較し、高速の読み上げでも良好な理解度を保つ傾向が見られました。また、普段設定している音声読み上げ速度に関しても、全盲の利用者が約2.3倍の速度で理解できるのに対し、弱視の利用者は約1.4倍の速度にとどまるという明確な差が見つかりました。これは、利用経験だけでなく、視覚障害特有の条件が音声理解能力に独自に影響を与えることを示唆しています。
今後の研究計画
今後の展望として、さらなる大規模な調査を行い、この評価手法の精度向上を図るとともに、視覚障害者の利用経験に伴う音声理解能力の変化を追跡評価することを目指しています。また、個々の能力に合った読み上げ速度を瞬時に提供するための評価ツールの開発も計画中です。これにより、視覚障害者が情報にアクセスする際の壁をさらに低くし、快適な生活をサポートすることが期待されます。
この成果は、2026年9月にオーストラリアのシドニーで開催される学会Interspeech 2026で発表される予定です。