- 01Google DeepMindが手話をテキストに変換するAIモデル「SL2T」を発表。
- 02聴覚障害者・難聴者向けの新機能として実装される予定。
- 03手話認識AIの実用化に向けた重要なマイルストーンとなる。
Google DeepMindが手話をテキストに変換するAIモデル「SL2T」を発表。
聴覚障害者・難聴者向けの新機能として実装される予定。
手話認識AIの実用化に向けた重要なマイルストーンとなる。
#01 何が起きたのか
2026年8月12日、Google DeepMindは手話テキスト変換モデル「SL2T(Sign Language to Text)」を発表しました。同モデルは、手話の動作をリアルタイムでテキストへ変換する技術であり、聴覚障害者(Deaf)および難聴者(hard of hearing)を対象としたユーザー向け新機能を支える基盤技術として開発されました。
Google DeepMindは同モデルを「ブレークスルー(画期的な突破口)」と位置づけており、手話認識の精度・実用性において従来技術からの大幅な前進を主張しています。発表によれば、SL2Tは既存のGoogleサービスに統合される新しい手話関連機能へ直接組み込まれる形で展開される予定です。今回の発表は、AI技術をアクセシビリティ(情報やサービスへのアクセスしやすさ)の向上に活用するという同社の取り組みの一環として位置づけられています。
#02 なぜ重要なのか
手話は世界で数千万人の聴覚障害者が日常的に使用する主要なコミュニケーション手段ですが、デジタルサービスにおける手話対応は音声認識や文字入力に比べて長らく遅れていました。手話は身体の動き・手の形・表情など複数の要素が組み合わさった複雑な言語体系であるため、AIによる高精度な認識は技術的に困難とされてきました。
SL2Tの登場は、こうした課題に対してディープラーニング(深層学習)を用いた実用的なアプローチが確立されたことを示すものです。大手AI企業が手話認識モデルを製品レベルで発表した事例として、業界全体のアクセシビリティ技術の水準を引き上げる可能性があります。
#03 で、私たちの生活にどう影響?
SL2Tが実装されたGoogleサービスを通じて、聴覚障害者や難聴者はこれまで音声や文字入力を前提としていたデジタルツールを、手話という自身のネイティブ言語でより直感的に操作できるようになります。たとえば、ビデオ通話や検索・入力操作などの場面で、手話の動作がそのままテキストに変換されることで、日常的なコミュニケーションや情報へのアクセスが容易になることが期待されます。
聴覚障害を持たない一般ユーザーにとっては直接的な影響は限られますが、手話通訳サービスや教育分野での活用可能性もあり、社会全体のコミュニケーション手段の多様化につながる技術として注目されます。
聴覚障害の方との日常的なやりとりが変わる可能性あるよね。
コーディング系と違って自分が直接恩恵を受けるわけじゃないけど、こういうアクセシビリティ系AIって個人的に応援したくなる。触ってみる機会がなかなかないジャンルなのが悔しいとこ。実際の精度がどこまで出てるか気になる。

