Googleは、従来のテキスト翻訳の枠を超え、世界の多様な言語をより深く理解するためにAI研究を拡大しています。Geminiのようなモデルに音声を直接処理するトレーニングを施すことで、従来の音声からテキストへの変換プロセスでは失われがちな、声のトーン、ペース、感情といった人間のコミュニケーション要素を捉えることを目指しています。
ニュースGoogleGeminiTranslateGemma
Google、多様な言語と文化的なニュアンスをサポートするためにAI機能を拡張
この記事は翻訳です。 原文を読む
リソースの少ない地域や接続が制限された地域のユーザーをサポートするため、GoogleはTranslateGemmaを導入しました。この軽量なオンデバイス翻訳モデルファミリーはGeminiをベースに構築されており、55の言語にわたってトレーニングされており、継続的なインターネット接続なしでも高品質な翻訳を可能にします。
また、同社はSign Language-to-Text (SL2T) のようなプロジェクトを通じてアクセシビリティの向上にも取り組んでいます。これは、ディクテーション機能を強化するために50以上の手話でトレーニングされています。さらに、Googleは文化的な正確性を確保するために地域コミュニティと協力しており、例えば、現地の遺産をより適切に反映させるために、Google Mapsにおけるマオリ語の地名の発音を改善するなどの取り組みを行っています。
出典
- AI for everyone in every language (Google AI Blog, 2026-09-15)