制度面での基盤整備も加速している。フィリピン大学の言語学部は、自国の主要言語に関するコーパス(大規模言語データベース)をデジタル化するプロジェクトを主導。在日フィリピン大使館などの外交機関と連携し、日本で働くフィリピン人労働者やその家族が直面する行政・医療用語の対訳データを蓄積してきた。
学術機関が担保する高品質なテキストデータがAIモデルの学習データとして提供されることで、文化的な差異から生じる翻訳エラーは大幅に削減されている。官民学の連携によって構築されたデータインフラが、高精度な翻訳技術を裏から支える屋台骨となっているのだ。