Microsoft veut renforcer la diversité linguistique des modèles d’intelligence artificielle en Europe
Microsoft a annoncé lundi un vaste plan d’investissement en Europe afin de produire des données numériques destinées à l’entraînement des modèles d’intelligence artificielle (IA) dans plus d’une dizaine de langues. L’objectif : garantir une meilleure représentativité des langues européennes dans les technologies d’avenir, aujourd’hui largement dominées par l’anglais.
Dans un entretien accordé à l’Agence France-Presse, Brad Smith, président de Microsoft, a exprimé son inquiétude quant à la sous-représentation des langues locales dans les bases de données d’IA. « La survie de certaines langues est en jeu », a-t-il affirmé, rappelant qu’un modèle d’IA « est moins performant lorsqu’il est utilisé dans une langue pour laquelle les données sont insuffisantes ». Selon lui, cette situation risque de pousser les utilisateurs vers l’anglais, au détriment de la diversité linguistique.
Dès septembre, la firme américaine prévoit d’ouvrir de nouvelles antennes de ses centres de recherche à Strasbourg, dans l’est de la France. Ces nouveaux pôles auront pour mission d’« étendre la disponibilité des données » dans au moins dix des vingt-quatre langues officielles de l’Union européenne, notamment l’estonien et le grec.
Le projet inclura la numérisation d’ouvrages en langues locales et la production de centaines d’heures d’enregistrements audio. Brad Smith a précisé que ces données seront accessibles à tous, en open source, et que Microsoft n’en conservera pas la propriété.
Cette initiative intervient dans un contexte où la souveraineté numérique européenne est au cœur des débats politiques et technologiques. Microsoft cherche ainsi à se positionner comme un partenaire privilégié du marché européen. Déjà en juin, l’entreprise avait annoncé un renforcement de ses engagements sur la cybersécurité et la protection des données stockées dans ses infrastructures européennes. « Nous nous engageons sans réserve à défendre la souveraineté et les données européennes », a insisté Brad Smith.
Si le secteur de l’IA est largement dominé par des acteurs américains et chinois, l’Europe voit émerger des initiatives ambitieuses, à l’image du français Mistral ou de la start-up franco-américaine Hugging Face. Des projets comme TildeLM s’efforcent également de développer des modèles IA spécifiques aux langues européennes.
En parallèle, Microsoft a annoncé la création, dès l’automne prochain, d’une réplique numérique de la cathédrale Notre-Dame de Paris, réalisée en partenariat avec l’Institut du Patrimoine et la société française Iconem. L’entreprise a aussi conclu des accords avec la Bibliothèque nationale de France et le Musée des arts décoratifs afin de numériser une partie de leurs collections, réaffirmant ainsi son ancrage dans le patrimoine culturel européen.
-
17:30
-
17:15
-
17:00
-
16:45
-
16:31
-
16:15
-
16:09
-
15:40
-
15:31
-
15:30
-
15:16
-
15:15
-
15:09
-
15:05
-
14:57
-
14:44
-
14:41
-
14:35
-
14:33
-
14:30
-
14:15
-
14:09
-
13:46
-
13:44
-
13:31
-
13:25
-
13:09
-
12:44
-
12:30
-
12:09
-
11:44
-
11:30
-
11:09
-
10:59
-
10:49
-
10:44
-
10:30
-
10:09
-
09:51
-
09:40
-
09:30
-
09:03
-
08:50
-
08:33
-
08:30
-
23:34
-
23:09
-
22:41
-
22:30
-
22:09
-
21:44
-
21:31
-
21:09
-
20:44
-
20:30
-
20:09
-
19:44
-
19:30
-
19:09
-
18:44
-
18:30
-
18:13
-
18:03