La Commission européenne a publié, mardi 21 juillet, son grand modèle de langage (LLM) institutionnel de l’Union européenne en tant que modèle ouvert (open model).
Ce modèle a été développé à partir des « données multilingues de haute qualité » de la Direction générale de la traduction (DGT), afin de garantir « une représentation équitable et équilibrée des 24 langues officielles de l’Union européenne, tout en comprenant la terminologie, la législation et le contexte politique qui font la spécificité de l’Union européenne », a annoncé le directeur général de la DGT, Christos Ellinides.
Le développement de ce modèle d’intelligence artificielle a été rendu possible grâce à la puissance des supercalculateurs européens MeluXina (Luxembourg), Leonardo (Bologne) et MareNostrum (Barcelone), combinée avec le modèle ouvert développé par l’entreprise française Mistral.
Deux versions du LLM institutionnel de l’UE sont désormais disponibles via l’European Language Data Space, une plateforme destinée à créer un marché des données linguistiques fiable et efficace pour l’échange de ressources linguistiques entre les secteurs public et privé. (Ana Pisonero Hernández)