Portugal levert open LLM Amália voor 7 miljoen euro terwijl Frankrijk nog steeds debatteert over AI-soevereiniteit
Mistral AI
Meta
Hugging Face
Op 1 juli 2026 presenteerde Portugal officieel Amália, geprezen als het eerste open grote taalmodel ontwikkeld in Europees Portugees. Gefinancierd door het Herstel- en Veerkrachtplan met een publieke investering van 7 miljoen euro, werd Amália gebouwd door bestaande open modellen aan te passen en gebruik te maken van gedeelde Europese computerinfrastructuur. Dit staat in contrast met Frankrijk, dat ondanks een wereldkampioen in Mistral AI en een publieke supercomputer, geen nationaal publiek taalmodel heeft opgeleverd.
Op 1 juli 2026 heeft de Portugese regering Amália gepresenteerd, dat zij het eerste open large language model (LLM) noemt dat is ontwikkeld in Europees Portugees. Het project, gecoördineerd door de Universidade Nova de Lisboa met andere universiteiten en onderzoekscentra, mobiliseerde meer dan zestig onderzoekers en werd gefinancierd door het Herstel- en Veerkrachtplan (PRR) met een publieke investering die tegen 2027 oploopt tot 7 miljoen euro. Het model is beschikbaar onder de Apache 2.0-licentie op Hugging Face. Amália is geen enkel systeem, maar een reeks modellen: een tekstmodel met 9 miljard parameters, een visionmodel en een spraakherkenningscomponent. Het tekstmodel bouwt voort op bestaande open modellen, met name EuroLLM-9B en GlorIA, en breidt de pretraining van EuroLLM uit om de kennis van Europees Portugees te verbeteren en de contextvenster te vergroten tot 32.000 tokens. Deze aanpak kostte aanzienlijk minder dan trainen vanaf nul. Vergelijkbare strategieën zijn elders in Europa gebruikt, zoals het Baskische Latxa, het Spaanse ALIA, het Duitse Teuken-7B en het EU-project OpenEuroLLM. Daarentegen heeft Frankrijk Mistral AI, een particulier bedrijf, en Albert, een staatsinfrastructuur die modellen van derden aanbiedt, maar geen publiek getraind nationaal taalmodel, ondanks eerdere inspanningen zoals BLOOM. Amália heeft beperkingen: het is een aanpassing van een bestaande basis en heeft slechts 9 miljard parameters, ver verwijderd van topmodellen uit de VS of China. Niettemin toont het aan dat een soeverein, open LLM dat is aangepast aan een taal kan worden gerealiseerd met een universitair consortium, Europese fondsen en gedeelde computerinfrastructuur.
Bron: ActuIA —
origineel
