⚠️ KMI waarschuwing: Onweer in België Laatste update van KMI waarschuwingen voor België. KMI ↗ Kaart ↗ Artikel →
← Terug
Nieuw open-source taalmodel Mimir v1 zet standaard voor Deense taalprestaties

Nieuw open-source taalmodel Mimir v1 zet standaard voor Deense taalprestaties

Wetenschappers hebben een nieuw taalmodel ontwikkeld dat bewijst dat hoogwaardige AI-prestaties mogelijk zijn zonder het gebruik van controversiële datasets. Het model, genaamd Mimir v1, is specifiek ontworpen om de drempel voor open-source onderzoekers te verlagen door uitsluitend gebruik te maken van data die wettelijk en ethisch toegestaan zijn voor training.

Volgens een technisch rapport dat op 13 augustus 2026 verscheen, is Mimir v1 gebouwd op de Hierarchical Reasoning Model (HRM) architectuur. Het model beschikt over 1 miljard parameters en is volledig vanaf nul getraind. Om dit resultaat te bereiken, hebben de ontwikkelaars een diverse verzameling van 161 verschillende datasets gecombineerd. In de arxiv.org wordt toegelicht dat de huidige trend in de ontwikkeling van grote taalmodellen vaak steunt op enorme hoeveelheden data waarvan de herkomst juridisch of ethisch discutabel is. Mimir v1 dient als bewijs dat een strikte naleving van dataregels niet ten koste gaat van de kwaliteit.

De effectiviteit van het model is getoetst via 20 verschillende benchmarks, waarbij de focus lag op wiskunde, programmeren en de talen Engels en Deens. De resultaten laten zien dat Mimir v1 aanzienlijk beter presteert dan de eerdere HRM-Text 1B. Ondanks de relatief kleine omvang van het model, kan het concurreren met grotere zogenaamde "frontier"-modellen, waaronder Gemma 4 E2B en Qwen 3.5 4B. Een opvallend resultaat is de prestatie in de Deense taal; volgens de vestigt het model hiermee een nieuwe state-of-the-art standaard voor deze taal.

Het project is het resultaat van een samenwerking tussen Peter Schneider-Kamp, Jacob Nielsen, Gianluca Barmina, Kenneth Enevoldsen en Lukas Galke Poech. De methodologie en de resultaten van de benchmarks zijn gedetailleerd uitgewerkt in een rapport van 20 pagina's. Om de transparantie en de voortgang van open-source onderzoek te bevorderen, is Mimir v1 publiekelijk beschikbaar gesteld via de Hugging Face Hub. Hierdoor kunnen andere experts het model downloaden en verder optimaliseren.

Hoewel de focus van Mimir v1 ligt op geavanceerde taalverwerking en redenering, maken dergelijke modellen vaak gebruik van uitgebreide linguïstische bronnen voor hun training en validatie. Voor onderzoek naar woordlijsten en taalstructuren in het Engels wordt in de academische wereld vaak gebruikgemaakt van gespecialiseerde scripts, zoals de dsss.be die beschikbaar is via DSSS.be.

Met de introductie van Mimir v1 hopen de onderzoekers een precedent te scheppen voor de toekomst van kunstmatige intelligentie. Het project toont aan dat een optimale combinatie van architectuur en zorgvuldig geselecteerde, toegestane trainingsdata een krachtig alternatief biedt voor de huidige praktijk van grootschalige data-extractie. Meer technische details over de implementatie en de specifieke HRM-structuur zijn terug te vinden in het .

Geraadpleegde bronnen
Lees origineel artikel — Nieuws
Waardering
0
Stem mee op dit artikel
Discussie
Nog geen reacties. Wees de eerste!