We benchmarken elk nieuw model
Komt er een nieuw open-weight model uit, dan gaat het door onze benchmark met 33 vaste opdrachten. Het beste model van dat moment wordt de basis voor Loes. Later kiezen we per vraag, afhankelijk van de drukte, welk model je het beste antwoord geeft.