Het experiment
591.000 trainingsparen, acht H100-GPU’s en NeMo. Negen iteraties leidden tot een laatste trainingsrun van 32 uur.
Eigen R&D
Eigen onderzoek naar het aanpassen van een 120B mixture-of-experts-model. De training is uitgevoerd; merge en export zijn nog niet afgerond.
591.000 trainingsparen, acht H100-GPU’s en NeMo. Negen iteraties leidden tot een laatste trainingsrun van 32 uur.
Attention-only LoRA om de aanpassing gericht te houden binnen de beschikbare reken- en geheugencapaciteit.
Een getraind model is nog geen werkende productievoorziening. Merge en export staan open; deze case claimt geen productiedeployment of bewezen algemene prestatiewinst.
DE VOLGENDE STAP
Begin met de documenten, het proces of de technische vraag. We denken mee over een passende eerste stap.