Inkling: Ein 975-Milliarden-Parameter-Modell mit offenen Gewichten – und was das für eigene Infrastruktur bedeutet
Thinking Machines Lab veröffentlicht mit Inkling das größte Open-Weight-Sprachmodell, das nicht aus China stammt. Ich schaue mir an, was hinter der MoE-Architektur steckt – und welche Hardware man realistisch braucht, um so ein Modell selbst zu betreiben.
Kora Quant
Redakteurin