Meta hat am 10. August Muse Glimmer unter der Apache 2.0-Lizenz veröffentlicht – ein 30-Milliarden-Parameter-Open-Weight-Modell für autonome KI-Agenten auf Consumer-Hardware. Es ist Metas erste vollständig offene Veröffentlichung seit dem Wechsel über die Llama-Familie hinaus mit dem proprietären Muse Spark.
Muse Glimmer ist ein dichter kausaler Transformer mit rund 29,6 Milliarden Parametern in 52 Schichten, einschließlich eines dedizierten ~1,8-Milliarden-Parameters-Vision-Encoders. Es akzeptiert verflochtene Texte und Bilder, unterstützt über 100 Sprachen und hat eine Kontextlänge von 131.072 Token.
Bei voller Präzision erfordert das Modell über 55GB Speicher. Meta entwickelte 4-Bit-quantisierte Varianten, die die Gewichte auf unter 20GB schrumpfen. Die K-Quant-17GB-Konfiguration passt auf Nvidias RTX 3090 oder RTX 4090 (24GB VRAM).
Meta führte außerdem DFlash-spekulatives Decoding ein, das die Generierungsgeschwindigkeit auf einer RTX 5090 von 74,9 auf 233,4 Token pro Sekunde steigert (3,1x).
Zuckerberg versprach zudem, Muse Spark 1.2 – Metas proprietäres Frontier-Modell – in naher Zukunft als Open Source zu veröffentlichen. Wenn geliefert, würde ein US-Flaggschiff-Modell erstmals in den offenen Umlauf gelangen.
Bis Mai 2026 machten chinesische Open-Weight-Modelle rund 61 % aller auf OpenRouter verbrauchten Tokens aus.




