PrismML présente le modèle quantifié Ternary Bonsai 2 27B
PrismML introduces Ternary Bonsai 2 27B quantized model
PrismML a publié Ternary Bonsai 2 27B basé sur Qwen3.8 27B, réduisant sa taille par 9 pour atteindre 5,9 Go tout en conservant 98,2 % de ses performances de référence. Parallèlement, Qwen a annoncé Qwen3.8-LiveTranslate, un modèle d'interprétation simultanée en temps réel basé sur une architecture Interleave.
6 comptes indépendants
43 messages
2 labos
112 497 interactions
qwen3kv cacheqwen3.8tokens per second