Sortie d'Opus 5.5 entraîné par distillation et apprentissage par renforcement à partir d'un modèle enseignant
Opus 5.5 released with distillation and reinforcement learning from a teacher model
Le modèle Opus 5.5 a été entraîné grâce à des techniques d'auto-amélioration et de distillation à partir d'un grand modèle enseignant interne. Cette approche de post-entraînement produit un modèle plus compact et économique doté d'une forte intelligence.
4 comptes indépendants
16 messages
1 articles
1 labos
21 405 interactions
distillation