CONSONANCE.for your information
lundi 5 octobre 2026frenvi

En discussion

01 — multimodal 3 VOIX

NetEase Youdao publie en open source Confucius4-R2T2, un modèle ASR en flux continu de 1,7 milliard de paramètres

NetEase Youdao open-sources Confucius4-R2T2, a 1.7B streaming ASR model

NetEase Youdao a publié en open source Confucius4-R2T2, un modèle de reconnaissance automatique de la parole en continu de 1,7 milliard de paramètres. Le système associe un encodeur audio unique à une fondation de modèle de langage pour gérer la reconnaissance vocale hors ligne et en flux, évitant ainsi que la modification des transcriptions ne corrompe l'état des agents vocaux.

3 comptes indépendants 12 messages 6 articles 331 interactions
@GithubProjects ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@NetEaseYouDaoAI ses sujets sur X ↗
↑