VisionHOPE: Visual Backbones as Self-Modifying Learning Systems
Les auteurs présentent VisionHOPE, le premier « backbone » visuel générique formulé comme un système d'apprentissage auto-modifiant, permettant au contenu de la mémoire et aux règles d'apprentissage de co-évoluer. S'appuyant sur le Nested Learning (NL), il intègre cinq mémoires couplées gérant le contenu, les clés/valeurs, le taux d'apprentissage et la rétention. Pour éviter l'instabilité, ils dérivent un schéma de contrôle du pas stabilisé par le spectre garantissant une dynamique non expansive. VisionHOPE obtient des résultats compétitifs sur ImageNet-1K, COCO et ADE20K.
VisionHOPE est le premier « backbone » visuel générique formulé comme un système d'apprentissage auto-modifiant.
Le système intègre cinq mémoires couplées qui co-évoluent le long de chaque balayage d'une image.
VisionHOPE obtient des résultats compétitifs sur ImageNet-1K, COCO et ADE20K.