RSIAgent: Kimi-K3 et GLM-5.3 dépassent GPT-6 sur OSWorld-v2 grâce à l'auto-amélioration récursive
Résumé
Le framework multi-agent RSIAgent enchaîne curriculum, actor et verifier pour explorer, valider et retenir des connaissances propres à chaque nouvel environnement, sans entraînement. La stratégie 'broad-then-deep' combine découverte parallèle et enquête ciblée sur cas limites. Sur OSWorld-v2 et Agent's Last Exam, les modèles ouverts Kimi-K3 et GLM-5.3 dépassent GPT-6 et le reste du frontier fermé.
Article original publié par huggingface.co
Lire l'article original →Titre original : RSIAgent: Kimi-K3 et GLM-5.3 dépassent GPT-6 sur OSWorld-v2 grâce à l'auto-amélioration récursive