huggingface.co détecté sur le web

RSIAgent: Kimi-K3 et GLM-5.3 dépassent GPT-6 sur OSWorld-v2 grâce à l'auto-amélioration récursive

Résumé

Le framework multi-agent RSIAgent enchaîne curriculum, actor et verifier pour explorer, valider et retenir des connaissances propres à chaque nouvel environnement, sans entraînement. La stratégie 'broad-then-deep' combine découverte parallèle et enquête ciblée sur cas limites. Sur OSWorld-v2 et Agent's Last Exam, les modèles ouverts Kimi-K3 et GLM-5.3 dépassent GPT-6 et le reste du frontier fermé.