LES VIDÉOS
Vidéos··1 min de lecture

Le comportement IA que personne n'avait prédit (actus IA)

Cette semaine dans la Revue IA : un deep dive sur Ring-Zero, le papier qui montre comment le zero reinforcement learning peut faire émerger des comportements de raisonnement à l’échelle du trillion de paramètres.

Cette semaine dans la Revue IA : un deep dive sur Ring-Zero, le papier qui montre comment le zero reinforcement learning peut faire émerger des comportements de raisonnement à l’échelle du trillion de paramètres.

On parle de DeepSeek-R1-Zero, de la “bitter lesson” de Rich Sutton, de l’anxiété de contexte, de raisonnement parallèle, de self-verification, et de ce que ça dit vraiment sur l’intelligence artificielle moderne.

Au programme aussi : Kimi K3 et Qwen 3.8 Max, deux modèles chinois open weights qui rattrapent le frontier ; Inkling, le premier gros modèle open weights américain de Thinking Machines ; PrismML Bonsai 27B, un modèle compressé pour tourner sur iPhone ; et trois innovations express côté vidéo IA, avatars temps réel et computer vision.

Au programme

Regarder la vidéo sur YouTube · S’abonner à la chaîne

Vidéo publiée le 27/07/2026. Les informations et les outils présentés correspondent à cette date. La description complète et les ressources sont disponibles sur YouTube.