Le comportement IA que personne n'avait prédit (actus IA)
Cette semaine dans la Revue IA : un deep dive sur Ring-Zero, le papier qui montre comment le zero reinforcement learning peut faire émerger des comportements de raisonnement à l’échelle du trillion de paramètres.
Cette semaine dans la Revue IA : un deep dive sur Ring-Zero, le papier qui montre comment le zero reinforcement learning peut faire émerger des comportements de raisonnement à l’échelle du trillion de paramètres.
On parle de DeepSeek-R1-Zero, de la “bitter lesson” de Rich Sutton, de l’anxiété de contexte, de raisonnement parallèle, de self-verification, et de ce que ça dit vraiment sur l’intelligence artificielle moderne.
Au programme aussi : Kimi K3 et Qwen 3.8 Max, deux modèles chinois open weights qui rattrapent le frontier ; Inkling, le premier gros modèle open weights américain de Thinking Machines ; PrismML Bonsai 27B, un modèle compressé pour tourner sur iPhone ; et trois innovations express côté vidéo IA, avatars temps réel et computer vision.
Au programme
- 00:00 — Ring-Zero, l’IA qui apprend à réfléchir seule
- 02:49 — DeepSeek-R1-Zero et le zero RL
- 04:18 — Le passage à 1 000 milliards de paramètres
- 05:07 — Les comportements émergents du modèle
- 06:18 — L’anxiété de contexte
- 08:39 — La Bitter Lesson : le scale bat l’ingénierie humaine
- 10:54 — Actu 1 : Kimi K3, le modèle chinois qui rattrape Claude Fable
- 11:46 — Actu 2 : Qwen 3.8 Max, Alibaba accélère
- 12:41 — Pourquoi l’open weights change la souveraineté IA
- 13:05 — Actu 3 : Inkling, le premier gros open weights américain
- 14:55 — Actu 4 : PrismML, Apple prépare l’IA locale sur iPhone
- 16:20 — Masterclass IA gratuite
- 16:37 — Actu 5 : Live Avatar, l’avatar IA temps réel
- 17:08 — Actu 6 : Wan-Dancer, 3 minutes de danse générée
Regarder la vidéo sur YouTube · S’abonner à la chaîne
Vidéo publiée le 27/07/2026. Les informations et les outils présentés correspondent à cette date. La description complète et les ressources sont disponibles sur YouTube.