Quand l'IA prend le temps de réfléchir : ce que DeepSeek-R1 et les modèles de raisonnement changent vraiment
Le 20 janvier 2025, DeepSeek a publié R1, un modèle de raisonnement en accès libre (licence MIT) qui « réfléchit » à voix haute avant de répondre et égale le modèle o1 d'OpenAI sur les maths et le code. Sa vraie nouveauté : cette capacité à raisonner n'a pas été enseignée pas à pas par des humains, elle a émergé toute seule par apprentissage par renforcement.
Lire l'actu expliquée →