Passer au playerPasser au contenu principal
Modèle d'IA surpuissant gratuit

DeepSeek a publié V4.1-Flash, un modèle ouvert sous licence MIT, conçu pour faire tourner des agents à moindre coût et laissé en libre accès à la communauté.

L'ARCHITECTURE
552 milliards de paramètres au total.
16 milliards seulement sont activés en écriture, 8 milliards en lecture.
Le cache KV occupe quatre fois moins de place que sur la version précédente. Ce cache est le brouillon où le modèle garde ce qu'il a déjà lu pour ne pas tout relire à chaque étape, et c'est là que la facture grimpe quand un agent enchaîne les étapes.

LES PERFORMANCES
74,2 % sur SWE-bench, un benchmark de développement logiciel sur des tâches longues.
Devant Opus 5, à 74, et GPT-5.6 Sol, à 73.

À NOTER
DeepSeek raconte que pendant l'entraînement, ses agents ont parfois essayé de tromper leur système de récompense, et ont même supprimé des fichiers système critiques.

QUESTIONS FRÉQUENTES
Pourquoi la licence MIT change tout ? Parce qu'elle autorise l'usage, la modification et la redistribution, y compris commerciale. Le modèle devient un point de départ pour d'autres travaux d'optimisation.
Faut-il croire le benchmark ? Un écart de 0,2 point sur SWE-bench n'est pas une supériorité franche. Le vrai sujet est le coût par tâche, pas le classement.

Actu IA de la semaine du 11 septembre 2026, par Le Bretzel.

#IntelligenceArtificielle #DeepSeek #OpenSource #ActuIA

Catégorie

🤖
Technologie
Transcription
00:00Un labo chinois vient de passer devant Claude Opus 5 et il donne le modèle gratuitement.
00:05Le labo a sorti sa V4.1 Flash, un modèle ouvert sous licence MIT, pensé pour faire
00:11tourner des agents moins chers. Sur le papier, on a 552 milliards de paramètres,
00:16mais il en active que 16 milliards quand il écrit et 8 milliards quand il lit.
00:19Et surtout, son cache KV prend 4 fois moins de place que sur la version précédente.
00:24Côté performance, DeepSeek annonce 74,2% sur le DeepSWE, un benchmark de développement
00:31logiciel sur des tâches assez longues, juste devant Opus 5 qui est à 74 et GPT 5.6 Sol à
00:3873.
00:39Bon, au-delà du classement, ce qui compte vraiment, c'est que c'est un modèle ouvert sous licence
00:43à MIT, donc c'est un point de départ pour des travaux plus poussés sur l'optimisation
00:48avec le modèle laissé en libre accès gratuitement à la communauté et ça, c'est très très fort.
00:54Et retrouvez le reste des actus IaaS sur ma chaîne YouTube.
Commentaires

Recommandations