DeepSeek lance la V3.1 : présentation d'une architecture de raisonnement hybride, commutation en un clic entre les modes doubles pensée/non-pensée

Le 21 août 2025, DeepSeek a publié la V3.1 sous le protocole MIT. Il adopte une architecture hybride bimode pensée/non-pensée et entraîne en outre plus de 800 milliards de jetons basés sur la V3. Il s'est grandement amélioré par rapport à la génération précédente sur SWE-bench, Terminal-bench et d'autres benchmarks, ainsi que des capacités d'agent améliorées.

Le 21 août 2025, DeepSeek a publié sous licence MIT, apportant une architecture d'inférence hybride.

Présentation de la version bimode de l'architecture d'inférence hybride DeepSeek-V3.1

Photo : interface de dialogue du site officiel de DeepSeek. La V3.1 entraîne 800 milliards de jetons supplémentaires sur la base de la V3, adopte une architecture hybride bimode réflexion/non réflexion et améliore de plus de 40 % les benchmarks tels que SWE-bench et Terminal-bench par rapport à la génération précédente. Il a été mis à jour vers la V3.1-Terminus le 22 septembre.

Aperçu des versions

Projet Contenu
Copyright : Contenu source Officiel DeepSeek . Cette plateforme a compilé et organisé ce contenu à des fins d'information et d'échange éducatif. Pour tout problème de droit d'auteur, veuillez nous contacter.

Avis

  • Chargement des avis...