DeepSeek veröffentlicht V3.1: Einführung einer hybriden Argumentationsarchitektur, Umschalten zwischen denkenden/nicht denkenden Dualmodi mit einem Klick

Am 21. August 2025 veröffentlichte DeepSeek V3.1 unter dem MIT-Protokoll. Es verwendet eine denkende/nicht denkende Dual-Mode-Hybridarchitektur und trainiert zusätzlich über 800 Milliarden Token auf Basis von V3. Es hat sich im Vergleich zur vorherigen Generation bei SWE-Bench, Terminal-Bench und anderen Benchmarks erheblich verbessert und die Agentenfunktionen erweitert.

Am 21. August 2025 veröffentlichte DeepSeek unter der MIT-Lizenz und brachte eine hybride Inferenzarchitektur mit sich.

DeepSeek-V3.1 Hybrid-Inferenzarchitektur Dual-Mode-Versionsübersicht

Bild: Dialogoberfläche der offiziellen DeepSeek-Website. V3.1 trainiert weitere 800 Milliarden Token auf Basis von V3, übernimmt eine denkende/nicht denkende Dual-Mode-Hybridarchitektur und verbessert sich im Vergleich zur vorherigen Generation bei Benchmarks wie SWE-Bench und Terminal-Bench um mehr als 40 %. Es wurde am 22. September auf V3.1-Terminus aktualisiert.

Versionsübersicht

Projekt Inhalt
Urheberrecht: Inhaltquelle DeepSeek-Beamter . Diese Plattform hat den Inhalt für Informationszwecke und Lernaustausch zusammengestellt. Bei Urheberrechtsbedenken kontaktieren Sie uns bitte.

Bewertungen

  • Bewertungen werden geladen...