DeepSeek veröffentlicht V3.1: Einführung einer hybriden Argumentationsarchitektur, Umschalten zwischen denkenden/nicht denkenden Dualmodi mit einem Klick
Am 21. August 2025 veröffentlichte DeepSeek V3.1 unter dem MIT-Protokoll. Es verwendet eine denkende/nicht denkende Dual-Mode-Hybridarchitektur und trainiert zusätzlich über 800 Milliarden Token auf Basis von V3. Es hat sich im Vergleich zur vorherigen Generation bei SWE-Bench, Terminal-Bench und anderen Benchmarks erheblich verbessert und die Agentenfunktionen erweitert.
Am 21. August 2025 veröffentlichte DeepSeek
Bild: Dialogoberfläche der offiziellen DeepSeek-Website. V3.1 trainiert weitere 800 Milliarden Token auf Basis von V3, übernimmt eine denkende/nicht denkende Dual-Mode-Hybridarchitektur und verbessert sich im Vergleich zur vorherigen Generation bei Benchmarks wie SWE-Bench und Terminal-Bench um mehr als 40 %. Es wurde am 22. September auf V3.1-Terminus aktualisiert.
Versionsübersicht
| Projekt | Inhalt |
|---|
Bewertungen