Finale des AI-College-Aufnahmeprüfungs-Aufsatzschreibwettbewerbs: DeepSeek V4-Erzählaufsatz gewann die Meisterschaft mit 46 Punkten, Hunyuans „eigene Leute“ erzielten die volle Punktzahl

GPT-5.5/Fable-5/DeepSeek V4/Hunyuan 3 Vorschau Der narrative Aufsatz von DeepSeek V4, der im Aufsatz zur Aufnahmeprüfung für das Beijing College 2026 mitgeschrieben wurde, gewann die Meisterschaft mit einer durchschnittlichen Punktzahl von 46 Punkten. Hunyuans Werk „Das eigene Volk beurteilt das eigene Volk“ erzielte eine perfekte Punktzahl und löste hitzige Diskussionen aus.

Finale der AI College-Aufnahmeprüfung: DeepSeek V4 gewann die Meisterschaft im narrativen Schreiben, und Hunyuans perfektes Ergebnis sorgte für Kontroversen

Während der College-Aufnahmeprüfung 2026 wurden gleichzeitig die Großmodelle von Anthropic auf Mythos-Niveau veröffentlicht. Tester nutzten die Gelegenheit, zwei wichtige Modelle im In- und Ausland auszuwählen – GPT-5.5, Fable-5, DeepSeek V4, Hunyuan 3 Preview –, um die Aufsatzfrage „Planning and Effort“ für die Pekinger College-Aufnahmeprüfung zu testen, die nicht weniger als 700 Wörter erfordert und zum Schreiben argumentativer Aufsätze oder Erzählungen verwendet werden kann.

Jedes der vier Hauptmodelle verfasste zwei argumentative Essays und zwei narrative Essays, die von vier „Bewertern“ kreuzbewertet wurden. Das Ergebnis ist wie folgt:

  • DeepSeek V4 Narrative: Durchschnittliche Punktzahl von 46 Punkten (höchste)
  • Vorschau auf Hunyuan 3: Hunyuan gab der Erzählung von DeepSeek V4 eine perfekte Punktzahl von 60 Punkten – „Das eigene Volk beurteilt das eigene Volk“ sorgte für Spott
  • Jedes Modell beherrscht unterschiedliche Schreibstile: Die argumentativen Essays GPT-5.5 und Fable-5 sind standardisierter, während die narrativen Essays von DeepSeek V4 literarischer sind.
Ergebnistabelle 1 für den Aufsatz zur AI College-Aufnahmeprüfung Ergebnistabelle 2 für den Aufsatz zur AI College-Aufnahmeprüfung

Der Test zeigte auch die gemeinsamen Merkmale des KI-Schreibens auf: saubere Struktur und starke Fähigkeit, Klassiker zu zitieren, aber es fehlt die „Wärme“ echter persönlicher Erfahrung. Besonders deutlich wird dies in der Erzählszene – die KI schreibt Geschichten flüssig, aber es mangelt an wirklicher emotionaler Tiefe.

Das Schreiben von KI-Aufsätzen für Hochschulaufnahmeprüfungen ist jedes Jahr eine festgelegte „private Bewertung“, deren wesentliche Bedeutung jedoch darin besteht, die Unterschiede in den Fähigkeiten jedes Modells im chinesischen kreativen Schreiben aufzudecken. Der Vorteil von DeepSeek V4 bei narrativen Texten zeigt, dass inländische Modelle in Bezug auf den chinesischen literarischen Ausdruck zu internationalen Konkurrenten aufschließen, während Hunyuans „Full Score“-Episode den grundlegenden Fehler des KI-Selbstbewertungssystems aufdeckte – dem Modell fehlt eine objektive Referenz für die Bewertung selbst, und der Aufbau einer KI-Bewertungsstandardisierung hat noch einen langen Weg vor sich.

Das Follow-up verdient Aufmerksamkeit:

  1. Objektivität der KI-Aufsatzbewertung: Wie kann ein modellübergreifendes, standardisiertes Bewertungssystem für chinesische Schriften etabliert werden?
  2. Kontinuierliche Weiterentwicklung des chinesischen kreativen Schreibens: Können die literarischen Vorteile von DeepSeek V4 in nachfolgenden Versionen beibehalten werden?
  3. Standardisierte Anwendung in Bildungsszenarien: Grenzen und Standards des KI-Schreibens in der Bildungsbewertung und im unterstützten Unterricht
Urheberrecht: Inhaltquelle 36 Krypton (Buchstabe AI) . Diese Plattform hat den Inhalt für Informationszwecke und Lernaustausch zusammengestellt. Bei Urheberrechtsbedenken kontaktieren Sie uns bitte.

Bewertungen

  • Bewertungen werden geladen...