Finales du concours de rédaction de dissertations à l'examen d'entrée à l'université d'IA : l'essai narratif DeepSeek V4 a remporté le championnat avec 46 points, le « propre peuple » de Hunyuan a obtenu la note maximale

GPT-5.5/Fable-5/DeepSeek V4/Hunyuan 3 Preview Co-écrit dans l'essai de l'examen d'entrée à l'université de Pékin 2026, l'essai narratif de DeepSeek V4 a remporté le championnat avec un score moyen de 46 points. Le texte de Hunyuan « son propre peuple juge son propre peuple » a obtenu un score parfait et a suscité des discussions animées.

Finales de rédaction d'essais à l'examen d'entrée à l'université AI : DeepSeek V4 a remporté le championnat d'écriture narrative et la note parfaite de Hunyuan a suscité la controverse

Lors de l'examen d'entrée à l'université de 2026, les modèles à grande échelle de niveau Mythe d'Anthropic ont été publiés simultanément. Les testeurs ont profité de l'occasion pour sélectionner deux modèles majeurs au pays et à l'étranger - GPT-5.5, Fable-5, DeepSeek V4, Hunyuan 3 Preview - pour tester la question à développement de l'examen d'entrée à l'université de Pékin « Planification et effort », qui nécessite pas moins de 700 mots pouvant être utilisés pour rédiger des essais ou des récits argumentatifs.

Chacun des quatre modèles majeurs a rédigé deux essais argumentatifs et deux essais narratifs, qui ont été notés de manière croisée par quatre « évaluateurs ». Le résultat est le suivant :

  • DeepSeek V4 Narrative : score moyen de 46 points (le plus élevé)
  • Aperçu de Hunyuan 3 : Hunyuan a attribué au récit de DeepSeek V4 un score parfait de 60 points - "Son propre peuple juge son propre peuple" a déclenché le ridicule
  • Chaque modèle convient à différents styles d'écriture : les essais argumentatifs GPT-5.5 et Fable-5 sont plus standardisés, tandis que les essais narratifs DeepSeek V4 sont plus littéraires.
Tableau 1 des résultats de l'examen d'entrée à l'université AI Tableau 2 des résultats de l'examen d'entrée à l'université AI

Le test a également révélé les caractéristiques communes de l'écriture IA : une structure soignée et une forte capacité à citer des classiques, mais il lui manque la « chaleur » d'une véritable expérience personnelle. Cela est particulièrement évident dans la scène narrative : l'IA écrit des histoires en douceur mais manque de réelle profondeur émotionnelle.

La rédaction d'essais d'examen d'entrée à l'université par l'IA est une « évaluation privée » fixe chaque année, mais sa signification essentielle réside dans la révélation des différences de capacités de chaque modèle dans l'écriture créative chinoise. L'avantage de DeepSeek V4 dans le texte narratif montre que les modèles nationaux rattrapent leurs concurrents internationaux en termes d'expression littéraire chinoise, tandis que l'épisode « partition complète » de Hunyuan a révélé le défaut fondamental du système d'auto-évaluation de l'IA : le modèle manque de référence objective pour se noter lui-même, et la construction de la normalisation de la notation de l'IA a encore un long chemin à parcourir.

Le suivi mérite attention :

  1. Objectivité de la notation des dissertations par l'IA : Comment établir un système de notation de l'écriture chinoise standardisé entre modèles ?
  2. Évolution continue de l'écriture créative chinoise : les avantages littéraires de DeepSeek V4 peuvent-ils être conservés dans les versions ultérieures ?
  3. Application standardisée dans les scénarios éducatifs : limites et normes de l'écriture de l'IA dans l'évaluation pédagogique et l'enseignement assisté
Copyright : Contenu source 36 krypton (lettre AI) . Cette plateforme a compilé et organisé ce contenu à des fins d'information et d'échange éducatif. Pour tout problème de droit d'auteur, veuillez nous contacter.

Avis

  • Chargement des avis...