AI大学入学試験エッセイライティングコンテスト決勝戦:DeepSeek V4ナラティブエッセイが46点で優勝、Hunyuan氏の「自分自身」が満点を獲得
GPT-5.5/Fable-5/DeepSeek V4/Hunyuan 3 プレビュー 2026 年の北京大学入学試験小論文で共同執筆された DeepSeek V4 の物語エッセイは、平均スコア 46 点で優勝しました。フンユアン氏の「自国民は自国民を判断する」は満点を獲得し、熱い議論を呼んだ。
AI大学入試エッセイライティング決勝戦: DeepSeek V4が物語ライティングで優勝、Hunyuan氏の満点が物議を醸した
2026年の大学入試では、Anthropic社のMythosレベルの大型モデルが一斉に発売された。テスターは、国内外の 2 つの主要モデル (GPT-5.5、Fable-5、DeepSeek V4、Hunyuan 3 Preview) を選択して、北京大学入学試験の小論文問題「計画と努力」をテストする機会を利用しました。この問題には、議論的なエッセイや物語を書くために 700 語以上の単語が必要です。
4 つの主要なモデルはそれぞれ、2 つの論述エッセイと 2 つの物語エッセイを書き、4 人の「評価者」によって相互採点されました。結果は次のとおりです。
- DeepSeek V4 Narrative: 平均スコア 46 ポイント (最高)
- Hunyuan 3 プレビュー: Hunyuan は DeepSeek V4 のナラティブに 60 点の満点を与えました - 「自国民が自国民を判断する」という嘲笑が引き起こされました
- 各モデルは異なる執筆スタイルに適しています: GPT-5.5 および Fable-5 の論述エッセイはより標準化されているのに対し、DeepSeek V4 の物語エッセイはより文学的です。
!【AI大学入試小論文得点表1】(https://res.aistarmap.com/uploads/images/news/temp/md_6a57c1ff2e6d2/images/okao-score-table-1.jpg) !【AI大学入試小論文得点表2】(https://res.aistarmap.com/uploads/images/news/temp/md_6a57c1ff2e6d2/images/okao-score-table-2.jpg)
このテストでは、AI ライティングに共通する特徴も明らかになりました。それは、きちんとした構成と古典を引用する強力な能力ですが、実際の個人的な経験のような「温かさ」が欠けているということです。これは、物語のシーンで特に顕著です。AI はスムーズに物語を書きますが、本当の感情的な深みが欠けています。
AIによる大学入試の小論文作成は毎年一定の「私的評価」だが、その本質的な意義は、中国語創作文における各モデルの能力差を明らかにすることにある。 DeepSeek V4の物語テキストにおける優位性は、国内モデルが中国文学表現の面で国際的な競合他社に追いつきつつあることを示している一方、Hunyuan氏の「フルスコア」エピソードはAI自己評価システムの根本的な欠陥を暴露した - モデルにはそれ自体をスコアリングするための客観的な基準が欠けており、AIスコア標準化の構築にはまだ長い道のりがある。
今後の続報は注目に値します。
- AI エッセイ採点の客観性: クロスモデルの標準化された中国語筆記採点システムを確立するにはどうすればよいですか?
- 中国語のクリエイティブライティングの継続的な進化: DeepSeek V4 の文学的な利点は、後続のバージョンでも維持できますか?
- 教育シナリオにおける標準化された適用: 教育評価および指導支援における AI ライティングの境界と基準
レビュー