[1]
A. Sturm, V. Unger, und F. Grünig, „Human versus machine: Comparing human and large-language-model assessments of students’ writing through benchmark ratings“, DIDEU, S. 42–64, Sep. 2026.