Sturm, A., Unger, V. und Grünig, F. (2026) „Human versus machine: Comparing human and large-language-model assessments of students’ writing through benchmark ratings“, Didaktik Deutsch, S. 42–64. doi: 10.21248/dideu.963.