KI und Deutschprüfung
ChatGPT korrigiert deinen Prüfungstext zu freundlich?
Warum das passiert, wie du ChatGPT besser nutzt und wann du ein ehrlicheres Urteil brauchst.
Kurze Antwort
Wenn ChatGPT deinen Text für TestDaF, DSH, Goethe oder telc lobt, heißt das nicht, dass du bestehst. Das Modell ist darauf ausgelegt, hilfreich und freundlich zu sein, und es kennt die Kriterien deiner Prüfung nur, wenn du sie ihm gibst. Eine Prüfung belohnt keine schönen Sätze, sondern erfüllte Kriterien.
Woran du es merkst
- Du bekommst eine umgeschriebene Fassung zurück, aber keine Liste deiner Fehler.
- Das Urteil lautet „sehr gut“ oder „gelungen“, ohne eine Stufe der Prüfungsskala.
- Bei jedem neuen Versuch fällt die Rückmeldung anders aus.
- Ein fehlender Aufgabenpunkt wird nicht erwähnt, weil der Text trotzdem gut klingt.
So nutzt du ChatGPT besser
Gib die Prüfung und die Kriterien vor, verbiete das Umschreiben und verlange eine Liste der Fehlerstellen. Zum Beispiel:
Bewerte den Text wie ein TestDaF-Prüfer nach Aufgabenerfüllung, Aufbau, Wortschatz und Korrektheit. Schreibe nichts um. Nenne jede fehlerhafte Stelle mit der Regel und sag, welche Stufe der Text erreicht.
Das macht die Rückmeldung deutlich brauchbarer. Es bleibt trotzdem eine Einschätzung ohne Prüfung, ob sie die Messlatte wirklich trifft.
Der Unterschied im Überblick
| ChatGPT ohne Vorgaben | GermanExam.pro | |
|---|---|---|
| Fehler | Schreibt den Text oft um, statt Fehlerstellen zu markieren | Markiert jede Fehlerstelle in deinem Text |
| Maßstab | Allgemeine Sprachqualität, solange du keine Kriterien vorgibst | Die veröffentlichten Kriterien deiner Prüfung (TestDaF, DSH, Goethe C1, telc C1 Hochschule) |
| Urteil | Oft ermutigend und ohne klare Stufe | Eine geschätzte Stufe der echten Prüfungsskala, auch wenn sie unbequem ist |
| Nächster Schritt | Was du fragst, bekommst du | Der Coach lenkt auf die größte Baustelle in deinem Text |
Wie die Bewertung hier entsteht
Die Bewertung bei GermanExam.pro ist eine KI. Sie arbeitet nach den veröffentlichten Kriterien der Prüfung, die du auswählst, und ist so eingestellt, dass sie ehrlich urteilt wie am Prüfungstag. Margarita Votteler, seit 2009 C1-Prüferin, hat sie an echten Prüfungsbögen geeicht und kontrolliert sie laufend an Texten, deren Note bekannt ist.
Die Grenzen gehören dazu: Es ist eine Lernhilfe und kein offizielles Ergebnis. Bei sehr kurzen Texten, Texten am Thema vorbei oder ungewöhnlichen Formaten kann sie danebenliegen.
Häufige Fragen
Warum lobt ChatGPT meinen Text, obwohl er Fehler hat?
Sprachmodelle sind darauf ausgelegt, hilfreich und freundlich zu antworten. Ohne klare Vorgaben formulieren sie Rückmeldung deshalb oft ermutigend. Eine Prüfung ist dagegen streng nach Kriterien: Ein Text kann gut klingen und trotzdem Punkte verlieren, etwa weil ein Aufgabenpunkt fehlt.
Wie bringe ich ChatGPT dazu, strenger zu sein?
Gib die Prüfung und die Kriterien vor, verbiete das Umschreiben und verlange eine Liste der Fehlerstellen. Zum Beispiel: „Bewerte den Text wie ein TestDaF-Prüfer nach Aufgabenerfüllung, Aufbau, Wortschatz und Korrektheit. Schreibe nichts um, nenne jede fehlerhafte Stelle mit der Regel und sag, welche Stufe der Text erreicht.“ Das hilft, ersetzt aber keine geprüfte Eichung.
Kann ich beides nutzen?
Ja. ChatGPT ist gut für Wortschatzfragen und Formulierungsideen. Für das Urteil „reicht das für TDN 4?“ ist eine Bewertung nach den Prüfungskriterien die bessere Grundlage.
Ist die Bewertung bei GermanExam.pro fehlerfrei?
Nein. Sie ist eine KI-Bewertung und eine Lernhilfe. Sie kann danebenliegen, besonders bei sehr kurzen Texten, Texten am Thema vorbei oder ungewöhnlichen Formaten. Offizielle Noten vergeben nur die Prüfungsinstitute.
Selbst vergleichen
- Text einreichen – ohne Konto, dein erster Text ist kostenlos. Reich denselben Text auch bei ChatGPT ein und vergleiche.
- Übungsblatt aus deinen eigenen Fehlern – was aus der Bewertung wird
- KI-Transparenz – wie unsere Bewertung geeicht ist und wo ihre Grenzen liegen