DR. INFOvsChatGPTAktualisiert 5. August 2026

ChatGPT in der Klinik: Stärken, Grenzen und eine quellengestützte Alternative

ChatGPT ist ein Allzweckmodell, und viele Ärztinnen und Ärzte nutzen es bereits zum Entwerfen, Zusammenfassen und Erklären. Die Frage ist nicht, ob es nützlich ist, sondern wo man sich auf seine Ausgabe verlassen kann. Ein Allzweckmodell schreibt aus den eigenen Parametern statt aus einer abgerufenen, zitierbaren Quelle, zeigt also nicht von sich aus die Leitlinie oder Arbeit, auf der eine Antwort beruht, es ist kein reguliertes Medizinprodukt, und seine Verbraucherversion wird außerhalb der EU gehostet. Genau das entscheidet, ob eine Antwort geprüft, zugelassen und am Behandlungsort genutzt werden kann. Worauf bei jedem Werkzeug für eine klinische Frage zu achten ist: ob die Antwort aus abgerufenen Quellen mit Zitaten aufgebaut wird, die man öffnen kann; ob die vor Ort geltenden Leitlinien abgedeckt sind; der Regulierungsstatus und der Ort der Datenhaltung; und wie es sich bei den akuitätssensiblen Aufgaben verhält, bei denen eine Unterschätzung unsicher ist. In einem strukturierten Triage-Benchmark stufte die getestete Allzweck-Konfiguration (GPT-5.1, das nächste Äquivalent zu ChatGPT) die dringlichsten Fälle deutlich häufiger zu niedrig ein als ein quellengestütztes System [1]. Das ist eine Konfiguration in einem Benchmark, kein Urteil über Allzweckmodelle als Klasse, und der Triage-Fehler variiert stark zwischen Modellen [2]. Das ist nicht das einzige Signal: Eine unabhängige Studie in Nature Medicine fand, dass ChatGPT bei der direkten Selbsttriage von Notfällen durch Patienten 51,6% der Fälle untertriagierte [3]. DR. INFO ist eine quellengestützte Option: Es schreibt eine zitierte Antwort aus Leitlinien und Literatur, ist ein CE-gekennzeichnetes Medizinprodukt nach EU-MDR 2017/745 und wird in der EU gehostet, mit einem kostenlosen Zugang für Ärztinnen und Ärzte [4]. Die ehrliche Zusammenfassung: Ein Allzweckmodell ist eine gute Hilfe zum Entwerfen und Lernen, und ein quellengestütztes, zitierendes Werkzeug ist die sicherere Wahl, wenn die Antwort an einer Quelle überprüfbar sein muss.

DR. INFO und ChatGPT im direkten Vergleich

Kategorie

DR. INFO Klinische Evidenz-Antwortmaschine mit Zitaten

ChatGPT Allzweck-Assistent

Am besten geeignet für

DR. INFO Eine bestimmte klinische Frage mit einer öffenbaren Quelle beantworten

ChatGPT Entwerfen, Zusammenfassen, Erklären, Lernen

Grundlage der Antwort

DR. INFO Abgerufene Leitlinien, Literatur und regulatorische Quellen, Inline-Zitate mit Links

ChatGPT Eigene Modellparameter; Browsing oder Zitate je nach Version unterschiedlich

Leitlinienabdeckung

DR. INFO Leitliniensuche über Fachgebiete hinweg, inkl. AWMF und DGVS

ChatGPT Kein dediziertes Leitlinien-Retrieval; abhängig von Trainingsdaten und Browsing

Regulierungsstatus

DR. INFO CE-gekennzeichnetes Medizinprodukt nach EU-MDR 2017/745

ChatGPT Kein Medizinprodukt; nicht für klinische Entscheidungen vorgesehen

Datenhaltung

DR. INFO In der EU gehostet, DSGVO-konform

ChatGPT Verbraucherversion außerhalb der EU gehostet

Verhalten bei dringlicher Triage

DR. INFO Stufte keinen der dringlichsten Fälle im Benchmark zu niedrig ein

ChatGPT Stufte die Mehrheit der dringlichsten Fälle im selben Benchmark zu niedrig ein [mtsbench]

Sprachen

DR. INFO Antworten in jeder Sprache; Oberfläche EN, DE, PT, NL

ChatGPT Antworten in vielen Sprachen

Kosten

DR. INFO Kostenloser Zugang für Ärzte und Studierende

ChatGPT Kostenlose Stufe; kostenpflichtige Stufen für mehr Leistung

Häufige Fragen

Ist ChatGPT sicher für die klinische Nutzung?
Das hängt von der Aufgabe ab. Zum Entwerfen, Zusammenfassen und Erklären ist ein Allzweckmodell wie ChatGPT nützlich. Bei einer klinischen Frage, deren Antwort überprüfbar sein muss, zählen seine Grenzen: Es ist kein reguliertes Medizinprodukt, es nennt nicht von sich aus die Leitlinie oder Arbeit hinter einer Antwort, und in einem strukturierten Triage-Benchmark stufte die getestete GPT-5.1-Konfiguration die meisten der dringlichsten Fälle zu niedrig ein [1]. Dieses Ergebnis ist spezifisch für die getestete Konfiguration, nicht für Allzweckmodelle als Klasse, da der Triage-Fehler stark zwischen Modellen variiert [2]. Für Aufgaben, bei denen die Antwort an einer Quelle geprüft werden muss, ist ein quellengestütztes, zitierendes Werkzeug die zuverlässigere Kategorie.
Dürfen Ärztinnen und Ärzte ChatGPT nutzen?
Viele tun es, zum Entwerfen und Lernen. Was ChatGPT nicht ist, ist ein für klinische Entscheidungen vorgesehenes Medizinprodukt; eine am Behandlungsort genutzte Antwort sollte daher an einer Primärquelle geprüft werden. Werkzeuge wie DR. INFO sind dafür gebaut: Die Antwort kommt mit öffenbaren Zitaten, und das Werkzeug ist CE-gekennzeichnet nach EU-MDR 2017/745 [4].
Nennt ChatGPT seine Quellen?
Nicht zuverlässig von sich aus. Je nach Version kann es browsen und verlinken, aber ein Allzweckmodell schreibt primär aus den eigenen Parametern, sodass die Quelle hinter einer Aussage nicht garantiert ist. Eine klinische Antwortmaschine wie DR. INFO baut die Antwort aus abgerufenen Dokumenten und zeigt das Zitat inline, sodass man es öffnen und prüfen kann.
Sind Patientendaten in ChatGPT sicher?
Die Verbraucherversion wird außerhalb der EU gehostet, was für die DSGVO und die Governance klinischer Daten relevant ist. Geben Sie keine identifizierbaren Patientendaten in ein allgemeines Verbraucherwerkzeug ein. DR. INFO wird in der EU DSGVO-konform gehostet und ist ein CE-gekennzeichnetes Medizinprodukt [4].
Was ist der Unterschied zwischen ChatGPT und einer klinischen KI?
ChatGPT ist ein allgemeiner Assistent; eine klinische KI wie DR. INFO ist darauf gebaut, eine klinische Frage aus abgerufenen, zitierbaren Quellen zu beantworten und die geltenden Leitlinien abzudecken. In der Praxis nutzen viele ein Allzweckmodell zum Entwerfen und ein quellengestütztes Werkzeug für eine Antwort, die sie an der Quelle prüfen können.

ChatGPT ist eine starke Hilfe zum Entwerfen und Lernen. Wenn die Antwort an einer Quelle überprüfbar, von einer Leitlinie gedeckt und nach EU-Datenregeln behandelt sein muss, ist ein quellengestütztes, CE-gekennzeichnetes Werkzeug wie DR. INFO die sicherere Wahl. Der Triage-Benchmark hinter diesem Vergleich ist als Preprint auf medRxiv verfügbar [1], sodass Methode und Ergebnisse je Priorität direkt geprüft werden können.

Referenzen

  1. 1.Ravichandran S, Romano M, Corga da Silva R, Mendes T, Absi N, Isidoro M, Kumar S, van der Heijden M, Gnanapragasam VE. MTS-Bench: A Manchester Triage System Benchmark for Language Model Triage Safety. medRxiv 2026.08.04.26359651; doi: 10.64898/2026.08.04.26359651.
  2. 2.Linzmayer R, Ramaswamy A, Hugo H, Nadkarni G, Elhadad N. Aggregate benchmark scores obscure patient safety implications of errors across frontier language models. medRxiv 2026.03.18.26348695; doi: 10.64898/2026.03.18.26348695. Preprint. Not yet peer reviewed.
  3. 3.Ramaswamy A, Tyagi A, Hugo H, et al., Nadkarni GN. ChatGPT Health performance in a structured test of triage recommendations. Nature Medicine. 2026. doi: 10.1038/s41591-026-04297-7.
  4. 4.Regulation (EU) 2017/745 of the European Parliament and of the Council on medical devices (EU MDR). 2017.