Zum Inhalt springen

Blog

85,5 Multi-Agent-Diagnostik gegen Arzt

24. Juni 2026 · Stanford AI Index 2026, Teil 17

85,5 Multi-Agent-Diagnostik gegen Arzt

Sechster Deep-Dive: Medizin. Das Kapitel mit dem klarsten Bild dafür, wie weit Können und Praxis-Reife auseinanderlaufen können.

Was AI in einzelnen Tests schafft, ist beeindruckend. Ein Verbund mehrerer AI-Modelle hat in einem ernst gemeinten Vergleich 86 Prozent komplexer publizierter Krankheitsfälle korrekt eingeordnet. Ärztinnen und Ärzte ohne Hilfsmittel kamen auf 20 Prozent. In Krankenhäusern hat sich auch die Schreibarbeit verändert: AI-Systeme, die Arztgespräche automatisch dokumentieren, reduzieren die Tippzeit für Notizen um bis zu 83 Prozent. Ein Klinikum berichtet von einem Wertbeitrag von 112 Prozent.

Was die Studienlage zeigt, ist aber ernüchternd. Die US-Zulassungsbehörde hat 2025 258 AI-Medizingeräte freigegeben. Nur 2,4 Prozent davon haben eine richtige Studie hinterlegt, also einen Vergleich von Patientengruppen mit und ohne den Einsatz. Der Rest lief über Genehmigungswege, die sich auf bestehende ältere Geräte stützen. Bei einer Auswertung von über 500 klinischen Studien arbeitete fast die Hälfte mit Prüfungsfragen statt echten Patientendaten, nur 5 Prozent mit echten Klinikdaten.

Daneben ist eine stille Verschiebung passiert. Bei 84 bis 92 Prozent der gesundheitsbezogenen Google-Suchen erscheint heute ein AI-Hinweis ganz oben. Bei Symptom-Fragen sogar 92 Prozent. Patientinnen und Patienten begegnen einer AI-Antwort, bevor sie mit einer Ärztin gesprochen haben, oft mit deutlich weniger Aufsicht als bei zugelassenen Klinik-Tools.

Nächster Deep-Dive: Bildung.

Zuerst erschienen auf LinkedIn.

Zurück: 2,4% FDA-zugelassene AI-Geräte mit RCT-Evidenz Alle Teile der Serie Weiter: -11 / +82 CS-Studium fällt, AI-Master steigt

Darüber sprechen?

Wenn Sie zu diesem Thema Fragen haben oder Unterstützung suchen, vereinbaren Sie einen Termin.