Zum Artikel

Wie viel ärztliche Schreibarbeit könnte heute bereits automatisiert werden?

AI muss nicht zuerst medizinische Entscheidungen übernehmen. Schon Transkription, Strukturierung und Formulierung können einen relevanten Teil der Dokumentation abnehmen.

  • Diktieren oder Stichworte – die AI formuliert den Verlauf.
  • Sie prüfen und entscheiden. Die AI stellt keine Diagnose.
  • Die Modelle unten könnten auf einem kräftigen Praxis-PC laufen.

Ausprobieren

Drei Wege, derselbe Vergleich

Ein vorbereitetes Beispiel, eigene Stichworte oder ein kurzes Diktat. Danach sehen Sie, wie vier Modelljahre denselben Verlauf formuliert hätten.

Fiktiver internistischer Verlauf. Keine echten Patientendaten.

Tag 3 nach Aufnahme, 67j.
Gestern noch Dyspnoe bei leichter Belastung, heute in Ruhe beschwerdefrei.
RR 128/78, HF 72/min, SpO2 96 % Raumluft.
Beine weniger geschwollen, Gewicht minus 1.4 kg.
Furosemid 40 mg weiter wie bisher.
Mobilisation auf Station.
Entlassung morgen geplant, wenn Gewicht stabil.

Quervergleich

Dieselbe Aufgabe, vier Jahre

Identische Stichworte, identischer Auftrag. Die Jahreszahl ist die Aussage – das Modell steht dahinter. Details zum Rechner nur, wenn Sie sie brauchen.

2024

Herbst 2024

Mistral Small 22B

Veröffentlicht am 17. September 2024

Noch nicht geladen.

Rechner und Details

Ein kräftiger Gaming-PC reicht

Grafikkarte mit rund 16 GB eigenem Speicher – oder ein Apple-Computer mit 32 GB Arbeitsspeicher. Kein Serverraum nötig.

Frühes «kleines» Alltagsmodell. Formuliert oft schon verständlich, stolpert aber leichter über medizinische Fachbegriffe und unordentliche Stichworte.

Ein durchgängiges Sprachmodell (kein Experten-Mix).

22 Milliarden Parameter

Rund 16 GB Grafikspeicher in der üblichen komprimierten Nutzung

mistral/mistral-small

Frühjahr 2025

Frühjahr 2025

Qwen3-30B-A3B

Veröffentlicht am 28. April 2025

Noch nicht geladen.

Rechner und Details

Läuft auf demselben kräftigen PC – und fühlt sich flotter an

Es merkt sich viel, rechnet aber jeweils nur mit einem kleinen Teil. Deshalb genügt weiterhin ein Gaming-PC; die Antworten kommen spürbar zügiger.

Bessere Struktur, weniger Auslassungen bei Vitalzeichen.

Experten-Mix: 30 Milliarden Parameter insgesamt, aktiv nur rund 3 Milliarden pro Satz.

30 Milliarden Parameter (3 Milliarden aktiv)

Weiterhin ein kräftiger Gaming-PC; der Rechenaufwand pro Wort ist kleiner

alibaba/qwen-3-30b

Spätsommer 2025

Spätsommer 2025

GPT-OSS-20B

Veröffentlicht am 5. August 2025

Noch nicht geladen.

Rechner und Details

Ausdrücklich für 16 GB gebaut

OpenAI hat dieses offene Modell so zugeschnitten, dass es auf einem Gerät mit 16 GB Speicher Platz findet – typischer Gaming-PC oder Mac mit 32 GB.

Hält sich meist enger an die Stichworte; weniger «glättende» Zusatzannahmen als die Generation davor.

Offenes OpenAI-Modell, ebenfalls mit Experten-Mix (rund 3,6 Milliarden aktiv).

20 Milliarden Parameter

Ein Gerät mit 16 GB Speicher – so hat es OpenAI spezifiziert

openai/gpt-oss-20b

2026

Frühjahr 2026

Qwen 3.6 27B

Veröffentlicht am 22. April 2026

Noch nicht geladen.

Rechner und Details

Ja – aber ein starker Rechner

Am angenehmsten auf einem sehr kräftigen Gaming-PC (rund 24 GB Grafikspeicher) oder einem neueren Mac mit 32 GB oder mehr. Ein Büro-Laptop ohne starke Grafikkarte wird langsam.

Aktuell stärkstes Modell in dieser lokalen Grössenklasse. Klarere Verlaufsstruktur und zuverlässigere medizinische Terminologie.

Neuere Hybrid-Architektur; für Text reicht der Sprachteil.

27 Milliarden Parameter

Rund 24 GB Grafikspeicher oder 32 GB+ gemeinsamer Speicher am Mac

alibaba/qwen3.6-27b

BerichteGuru im Alltag nutzt ein Cloud-Modell. Hier sehen Sie, was lokal schon geht. Grafikspeicher ist der Speicher der Grafikkarte, nicht der normale Arbeitsspeicher.

Transkription: unabhängige Fehlerquoten

Word Error Rate (WER): Anteil falsch erkannter Wörter. Niedriger ist besser. Die Zahlen stammen aus unabhängigen Benchmarks, nicht aus diesem Experiment. Das Diktat oben ist der erlebte Beweis.

  • whisper-13.87 % WER

    Seit 2022/23 im API-Einsatz · Deutsch, 200 Äusserungen (koedesk, 5. Juli 2026)

    Solide Alltagsqualität. Medizinische Fachbegriffe und Medikamentennamen werden häufiger verdreht.

  • gpt-4o-transcribe2.21 % WER

    Seit März 2025 · Deutsch, 200 Äusserungen (koedesk, 5. Juli 2026)

    Niedrigere Fehlerrate und bessere Erkennung medizinischer Terminologie bei klarem Diktat.

Quelle: koedesk STT Bench. Zum Vergleich FLEURS-DE: 3.9 % (whisper-1) vs. 3.3 % (gpt-4o-transcribe), Novascribe Juli 2026.

Typisches Fehlerbild bei Fachsprache

Rekonstruiertes Beispiel typischer Erkennungsmuster, kein archiviertes Original-Audio. Dient nur der Anschauung, nicht als Benchmark.

Gesprochen (Referenz)

Crescendo-Angina, Troponin diskret erhöht, D-Dimer negativ, kein Lungenödem.

Typisch whisper-Klasse

Crescendo Angina, Troponin diskret erhöht, D-Dimmer negativ, kein Lungen ödem.

Typisch heutige Transkription

Crescendo-Angina, Troponin diskret erhöht, D-Dimer negativ, kein Lungenödem.

Was, wenn Schreibarbeit kürzer würde?

Im Artikel folgt ein persönlicher Zeitvergleich. Bis dahin eine nachvollziehbare Beispielrechnung – Werte lassen sich anpassen.

Ersparnis pro Eintrag: 4 Minuten

Pro Arzt und Jahr
147 Stunden
rund 18.3 Arbeitstage
Ganze Abteilung, Jahr
1'173 Stunden
rund 146.7 Arbeitstage

Beispielrechnung, keine Studie. Sie setzt voraus, dass der AI-Entwurf ärztlich gelesen und bei Bedarf korrigiert wird – und dass nicht jede Dokumentation gleich lang ist. Die persönlichen Messwerte aus dem Artikel können später eingesetzt werden.

Fragen oder Anregungen?

Wenn Sie die Demonstration im Artikel gelesen haben und etwas ausprobieren, ergänzen oder kritisieren möchten: schreiben Sie uns. Kein Verkaufsgespräch – eine Rückmeldung reicht.