„Laura“ hat gute Arbeit geleistet. Sehr gute sogar. Trotzdem wurde sie nicht befördert. Nun sitzt sie einer Führungskraft gegenüber und möchte wissen, warum. Sie klingt freundlich, aber enttäuscht. Ausweichende Antworten lässt sie nicht gelten.
Laura ist keine Angestellte, sondern ein KI-Avatar. Mit ihr sollen Menschen Situationen üben, die im echten Berufsleben schnell unangenehm werden: Kritik äußern, Erwartungen korrigieren, Einwände aushalten, schlechte Nachrichten überbringen. Wer sich verheddert, verletzt immerhin keinen Kollegen. Noch nicht.
Vom Schulungsvideo zum digitalen Gegenüber
Am 22. Juli 2026 stellte das britische KI-Unternehmen Synthesia seine „Roleplay Sessions“ vor. Darin führen Beschäftigte gesprochene Gespräche mit virtuellen Figuren, die zuhören, antworten und Widerspruch leisten. Anschließend bewertet ein KI-Coach, wie gut sie das Gespräch bewältigt haben. Vorerst richtet sich das Angebot an die Bereiche Verkauf, Kundenservice und Führungskräftetraining. So wird der Avatar, der früher vor allem vorbereitete Texte vorlas, vom Vorleser zum Gegenüber – und das Schulungsvideo zur Prüfungssituation. Recherchequelle: Synthesia
Der Ablauf erinnert zunächst an ein klassisches Training. Ein kurzes Video führt in das Thema ein und zeigt, wie eine gelungene Gesprächsführung aussehen könnte. Dann beginnt das Rollenspiel. Der Avatar schlüpft beispielsweise in die Rolle eines skeptischen Kunden, eines enttäuschten Mitarbeiters oder einer Kollegin, die kritisches Feedback erhalten soll. Zum Schluss gibt es Punktzahlen, eine Gesprächsanalyse und Hinweise für den nächsten Versuch. Lernen, üben, korrigieren – nur dass der Sparringspartner diesmal aus Pixeln, Stimme und Sprachmodell besteht. Recherchequelle: Synthesia Help Center
Bewertet wird laut Produktdokumentation nicht nur, was jemand sagt, sondern auch, wie: Erfasst werden das Verhältnis von Rede- und Zuhöranteilen, typische Satzlängen, häufige Füll- und Abschwächungswörter, wiederholte Satzanfänge sowie die Zahl der Selbstkorrekturen. Einzelne Fähigkeiten werden den Kategorien „unter den Erwartungen“, „entspricht den Erwartungen“ oder „übertrifft die Erwartungen“ zugeordnet und zusätzlich mit einem Prozentwert versehen. So wird selbst ein flüchtiges „ähm“ zum Datenpunkt über die eigene Kommunikationsweise. Recherchequelle: Synthesia Help Center
Ein Proberaum ohne ungeduldige Kollegen
Für Lernende liegt darin ein nachvollziehbarer Reiz. Schwierige Gespräche lassen sich beliebig oft wiederholen, ohne dass ein Trainer dafür Zeit einplanen oder ein Kollege den wütenden Kunden spielen muss. Misslingt der Einstieg zum fünften Mal, verdreht niemand die Augen. Auch eine ungeschickte Formulierung nimmt keiner persönlich. Der digitale Übungsraum kennt keinen Feierabend, und der Avatar verliert selbst nach mehreren Anläufen nicht die Geduld.
Die Bedeutung praktischer Übung für den Lernerfolg ist keine Erfindung der KI-Branche. Eine umfangreiche Metaanalyse zum Führungskräftetraining kam zu dem Ergebnis, dass Programme besonders wirksam waren, wenn sie Information, Demonstration und praktische Anwendung miteinander verbanden. Reines Zuhören oder das bloße Durcharbeiten von Unterlagen reicht oft nicht aus, um Verhalten tatsächlich zu verändern. Doch gerade die praktische Phase lässt sich in Unternehmen nur schwer organisieren. Dafür braucht es Zeit, geschulte Beobachter und Situationen, die wenigstens halbwegs dem wirklichen Arbeitsalltag ähneln. Recherchequelle: Rice University
Genau an diesem Engpass setzen KI-Rollenspiele an. Theoretisch kann ein System Tausende Beschäftigte durch ähnliche Szenarien führen und ihre Leistung anschließend nach denselben Kriterien beurteilen. Unternehmen legen Persona, Stimmung, Schwierigkeitsgrad und Bewertungsraster fest. Für Übungen werden Gesprächslängen von fünf bis sieben Minuten empfohlen, für Prüfungen acht bis zwölf Minuten. Auch eine Bestehensgrenze ist möglich; Wiederholungen können erlaubt oder gesperrt werden. Damit verlässt die Anwendung allmählich den unverbindlichen Proberaum und nähert sich einer formalen Beurteilung. Recherchequelle: Synthesia Help Center
Wenn Kommunikation zur Punktzahl wird
Sobald Punktzahlen ins Spiel kommen, kippt die Atmosphäre. Eine Zahl wirkt objektiv, auch wenn sie auf menschlichen Vorgaben und maschineller Interpretation beruht. Wer bestimmt, wie viel ein guter Gesprächseinstieg wert ist? Welche Sprechweise gilt als empathisch? Zeugt eine Pause von Unsicherheit – oder von Aufmerksamkeit? Ein Mensch kann leise sprechen und trotzdem überzeugen. Ein anderer wirkt rhetorisch makellos, hört seinem Gegenüber aber kaum zu.
Forscher befragten Führungskräfte zu KI-gestütztem Kommunikationstraining. Die Aussicht auf geschützte, anpassbare Übungssituationen stieß dabei durchaus auf Zustimmung. Zugleich nannten die Teilnehmer zentrale Spannungsfelder: Feedback müsse transparent und auf den Kontext abgestimmt sein, dürfe unterschiedliche Kommunikationsstile nicht vorschnell abwerten und solle sinnvoll mit menschlichem Coaching verbunden werden. Was in einem Verkaufsgespräch als zielstrebig gilt, kann in einem Konfliktgespräch kalt wirken. Für gelungene Kommunikation gibt es keine universelle Musterlösung. Recherchequelle: arXiv
Auch das Erscheinungsbild des Gegenübers prägt die Wahrnehmung. In einer Studie mit mehr als 250 Berufstätigen schnitten Schulungsvideos mit synthetischen und menschlichen Präsentatoren beim tatsächlichen Wissenstransfer ähnlich ab. Erkannten die Teilnehmer jedoch, dass sie einen künstlichen Sprecher sahen, bewerteten sie die wahrgenommene Wirksamkeit und den Markeneindruck etwas schlechter. Zwar ging es in der Untersuchung um Videos und nicht um interaktive Rollenspiele. Dennoch zeigt sie, dass technische Funktionsfähigkeit und menschliche Akzeptanz zweierlei sind. Ein Avatar kann korrekt reagieren und sich trotzdem merkwürdig anfühlen. Recherchequelle: ScienceDirect
Was das Training im Arbeitsalltag bewirkt
Erste Untersuchungen deuten darauf hin, dass KI-Rollenspiele mehr sein können als ein eindrucksvoller Messestandtrick. Eine im Jahr 2026 aktualisierte Feldstudie wertete Daten von fast 2.000 Vertriebsmitarbeitern aus. Nach einem KI-gestützten Rollenspieltraining stieg ihre Arbeitsleistung im Durchschnitt um etwa zwei Prozent. Besonders profitierten zuvor schwächere Verkäufer sowie Beschäftigte mit ambitionierten Zielen und leistungsfähigen Vorgesetzten. Der Effekt war also weder gewaltig noch gleichmäßig verteilt. Entscheidend blieb das Umfeld, in dem die Teilnehmer das Gelernte anwendeten. Recherchequelle: SSRN
Der geschützte Raum bekommt Zuschauer
Bei Synthesia endet das Training allerdings nicht mit dem Feedback an die Lernenden. Vorgesetzte können Punktzahlen, Fortschritte und vollständige Gesprächsprotokolle ihrer Mitarbeiter einsehen; Administratoren erhalten organisationsweite Daten. Zudem lassen sich die Ergebnisse nach Teams aufschlüsseln und exportieren. So kann aus dem geschützten Probelauf eine neue Form betrieblicher Beobachtung werden. Recherchequelle: Synthesia Help Center
TechCrunch berichtete zum Start, dass die Plattform später auch für Bewerbungsgespräche und die Auswahl von Kandidaten eingesetzt werden soll. Die zugrunde liegende Sprachtechnologie stamme von OpenAI, während Synthesia Avatare, Bewertungsraster und Leistungsanalysen beisteuere. Aus dem reinen Videowerkzeug wird damit eine Plattform, die menschliche Fähigkeiten nicht nur vermitteln, sondern auch vermessen soll. Recherchequelle: TechCrunch
Die entscheidende Grenze verläuft deshalb nicht zwischen Mensch und Avatar, sondern zwischen Übung und Urteil. Solange Laura ein geduldiges Gegenüber bleibt, mit dem eine Führungskraft ohne Angst vor Gesichtsverlust trainieren kann, bietet die Maschine einen geschützten Raum für schwierige Gespräche. Sobald ihre Punktzahl jedoch über Beförderung, Einstellung oder berufliche Eignung mitentscheidet, wird aus dem digitalen Proberaum etwas anderes.
Dann ist Laura nicht länger nur die Kollegin, die es nie gab. Dann sitzt sie plötzlich mit am Konferenztisch.
Weiterführende Informationen
Quellenhinweis: Einzelne Fakten, Einschätzungen und Prognosen dieses Beitrags stützen sich auf Veröffentlichungen der nachfolgend genannten Unternehmen und Institutionen. Die Links dienen zugleich der weiterführenden Information.
Synthesia – Rollenspiel-Sessions: KI-Coaching für Gespräche, bei denen viel auf dem Spiel steht
Die Produktseite erklärt interaktive Avatare, gesprochene Übungsdialoge, automatisches Coaching sowie Kompetenzbewertungen und Gesprächsprotokolle.
https://www.synthesia.io/de/features/rollenspiel-sessions
Der KOBcast – KI-Agenten im B2B-Vertrieb: Mittelmaß raus, Top-Jobs rauf
Studienautor Johannes Habel ordnet im deutschsprachigen Interview die Wirksamkeit virtueller Rollenspiele und KI-Trainer im Vertrieb ein.
https://podcasts.apple.com/us/podcast/ki-agenten-im-b2b-vertrieb-mittelma%C3%9F-raus-top-jobs/id1172726837?i=1000743042617
JobMojito – Alle Funktionen der KI-Avatar- und Sprachinterview-Plattform
Die Produktseite zeigt konkret, wie Avatar-Interviews, Transkripte, Bewertungsrubriken und automatisch erzeugte Punktzahlen zur Kandidatenauswahl eingesetzt werden.
https://jobmojito.com/de/interview/all-features



