Zum Inhalt springen
Illustration: Illustration: Ein Telefonhörer, aus dem eine grüne Tonwelle aufsteigt und sich in zwei gleiche Wellen teilt; daneben ein Videokonferenzfenster mit drei leeren Kacheln und eine Bankkarte hinter einer Schranke.
KI

Deepfake-Anrufe und CEO-Fraud: so schützt sich ein Betrieb

Von · · 6 Min. Lesezeit

Ein Anruf mit der Stimme der Chefin, ein Videocall mit dem Finanzvorstand und zwei Kollegen, eine dringende, vertrauliche Überweisung: So sieht CEO-Fraud aus, seit sich Stimmen und Gesichter mit KI nachbauen lassen. Geschützt ist ein Betrieb nicht dadurch, dass jemand die Fälschung hört, sondern dadurch, dass eine Zahlung ohne Rückruf über einen zweiten Weg gar nicht ausgelöst werden kann.

Ob die Stimme echt klingt, ist die falsche Prüffrage. Die richtige lautet: Ist diese Anweisung über einen Weg bestätigt, den der Anrufer nicht kontrolliert?

Hier geht es um Anruf und Video. Die klassische Variante per Mail, mit gefälschtem Absender und der technischen Abwehr dagegen, beschreibt CEO-Fraud: Chef-Betrug per Mail erkennen und abwehren.

Wie ein Angriff abläuft#

Der bekannteste Fall stammt aus Hongkong. Ein Mitarbeiter der Finanzabteilung des Ingenieurkonzerns Arup nahm im Januar 2024 an einer Videokonferenz mit dem vermeintlichen Finanzvorstand und weiteren Kollegen teil und überwies danach in 15 Buchungen rund 200 Millionen Hongkong-Dollar, etwa 25 Millionen US-Dollar. Außer ihm war niemand in der Konferenz echt. Die Polizei Hongkong erklärte, die Täter hätten öffentlich verfügbare Video- und Tonaufnahmen der Führungskräfte von YouTube verwendet, um deren Stimmen nachzubilden; die Videos seien vorab aufgezeichnet gewesen und hätten keine echte Unterhaltung mit dem Opfer enthalten (Hong Kong Free Press, 5. Februar 2024). Arup bestätigte im Mai 2024 gegenüber CNN, dass „fake voices and images“ verwendet wurden (CNN).

Der Ablauf im Kleinbetrieb ist derselbe, nur mit kleineren Beträgen. Die Watchlist Internet beschreibt ihn so: Zuerst kommt eine Mail der vermeintlichen Führungskraft, dann ein Video- oder Telefonanruf, in dem die Person „mit Nachdruck von einer strategisch wichtigen Übernahme“ spricht, konkrete Beträge nennt und eine rasche Überweisung anweist (Watchlist Internet). Dazu kommen fast immer zwei Zutaten: Zeitdruck („heute noch, sonst platzt der Deal“) und Vertraulichkeit („sprich mit niemandem darüber, auch nicht mit der Buchhaltung“). Beides dient demselben Zweck: Der Mitarbeiter soll niemanden fragen.

Das BSI beschreibt das Szenario für Unternehmen ausdrücklich: Ein Angreifer könne eine Person „mit der Stimme von deren Führungskraft anrufen, um eine Geldtransaktion auszulösen“ (BSI, Deepfakes – Gefahren und Gegenmaßnahmen). Das FBI warnt seit Mai 2025 vor Kampagnen, in denen KI-erzeugte Sprachnachrichten hochrangige Amtsträger imitieren, um Vertrauen aufzubauen und an Zugänge zu kommen (FBI IC3, I-051525-PSA).

Warum man es am Klang nicht zuverlässig erkennt#

Die üblichen Hinweise stimmen: metallischer Klang, monotone Betonung, falsch ausgesprochene Namen, Verzögerungen, im Video unsaubere Lippenbewegungen. Sie helfen nur gegen schlechte Fälschungen. Das BSI nennt für hohe Qualität zwar noch „mehrere Stunden Audiomaterial“ der Zielperson, verweist aber auf Verfahren, die mit „wenigen Sekunden“ auskommen. Von einer Geschäftsführerin, die einmal einen Vortrag auf YouTube gehalten oder ein Firmenvideo eingesprochen hat, gibt es genug.

Auch Software ist keine Lösung für den Moment des Anrufs. Das BSI bezeichnet als zentrales Problem der meisten Erkennungsverfahren ihre „mangelhafte Generalisierbarkeit“: Sie erkennen die Fälschungsmethoden, mit denen sie trainiert wurden, und versagen bei neuen. Das beste Modell der Deepfake Detection Challenge 2020 lag laut BSI bei 65,18 % Trefferquote.

Dazu kommt die Situation selbst. Wer mitten in einem Videocall mit drei bekannten Gesichtern sitzt und um eine dringende Freigabe gebeten wird, achtet nicht auf Lippensynchronität. Im Fall Arup war die Konferenz vorab aufgezeichnet, eine echte Rückfrage hätte sie gesprengt. Gestellt wurde sie offenbar nicht.

Illustration: Illustration: Eine Zahlungskarte auf einem Sockel mit zwei getrennten Schlüsselschlitzen; nur einer bekommt einen Schlüssel, der zweite leuchtet grün und bleibt leer; dahinter ein Telefonhörer mit Tonwelle.

Was zu tun ist: vier Regeln, die ohne Technik wirken#

Die Gegenmittel sind organisatorisch, und sie wirken unabhängig davon, wie gut die Fälschung ist. Aufgeschrieben und von der Geschäftsführung unterschrieben sind sie in einer Stunde.

  1. Rückruf über eine bekannte Nummer. Jede Zahlungsanweisung, die per Anruf, Videocall, Sprachnachricht oder Messenger kommt, wird über eine Nummer bestätigt, die schon vorher bekannt war: aus dem Firmenverzeichnis, nicht aus der Mail, nicht aus der Signatur, nicht aus dem Rückruf-Button. Das FBI empfiehlt genau das: die Person über eine zuvor bestätigte Nummer zurückrufen.
  2. Vier-Augen-Freigabe ab einem Schwellenwert. Ab einem festgelegten Betrag braucht jede Überweisung an einen neuen Empfänger die Freigabe einer zweiten Person. Die meisten Online-Banking-Zugänge für Unternehmen bieten dafür eine Zeichnungsregel an; die Hausbank richtet sie ein. Eine Regel im Bankkonto hält auch dann, wenn jemand unter Druck die Prozessbeschreibung vergisst.
  3. Codewort für Zahlungsfreigaben. Ein vereinbartes Wort oder eine Kontrollfrage, die nur Geschäftsführung und Buchhaltung kennen, persönlich vereinbart und nie per Mail verschickt. Das FBI rät Familien dasselbe; im Betrieb funktioniert es genauso. Wer das Codewort nicht kennt, ist nicht die Chefin, egal wie sie klingt.
  4. Zeitdruck und Geheimhaltung sind Gründe zum Bremsen. Die Regel muss ausdrücklich lauten: Wer bei einer dringenden, vertraulichen Zahlungsanweisung erst zurückruft, hat richtig gehandelt, auch wenn die Anweisung echt war. Ohne diesen Satz von oben ruft niemand die Geschäftsführung zurück, die gerade „aus der Verhandlung“ anruft.

Für Änderungen von Bankverbindungen bei Lieferanten gilt dasselbe: Eine neue IBAN wird nie auf Zuruf oder per Mail übernommen, sondern erst nach Rückruf beim Lieferanten über die bekannte Nummer.

Die Mail davor: wo Technik doch hilft#

Fast jeder Deepfake-Anruf hat eine Vorgeschichte in Textform: eine Mail, die den Termin ankündigt, oder eine Nachricht, die den Anruf vorbereitet. An dieser Stelle hilft Technik. Kommt die Mail scheinbar von der eigenen Domain, verhindert eine durchgesetzte DMARC-Regel, dass sie überhaupt zugestellt wird. Wie das Fälschen eines Absenders funktioniert, steht in E-Mail-Spoofing; wie DKIM und DMARC zusammenspielen, in DKIM und DMARC. Ob deine Domain fälschbar ist, zeigt der kostenlose E-Mail-Check in wenigen Sekunden.

Die Grenze: DMARC schützt den eigenen Domainnamen. Gegen eine ähnlich geschriebene Fremddomain oder eine Nachricht über einen privaten Messenger hilft es nicht. Deshalb ersetzt die Technik den Rückruf nicht, sie nimmt den Angreifern nur den bequemsten Einstieg.

Wenn schon überwiesen wurde#

Jede Stunde zählt, weil das Geld weiterverschoben wird.

  1. Sofort die eigene Bank anrufen, nicht mailen. Die Bank kann versuchen, die Überweisung zurückzurufen oder beim Empfängerinstitut einfrieren zu lassen. Die Watchlist Internet nennt die Bank als ersten Schritt.
  2. Beweise sichern: Anrufliste mit Uhrzeiten, Einladung und Link zur Videokonferenz, Mails samt Kopfzeilen, Chatverläufe, Kontoauszug. Nichts löschen, auch nicht aus Scham.
  3. Anzeige erstatten. In Österreich bei jeder Polizeidienststelle. Die Meldestelle Internetkriminalität des Bundeskriminalamts unter against-cybercrime@bmi.gv.at berät, nimmt aber laut eigener Angabe derzeit keine Anzeigen entgegen (Bundeskriminalamt). In Deutschland ist die Polizei zuständig, viele Länder haben Zentrale Ansprechstellen Cybercrime für Unternehmen.
  4. Intern informieren, damit derselbe Angreifer nicht am nächsten Tag die Kollegin in der Lohnverrechnung anruft. Waren Zugangsdaten im Spiel, etwa weil im Gespräch ein Bestätigungscode abgefragt wurde, diese sofort ändern.

Was nicht hilft#

Eine Erkennungssoftware als einzige Schutzschicht. Sie arbeitet mit Wahrscheinlichkeiten und hinkt neuen Verfahren hinterher. Für Aufnahmen im Nachhinein kann sie nützlich sein, für die Entscheidung im Gespräch nicht.

„Unsere Chefin ist nicht im Internet.“ Ein Interview im Lokalradio, ein Podcast, eine Sprachnachricht an den falschen Empfänger: Das Material ist meist da. Und gegen einen Anruf, der nur sagt „Ich bin in einer Besprechung, die Mail kommt gleich“, braucht es gar keine perfekte Stimme.

Eine einmalige Schulung. Wer im Ernstfall zurückrufen soll, muss das vorher geübt haben, am besten mit einem angekündigten Testanruf im Jahr. Ein Foliensatz von vor zwei Jahren wirkt nicht unter Druck.

Das Codewort per Mail verteilen. Eine Kontrollfrage, die im Postfach liegt, kennt jeder, der das Postfach übernommen hat.

Der ehrliche Schluss#

Gegen gute Fälschungen gewinnt kein Ohr und keine Software zuverlässig. Gewinnen kann ein Ablauf, bei dem die Echtheit der Stimme egal ist, weil keine Zahlung an einem einzigen Kanal hängt. Das kostet die Geschäftsführung einmal etwas Bequemlichkeit und der Buchhaltung einen Rückruf mehr. Wie dieselbe Täuschung sonst in Postfächer kommt, steht in E-Mail-Spoofing; wie KI-Werkzeuge im Betrieb selbst zum Risiko werden, in Schatten-KI.

Stand 04.10.2026. Quellen am selben Tag abgerufen; die CNN-Seite beantwortet automatisierte Abrufe mit 451 und wurde über die Suche bestätigt.

Weiterlesen