Vollständige Anleitung zum Erstellen von Deepfakes: Techniken, Tools und Risiken

Letzte Aktualisierung: Juli 28 2025
  • Bei der Erstellung von Deepfakes werden künstliche Intelligenz, neuronale Netzwerke und große Datenmengen kombiniert.
  • Techniken wie Diffusionsnetzwerke, GANs, Face-Swapping und Lippensynchronisation ermöglichen realistische Ergebnisse.
  • Der verantwortungsvolle Einsatz und die Erkennung von Deepfakes sind der Schlüssel zur Eindämmung von Fehlinformationen und Betrug.

Deepfake

Deepfakes zählen zu den überraschendsten und zugleich kontroversesten technologischen Entwicklungen der letzten Jahre. Immer häufiger stößt man auf Videos oder Bilder, die Persönlichkeiten des öffentlichen Lebens und anonyme Personen zeigen, die Aussagen machen oder Handlungen ausführen, die so nie stattgefunden haben. Der Schlüssel zu diesem Phänomen liegt im Einsatz künstlicher Intelligenz, mit der visuelle und akustische Inhalte manipuliert und generiert werden, die von der Realität kaum zu unterscheiden sind. Falls Sie sich jemals gefragt haben, wie Deepfakes entstehen oder welche Technologien dahinterstecken, finden Sie hier einen umfassenden Leitfaden, der alle Geheimnisse lüftet: von den verwendeten Techniken über die Risiken bis hin zum verantwortungsvollen Einsatz.

Die Popularität von Deepfakes kommt nicht von ungefähr: Jeder mit einem guten Computer und ein wenig Neugier kann mittlerweile auf kostenlose oder kostenpflichtige Tools zugreifen und experimentieren. Die tiefgreifenden sozialen, ethischen und technischen Auswirkungen von Deepfakes erfordern jedoch mehr als bloße Neugier: Angesichts des Aufstiegs der künstlichen Intelligenz ist es entscheidend zu verstehen, wie sie funktionieren, welche Risiken sie bergen und wie sie positiv eingesetzt werden können.

Was ist ein Deepfake und warum sind sie so realistisch?

Im Wesentlichen handelt es sich bei einem Deepfake um manipulierte audiovisuelle Inhalte – hauptsächlich Videos, aber auch Bilder und Audiodateien –, die mithilfe von Deep-Learning-Algorithmen generiert werden . Diese Algorithmen , insbesondere neuronale Netze , sind in der Lage, Gesichtsausdrücke, Bewegungen, Tonfall und sogar Körpergesten anhand großer Datensätze zu analysieren und nachzubilden. So ist es möglich, nicht nur das Gesicht einer Person in einem Video zu verändern, sondern ihr auch Worte in den Mund zu legen oder ihre Stimme mit bemerkenswertem Realismus zu imitieren.

Das Beeindruckendste an aktuellen Deepfakes ist ihr Realismus . Frühe Versionen waren unbeholfen und wenig überzeugend, doch Fortschritte im Bereich der KI haben es zunehmend schwieriger gemacht, ein echtes Video von einem manipulierten zu unterscheiden. All dies hat zu intensiven Debatten über ihren Einsatz und ihre potenziellen sozialen und rechtlichen Folgen geführt.

Die fortschrittlichsten Technologien zum Erstellen von Deepfakes

Das Erstellen eines überzeugenden Deepfakes kann heute auf verschiedene Weise erreicht werden. Zu den fortschrittlichsten und beliebtesten Techniken gehören:

  • Rundfunknetze: KI-Modelle, die Bilder und Videos generieren, indem sie digitales „Rauschen“ hinzufügen und entfernen und so aus den Originaldaten völlig neue Gesichter erstellen.
  • Generative Adversarial Networks (GANs): Zwei gegensätzliche neuronale Netzwerke generieren und validieren gefälschte Inhalte, bis sie ein Ergebnis erzielen, das vom Original kaum noch zu unterscheiden ist.
  • Gesichtsaustausch: Der bekannte Gesichtstausch, bei dem das Gesicht einer Person in einem Video oder Bild sehr detailliert auf das Gesicht einer anderen Person gelegt wird.
  • Lippensynchronisation: Eine Technik, die Mund- und Stimmbewegungen an eine gewählte Sprache anpasst. In Kombination mit einer synthetischen Stimme ist sie noch effektiver.
  Wie man künstliche Intelligenz nutzt, ohne ein Konto zu erstellen

Rundfunknetze: Aus Rauschen Bilder erzeugen

Diffusionsnetzwerke stellen die letzte Herausforderung im Bereich der Deepfakes dar. Sie funktionieren, indem sie Originalbilder durch Hinzufügen von zufälligem Rauschen „verfälschen“, bis diese unkenntlich werden. Das Modell lernt dann, dieses Rauschen umzukehren und das Bild mit festgelegten Modifikationen (z. B. dem Gesicht oder dem Gesichtsausdruck einer anderen Person) zu rekonstruieren. Dies führt zu erstaunlich realistischen Ergebnissen, die direkt von einer verzerrten Version abgeleitet werden können, wodurch die ursprüngliche Manipulation extrem schwer zu erkennen ist.

Laut aktuellen Forschungsergebnissen übertreffen sogenannte Konsistenzmodelle bereits die herkömmlichen Rundfunknetze, indem sie Rauschen direkter und effizienter in nutzbare Daten umwandeln.

GAN: die Doppelkontrolltechnik

Vor der Einführung von Broadcast-Netzwerken waren generative adversarial networks ( GANs ) Standard . Dabei erzeugt ein Generator gefälschte Inhalte (Bilder oder Videos), während ein Diskriminator deren Echtheit bewertet. Beide werden gegeneinander trainiert, ähnlich wie in einem Katz-und-Maus-Spiel, bis die Deepfake für das menschliche Auge praktisch nicht mehr erkennbar ist.

Diese Technik war der Schlüssel zu den ersten hochwertigen Deepfakes, war jedoch teurer und weniger effizient als aktuelle Systeme. Dennoch bleibt sie eine weit verbreitete Grundlage für die meisten kommerziellen Tools und Open-Source-Projekte.

Lip-Syncing: Lippensynchronisation für virale Videos

Lippensynchronisation ist eine beliebte Technik, sowohl wegen ihrer Einfachheit als auch wegen ihrer leichten Automatisierbarkeit. Dabei werden die Mundbewegungen in einem Video an einen beliebigen Ton angepasst, sogar mithilfe von KI-generierten synthetischen Stimmen.

In vielen Fällen ist ein leistungsstarker Computer nicht einmal nötig: Mobile Apps können Deepfake- Videos in nur wenigen Minuten erstellen. Qualität und Realismus steigen mit der Anzahl der verwendeten Referenzbilder und der eingesetzten Hardware.

Face-Swapping: Der klassische Gesichtstausch

Gesichtstausch ist die Grundlage vieler Deepfakes, die online kursieren. Dabei wird das Gesicht der Person, die man imitieren möchte, in ein reales Video auf das Gesicht einer anderen Person projiziert. Je mehr Bilder und Blickwinkel zum Trainieren des Modells verwendet werden, desto realistischer wirkt das Ergebnis.

Bekannte Beispiele reichen von humorvollen Videos, in denen Prominente in andere Charaktere „verwandelt“ werden, bis hin zu Initiativen wie dem Salvador Dalí Museum, das aus Tausenden von Bildern eine interaktive Version des Künstlers erstellte. Die Gefahr besteht darin, dass mit den aktuellen Tools praktisch jeder mit nur einem Referenzfoto ein halbwegs überzeugendes Deepfake erstellen kann, was die Einsatz- (und Missbrauchsmöglichkeiten) vervielfacht.

Wie erstellt man Schritt für Schritt einen Deepfake?

Um einen hochwertigen Deepfake zu erstellen, müssen Sie die Grundlagen der KI verstehen und über die richtigen Ressourcen verfügen. Um dies zu erreichen, umfasst der Prozess typischerweise die folgenden Schritte:

  • Suchen und Auswählen von Bildern oder VideosJe mehr hochwertige Bilder und Videos Sie von der Person, die Sie imitieren (und vom Original), sammeln können, desto besser wird das Ergebnis. Unterschiedliche Gesichtsausdrücke, Winkel und Lichtverhältnisse sind dabei sehr hilfreich.
  • Training des KI-ModellsDeep-Learning-Algorithmen verarbeiten all dieses Material, um die besonderen Merkmale und Bewegungen des zu kopierenden Gesichts zu erlernen.
  • Einsatz spezifischer ToolsProgramme wie DeepFaceLab, Zao, FaceApp und Deepfakes Web bieten einfache Schnittstellen zum Gesichtsaustausch, zur Lippensynchronisation oder zur Generierung synthetischer Stimmen. Einige erfordern leistungsstarke Computer mit GPUs, während andere in der Cloud oder direkt auf einem mobilen Gerät laufen.
  • Verarbeitung und AnpassungDas KI-Modell komponiert das Video, indem es das imitierte Gesicht einblendet und bei Bedarf Lippenbewegungen und Stimme anpasst, damit alles perfekt zusammenpasst. Manuelle Anpassungen können vorgenommen werden, um Details (Ausdruck, Beleuchtung usw.) zu perfektionieren.
  • Letzter SchliffMit einigen Programmen können Sie die Videoqualität verbessern, Fehler beseitigen oder sogar Wasserzeichen hinzufügen, um manipulierte Inhalte zu kennzeichnen.
  Vollständiger Leitfaden zu Gemini Code Assist: Funktionen, Editionen und Neuigkeiten

Manchmal kann der Vorgang nur wenige Minuten dauern, manchmal sind jedoch je nach gewünschtem Realismus und verfügbaren Ressourcen mehrere Tage Training und sehr teure Hardware erforderlich.

Beliebte Tools und Programme zum Erstellen von Deepfakes

Gesicht App

Heutzutage gibt es alles von mobilen Apps bis hin zu komplexen Open-Source-Programmen. Zu den am weitesten verbreiteten und zugänglichsten Programmen gehören:

  • DeepFaceLab: Ein Maßstab in der Welt der Deepfakes. Es bietet eine große Auswahl an Tutorials und erweiterten Funktionen zum Gesichtsaustausch.
  • Zao: Eine sehr beliebte chinesische mobile App, mit der Sie mithilfe eines Referenzfotos schnell Deepfake-Videos erstellen können.
  • Snapchat y Linsen-KI: Apps, die das Austauschen von Gesichtern und Anwenden erweiterter Filter erleichtern, ideal für Benutzer, die schnelle und unterhaltsame Ergebnisse suchen.
  • Deepfakes-Web: Online-Plattformen, die alles von der Animation alter Fotos bis hin zu aufwendigeren Videos anbieten, oft mit kostenpflichtigen oder Freemium-Tools.
  • Wombe y DeepBrain: Sie zeichnen sich durch den Realismus der generierten Stimmen und die Benutzerfreundlichkeit beim Erstellen von Musikvideos und Memes aus.
  • FaceApp: Ermöglicht Ihnen, Gesichter zu verändern und beeindruckende Effekte mit nur einem Klick zu erstellen.

Darüber hinaus sind Dienste wie Speechify AI Voice Generator darauf spezialisiert, KI-Stimmen zu erzeugen, die natürlich klingen, wodurch es einfach wird, realistische Sprachaufnahmen in jedes Deepfake-Video einzubinden.

Positive Verwendungsmöglichkeiten und Risiken von Deepfakes

Die Technologie hinter Deepfakes ist an sich weder gut noch schlecht: Es kommt ganz auf die Intention an. Einerseits gibt es positive Anwendungsbereiche, die von Unterhaltung – Memes, Witze und virale Videos – bis hin zu Film, Werbung und Bildung reichen. Beispiele hierfür sind die Erstellung mehrsprachiger Werbekampagnen ohne Reise- oder Dreharbeiten, die Wiederbelebung historischer Persönlichkeiten oder der Schutz der Identität von Personen in Dokumentarfilmen (wie in „ Welcome to Chechnya “).

Die Risiken sind jedoch sehr real. Deepfakes können zur Verbreitung von Falschinformationen, zur Wahlmanipulation, zum Betrug oder zur Belästigung missbraucht werden . Es gibt dokumentierte Fälle von Stimmenimitationen von Führungskräften, um millionenschwere Betrügereien zu begehen. Die einfache Bedienbarkeit vieler Tools erhöht die Gefahr eines unverantwortlichen oder böswilligen Einsatzes.

Daher ist es unerlässlich, einen verantwortungsvollen Umgang zu fördern : Inhalte sollten klar als Fälschungen gekennzeichnet , mit Wasserzeichen versehen und über die Existenz und die Risiken solcher Videos aufgeklärt werden. Zudem wird KI selbst eingesetzt, um immer effektivere Deepfake-Detektoren zu entwickeln, wobei das Rennen zwischen den Erstellern und den Detektoren weiterhin sehr eng ist.

Nachteile der künstlichen Intelligenz
In Verbindung stehender Artikel:
Nachteile der künstlichen Intelligenz: Was man Ihnen über diese Technologie nicht erzählt

Deepfakes in der Gesellschaft: Medienfälle und aktuelle Anwendungen

In den letzten Jahren haben sich Deepfakes von einer Kuriosität zu einem kulturell und gesellschaftlich relevanten Phänomen entwickelt. In der Politik werden sie sowohl zur Manipulation des Diskurses als auch zur Satire auf Persönlichkeiten des öffentlichen Lebens eingesetzt. Von Videos in Indien, in denen Politiker ihre Sprache verändern, um mehr Wähler anzulocken, bis hin zu viralen Manipulationen im Zusammenhang mit Wahlkämpfen in den USA.

  Vollständige Analyse von Chromebooks: Vorteile und Nachteile

In der Film- und Fernsehbranche haben Deepfakes die Produktion von Werbung und Filmen revolutioniert und ermöglichen die Erstellung von Inhalten, in denen die Protagonisten nie physisch anwesend waren. Ein Beispiel hierfür ist die Cruzcampo-Kampagne, in der Lola Flores und David Beckham für eine Wohltätigkeitsinitiative in verschiedenen Sprachen zu sehen waren.

Auch in Dokumentarfilmen und im Journalismus wird KI eingesetzt, um historische Ereignisse nachzustellen oder die Identität von Zeugen und Opfern zu schützen. Im Bildungs- und Kulturbereich wird ebenfalls das Potenzial von Deepfakes erforscht, wie beispielsweise im Dalí-Museum, wo der Künstler selbst „zum Leben erwacht“ und mit den Besuchern interagiert.

Im medizinischen Bereich werden GANs verwendet, um synthetische Bilder von Tumoren oder Läsionen zu erzeugen, die für das Training von Diagnosemodellen unerlässlich sind, wenn nicht genügend reale Daten vorhanden sind.

Herausforderungen, Ethik und die Zukunft von Deepfakes

Fortschritte in der KI machen das Erkennen von Deepfakes zu einer ständig wachsenden Herausforderung. Große Technologieunternehmen und Regulierungsbehörden arbeiten daran, diese Manipulationen zu identifizieren und die Nutzer zu schützen. Dazu setzen sie alles um, von Social-Media-Labels bis hin zur Einschränkung gefährlicher Apps.

Die größte Herausforderung besteht darin, Innovation und Sicherheit in Einklang zu bringen . Der zunehmende Zugang zu Werkzeugen zur Erstellung von Deepfakes zwingt die Gesellschaft, sich zu informieren, eine kritische Perspektive zu entwickeln und Verantwortlichkeit einzufordern, wenn diese Technologie für schädliche Zwecke eingesetzt wird. Werden Deepfakes jedoch richtig eingesetzt, können sie neue Ausdrucksformen, Kreativität und Lernmöglichkeiten eröffnen.

Die Deepfake-Technologie ist ein Dauerbrenner und wird sich rasant weiterentwickeln. Das Verständnis ihrer Techniken und Anwendungen sowie der ethische und verantwortungsvolle Umgang mit ihr ist der beste Weg, ihr volles Potenzial auszuschöpfen und gleichzeitig ihre Risiken zu minimieren. Bleiben Sie auf dem Laufenden und erkunden Sie die Möglichkeiten – stets mit kritischem Blick und Respekt für Privatsphäre und Wahrheit.

Was ist Phishing?
In Verbindung stehender Artikel:
Was ist Phishing: 10 Warnzeichen