LEISTUNGENCASE STUDIESPRODUKTEBLOGÜBER UNS15 MIN ANALYSE
← RESSOURCEN
Das 7-Schritt-Avatar-Protokoll
5 Seiten · PDF · KOSTENLOS

Automatisierung

Das 7-Schritt-Avatar-Protokoll

Eine Arbeitsanweisung, kein Ratgeber. Einmal ausfüllen, danach in jedes Bild kopieren.

DIREKT ZUM KOSTENLOSEN PDF ↓

Das 7-Schritt-Avatar-Protokoll ist eine Arbeitsanweisung, die festlegt, was an deiner KI-Figur über alle Bilder hinweg gleich bleiben muss: Stimme, Rahmen, fünf feste Merkmale, drei Posen und eine Stichprobe vor der Veröffentlichung. Drei Schritte richtest du einmal ein, drei gehören in jeden einzelnen Auftrag, einer sichert die Veröffentlichung ab. Gedacht für alle, die mit KI-Bildern regelmäßig posten und deren Figur ab Karte drei aussieht wie eine andere Person. Stand: August 2026.

Warum sieht mein KI-Avatar in jedem Bild anders aus?

Weil jedes Bild bei null anfängt. Ein Bildmodell erinnert sich nicht an das, was du zehn Minuten vorher erzeugt hast. Es liest deinen Auftrag, füllt alles Ungesagte mit Durchschnitt und würfelt genau die Details neu, die du nicht festgeschrieben hast. Szene 1 sitzt, Szene 2 ist fast richtig, ab Szene 3 sitzt eine fremde Person auf deinem Karussell.

Das Problem liegt also nicht im Werkzeug, sondern in dem, was du vor dem ersten Bild versäumt hast. Wer das genauer nachlesen will: im Beitrag KI-Klon: So bleibt dein Avatar immer dieselbe Person steht die Mechanik dahinter, und KI-Bilder verbessern erklärt, warum ein Modell beim Nachbessern gleich das ganze Bild umbaut.

Was lege ich einmal fest und was gehört in jedes Bild?

Das ist die Trennung, an der die meisten scheitern. Sie behandeln alles als Einmal-Aufgabe und wundern sich, dass der Anfangserfolg nicht hält.

Einmal pro Person, Teil A. Deine eigenen Aufnahmen abgetippt in einer Referenz-Datei, damit die Maschine nach dir klingt und nicht nach Durchschnitt. Eine zweite Datei mit deinem Rahmen: Zielgruppe, deine Wörter, deine Tabus, deine belegbaren Beweise. Und deine eigene geklonte Stimme statt einer Standard-Stimme, die dein Publikum nach zwei Videos wiedererkennt.

In jedes Bild, Teil B. Ein fester Merkmal-Block, den du unverändert kopierst. Bild und Schrift in zwei getrennten Durchgängen. Und eine Begrenzung auf drei Posen, statt jede Karte neu zu erfinden.

Vor jeder Veröffentlichung, Teil C. Eine Stichprobe aus zwei zufällig gezogenen Karten.

Welche Merkmale halten ein Gesicht wirklich fest?

Fünf Kategorien reichen, wenn du sie richtig aufschreibst: Gesicht, Haare, Kleidung, Umgebung, Licht. Entscheidend ist die Formulierungsrichtung. Du schreibst hin, was da sein muss, nicht was verboten ist. Ein Verbot hält kein Merkmal fest, es entfernt nur eine von tausend Alternativen.

Zweite Regel: konkret statt stimmungsvoll. "Casual" ist keine Kleidung und "gemütlich" ist keine Umgebung. Beides überlässt dem Modell die Entscheidung, und das Modell entscheidet bei jedem Auftrag neu. Wenn du deine Anker sauber vorformuliert brauchst, liegt daneben das Anker-Blatt für konsistente Avatar-Szenen.

Warum brechen Schrift und Umlaute in KI-Bildern?

Weil du zwei Aufgaben in einen Auftrag packst. Verlangst du Person und Text gleichzeitig, bekommst du beides halb: Das Gesicht driftet, weil Rechenaufmerksamkeit in die Buchstaben geht, und die Buchstaben brechen, weil das Modell Schrift malt statt setzt. Deutsche Umlaute und das ß trifft es zuerst.

Die Trennung in zwei Durchgänge kostet dich zwei Minuten pro Karte und nimmt die häufigste Fehlerquelle komplett raus. Für die Stimme dahinter gilt dasselbe Prinzip in Textform, nachzulesen in Dein KI-Content klingt nach ChatGPT, nicht nach dir.

Wie prüfe ich vor der Veröffentlichung, ob der Avatar hält?

Nicht mit dem Gefühl, sondern mit einer Stichprobe. Zwei Karten zufällig ziehen, ausdrücklich nicht die Lieblingskarten, und gegen das Cover halten. Geprüft werden Gesicht, Hände, Schrift und Umlaute, jeweils im direkten Bildvergleich statt aus dem Gedächtnis.

Und die Konsequenz gehört dazu: Fällt ein Punkt durch, geht die Karte zurück in Durchgang 1. Nicht nachbessern, neu bauen. Nachbessern erzeugt im gerenderten Bild fast immer den nächsten Bruch. Wer die typischen Bruchstellen einzeln durchgehen will, findet sie im Avatar-Bruch-Check.

Was steckt im PDF?

Das PDF ist die Arbeitsfassung zum Abarbeiten: alle sieben Schritte mit den konkreten Formulierungen, die Merkmal-Tabelle mit der Spalte "So schreibst du es auf", pro Schritt ein "Fertig, wenn"-Kriterium zum Abhaken und die Kurzfassung als Sieben-Punkte-Liste für den zweiten Avatar. Fünf Seiten, gebrandet, zum Ausdrucken oder Danebenlegen. Trag unten deine E-Mail ein, dann liegt es sofort im Postfach.

Kostenlos herunterladen

Alle sieben Schritte als Arbeitsfassung zum Abarbeiten, mit den konkreten Formulierungen statt nur dem Prinzip. Enthalten sind die Merkmal-Tabelle mit der Spalte "So schreibst du es auf", pro Schritt ein "Fertig, wenn"-Kriterium zum Abhaken und die Kurzfassung als Sieben-Punkte-Liste für den zweiten Avatar. Fünf Seiten, gebrandet, zum Ausdrucken oder Danebenlegen.

Name + E-Mail, kein Spam, kein Abo. Du erhältst das PDF direkt per E-Mail.

Mit dem Absenden stimmst du zu, gelegentlich relevante Inhalte von adcompany zu erhalten. Abmeldung jederzeit. Datenschutz

Häufige Fragen

Warum sieht mein KI-Avatar in jedem Bild anders aus?

Weil jedes Bild bei null anfängt. Das Modell erinnert sich nicht an vorherige Bilder, es liest nur den aktuellen Auftrag und füllt alles Ungesagte mit Durchschnitt. Alles, was du nicht ausdrücklich festschreibst, wird bei jedem Auftrag neu gewürfelt.

Wie halte ich ein KI-Gesicht über mehrere Bilder konsistent?

Mit einem festen Merkmal-Block, den du unverändert in jeden Auftrag kopierst. Fünf Kategorien reichen: Gesicht, Haare, Kleidung, Umgebung, Licht. Entscheidend ist, dass du hinschreibst, was da sein muss, statt was verboten ist. Verbote halten kein Merkmal fest.

Warum schreibt die KI Umlaute und Text im Bild falsch?

Weil Bild und Schrift in einem Durchgang verlangt werden. Dann bekommst du beides halb: das Gesicht driftet und die Buchstaben brechen, bei ä, ö, ü und ß zuerst. Bau das Bild in Durchgang 1 ohne Textvorgabe und setz die Schrift in Durchgang 2 als eigene Ebene darüber.

Wie viele Posen sollte ein KI-Avatar haben?

Drei: Anchor für Cover und Abschluss, Story für die Argument-Karten, Twist für den Wendepunkt oder das ruhige Ende. Jede weitere Pose ist eine zusätzliche Gelegenheit für einen Bruch. Ausnahme: Du zeigst Konsistenz absichtlich als Thema, dann darf der Wechsel sichtbar sein.

Reicht eine Standard-Stimme für KI-Videos oder brauche ich einen Stimmklon?

Standard-Stimmen erkennt dein Publikum nach zwei Videos. Für einen eigenen Klon reichen 3 bis 5 Minuten sauberes Audio aus einem ruhigen Raum, gleiches Mikro, gleicher Abstand, normal gesprochen statt abgelesen. Die Stimm-ID legst du zu deinen anderen Referenz-Dateien.

Passend dazu

NO-CODE Mastery: KI-Agenten und Automationen ohne ProgrammierungKI-Klon: So bleibt dein Avatar immer dieselbe PersonKI-Bilder verbessern: Warum ChatGPT dein ganzes Bild ändertDein KI-Content klingt nach ChatGPT, nicht nach dirAbsicherungs-Checkliste vor dem ersten AgentenSchlüssel-Ordnung ChecklisteDIE 7 LÖCHER