Best Practices für das Generieren von Videos

In diesem Leitfaden finden Sie Best Practices, mit denen Sie hochwertige Videos mit Gemini Omni und Veo erstellen können.

Weitere Informationen zum Schreiben effektiver Prompts finden Sie im Leitfaden für Prompts zur Videogenerierung.

Klare und präzise Prompts verwenden

Klare und direkte Prompts, die Unklarheiten vermeiden, führen zu besseren Videoergebnissen.

  • Nicht empfohlen: "Ich stelle mir eine Szene vor, wo der Fokus auf so einem Typen liegt, der irgendwie traurig ist, und es ist alles so düster, und die Kamera ist quasi von unten, verstehst du?"

  • Empfohlen: "Nahaufnahme eines Mannes mit einem düsteren Gesichtsausdruck aus der Froschperspektive. Die Szene ist schwach beleuchtet und vermittelt eine melancholische Stimmung.“

Anführungszeichen vermeiden

Damit das Modell keinen Text in das Video einfügt, verwenden Sie nach der Aktion des Sprechers einen Doppelpunkt (:), um die Rede zu kennzeichnen, und vermeiden Sie Anführungszeichen (").

  • Nicht empfohlen: Eine Frau sagt: „Ich heiße Clara.“

  • Empfohlen: Eine Frau sagt: Ich heiße Clara.

Mehrere Seitenverhältnisse verwenden

Verwenden Sie verschiedene Seitenverhältnisse, um die Leistung Ihres Videos auf mehreren Plattformen zu steigern. Verschiedene Plattformen sind für unterschiedliche Seitenverhältnisse optimiert. Es ist wichtig, die Seitenverhältnisse der Plattformen zu kennen, um Marketing- und Werbekampagnen zu planen.

Im Folgenden sind die wichtigsten Seitenverhältnisse und ihre primären Anwendungsfälle aufgeführt:

  • 16:9: Wird auch als „Querformat“ oder „Breitbild“ bezeichnet und gilt als Standard für Fernseher, Monitore, die meisten Videoanzeigen, YouTube, Präsentationen und Mobilgeräte im Querformat. Das Seitenverhältnis 16:9 ist auch hilfreich, um mehr vom Hintergrund zu erfassen, z. B. malerische Landschaften.

  • 9:16: Wird auch als Hochformat, vertikal oder gedrehtes Breitbild bezeichnet. 9:16 ist für Mobile-First-Plattformen wie TikTok, Instagram Reels und YouTube Shorts unerlässlich. Das Seitenverhältnis 9:16 ist auch hilfreich für Porträts oder hohe Objekte mit stark vertikalen Ausrichtungen wie Gebäude, Bäume oder Wasserfälle.

Kurze Videos auf eine einzelne Szene konzentrieren

Bei kurzen Videos sollte sich jeder Prompt auf einen einzelnen, fokussierten Moment beziehen. Wenn Sie versuchen, mehrere unterschiedliche Ereignisse (A, dann B, dann C) in einem Prompt für ein Kurzvideo zu verketten, führt das oft zu verwirrenden oder unvollständigen Videos.

  • Nicht empfohlen: "Ein Detektiv findet einen Hinweis in einer Bibliothek, fährt dann nachts durch die Stadt und konfrontiert einen Verdächtigen in einem Lagerhaus."

  • Empfohlen: Erstellen Sie jeden Teil als separaten Clip:

    • Clip 1: „Nahaufnahme der behandschuhten Hand eines Detektivs, der Staub von einem alten Buch in einer dunklen Bibliothek wischt und ein verstecktes Symbol entdeckt.“

    • Clip 2: „Ein Auto fährt nachts durch eine neonbeleuchtete Stadt, Regen streift über die Windschutzscheibe, im Film-Noir-Stil.“

    • Clip 3: „In einem schattigen Lagerhaus steht ein Detektiv einer silhouettenhaften Figur gegenüber, was eine angespannte Atmosphäre erzeugt.“

Workflow mit Gemini Omni verbessern

Gemini Omni kann Sie während des gesamten Prozesses der Videoerstellung unterstützen, von der Ideenfindung bis zur Bewertung.

Vor der Videoerstellung: Gemini Omni als Experte für Prompts verwenden

Anstatt von Grund auf neu zu beginnen, können Sie Gemini Omni als Experte für Prompts verwenden. Lassen Sie Ihre grundlegenden Ideen in detaillierte Prompts umwandeln. Sie können beispielsweise eine Anweisung wie die folgende geben:

"Act as an expert prompter for a generative AI video generation model. Look at
this image, and write a prompt that INSTRUCTION. Ensure your
prompt is comprehensive and detailed."

Ersetzen Sie INSTRUCTION durch weitere Anweisungen für das Modell.

Nach der Videoerstellung: Gemini Omni als „zweites Augenpaar“ verwenden

Nachdem Ihr Video erstellt wurde, kann Gemini Omni das Endergebnis bewerten, es mit den Unternehmens- oder Markenrichtlinien vergleichen und alle potenziell problematischen Bereiche kennzeichnen, die möglicherweise von einem Menschen überprüft werden müssen.

Konsistenz von Figur und Stimme erreichen

Detaillierte Figurenbeschreibung erstellen: Ihre Figurenbeschreibung ist die Grundlage für Konsistenz. Damit die Figur wiederverwendet werden kann und die Stimme konsistent ist, geben Sie ihr einen Namen und einen bestimmten Stimmstil. Erstellen Sie dann die Beschreibung mit einer Reihe unveränderlicher Merkmale: Körperbau und Alter, Haarfarbe und -stil, Gesichtszüge, Augenfarbe und -form sowie alle charakteristischen Merkmale. Mit Gemini Omni können Sie eine umfassende verbale Beschreibung der Gesichtszüge Ihrer Figur erstellen.

Beschreibung konsistent anwenden: Kopieren Sie die vollständige, unveränderte Figurenbeschreibung für jede neue Szene oder Aktion in Ihren Prompt. Ändern Sie nur die Teile, die die neue Aktion oder Umgebung beschreiben. Um Ihren Workflow zu verbessern, können Sie Gemini Omni auch als Szenengenerator verwenden. Geben Sie Gemini Omni Ihre endgültige Figurenbeschreibung und bitten Sie das Tool, mehrere Szenen-Prompts für Sie zu erstellen.

Denselben Seed-Parameter verwenden: Damit die visuellen, stilistischen und stimmlichen Ergebnisse in mehreren Szenen konsistent sind, verwenden Sie denselben Seed-Parameter.

Beispiel:Das folgende Video wurde mit demselben Seed-Parameter und den folgenden Prompts erstellt. Die wiederholten Beschreibungen von Figur und Stimme sind in jedem der folgenden Prompts fett hervorgehoben:

Prompt für Szene 1:

"A medium shot, with the camera slowly dollying forward in a dimly lit, grand
Parisian archive. Dust motes dance in a single beam of light from a high window.
Clara, a historian in her early 30s, with observant, dark brown
eyes that hold a quiet intensity. She has chin-length, black hair styled in a
classic bob. She is dressed in a sophisticated, dark navy-blue
wool coat, with a silk scarf patterned with subtle gold and cream designs tied
around her neck. She stands before a large, ancient wooden table, carefully
turning the fragile, yellowed page of a massive, leather-bound book. Her
expression is one of deep concentration. In a voice that is crisp
and clear, with a thoughtful, analytical tone and a standard American
accent, Clara says: It has to be here"

Prompt für Szene 2:

"A wide shot of the Pont des Arts in Paris at twilight, the sky a mix of deep
blue and soft orange. The lights of the city are beginning to twinkle on along
the Seine. Clara, a historian in her early 30s, with observant,
dark brown eyes that hold a quiet intensity. She has chin-length, black hair
styled in a classic bob. She is dressed in a sophisticated, dark
navy-blue wool coat, with a silk scarf patterned with subtle gold and cream
designs tied around her neck. She leans against the railing, looking out at the
water, a small, triumphant smile on her face. She pulls a folded, old map from
her coat pocket and looks down at it. In a voice that is crisp and
clear, with a thoughtful, analytical tone and a standard American
accent, Clara says: I knew it. The path starts from here"

Prompt für Szene 3:

"An eye-level shot in a small, hidden Parisian courtyard, overgrown with ivy and
lit by a single, warm gas lamp. Clara, a historian in her early
30s, with observant, dark brown eyes that hold a quiet intensity. She has
chin-length, black hair styled in a classic bob. She is dressed
in a sophisticated, dark navy-blue wool coat, with a silk scarf patterned with
subtle gold and cream designs tied around her neck. She kneels down and runs her
fingers over an ancient, carved symbol on a stone paver, almost completely
obscured by moss. Her eyes light up with discovery. In a voice
that is crisp and clear, with a thoughtful, analytical tone and a standard
American accent, Clara says: After all these years, I've found
it"

Bild zu Video

In den folgenden Abschnitten finden Sie Best Practices, die bei der Verwendung der Funktion „Bild zu Video“ wichtig sind.

Hochwertiges Quellbild verwenden

Wenn Sie die Funktion „Bild zu Video“ verwenden, ist die Qualität Ihres Quellbilds wichtig. Gemini Omni und Veo verwenden das Quellbild als Grundlage für alles, was folgt, einschließlich Details zur Figur, Beleuchtung und allgemeinem künstlerischen Stil.

Ein scharfes, klares und gut komponiertes Foto führt zu einem stimmigeren und hochwertigeren Video. Betrachten Sie Ihr Quellbild als das erste Bild Ihres Films: Je besser der Anfang, desto besser das Ende.

Nur Bewegungen prompten

Ihr Quellbild definiert bereits Motiv, Szene und Stil. Konzentrieren Sie sich in Ihrem Prompt auf die gewünschte Bewegung.

  • Nicht empfohlen: Beschreiben Sie die Figur, den Hintergrund oder die Beleuchtung im Bild nicht noch einmal. Redundante Prompts verwirren das Modell und führen zu schlechten Ergebnissen.

  • Empfohlen: Prompts für Kamerabewegungen , Animationen des Motivs und Änderungen der Umgebung.

Allgemeine Begriffe für Figuren im Quellbild verwenden

Verwenden Sie in Ihrem Prompt für Bewegungen allgemeine Begriffe für die Figur, z. B. „das Motiv“, „die Frau“, „er“, „sie“ oder „sie“.

Kamerabewegung anweisen

Sie können drei Arten von Bewegungen einzeln oder in Kombination anweisen.

  • Kamerabewegung: Die Kamera bewegt sich, aber die Szene ist statisch. Dies ist die einfachste und zuverlässigste Möglichkeit, Dynamik hinzuzufügen.

    • Beispiel: „Langsame Kamerafahrt auf das Motiv zu.“
  • Animation des Motivs: Die Hauptfigur oder das Hauptobjekt bewegt sich. Am besten für subtile, lebensechte Bewegungen geeignet.

    • Beispiel: „Die Haare und die Kleidung der Figur wehen sanft im Wind.“
  • Animation der Umgebung: Der Hintergrund oder die Atmosphäre wird lebendig.

    • Beispiel: „Nebel zieht langsam über die Landschaft.“

Beispiel: Das folgende Video und der folgende Prompt zeigen die Animation des Motivs anhand von folgendem Bild:

Ein alter, etwas heruntergekommener blauer Pickup vor einem Sonnenblumenfeld

"A sweeping drone-like aerial view starting from ground level and rising to
reveal the entire landscape in epic proportions"

Zusammenfassung der Best Practices

In der folgenden Tabelle sind die Best Practices zusammengefasst, die in diesem Dokument empfohlen werden:

Thema Aufgabe
Prompts
Videogenerierung
Bild zu Video

Nächste Schritte