Aus einem Video eine übersichtliche Infografik erstellen

✅ Freie Nutzung von Text & Abbildungen & Audio & Video mit einem Unidigital-Zugang

Basierend auf einem Video lassen sich mithilfe von KI-Anwendungen moderne Infografiken entwickeln, die als ergänzendes Format in Lernprozessen eingesetzt werden können. Im Beitrag habe ich eine Bildschirmaufzeichnung in ChatGPT hochgeladen und diese mit der Bild-KI ChatGPT-Images in informative Abbildungen im Sketchnote-Stil umgewandelt.

Zum offenen ChatGPT-Chat

KI-Podcast in NotebookLM (neu: Gemini Notebook) als kurzes Briefing generiert.

Über das Plus-Symbol in der Promptleiste und die Upload-Funktion wurde zuerst das Video zur Lernplattform für Dokumente hochgeladen und anschließend die Bildgenerierung aktiviert. Nun startet ChatGPT Images automatisch die Bilderzeugung. Im Prompt habe ich festgelegt, dass insgesamt drei Infografiken in den drei Formaten Quadrat-, Quer- und Hochformat generiert werden sollen.

Prompt generiert mit ChatGPT

Analysiere das von mir hochgeladene Video vollständig und erstelle daraus drei eigenständige Infografiken in deutscher Sprache.

## Ziel

Die Infografiken sollen die zentrale Thematik, die wichtigsten Zusammenhänge und die Kernaussagen des Videos verständlich, visuell ansprechend und ohne zusätzliche Erklärtexte außerhalb der Grafiken vermitteln.

Das Ergebnis soll auch für Personen verständlich sein, die das ursprüngliche Video nicht gesehen haben.

## Inhaltliche Anforderungen

1. Identifiziere das Hauptthema des Videos.
2. Extrahiere die wichtigsten Aussagen, Schritte, Fakten, Zusammenhänge und Schlussfolgerungen.
3. Reduziere die Inhalte auf die wesentlichen Informationen.
4. Ordne die Informationen in einer klaren und nachvollziehbaren visuellen Reihenfolge.
5. Verwende ausschließlich deutsche Texte.
6. Formuliere Überschriften und Beschriftungen kurz, verständlich und prägnant.
7. Erfinde keine Inhalte, Zahlen oder Aussagen, die nicht aus dem Video hervorgehen.
8. Entferne Wiederholungen, Nebenthemen und unwichtige Details.
9. Achte auf eine korrekte deutsche Rechtschreibung.
10. Stelle komplexe Zusammenhänge durch Pfeile, Abläufe, Symbole, kleine Diagramme oder Ursache-Wirkungs-Beziehungen dar.

## Visueller Stil

Gestalte alle Infografiken im Stil hochwertiger Sketchnotes:

* handgezeichnete Optik
* klare schwarze oder dunkelgraue Konturen
* einfache Illustrationen und Piktogramme
* gut lesbare handschriftähnliche Typografie
* Pfeile, Rahmen, Sprechblasen und Verbindungslinien
* wenige, gezielt eingesetzte Akzentfarben
* heller, ruhiger Hintergrund
* übersichtliche Informationshierarchie
* sympathisch, modern und professionell
* keine fotorealistische Darstellung
* keine überladene Gestaltung
* keine dekorativen Elemente ohne inhaltliche Funktion

Alle drei Infografiken sollen dieselbe visuelle Gestaltungssprache verwenden, aber für das jeweilige Format individuell aufgebaut werden. Die Motive dürfen nicht lediglich automatisch zugeschnitten oder skaliert werden.

## Zu erstellende Formate

### 1. Querformat

Seitenverhältnis: 16:9

Erstelle eine Infografik mit einer horizontalen Leserichtung. Ordne die Inhalte beispielsweise als Ablauf, Zeitstrahl, Prozess oder thematische Reise von links nach rechts an.

Die wichtigsten Inhalte müssen auch bei der Darstellung auf einem Bildschirm gut lesbar sein.

### 2. Quadratformat

Seitenverhältnis: 1:1

Erstelle eine eigenständige quadratische Komposition. Ordne das Hauptthema zentral an und gruppiere die wichtigsten Teilaspekte übersichtlich darum herum oder verwende ein klar strukturiertes Raster.

Die Gestaltung soll besonders für Social-Media-Beiträge geeignet sein.

### 3. Hochformat

Seitenverhältnis: 9:16

Erstelle eine vertikale Infografik mit einer Leserichtung von oben nach unten. Beginne mit einer aussagekräftigen Überschrift und führe anschließend schrittweise durch die wichtigsten Inhalte.

Die Gestaltung soll besonders für mobile Endgeräte, Stories, Reels oder Shorts geeignet sein.

## Aufbau jeder Infografik

Jede Infografik soll enthalten:

* eine kurze, aussagekräftige Hauptüberschrift
* eine knappe Einleitung oder Kernaussage
* drei bis sieben zentrale Inhalte oder Erklärungsschritte
* passende handgezeichnete Symbole oder Illustrationen
* deutlich erkennbare Zusammenhänge
* eine abschließende Zusammenfassung, Erkenntnis oder zentrale Botschaft

## Wichtige Produktionshinweise

* Das ursprüngliche Video ist stumm. Leite die Inhalte daher aus den sichtbaren Szenen, eingeblendeten Texten, Handlungen, Grafiken und Abläufen ab.
* Übernimm keinen fehlerhaften oder unleserlichen Text aus dem Video.
* Weise auf Inhalte, die sich aus dem Video nicht eindeutig bestimmen lassen, nicht spekulativ hin.
* Vermeide zu kleine Schrift.
* Vermeide abgeschnittene Texte und Illustrationen.
* Halte ausreichend Abstand zu allen Bildrändern.
* Verwende keine Logos, Markenzeichen oder urheberrechtlich geschützten Figuren, sofern diese nicht ausdrücklich Bestandteil des Videos sind.
* Gib jede Infografik als separate, hochauflösende Grafik aus.
* Erstelle keine Collage, in der alle drei Formate gemeinsam dargestellt werden.

Erstelle zuerst eine kurze interne Inhaltsstruktur auf Grundlage des Videos und generiere anschließend die drei finalen Infografiken.

Die Analyse des Videos läuft über den Thinking-Modus von ChatGPT. Der Verlauf des „Gedankenprozesses“ kann ich jederzeit einsehen, indem ich auf die angegebene Zeit klicke, die entweder oberhalb oder unterhalb des Bildes angezeigt wird. Anschließend klicke ich auf „Focused on the video content“. Danach öffnet sich eine rechte Seitenleiste, die die einzelnen Analyseschritte präzise dokumentiert.

Es ist gut erkennbar, dass ChatGPT einzelne Bilder aus dem Video verwendet, um diese mithilfe der Vision-Funktion zu analysieren. Hier wird auch gerne von Frames gesprochen, also Bilderserien, die sich das Sprachmodell einschließlich des darin enthaltenen Textes genauer „anschaut“. Die Analyse verläuft chronologisch anhand von Zeitstempeln vom Startpunkt des Videos bei 0:00 bis zum Ende bei etwa 1:30 Minuten. Das Sprachmodell schaut sich nicht jedes einzelne Bild an, sondern filtert die wichtigsten Bilder und leitet daraus den zentralen Inhalt. 

Die unten dargestellte Nahaufnahme der Seitenleiste zeigt über den einzelnen Abbildungen die Bezeichnung „Analysiertes Bild“. Daran wird deutlich: Wenn ein KI-System ein Video auswertet, erfolgt die Analyse anhand einzelner Bilder. Mit einem Klick auf die rechte Maustaste lassen sich diese speichern und zur Demonstration im Rahmen von Blogbeiträgen oder Ähnlichem weiterverwenden.

Nach einer Bearbeitungszeit von genau 7 Minuten und 23 Sekunden hat ChatGPT Images auf der Grundlage des Videos die drei Infografiken im Sketchnote-Stil generiert. Diese geben die Inhalte des Video präzise wieder und verdeutlichen anschaulich, wie die Lernapp zur Dokumentenanalyse aufgebaut ist und welche vier zentralen Funktionen sie bietet.

 

Autor

matthias kindt

Matthias Kindt auf Linkedin