Film Lab · Befunde

Was wir gemessen haben —
und was daraus wurde.

Die Belege hinter dem Handbuch: jede Messreihe mit Datum, jeder Fehlschlag mit Namen, und zu fast jeder Eigenschaft des Produkts die Messung, die sie verursacht hat. Wer wissen will, wie man etwas bedient, ist im Handbuch richtig; wer wissen will, warum es so gebaut ist und wo es kippt, hier.

Stand 2026-09-28 · Bilder aus echten Läufen · Anleitung unter /handbuch

Worum es geht, was du davon hast, für wen es ist#

Drei Fragen, die eine Produktseite beantworten muss, bevor sie irgendetwas zeigt. Hier stehen sie zuerst — und der Rest der Seite belegt sie.

Worum es geht

Die Kreativ-Stufe eines Produktionsbetriebs.

Vom Exposé zum pitchfähigen Look: Stoff, Figuren, Orte, Bild, Bewegung, Schnitt, Export. Nicht ein Werkzeug für Clips, sondern die Strecke dazwischen — und der Anschluss an Kalkulation und Rechtenachweis.

Was du davon hast

Bis Freitag pitchfähig — und du weißt vorher, was es kostet.

Ein Nachmittag statt drei Wochen Konzeptarbeit. Der Preis steht vor dem Absenden, nicht auf der Rechnung. Und was das Werkzeug kann, ist gemessen und nachlesbar, statt behauptet.

Für wen

Filmschaffende im deutschsprachigen Raum mit einem Termin.

Solo-Regie und Autorinnen mit einem Exposé, das visuell werden muss. Produktionsfirmen von zwei bis fünfzehn Leuten, die im Jahr drei bis zehn Stoffe pitchen. Werbe- und Imagefilm, wo ein Look-Konzept vor den Dreh muss.

Der bezahlte Anlass ist dabei nicht Kreativität, sondern Termindruck mit Geld dahinter: Einreichfrist, Pitch-Termin, Kundenpräsentation. Wer nächste Woche einreichen muss, vergleicht keine sechs Werkzeuge — der zahlt dafür, bis Freitag pitchfähig zu sein.

Und was es nicht wird, damit du nicht das Falsche erwartest: kein weiterer Modell-Zoo, kein Wettbewerb um das beste Videomodell, kein Preiskampf gegen Flatrate-Anbieter. Wer nur Clips am Fließband will, ist woanders günstiger bedient. Der Wert sitzt in der Planung und im DACH-Kontext.

Die zehn Stufen#

Dieselbe Ordnung wie in der Vorführung, wo eine einzelne Einstellung durch alle Stufen läuft. Hier die Übersicht.

Unentwickelt

Alles ist da, aber noch kein Bild.

Der Stoff, die Menschen, die Orte. Was ein Team am Tisch klärt, bevor eine Kamera aufgebaut wird.

  • ① Idee
  • ② Drehbuch
  • ③ Location
  • ④ Crew
  • ⑤ Cast
Entwickelt

Aus Text wird Bild.

Prompt, Bild, Bewegung, Ton. Hier entsteht, was man ansehen kann — und hier sitzen die Kosten.

  • ⑥ Prompt
  • ⑦ Bild + VFX
  • ⑧ Video + Ton
Abgezogen

Montage, Finish, Vorführung.

Aus Einstellungen wird eine Sequenz, aus der Sequenz ein Film in den Formaten, die jemand abnimmt.

  • ⑨ Sequencer
  • ⑩ Export
Die Werkstatt im Film Lab: links die zehn Schritte von Idee bis Export, in der Mitte der Drehbuch-Import
So sieht das im Werkzeug aus. Links die zehn Schritte, in der Mitte der Einstieg — ganzes Drehbuch importieren oder in ein paar Sätzen beschreiben. Wer will, lässt zuerst ein grobes Animatic laufen und veredelt danach Stufe für Stufe.

Die Werkzeuge#

Bild-Stile

Film Stocks (Portra, Cinestill, Tri-X …), Cinematic Looks und Grafik-Stile, die das ganze Bild umschreiben — Bauhaus-Plakat, Anime-Cel, Blindprägung, Siebdruck. Presets mit fester Schrift haben Eingabefelder: die Wörter im Bild sind deine, nicht unsere.

48 Presets, jedes mit Referenzbild am selben Motiv

Crew-Presets

Kuratierte Parameter statt generischer Prompt-Wrapper: jedes Preset trägt die Handschrift eines Gewerks. Für Filmleute sofort lesbar, weil es die Sprache am Set spricht und nicht die des Modells.

Grade — der Look, pixelgenau

Belichtung, Kontrast, Farbton, Sättigung, Korn — als Regler, nicht als Prompt. Der Grade rechnet direkt aufs Bild: derselbe Look trifft jeden Still gleich, reproduzierbar und ohne einen Credit zu verbrennen, weil kein Modell mehr rät. „Vom Colorist-Brief ausgehen" nimmt den Look der Crew-Konfiguration als Startpunkt, die Regler feinen darüber. Denselben Grade gibt es als MCP-Werkzeug lab_grade — ein KI-Agent setzt den Look über dieselben Regler, ohne die App zu öffnen.

70 Looks. Zwanzig sind frei entworfen, 17 davon benannt in drei Familien:

  • Neutral — zurückhaltende Startpunkte: neutral, warm, cool, soft, punch.
  • Bold — laute Grades: teal-orange, bleach, noir, sunset, neon.
  • Film-Emulation — im Charakter bekannter Stocks: kodak-print, fuji-eterna, vision3, ektachrome, technicolor, portra, super8.

Dazu drei technische für Material, das als Cineon-Log ankommt (log-neutral, print-warm, print-kühl) — sie erwarten Log und geben Rec.709 aus, auf normalem Material sehen sie falsch aus.

Die übrigen fünfzig sind Referenz-Looks, seit dem 27.09.: jeder einem bestimmten Filmbild nachgebaut, aus drei Leitfarben des Bildes und unserer Grade-Mathematik — Kurve, Sättigung, Korn —, gebacken als eigene LUT. Im Pult steht jeder mit seinem Standbild und der genauen Angabe darunter: Film, Jahr, Regie, Kamera. Gewählt wird er über den Film, deshalb schlägt der Begleiter ihn nicht nach Motiv vor. Die vollständige Liste steht unter den Werkzeugen.

Anwenden ist zerstörungsfrei — das Original bleibt, das gegradete Bild ist eine neue Galerie-Zeile. Der Begleiter (Pipeline-Agent) schlägt einen Look vor und wendet ihn auf Freigabe an: im Pult geführt oder im Chat („welcher Look passt zu diesem Shot?").

70 Looks (20 frei entworfen, 50 nach Filmbild) · im Pult, als MCP-Tool lab_grade, über den Begleiter · deterministisch, keine KI-Credits · live seit 2026-09-21

Router und Kosten-Preflight

Der Router ordnet je Absicht nach Qualität, cappt die Kosten und nimmt innerhalb einer Modellfamilie den günstigsten verdrahteten Zugang. Findet er keinen unter dem Deckel, sagt er das mit Zahlen — statt still das teuerste Modell zu nehmen.

Preis vor dem Absenden, nicht danach

Murnau — Schnitt im Browser

Timeline, Transport, zwei Monitore, Export. Die Einstellungen aus der Pipeline landen direkt darin, ohne Umweg über einen Download-Ordner.

Drei Zugänge

Die App im Browser. Ein MCP-Server, über den KI-Agenten dieselbe Pipeline bedienen — 82 Werkzeuge. Und eine Brücke, die in DaVinci Resolve läuft und seit dem 27.09. mit dem MCP eine gemeinsame Fassade bildet: ein Agent sieht FilmLab und die offene Resolve-Timeline zugleich. Was Geld kostet, läuft dort in zwei Schritten — erst der Preis, dann eine Freigabe, die nur für genau diesen Aufruf und fünfzehn Minuten gilt.

App · MCP (OAuth oder Brücken-Schlüssel) · Resolve-Brücke 0.67 · Details unten

Die fünfzig Referenz-Looks und ihre Filmbilder

Jeder Look trägt die Nummer, unter der er im Pult steht (filmlab-ref-01 bis -50). Die Standbilder zeigen wir nur im Pult, als Beleg, woran der Look Maß genommen hat; die Rechte an den Bildern liegen bei den Rechteinhabern der Filme.

Nr.FilmJahrRegieKamera
01American Honey2016Andrea ArnoldRobbie Ryan
02Drive2011Nicolas Winding RefnNewton Thomas Sigel
03Aftersun2022Charlotte WellsGregory Oke
04Sicario2015Denis VilleneuveRoger Deakins
05Aftersun2022Charlotte WellsGregory Oke
06The Florida Project2017Sean BakerAlexis Zabé
07The Florida Project2017Sean BakerAlexis Zabé
08Fish Tank2009Andrea ArnoldRobbie Ryan
09Fish Tank2009Andrea ArnoldRobbie Ryan
10Fish Tank2009Andrea ArnoldRobbie Ryan
11This Is England2006Shane MeadowsDanny Cohen
12This Is England2006Shane MeadowsDanny Cohen
13This Is England2006Shane MeadowsDanny Cohen
14Under the Skin2013Jonathan GlazerDaniel Landin
15Portrait of a Lady on Fire2019Céline SciammaClaire Mathon
16Portrait of a Lady on Fire2019Céline SciammaClaire Mathon
17The Master2012Paul Thomas AndersonMihai Malaimare Jr.
18Blade Runner 20492017Denis VilleneuveRoger Deakins
19In the Mood for Love2000Wong Kar-waiChristopher Doyle / Mark Lee Ping-Bing
20In the Mood for Love2000Wong Kar-waiChristopher Doyle / Mark Lee Ping-Bing
21In the Mood for Love2000Wong Kar-waiChristopher Doyle / Mark Lee Ping-Bing
22Drive2011Nicolas Winding RefnNewton Thomas Sigel
23Buffalo '661998Vincent GalloLance Acord
24The Master2012Paul Thomas AndersonMihai Malaimare Jr.
25Sicario2015Denis VilleneuveRoger Deakins
26Uncut Gems2019Josh & Benny SafdieDarius Khondji
27The Neon Demon2016Nicolas Winding RefnNatasha Braier
28Moonlight2016Barry JenkinsJames Laxton
29The Florida Project2017Sean BakerAlexis Zabé
30Drive2011Nicolas Winding RefnNewton Thomas Sigel
31Good Time2017Josh & Benny SafdieSean Price Williams
32American Honey2016Andrea ArnoldRobbie Ryan
33Chungking Express1994Wong Kar-waiChristopher Doyle / Andrew Lau
34Chungking Express1994Wong Kar-waiChristopher Doyle / Andrew Lau
35Good Time2017Josh & Benny SafdieSean Price Williams
36Good Time2017Josh & Benny SafdieSean Price Williams
37Uncut Gems2019Josh & Benny SafdieDarius Khondji
38Uncut Gems2019Josh & Benny SafdieDarius Khondji
39Paris, Texas1984Wim WendersRobby Müller
40Paris, Texas1984Wim WendersRobby Müller
41The Neon Demon2016Nicolas Winding RefnNatasha Braier
42The Neon Demon2016Nicolas Winding RefnNatasha Braier
43Buffalo '661998Vincent GalloLance Acord
44Under the Skin2013Jonathan GlazerDaniel Landin
45Under the Skin2013Jonathan GlazerDaniel Landin
46Moonlight2016Barry JenkinsJames Laxton
47Moonlight2016Barry JenkinsJames Laxton
48Blade Runner 20492017Denis VilleneuveRoger Deakins
49Blade Runner 20492017Denis VilleneuveRoger Deakins
50Paris, Texas1984Wim WendersRobby Müller

Der Dreamer — dort, wo aus Sprache ein Bild wird#

Jede Stufe hängt am Prompt, und der Prompt ist die Stelle, an der die meisten Anläufe verbrannt werden. Der Dreamer ist deshalb kein Textfeld, sondern ein Werkzeugkasten.

Der Dreamer-Editor: Werkzeugleiste mit Ausformulieren, Storyboard, Polish, Format, Expand, Shorten, Custom, Vorschau und Stil-Auswahl; darunter ein Prompt, in dem Fachbegriffe nach Kategorie eingefärbt sind
Der Editor, so wie er aussieht. Oben die Werkzeuge, darunter der Prompt — und darin farbig, was das Bild wirklich steuert: Sektionen, Licht („Oberlicht", „low key"), Optik („35mm Weitwinkel", „Schärfentiefe"), Material („Kodak Portra"), Komposition („Drittelregel") und Bewegung („Schwenk"). Man sieht auf einen Blick, wovon der Prompt redet — und wovon nicht.

Ausformulieren

Aus einer Idee einen vollständigen, gegliederten Prompt bauen — Licht, Optik, Kamera ergänzt, statt sie zu vergessen.

Storyboard

Eine Szene in vier bis acht nummerierte Panels zerlegen, jedes ein eigenständiger Bild-Prompt mit Einstellungsgröße und Winkel.

Format, Polish, Kürzen, Erweitern

In Sektionen strukturieren, den Wortfluss glätten, cinematische Details ergänzen oder um rund ein Drittel kürzen — der Kern bleibt.

Fachbegriffe sichtbar

Licht, Optik, Kamera, Material, Farbe, Komposition, Bewegung, Stil werden im Text eingefärbt — gespeist aus dem Filmlexikon. Man sieht, wovon der Prompt redet und wovon nicht.

48 Stile mit deinen Wörtern

Film Stocks, Cinematic Looks, Grafik-Stile. Presets, die Schrift ins Bild setzen, haben Eingabefelder — die Wörter im Bild sind deine.

Vorschau, bevor es Geld kostet

Ein winziges Testbild zum Prompt für rund einen Drittel-Cent. Es wird nicht gespeichert; es beantwortet nur die Frage, ob der Prompt trägt.

~$0,003 je Blick

Eine räumliche Ebene

Im Blocking Board werden Figuren und Requisiten im Kader platziert statt umschrieben. Der Prompt fällt dabei als Nebenprodukt ab — siehe unten.

Zurücknehmen

Jeder Schritt ist umkehrbar, bis zwanzig zurück. Wer probiert, muss zurückkönnen, sonst probiert er nicht.

Warum das ein Werkzeugkasten ist und keine Automatik: wir haben gemessen, ob ein handgeschriebener Prompt besser trägt als ein generierter — 110 Würfe, drei Anläufe, kein Unterschied. Die Werkzeuge sparen also keine Qualität herbei, sie sparen Anläufe. Das ist der ehrliche Anspruch, und er ist mehr wert als der andere.

Warum das Produkt so aussieht#

Fast jede Eigenschaft hier hat eine Messung als Ursache — oft eine, die gegen die eigene Erwartung ausging. Die Reihe von links nach rechts: wann, was gemessen wurde, was daraus im Produkt wurde.

Wie wir messen#

Immer nach demselben Muster: eine Frage, zwei Arme, abwechselnd im selben Lauf geworfen — sonst misst man die Tagesform des Modells statt der Sache. Am Ende ein Kontaktbogen, auf dem jeder Wurf mit seinen Messwerten steht, damit nachvollziehbar ist, was gezählt wurde.

Kontaktbogen mit 30 Bildern, je 15 pro Prompt-Fassung, mit Messwerten unter jeder Kachel
Direktvergleich, 22.08. nachts — 30 Würfe. Links oben die Kopfzeile mit dem Ergebnis: p = 0,936. Unter jeder Kachel die drei gemessenen Werte, golden umrandet die Treffer. Zwei Prompt-Fassungen, die sich als gleich herausstellten — sichtbar in einem Blick statt in einer Behauptung.
Kontaktbogen mit 20 Bildern, zwei Prompt-Varianten für Trennlinien im Raster
Stegtest, 22.08. — 20 Würfe. Zwei Formulierungen für dieselbe Sache. p = 0,474: die Zeile war nicht der Hebel. Der erste von drei Versuchen, einen Effekt zu finden, den es nicht gab.

Was Messen kostet. Die Nacht vom 22.08.: 110 Würfe, rund 8,80 $. Die Stil-Runde vom 02.09.: 18 Generierungen, 2,70 $. Zusammen weniger als ein einziger falsch geratener Kundenjob.

Und warum das hier steht. Weil ein Werkzeug, das nur seine Treffer zeigt, dich die Lücken selbst finden lässt — im Zweifel am Tag vor der Einreichung.

Die Bild-Stile#

48 Stück, alle am selben Motiv gerendert. Nur so ist der Unterschied der Stil und nicht das Motiv — und nur so fällt auf, wenn einer nicht tut, was draufsteht.

Schweizer Plakat: Halbton-Foto im Raster, roter Balken, Helvetica
Swiss International 1962Drei Schriftzeilen, alle korrekt gesetzt.
Handgemalte Cel-Animation mit Tuschelinien und Zweiton-Schatten
Anime-Cel (90er)Tuschelinie und gemalter Hintergrund statt Filter.
Art-Deco-Plakat in Gold und Schwarz mit Sunburst
Art Deco 1928Sunburst, Ziggurat, drei Zeilen fehlerfrei.
Acid-gelbes Glitch-Editorial mit Wireframe-Raum
Cyberpunk GlitchUnd wie verlangt: kein einziges Wort im Bild.

Der Befund der letzten Runde

Fünfzehn neue Grafik-Stile, jedes Bild angesehen und jedes Wort darin gelesen:

Die häufigste Abweichung ist harmlos und wiederkehrend: das Plakat kommt als abfotografiertes Objekt statt vollflächig. Die seltene ist es nicht — und die zwei Fälle stehen unten.

Der Figurenabdruck — dieselbe Person in jedem Licht#

Eine Figur, die im zweiten Bild anders aussieht als im ersten, ist keine Figur. Der Abdruck ist die trainierte Identität: einmal angelegt, danach in jeder Einstellung abrufbar.

Acht Bilder derselben trainierten Figur in acht Lichtsituationen: hartes Oberlicht, Low Key, bedeckter Himmel, Feuerschein, Nachtstraße, Fensterlicht, Sonne, halb von hinten
Die Abnahme, an der ein Abdruck durchfällt oder nicht. Acht Lichtsituationen, von hartem Oberlicht bis halb von hinten. Die Frage lautet nicht „schönes Bild", sondern „dieselbe Person?" — hier acht von acht, das Urteil fällt ein Mensch. Die Figur ist erfunden und aus einer Beschreibung entstanden; kein realer Mensch wurde trainiert.

Etikett oder Geometrie — woran eine Ansage scheitert

Die Identität einer Figur wird über ein Referenzbild gehalten, nicht über Wiederholung im Text. Das funktioniert so gut, dass es ein eigenes Problem erzeugt: die Referenz überstimmt auch das, was sie gar nicht überstimmen soll. Wir haben gemessen, wann — an einer Figur, vier Einstellungen, je zehn Läufen pro Arm, Kriterium vorher festgelegt.

Etikett
Ein Mann steht ruhig und frontal im Studio, Arme am Körper
Die Ansage lautete „dynamic action pose, expressive gesture". Zehn von zehn Läufen zeigen einen ruhig stehenden Mann. 0/10.
Geometrie
Derselbe Mann in Bewegung: ein Bein angehoben, Gewicht auf dem anderen, beide Arme vom Körper gelöst
Dieselbe Figur, dieselbe Referenz — nur beschreibt die Ansage jetzt Mechanik: welches Bein trägt, welche Ferse hebt, wohin die Arme gehen. 3/3 im Nachtest.

Die zwei, die brachen, waren Etiketten: „full side profile" und „dynamic action pose" — Namen für Einstellungen, die ein Modell auch großzügig vergibt. Die zwei, die hielten, beschrieben ohnehin schon Mechanik: „hands resting on thighs", „mid-stride toward camera". Die Referenz frisst keine Haltung. Sie frisst ein Etikett.

Praktisch heißt das: Streitstellen sind an der Formulierung ablesbar, statt sie einzeln messen zu müssen. Steht dort, was zu sehen sein soll, hält es. Steht dort der Name einer Einstellung, gewinnt das Referenzbild.

Farbfeld statt Studiohintergrund — und der Anker, der dabei Ganzkörper wurde#

Ein Sheet ist eine Referenz, kein fertiges Bild. Alles, was darin an Licht steckt — ein Standschatten, ein Boden, der zum Horizont ausläuft — erbt jede Folgeszene und muss dort gegen das Licht der Szene kämpfen. Die Sheet-Ansichten verlangten bisher einen „grauen Hintergrund, gleichmäßiges Studiolicht", also einen fotografierten Hintergrund. Seit dem 2026-10-01 verlangen sie ein Farbfeld: ein einheitliches Mittelgrau an jedem Pixel, ohne Boden, Wand oder Horizont, schattenlos beleuchtet, ohne Schatten und ohne Lichtspill außerhalb der Figur.

Drei Ganzkörperbilder derselben Frau; Boden und Horizont laufen hell aus, in einem Bild ein Schatten neben den Füßen
Vorher: Studiohintergrund. Dieselbe Beschreibung, drei Läufe. Bodenverlauf oder Horizont in 2 von 3, ein Standschatten in einem.
Drei Ganzkörperbilder derselben Frau auf einem fast einheitlichen grauen Grund ohne Boden
Nachher: Farbfeld. Kein Boden in 3 von 3; ein Bild mit leichtem Verlauf. Eckenstreuung 14,1 → 4,1, Unterschied Boden/Kopf 30,5 → 8,0.

Die Messung: Ansicht „Ganzkörper", je drei Läufe pro Arm, Helligkeit der Bildecken und ein Streifen am Boden gegen einen am Kopf. Mit Referenz geprüft (Anker plus fünf weitere Ansichten, Gesichtsähnlichkeit gegen den Anker) hat sich die Identität nicht verschlechtert: bei gleichem Anker für beide Arme 0,684 → 0,735, Unterschied +0,05 bei einem 95-%-Intervall von −0,01 bis +0,12 (13 Paare). Der Gewinn kommt fast nur vom Profil; ohne das sind die Ansichten gleich. Das ist „kein Verlust", nicht „ein Gewinn".

Der Fehlschlag, den wir dabei selbst eingebaut hatten.

Mit dem Farbfeld wurde der Detail-Anker — das Porträt, aus dem alle weiteren Ansichten abgeleitet werden — bei vielen Figuren kein Porträt mehr, sondern ein Halb- oder Ganzkörperbild. Aufgefallen ist es, als wir die Identität mit einer echten Figur nachmaßen: bei einem Lauf mit anderem Anker sah „neu" plötzlich schlechter aus, und die Ursache war nicht die Ähnlichkeit, sondern der Ausschnitt. Der Beschreibungstext der Figur (hier: „Standing at full length, the whole figure inside the frame, both shoes fully visible", bei einer anderen: „trousers and brown leather boots") gewinnt gegen die Ansage „großes Porträt", und der Satz über „die Figur" im Farbfeld hilft dem nicht. Es ist dieselbe Mechanik wie bei Etikett und Geometrie: die Referenz — hier der Text — überstimmt die Ansage.

Drei Zeilen mit je fünf Porträt-Ankern derselben Figur: oben alt, Mitte neu mit mehreren Ganzkörperbildern, unten mit Kadrierungs-Satz alle als Porträt
Figur 190, je Zeile die ersten fünf Läufe (nicht ausgesucht). Oben der alte Hintergrund, Mitte das Farbfeld ohne Gegenmaßnahme, unten das Farbfeld mit einem Kadrierungs-Satz am Ende des Prompts. Die Figur ist erfunden.

Der Fix steht seit dem 2026-10-02 in den Ansichten „detail" und „detail_smile": ein Satz am Ende, der den Kopf-und-Schultern-Ausschnitt über jede Kadrierung im Beschreibungstext stellt. Als Ganzkörper gilt ein Gesicht unter 20 % der Bildhöhe. Grenzen: Figur 190 (echt, zehn Läufe je Arm) und zwei erfundene Testfiguren (je fünf Läufe) sind eine kleine Stichprobe; einzelne Ausschnitte sind jetzt sehr eng, an einer Stirn ist das Haar angeschnitten. Nicht neu gemessen ist, wie gut die Folgeansichten mit dem neuen Anker die Identität halten. Bereits gespeicherte Sheets ändern sich nicht; wer einen Ganzkörper-Anker bekommen hat, erzeugt das Sheet neu.

Dieselbe Person, neunundvierzig Jahre auseinander

Ein Drehbuch verlangte für eine Figur beides: eine Siebenundsiebzigjährige im Bett und dieselbe Frau mit achtundzwanzig, in Rückblenden, die ein Drittel der Folge tragen. Zwei getrennte Figuren im System — und damit zwei Gesichter, die nichts miteinander zu tun haben.

Zwei Porträts nebeneinander: links eine Frau um die dreißig, rechts eine alte Frau mit weißem Haar; gleiche Augenfarbe, gleiche Wangenknochen, gleicher Leberfleck unter dem linken Auge
Gelöst mit fünf Merkmalen, nicht mit einer Behauptung. Beide Beschreibungen tragen dieselben alters­neutralen Angaben: blaugraue, leicht tiefliegende Augen; hohe Wangenknochen; gerade Nase mit leicht nach unten weisender Spitze; dünne, geschlossene Lippen; ein kleiner Leberfleck unter dem äußeren Winkel des linken Auges — und, nachgetragen, die Herkunft. Hier stand zuerst, der Hautton laufe auseinander; er tat es, weil er in keiner der beiden Beschreibungen stand. Das Drehbuch sagt es sehr wohl („zwischen den Gebirgen, die Sie Pamir nennen"), es war nur nie übernommen worden. Beide Figuren sind erfunden.

Drei Generationen — und wie weit das trägt

Dieselbe Familie über vier Sheets: Tochter, Mutter, Großmutter jung, Großmutter alt. Alle vier tragen dieselbe Augenfarbe, und die trägt sichtbar durch.

Vier Porträts nebeneinander: ein Kind, eine Frau um vierzig, eine junge Frau, eine alte Frau — alle mit grau-blauen Augen
Was ein gemeinsames Merkmal leistet, und was nicht. Die Augenfarbe steht in allen vier Beschreibungen und ist in allen vier Bildern da. Gesichtsform und Haarfarbe laufen dagegen auseinander — sie stehen nicht als gemeinsames Merkmal drin, und was nicht drinsteht, würfelt das Modell. Beim Hautton war es genauso, bis die Herkunft aus dem Drehbuch in beide Nova-Beschreibungen nachgetragen wurde; seither hält er. Eine Familienähnlichkeit ist damit anlegbar, aber sie entsteht nicht von selbst: jedes Merkmal, das durchtragen soll, muss in jeder Beschreibung einzeln stehen. Alle Figuren sind erfunden.

„Dieselbe Person, nur jünger" hätte nichts getragen — das ist wieder ein Etikett. Und die Merkmale dürfen nicht von der älteren Figur abgeschrieben werden: „schmales Gesicht mit hohen Wangenknochen" ist an einer Siebenundsiebzigjährigen vom Alter geschnitzt und bringt es rückwärts mit. Der erste Versuch lieferte prompt eine Frau von fünfzig.

Die Beschreibung einer Figur lässt sich nicht mehr spurlos überschreiben

Der Descriptor ist der Text, aus dem jedes Bild einer Figur entsteht, und er ist Handarbeit — einer im Bestand trägt 1349 Zeichen und wurde an einem Tag dreimal geschärft. Bis zum 2. September hatte diese Spalte keine Historie: kein Änderungsdatum, keine Versionen. Ein falsches Überschreiben war endgültig, und die einzige Absicherung waren von Hand angelegte Sicherungsdateien.

Jetzt schreibt die Datenbank jede Fassung selbst mit, samt Zeitpunkt und Herkunft. Bewusst in der Datenbank und nicht in der Anwendung: das Reparatur-Werkzeug, mit dem am selben Tag dreizehn Figuren instand gesetzt wurden, schreibt direkt in die Tabelle und wäre an einer Absicherung in der Anwendung vorbeigelaufen. Ein Schutz, der nur die bekannten Wege kennt, schützt nicht vor dem nächsten Werkzeug. Der Bestand hat seinen damaligen Stand als erste Fassung bekommen — 189 Figuren, damit auch die unangetasteten eine Vergangenheit haben.

Die Einwilligung ist ein Tor, kein Häkchen. Jeder Schritt fragt sie ab, und der Weg mit Fotos einer realen Person ist zwar gebaut, aber ohne Kennung aus dem Likeness-Register nicht befahrbar. Ein Abdruck ist die Identität eines Menschen — er entsteht nicht nebenbei.

Und wenn die Einwilligung zurückgenommen wird? Dann ist der Weg sofort zu — ist das Register nicht erreichbar, gilt das Tor ebenfalls als zu, nicht als offen. Gelöscht wird dagegen nicht automatisch, sondern nach Sichtung: eine Liste führt jeden Abdruck, dessen Einwilligung nicht mehr trägt, und meldet ihn bei jedem Prüflauf wieder, bis er weg ist. Beim Löschen geht seit dem 27.09. auch das Trainingsarchiv mit den Fotos mit — vorher blieb es liegen. Was beim Trainingsanbieter nach dem Lauf verbleibt, erreicht unser Löschen nicht; das steht hier, weil es sonst niemand sagt.

Und was uns dieser eine Durchlauf gekostet hat: acht Fehler, die keine grüne Testsuite gefunden hätte — ein Zeitlimit am schnellsten Modell gemessen, ein Preis, der still auf den Referenzwert zurückfiel, ein Netz für Erstattungen, das übersprungen wurde, weil die Ausnahme darüber flog. Alle acht kamen erst aus echten Läufen mit echtem Geld.

Bewegung — und warum das Modell die teuerste Entscheidung ist#

Ein Standbild in Bewegung zu setzen ist der Schritt, an dem am meisten Geld hängt. Deshalb ist er gemessen und nicht geraten.

Zehn Sekunden aus einem echten Lauf. Die Anweisung lautete: die Kamera steht still, bewegen dürfen sich nur der Rauch, der Efeu — und einmal ihre Hand. Gemini Omni Flash, 10 s, Ton nativ, 80 Credits. Der ganze Weg dorthin steht in der Vorführung.

Dieselbe Einstellung durch sechs Modelle

Gemessen wird, ob der Kader wirklich stillsteht: Rauschabstand zwischen erstem und letztem Bild im unbewegten Bildteil links — dort, wo sich laut Anweisung nichts bewegen darf. Je höher der Wert, desto ruhiger die Kamera.

Sechs letzte Bilder aus sechs Videomodellen, jeweils mit gemessenem Kaderwert, Dauer und Bildzahl; der gemessene Ausschnitt ist gold umrandet
Sechs Modelle, dasselbe Standbild, dieselbe Anweisung. Gezeigt ist jeweils das letzte Bild — dort sieht man, wohin die Kamera gewandert ist. Gold umrandet der gemessene Ausschnitt. Bei Veo ist der Bildausschnitt mit bloßem Auge verschoben; die Zahl darunter sagt dasselbe.
ModellStufeCreditsgeliefertKaderUrteil
Seedance 2.5 *720p65510,04 s43,3 dBsteht still
Seedance 2.01080p94410,04 s39,3 dBhält
Gemini Omni Flashfest17310,00 s38,4 dBhält, mit Ton
Seedance 2.0720p42010,04 s38,2 dBhält
FLUX 3 Video720p23610,04 s33,4 dBleichtes Wandern
MiniMax H3720p8310,12 s29,4 dBwandert
Veo 3.1 fast720p1398,00 s22,8 dBwandert deutlich, zu kurz

Und so sehen die Modelle aus

Die Tabelle oben misst eine einzige Eigenschaft: ob der Kader steht. Wie ein Modell aussieht, entscheidet sie nicht. Vier typische Läufe, jeder ohne Nachbearbeitung — zum Ansehen, nicht zum Vergleichen: es sind verschiedene Motive und verschiedene Anweisungen.

Dieselben vier Läufe stehen seit dem 2. September auch in der Werkbank, unter der Modellauswahl in der Stufe „Video". Bis dahin las man dort dreizehn Modellnamen mit je einem Satz Beschreibung und wählte blind — die Dateien lagen seit vier Tagen fertig daneben, verlinkt hatte sie niemand.

Seedance 2 — das Modell mit dem ruhigsten Kader in der Messung oben.
Kling 2.5 Turbo
Veo 3.1 — in der Messung oben das Modell, dessen Kader am deutlichsten wandert. Das ist hier nicht zu sehen: anderes Motiv, andere Anweisung.
HappyHorse 1

Alle mit demselben Zuschnitt gemessen — untereinander vergleichbar, nicht mit fremden Messungen. * Seedance 2.5 lief als einziges an einem anderen Startbild (dunkler Innenraum statt Balkon, siehe unten). Dunkle, detailarme Flächen heben den Wert; die 43,3 dB stehen deshalb neben der Liste, nicht in ihr.

Der billigste ist nicht der schlechteste, und der teuerste nicht der beste. MiniMax H3 kostet ein Zehntel von Seedance in 1080p und liefert die volle Länge — nur eben eine Kamera, die wandert. Für ein Stimmungsbild reicht das; für eine Anschlussfolge nicht. Genau diese Wahl trifft der Router, wenn man ihm sagt, worauf es ankommt.

Bestellt zehn Sekunden, geliefert acht — jetzt zum zweiten Mal. Beim ersten Mal, in 1080p, war es eine Beobachtung. Mit einem zweiten Lauf in 720p ist es ein Muster: Veo 3.1 fast kürzt, und abgerechnet wird die volle Länge.

Seedance 2.5 lehnt Gesichter ab — und das ist wichtiger als sein Spitzenwert. Der erste Versuch mit dem Balkon-Standbild wurde vom Anbieter zurückgewiesen: das Bild könne „likenesses of real people" enthalten. Es zeigt eine KI-erzeugte Frau; dass sie erfunden ist, kann der Anbieter nicht wissen. Dasselbe Bild hat Seedance 2.0 zweimal anstandslos animiert — die Schranke ist neu in 2.5.

Der Gegenversuch beantwortet die Frage. Dasselbe Modell, derselbe Auftrag, aber ein Startbild ohne sichtbares Gesicht — die Figur von hinten im Sessel, die Identität als Referenz mitgegeben statt im Bild. Es lief durch, in voller Länge, und hielt den Kader ruhiger als alles andere im Test. Die Grenze ist also nicht das Können des Modells, sondern eine Inhaltsschranke: für Nahaufnahmen von Figuren ist Seedance 2.5 auf dem i2v-Weg nicht zu gebrauchen, für alles andere ist es das Ruhigste, was wir gemessen haben. Genau diese Unterscheidung gehört in die Modellwahl und nicht in die Überraschung zur Laufzeit.

Und ein Fund, den dieser Lauf selbst bezahlt hat: beim Ausweichen wich der Router korrekt auf Veo 3.1 fast aus, abgerechnet wurden aber 655 Credits statt 139. Der Fallback liefert das billige Modell und rechnet das teure ab — 516 Credits Differenz an einem einzigen Clip. Notiert, mit Reproduktion und Zahlen, und wird behoben.

Und die Auflösung ist selten das Geld wert: derselbe Clip in 720p statt 1080p kostet weniger als die Hälfte, und der Kader liegt 1,1 dB darunter — bei einem Abstand von 16 dB zwischen bestem und schwächstem Modell. Die Wahl des Modells entscheidet, nicht die Stufe.

Was ein Modell annimmt — steht jetzt am Modell

Startbild, Schlussbild, Referenzbilder, ein Video als Vorlage, Ton als Eingang oder Ausgang: das unterscheidet sich von Modell zu Modell mehr als der Preis. Seit dem 27.09. trägt jedes der 42 Videomodelle seine Eingabe-Rollen, abgeleitet aus derselben Tabelle, die den Aufruf baut — nicht aus einer Beschreibung daneben. Das Schlussbild-Feld erscheint nur, wo das Modell eines nimmt.

Gefunden hat die Tabelle einen Fehler, den die Modellliste für Agenten bis dahin trug: drei Anbieterwege standen dort als reine Text-Modelle und nehmen in Wahrheit ein Startbild.

Seedance 2.5 lehnt Gesichter auch als Referenz ab. Oben steht, dass der Umweg über ein Startbild ohne Gesicht funktioniert, mit der Identität als Referenz. Die Sonde vom 28.09. hat die Referenz selbst geprüft: ein Referenzbild mit Gesicht wird ebenfalls zurückgewiesen, ein reines Ortsbild geht durch. Für Figuren bleibt damit nur Seedance 2.0 — oder ein Modell, das wandert.

Und der Bearbeitungsmodus staucht die Zeit: aus 60 Bildern Vorlage wurden 58. Für einen Schnitt, der auf Bild genau anschließen soll, ist das ein Fehler, kein Rundungsdetail.

Blocking — erst der Raum, dann das Bild#

Wer nur beschreibt, wo jemand steht, bekommt es selten. Wer es hinstellt, bekommt es — das ist gemessen, nicht behauptet.

Blocking Board: drei benannte Figuren als farbige Rahmen im 16:9-Kader, rechts die daraus erzeugte strukturierte Bildbeschreibung
Das Blocking Board. Cast und Requisiten werden im Kader platziert, nicht umschrieben. Aus den Rahmen entsteht rechts die strukturierte Beschreibung mit Koordinaten — der Prompt fällt als Nebenprodukt ab, statt am Anfang zu stehen.

Und bei der Kamerafahrt zählt es doppelt

Ein grauer Rohbau gibt die Fahrt vor, das Modell soll ihr folgen. Gemessen wurde, wie weit der Schwerpunkt der Silhouette wandert — also ob die Kamera wirklich den geplanten Weg nimmt:

LaufSchwerpunkt wandertKamerafolge
Steuervorlage (der Rohbau selbst)7,48 px100 %
ohne Bildanker6,53 px87 %
mit Bildanker1,69 px23 %

Der Bildanker war die Ursache. Ein frontales Referenzfoto überstimmt die Fahrt — es hält das Bild fest, statt es mitzunehmen. Ohne ihn folgt das Modell dem Rohbau.

Der eigentliche Ausschlag ist aber nicht die Prozentzahl: über den Rohbau braucht die volle Fahrt sechs Generierungen statt 360. Das ist der Unterschied zwischen einem Nachmittag und einer Woche.

Komparsen — eine Menge, die auf dem Boden steht#

Eine Straße mit zwanzig Leuten ist das, was ein Videomodell am zuverlässigsten verdirbt: Gesichter verschwimmen, Menschen verschmelzen, die Hälfte steht in der Luft. Deshalb entstehen Komparsen hier nicht im Modell, sondern als eigene Ebene über der Plate.

Im Composer-Schritt Ebenen: Figuren als Karten erzeugen, auf der Plate verteilen, rendern. Die Plate darf ein Standbild sein oder ein Video mit Kamerabewegung, die Komparsen ein Standbild oder ein kurzer Clip mit Freistellung.

SchrittCreditswas dabei passiert
Komparsen-Karte6Figur im Hochformat, mit Füßen — fehlen sie, wird auf unsere Kosten einmal nachgeworfen
Komparsen-Clip276 s, auf Grün gedreht und lokal freigestellt; „stehen" oder „Gespräch"; Erstattung, wenn nichts entsteht
Kamera tracken0für bewegte Plates; rund eine Minute je fünf Sekunden Shot, mit Urteil „trackbar" oder nicht
Verdeckung, Licht, Render0auf unseren Maschinen, 17–39 s bei 12–30 Figuren

Was dabei gemessen wurde

Die Größe. Ohne Anhaltspunkt nimmt die Rechnung Augenhöhe als Kamerahöhe an — bei Untersicht war die Menge dadurch zweieinhalb- bis dreimal zu klein. Jetzt klickst du Fuß und Scheitel der Hauptfigur und gibst ihre Größe ein; die Komparsen bekommen daraus ihre, 1,72 m im Mittel, per Regler zwischen 70 und 130 %.

Die Verdeckung. Steht die Hauptfigur vor der Menge, muss die Menge hinter ihr verschwinden. Vier Modelle für die Personenmaske getestet, eines ohne Fehlalarm — das ist eingebaut. Dasselbe für Gegenstände: Säulen, Laternen, Kioske verdecken seit dem 26.09. von selbst, gemessen an einer Plate mit 99,2 % korrekt gestanzt und 0,015 % zu viel.

Das Tracking. Auf vier KI-erzeugten Plates hat der globale Rekonstruktions­weg drei vollständig erfasst, der übliche schrittweise keinen, das Tracking in Blender einen von drei. KI-Plates sind für klassisches Tracking schwerer als echtes Material; wo es nicht reicht, sagt das Urteil „nicht trackbar", statt eine rutschende Menge zu liefern.

Dieselbe Neon-Gasse dreimal: links heben sich die Komparsen farblos vom blauen Licht ab, in der Mitte und rechts haben sie das Blau der Szene angenommen
Licht-Angleich, vorher · 50 % · 80 %. Die Figuren übernehmen die Farbe des Lichts um sie herum, ihre Helligkeit bleibt. Der Farbabstand zur Umgebung sinkt von 19,2 auf 9,3 beziehungsweise 4,1; die Vorgabe steht auf 60 %. Bei 100 % werden auch die Hauttöne umgefärbt — zu viel. Plate und Figuren sind KI-erzeugt.

Gehen geht nicht. Null von sechs Geh-Clips zeigten einen Gehzyklus. Die Menge steht oder redet; eine Menge, die läuft, ist gesperrt, bis ein Modell es kann.

Und dreimal war die Korrektur selbst der Fehler. Figuren schwebten um bis zu 7,7 % ihrer Höhe über dem Boden, Komparsen maßen 1,31–1,49 m statt 1,72, und die Kamera lag eine Vierundzwanzigstelsekunde neben dem Bild. Jede dieser Stellen war schon einmal „behoben" worden. Seither wird eine Korrektur gemessen, bevor sie als Korrektur gilt.

Tiefe und eine Maske aus Resolve

Depth Map. Für jedes Plate-Video eine Tiefenkarte, nah hell und fern dunkel wie in Resolve, gratis. Gerechnet mit Depth Anything V2 in der kleinen Fassung — die größeren stehen unter einer Lizenz, die kommerzielle Nutzung ausschließt, und sind deshalb gesperrt. Für Gegenstände trägt sie (100 % getroffen), für Personen nicht: sie ordnet Menschen hintereinander in drei von vier, im schwierigen Fall nur in jedem zweiten Bild richtig. Die Personenmaske bleibt deshalb ein eigener Weg. Erreichbar ist die Tiefenkarte derzeit über das MCP-Werkzeug lab_depth_map und die Resolve-Brücke, noch nicht in der App.

Magic Mask als Personenmaske. Wer die Hauptfigur in Resolve sauberer freistellt als die Automatik, schickt die Matte über die Brücke zurück; sie ersetzt dann die automatische Maske und lässt sich wieder abschalten. Den Klick auf die Figur macht ein Mensch in Resolve — per Skript gesetzte Punkte haben in sechs Varianten kein einziges Bild erzeugt.

Ton — die Stufe, die am längsten nur im Menü stand#

Stufe ⑧ heißt „Video + Ton". Die Tonhälfte bot bis zum 2. September fünf Werkzeuge an und hatte eines. Suno, ElevenLabs, ElevenLabs SFX, Freesound standen im Auswahlfeld und antworteten mit einem Fehler. Ein Menüpunkt, der nichts tut, beschwert sich nicht — er wird einfach nicht mehr angeklickt, und dann fällt es niemandem mehr auf.

Jetzt sind es drei, und alle drei laufen. Zwei sind hinzugekommen (ElevenLabs SFX v2 für Geräusche, ElevenLabs TTS Multilingual v2 für Sprache), zwei sind verschwunden: Suno gibt es bei unserem Anbieter nicht — die Suche liefert einen anderen Hersteller mit ähnlichem Namen —, und Freesound ist keine Generierung, sondern eine Bibliothek. Suchen, Lizenz prüfen, Namensnennung mitführen ist ein anderes Werkzeug, kein Häkchen im selben Feld.

Zwei Wellenformen übereinander: oben ein drei Sekunden langer Soundeffekt, unten ein knapp sechs Sekunden langer Voiceover, jeweils mit Dauer, Dateigröße und Preis
Zwei Läufe, 02.09., durch den Produktions-Endpunkt. Oben ein Geräusch („schwere Stahltür fällt ins Schloss, Hall im leeren Treppenhaus"), unten ein Satz Voiceover. Beide Male steht neben der Kurve, was sie gekostet hat — und beim Geräusch, dass die bestellte Länge auch die gelieferte war.
Stable Audio 2.5, ein Lauf zum Anhören. Bis hierher stand über Ton nur eine Kurve und eine Zahl — eine Abbildung von Klang ist kein Klang. Die beiden Läufe aus der Messung darüber (Geräusch und Voiceover) liegen im nicht-öffentlichen Teil des Speichers und fehlen deshalb noch.
Werkzeugrechnet nachBeispielCreditswofür
ElevenLabs SFX v2Sekunde3 s1Geräusche, 0,5–22 s
ElevenLabs TTS Multilingual v21000 Zeichen95 Zeichen2Sprache, Voiceover
Stable Audio 2.5Laufbis 190 s28Musik, Atmo, lange Betten

Drei Werkzeuge, drei Abrechnungseinheiten — und das ist der Punkt. Bis zum 2. September kostete jeder Tonlauf dasselbe: einen Pauschalpreis, der von Stable Audio hergeleitet war, weil es lange nichts anderes gab. Ein Drei-Sekunden-Geräusch hätte darunter dreißigmal so viel gekostet wie es soll.

Aufgefallen ist das nicht durch eine Beschwerde, sondern beim Anschließen der neuen Werkzeuge: der Preis fiel auf, bevor ihn jemand bezahlt hat. Beim Video war dieselbe Sache eine Woche zuvor andersherum gelaufen — dort wurde erst gezahlt und dann gerechnet.

Sequencer — Titel, Abspann und eine Zeile, die sein muss#

Stufe ⑨. Aus Einstellungen wird eine Sequenz. Die Rechenarbeit dafür kostet nichts: hier wird nichts generiert, sondern angeordnet.

Zwölf Look-Vorgaben tragen Filmnamen statt Farbwerte — Blade Runner 2049, In the Mood for Love, Grand Budapest Hotel, 2001, Chinatown, Tree of Life, Amélie, Mad Max: Fury Road, Moonlight, Parasite, Drive, Stalker. Das ist keine Koketterie: wer im Schneideraum sagt „mach das mehr wie Moonlight", wird verstanden, und ein Zahlenpaar für Farbtemperatur und Sättigung wird es nicht.

BlockLängewas er ist
Titel5 sTitel und Unterzeile; leer heißt Projekttitel
Abspann8 sRolle und Name, zeilenweise
KI-Kennzeichnung4 sPflicht nach Art. 50 Abs. 4 KI-VO

Der dritte Block ist kein Angebot. Art. 50 Abs. 4 der KI-Verordnung verlangt bei KI-erzeugten Personen eine Offenlegung. Sie steht deshalb nicht in einer Checkliste, die man abhaken kann, sondern als Baustein neben Titel und Abspann — an derselben Stelle, an der man ohnehin arbeitet, mit vorformuliertem Text und vier Sekunden Standzeit.

Ehrlicher Nachtrag vom 28.09.: „Pflicht" ist an diesem Block eine Beschriftung, keine Sperre — ein Export ohne ihn wird nicht verweigert. Was nicht abwählbar ist, sitzt seit dem 25.09. eine Ebene tiefer: jeder Render mit KI-Material trägt das Kennzeichen im Bild und in der Datei, ob der Block drin ist oder nicht. Mehr dazu unter Herkunft.

Lotte — die Assistenz im Schneideraum, und was sie heute wirklich kann#

In Murnau steht rechts neben dem Schnittbereich eine eigene Spalte mit drei Eingabezeilen — Schnitt, VFX, Ton —, darüber ein kleines Zeichen und der Name Lotte. Dort stand bis zum 17. September 2026 „AI". Der Name ist keine Verpackung: er zeigt auf Lotte Reiniger, die 1926 mit Die Abenteuer des Prinzen Achmed den ersten abendfüllenden Animationsfilm gemacht hat — aus geschnittenem schwarzem Papier, von hinten durchleuchtet, die Flächen dahinter von Hand eingefärbt.

Das Zeichen ist seit dem 22. September 2026 ein Korridor: fünf dunkle Bänder, die nach außen ziehen, auf einer leuchtenden Scheibe in Glut-Orange. Die Bänder wandern in 21 Sekunden durch sechs tiefe Töne — Dunkelbraun, Karmin, Violett, Nachtblau, Petrol, Tannengrün —, an ihren Rändern laufen zwei farbige Säume gegeneinander, wie ein Objektiv Rot und Blau verschieden weit bricht. Spektralfarben, wie hier bis zum 28.09. stand, sind es nicht: auf dem hellen Orange hielt keine davon genug Abstand, gemessen 1,04:1 bis 2,64:1. Dunkel auf Licht, das bleibt Reinigers Prinzip.

Die Saisons sind geblieben, anders als hier bis zum 28.09. stand: Halloween, Weihnachten, Ostern und Silvester färben die Scheibe, die Figur bleibt dieselbe. Die Berlinale gibt es nur über ?saison=berlinale — ein Festivaltermin folgt keiner Formel. ?saison=aus erzwingt den Grundton.

Das Zeichen sagt auch, was gerade läuft. Ruhig braucht ein Band fünf Sekunden nach außen; während sie antwortet, 1,35; während sie liest, zieht es rückwärts — sie nimmt auf, statt zu senden. Liegt ein Vorschlag an, wickelt sich der Korridor zu einer Spirale auf, die sich über die Gültigkeit des Vorschlags (15 Minuten) wieder abwickelt. Ist sie am Kern angekommen, ist der Vorschlag verfallen. Wer keine Bewegung sehen will, bekommt über die Systemeinstellung ein stehendes Bild in voller Stärke.

Ein Feld, ein Knopf

Bis zum 19. September 2026 standen an dieser einen Zeile drei Knöpfe. Apply schickte den Text an einen Klassifikator, Fragen an Lotte, Inspire war gar kein Modell, sondern eine Liste — und wählte aus sechs festen Sätzen einen zufällig aus. Der Nutzer musste sich also vor dem Tippen entscheiden, ob er ändern oder fragen will. Das ist eine Entscheidung, die man erst nach der Antwort treffen kann.

Jetzt geht alles an Lotte. Sie darf das erst, seit sie mehrere Schnitte in einem Zug vorschlagen kann und die Regler kennt — vorher hätte ein Verb die Fähigkeit gekostet, mit einer Anweisung jede Einstellung zu treffen. Erst das Werkzeug, dann die Bedienung.

Die sechs Anregungen stehen als Auswahl unter dem leeren Feld und verschwinden, sobald du tippst. Eine Anregung neben einem halb getippten Satz ist kein Angebot mehr, sondern Ablenkung.

Sie heißt nicht überall gleich

In allen drei Flächen stand dieselbe Lotte — obwohl FilmRadar seit Juli eine ganze Besetzung führt: zehn Gewerke und zwanzig Board-Fassungen, mit Namen, Werdegang und Denkweise. Murnau kam nur nicht heran.

FlächeWer dort stehtGewerk
SchnittTarek MansouriFilmeditor, denkt in Rhythmus, Ellipsen, Kontrasten
TonRafael DuarteKomponist und Sound Designer, denkt beides als Einheit
VFXAnders MarderBildgestaltung — Licht, Textur, Farbe, Raum

Das Zeichen bleibt Lottes. Der Lichtkorridor ist die Handschrift der Assistenz, nicht der Ausweis einer Person — er trägt jetzt drei Namen. Fällt die Registry aus, steht wieder „Lotte" da: die Besetzung ist Anreicherung, kein Betrieb. Ein Editor, der nicht mehr antwortet, weil eine fremde Datenbank klemmt, wäre ein schlechter Tausch gegen einen Namen.

In der Registry sind sie Gutachter — hier arbeiten sie. Jede Persona endet mit „Antworte IMMER als JSON mit exakt diesen Feldern: score, headline, strengths, concerns". So sind sie für das Urteils-Tier von ScriptLab gebaut. Für Murnau wird genau dieser Teil abgeschnitten: es kommt nur der Mensch mit, nicht das Formular. Eine Bedienerin, die auf jede Anweisung eine Note zurückgibt, wäre unbrauchbar — und sie täte es, weil ein Vertrag im Prompt schwerer wiegt als jede spätere Bitte.

Die Figur zeigt grob, das Feld genau

Das Zeichen trug einen Tag lang fünf Zustände — Schere, Filmstreifen, fertiger Schnitt, gerissener Bogen. Bei 36 Pixeln war das die falsche Bühne: was liest, wartet auf dich und fehlgeschlagen unterscheidet, braucht Worte, keine Silhouette. Und der Stern für den fertigen Vorschlag stand dreißig Pixel neben dem Stern des Inspire-Knopfs.

Heute sind es vier Zustände aus einer einzigen Figur — bereit, denkt, liest, Vorschlag —, unterschieden nur durch die Bewegung, nie durch ein Symbol. Alles Genaue steht am Feld, wo das Auge beim Tippen ohnehin ist und wo volle Breite zur Verfügung steht: ein Balken am unteren Feldrand während der Arbeit, die Zeile darunter für Antwort, nachgeschlagene Werkzeuge und Fehler.

Warum eine Liste und kein Absatz im Systemprompt

Murnaus /ai/interpret hatte drei handgeschriebene Systemprompts, jeder mit seiner eigenen Aufzählung des Nichtmöglichen. Am 2026-09-17 gemessen war die Schnitt-Fassung bei vier von fünf Punkten falsch: sie erklärte Schneiden, Löschen, Umsortieren und Übergänge für unmöglich, obwohl alle vier im Editor stehen.

Für den Nutzer sieht das nicht wie eine Schnittstellen-Grenze aus, sondern wie eine Produkt-Grenze. Er fragt einmal, liest „gibt es nicht", und fragt nicht wieder. Eine Liste in Prosa veraltet, weil kein Wächter zwei Sätze vergleichen kann; diese veraltet nicht, weil jeder Eintrag einen Beleg trägt, den scripts/ci/check_playbook_belege.py in jedem Pull Request nachschlägt — und zwar in beide Richtungen. Wer splitClipAtFrame baut und den Eintrag auf nein stehen lässt, wird rot.

Sie steht jetzt auch im Composer — und kennt den Preis

Seit dem 25.09. sitzt Lotte auch rechts im Composer, der Werkstatt mit den zehn Stufen. Dort liest sie, was ein Mensch vor einer Entscheidung nachsehen würde: wo das Projekt steht, was ein Schritt kostet, welcher Tarif was enthält, wie viel Guthaben übrig ist. Nennt sie eine Stufe, dann beim Namen und nicht beim internen Schlüssel — das stand bei der Abnahme einmal falsch da.

Sie schlägt vor, statt zu handeln, und trennt dabei zwei Sorten:

Kann sie den Preis nicht sicher erfragen, gibt es den bezahlten Vorschlag nicht — ein Knopf ohne Zahl darauf wird nicht gebaut. Ausgeführt wird ohnehin nur, was du anklickst.

Braucht eine Frage ein Gewerk, holt sie es beim Namen dazu: eine der zehn Crew-Rollen, höchstens zwei je Antwort. Fällt die Besetzung aus, antwortet sie selbst, statt zu schweigen. Und in Murnau führt sie seit dem 24.09. ein Protokoll — die letzten zwölf Antworten, neueste oben; vorher löschte jede Antwort die vorige. Jeder Schritt darin nennt seine Dauer, auch der gescheiterte.

Mit der Resolve-Brücke kennt sie auch die offene Resolve-Timeline und kann dort Tiefe und Magic Mask vorschlagen. Einen Clip schlägt sie dort nicht vor: dafür bräuchte es ein Quellbild, das es an der Stelle nicht gibt.

Widerspruch ist ein Werkzeug, kein Formular

Wenn Lotte etwas Falsches sagt, kann sie es zurücknehmen. Der Widerruf landet nicht als Löschung, sondern als Korrektur neben der Quelle: eine gelöschte Falschauskunft kommt bei der nächsten Aufnahme wieder, eine korrigierte nicht. Die Korrektur trägt, wer sie geschrieben hat — ohne Identität gibt es keinen Schreibweg, und was du korrigierst, sieht niemand sonst.

Die Regler — zwölf Zahlen, die bis gestern nichts bedeuteten#

Unter jeder der drei Leisten sitzt eine Reihe Schieber. Sie sehen aus wie Bedienelemente, und bis zum 19. September 2026 waren sie keine: der Wert wanderte in ein Objekt, das Objekt reiste als sliders mit dem Auftrag mit, und im Prompt landete es als nackte Zeile —

{"pace":100,"tension":50,"rhythm":50,"flow":75}

ohne Einheit, ohne Skala, ohne ein Wort Erklärung. Pace 0 und Pace 200 erzeugten dieselbe Anweisung. Was das Modell daraus ableitete, war Glückssache.

Schnitt

ReglerBereich · Vorgabehoch heißtniedrig heißt
Pace0–200 · 100straffen — Totzeit raus, früher schneidenLuft lassen, Pausen stehen lassen
Tension0–100 · 50auf die Bewegung schneiden, gegen Ende kürzenausatmen lassen, auslaufen lassen
Rhythm0–100 · 50gleichmäßige Längen, auf den Taktbewusst ungleich — lang gegen kurz
Flow0–100 · 75weiche Übergänge, J- und L-Schnitteharte Schnitte, Brüche stehen lassen

VFX

ReglerBereich · Vorgabehoch heißtniedrig heißt
Intensity0–100 · 100voll ausspielenzurücknehmen — angedeutet
Blend0–100 · 100nahtlos — Korn, Farbe, Licht angeglichensichtbar aufgesetzt, als eigenes Element
Detail0–100 · 50Haare und Kanten sauber — langsamer, teurergrob halten
Edge0–100 · 75harte, präzise Kanteweich und ausgefranst — richtig bei Bewegungsunschärfe und Haar

Ton

ReglerBereich · Vorgabehoch heißtniedrig heißt
Loudness−24…0 · −14lauter Richtung 0 — Social-Endeleiser — Kino und Archiv
Dynamics0–100 · 50leise und laut auseinanderlassenkomprimieren — gleichmäßig laut
Clarity0–100 · 60Sprache nach vorn, Störgeräusch zurückden Raum ungeschönt lassen
Depth0–100 · 40Hall und Tiefe zulassentrocken und nah

Loudness ist kein Geschmack, sondern eine Norm. Das sind LUFS, und die Zielwerte stehen in diesem Handbuch schon weiter unten: −14 für Web und YouTube, −12 für Social, −24 für Kino und Archiv. Wer dort schiebt, wählt eine Abgabe-Norm, keine Klangfarbe.

Genau dieser Regler ist beim Inventarisieren zweimal übersehen worden — er ist der einzige mit negativem Bereich, und die Messung, die ihn finden sollte, ließ kein Minuszeichen zu. Ein Regler mit negativem Bereich sieht in einer Zählung, die nur positive Zahlen kennt, aus wie gar keiner. Gefunden hat ihn der Wächter beim ersten Lauf.

Was der Auftrag wirklich mitbekommt

Nur Abweichungen. Ein Regler auf Vorgabe ist keine Anweisung, sondern die Abwesenheit einer — stünde er trotzdem im Text, wäre die eine Abweichung, auf die es ankommt, zwischen drei belanglosen versteckt. Stehen alle auf Vorgabe, bekommt das Modell den Satz „entscheide nach dem Material".

Jede Leiste schickt ihre eigene Gruppe. Pace und Tension sagen einem Compositing-Auftrag nichts; vorher hätte die VFX-Leiste die Schnitt-Bedeutungen vorgesetzt bekommen und darin keinen einzigen ihrer Namen wiedergefunden.

Und die Bedeutung steht an einer Stelle, für beide Wege — den schnellen Klassifikator und die Werkzeugschleife. Ein Regler, der an einem Weg gilt und am anderen nicht, ist schlimmer als einer, der nirgends gilt: du schiebst ihn, siehst eine Wirkung, und beim nächsten Mal bleibt sie aus.

Die Cue-Spur — den Prompt gegen den fertigen Schnitt halten#

Unter der Timeline liegt eine zusätzliche Spur, beschriftet CUES. Sie beantwortet eine Frage, die sonst niemand stellt, weil sie zu mühsam ist: Ist das, was im Prompt steht, im Bild tatsächlich passiert?

Ein Cue ist eine einzelne Aussage aus dem Prompt, gebunden an ein Fenster im Schnitt. „Harter Schnitt bei 00:01.50, Kamera auf den Helden, medium" ist ein Cue. Er steht nicht als Kommentar daneben, sondern liegt auf den Frames, für die er gilt — und ist damit vergleichbar mit dem, was dort wirklich zu sehen ist.

Zehn Typen, und zwei davon verhalten sich anders als die acht übrigen. Die ersten acht kommen aus SceneFlow und gelten jeweils einem Zeitfenster: dialogue, action, camera, shot, audio, vfx, transition, environment.

Die beiden anderen gelten dem ganzen Clip. regel kommt aus POSITIVE CONSTRAINTS beziehungsweise RULES („genau drei Personen, keine vierte"), referenz satzweise aus ACTIVE REFERENCES („@Video1 ist die alleinige Autorität für Kamera, Schnitte und Timing"). Eine Regel hat kein Fenster, in dem sie gilt — sie gilt immer. Deshalb stehen beide in der Spur links als Zählung (@ 9 · § 7) und nicht als Block an einer Stelle.

Vier Befunde, und warum „anders" nicht „fehlt" ist

Jeder Cue trägt ein Urteil. Vier sind möglich, und der Unterschied zwischen den letzten beiden ist der, auf den es ankommt:

BefundBedeutungWas er über das Modell sagt
offennoch niemand hat hingesehennichts — es ist keine Aussage, sondern deren Abwesenheit
dasteht so im Bilddie Anweisung ist angekommen
fehltkommt im Bild nicht vordie Anweisung wurde überhört
andersetwas passiert, aber nicht dasdie Anweisung wurde verstanden und uminterpretiert

Die Trennung ist keine Erbsenzählerei. fehlt heilt man mit Nachdruck — die Anweisung deutlicher, früher, wiederholt. anders heilt man damit nie: das Modell hat die Stelle gelesen und sich anders entschieden. Da hilft nur, die Anweisung umzuschreiben. Wer beides in einen Topf wirft, probiert die falsche Abhilfe so lange, bis er das Modell für unbrauchbar hält.

Die Beschriftung der Spur nennt immer zuerst, was offen ist: „12 offen · 31 da · 6 fehlt · 2 anders (79 %)". Eine Quote, die zwölf ungeprüfte Cues verschweigt, liest sich wie ein Ergebnis und ist eine Zwischenmeldung.

Zwei Zahlen, die verschieden sind — und einmal gelogen haben

Im Kopf der Prompt-Ansicht steht „19 von 19 Stelle(n) markiert". Beide Zahlen sehen aus, als müssten sie gleich sein. Sie sind es nicht, und der Unterschied ist der ganze Sinn der Anzeige.

Die zweite Zahl gehört dem Quellclip und kennt alle seine Cues. Die erste gehört diesem Vorkommen im Schnitt — und ein getrimmter Clip enthält die Beats außerhalb seines Fensters nicht. Am 18. September 2026 meldete der Kopf „19 Stellen markiert", gezeichnet waren 17: das Vorkommen war auf 19 von 96 Frames getrimmt, zwei der drei Beats fielen heraus. Die Zahl stimmte für den Quellclip und log für das, was auf dem Schirm stand.

Die Fehlenden werden genannt, nicht verschwiegen. Steht hinter der Bilanz „· 2 außerhalb dieses Schnitts", dann ist das die Auskunft, die ein Schnittmensch braucht. Ohne sie vergleicht er Prompt und Ansicht, findet zwei Stellen zu wenig und sucht den Fehler bei sich.

Warum ein Urteil eine Neu-Extraktion überlebt

Der Prompt ändert sich, die Cues werden neu aus ihm gelesen — und die Urteile wären weg. Sie sind es nicht: ein Befund hängt an Typ, Wortlaut und Zeitfenster, nicht an der Stelle im Text.

Die Zeichen-Offsets zählen ausdrücklich nicht mit. Sie verschieben sich schon, wenn anderswo im Prompt ein Zeichen dazukommt — und ein Urteil gilt nicht der Stelle, an der ein Satz steht, sondern dem, was er sagt. Was sich nicht wiederfindet, wird nicht stillschweigend fallen gelassen: die Antwort nennt befunde_übernommen und befunde_verworfen, damit ein Verlust auffällt, statt sich als leere Spur zu tarnen.

Was die Spur nicht tut: urteilen. Die Cues liest sie aus dem Prompt, das Fenster rechnet sie aus dem Schnitt — den Befund setzt ein Mensch, der sich das Bild angesehen hat. Es gibt keine automatische Abnahme und keine Quote, die von selbst entsteht. Eine Maschine, die ihre eigene Anweisungstreue benotet, benotet ihre eigene Lesart des Prompts.

Der Schnitt — ein Stand für Mensch und Agent#

Bis zum 23.09. sahen der Mensch in Murnau und ein Agent über MCP zwei verschiedene Schnitte derselben Sequenz. Das Speichern im Editor schrieb in die eigene Sitzung, der Agent las woanders.

Jetzt schreibt jedes Speichern, auch das automatische, den Schnitt dorthin durch, wo der Agent liest. Überschreibt es dabei Arbeit des Agenten, sagt die Speicherzeile, was weg ist — „3 Clips des Agenten überschrieben (8 s, 2 Blenden, 2 Tonspuren)" — und legt vorher einen Stand an, aus dem es zurückkommt. Das war nötig: am 24.09. hat ein einziger Klick eine Sequenz mit einem Clip überschrieben, weil der Editor bei zehn Sequenzen im Projekt geraten hatte, welche gemeint war. Gerettet hat sie der Stand. Seither rät er nicht mehr: ist das Ziel unklar, fragt er.

Edit Index — Umschalt+I

Die Schnittliste als Tabelle: Spur, Quell-Ein und -Aus, Timeline-Ein, Dauer, Quelle, Shot — in Timecode. Nur Bildspuren.

Stand sichern

Einem Stand einen Namen geben — im Kopf „Stände", dann „Stand sichern". Benannte Fassungen fallen nie unter den Deckel von 50 automatischen Ständen und zählen nicht dagegen.

Schnitt-Historie

Die Liste der Stände, und zu jedem auf Abruf: was änderte sich? Wer geändert hat — du oder ein Agent — steht dabei.

Ansehen ja, Zurückholen aus dieser Liste noch nicht

Einfügen schiebt

Was nach dem Einfügepunkt liegt, rückt um die volle Dauer; ein Clip, der über den Punkt reicht, wird geteilt. Vorher legte der Knopf übereinander — siehe oben.

OpenTimelineIO — der Schnitt kann das Haus verlassen

Eine Sequenz lässt sich als OTIO ausgeben und wieder hereinholen, etwa aus einem anderen Schnittprogramm zurück. Der Rückweg legt immer eine neue Sequenz an und überschreibt nichts; die Kennung jedes Clips reist mit, damit er drüben und hier derselbe bleibt.

Bildgenau, nicht bitgleich. 5,5 Sekunden kommen als 5,52 zurück — 138 Bilder bei 25 fps, weil ein halbes Bild in die Länge gehört und nicht verschwinden darf. Wird ein Clip drüben geteilt, behält nur das erste Stück seine Kennung.

Und wo der Knopf ist: noch nirgends. Beide Richtungen sind gebaut und getestet, erreichbar sind sie heute über die Schnittstelle, nicht über die Oberfläche.

Resolve und Agenten — eine Fassade für beide#

Die Resolve-Brücke läuft in DaVinci Resolve, nicht daneben. Das ist keine Stilfrage: Resolve aus dem App Store lässt sich von außen nicht skripten — die Schnittstelle antwortet schlicht mit nichts, gemessen am 12.09. Von innen geht es.

Seit dem 27.09. bilden Brücke und MCP-Server eine gemeinsame Fassade. Ein Agent — etwa Claude am Schreibtisch — sieht damit FilmLab und die offene Timeline zugleich. Dazu gehört ein Viewer, der das Bild unter dem Abspielkopf zeigt und eine Tiefenkarte per Wischblende darüberlegen kann — gebaut, aber noch nicht in jedem Agenten-Programm abgenommen.

SeiteWerkzeugedavon schreibend
FilmLab (MCP)82Generieren, Grade, Tiefe, Schnitt — bezahlte nur mit Freigabe
Resolve (Brücke 0.67)143: Magic Mask tracken, Matte exportieren, Ergebnis an die Timeline

Jedes der drei schreibenden Resolve-Werkzeuge legt vorher ein Duplikat der Timeline an. Ein Agent, der in deinem Schnitt arbeitet, soll ihn nicht verlieren können.

Den Klick macht ein Mensch. Magic Mask lässt sich per Skript tracken und exportieren, aber nicht anstoßen: in sechs Varianten gesetzte Punkte haben kein einziges Bild erzeugt. Die Figur anklicken musst du selbst.

Und drei Grenzen aus dem ersten Tag: Tracking läuft nur bei offener Fusion-Seite; der Dialog „Render completed!" hält Resolve an, bis ihn jemand wegklickt; und ein Aufruf hat zwanzig Sekunden, bevor der Agent aufgibt.

Zwei Stufen, wo es Geld kostet. Ein Agent bekommt zuerst den Preis in Credits und Euro, dann eine Freigabe-Kennung, die genau für diesen Aufruf mit genau diesen Angaben gilt, einmal und fünfzehn Minuten lang. Eine Hintertür, beliebigen Code in Resolve auszuführen, gibt es nicht.

Export — sechs Ziele, und was sie wirklich unterscheidet#

Stufe ⑩. Auch sie kostet keine Credits — gerechnet wird auf unseren Maschinen, nicht bei einem Modellanbieter.

Ein Export ist nicht „eine Datei in einer Auflösung". Er ist ein Bündel aus Farbraum, Dynamik, Codec, Container und Lautheit — und die Lautheit ist die Zahl, an der die meisten Abgaben scheitern, weil sie im Schnittprogramm nicht auffällt.

ZielFarbraumCodecAuflösungLautheit
Web / FrameZerosRGB · SDRH.264 / MP41080p−14 LUFS
Social (IG/TikTok)sRGB · SDRH.264 / MP41080×1920−12 LUFS
YouTubeRec.709 · SDRH.264 / MP42160p−14 LUFS
Streaming HDRRec.2020 · HDR10H.265 / MP42160p−14 LUFS
Kino-ProjektionDCI-P3 · HDRProRes / MOV4K DCI−24 LUFS
Archiv / MasterRec.2020 · HDRProRes 44444K−24 LUFS

Die Lautheit ist der Unterschied, der weh tut. Zehn Dezibel liegen zwischen Social und Kino — −12 gegen −24 LUFS. Wer einen Kinomix bei Instagram hochlädt, wird leise gedreht und klingt dünn; wer umgekehrt liefert, fällt bei der Abnahme durch. Es ist dieselbe Sequenz, und es sind zwei verschiedene Dateien.

Quer über alle sechs Ziele liegen drei Qualitätsstufen: Draft (halbe Auflösung, für den schnellen Blick), Standard und High Quality (doppelte). Die Stufe ändert Auflösung und Datenrate, nicht das Profil — Farbraum und Lautheit bleiben, wo das Ziel sie hinlegt.

Herkunft — was ein Export über sich selbst sagt#

Ein Sender, ein Festival, eine Förderung fragt irgendwann: was in diesem Film ist KI, und wer hat es freigegeben? Seit dem 26.09. liegt die Antwort neben jeder Filmdatei — und ist prüfbar, ohne uns zu vertrauen.

Zu jedem Export entsteht ein Herkunftsnachweis, als PDF zum Lesen und als JSON für Maschinen, mit einem Link auf die Prüfseite. Er liegt neben der Filmdatei, nicht in ihr: ein Nachweis, der in der Datei steckt, deren Prüfsumme er nennt, wäre zirkulär.

Was drinstehtWas nie öffentlich wird
Prüfsumme der Filmdatei, Dauer, ob die Kennzeichnung im Bild ist, Freigabe mit DatumPrompts — die sieht nur, wem das Projekt gehört
je Clip: Timecode, Quelle, Art (z. B. Bild zu Video), Werkzeug, Anbieter, ErzeugungszeitEinwilligungs-Kennungen, E-Mail, Konto

Prüfen geht unter seal.thefilmradar.com/herkunft: die Datei hineinziehen, der Browser rechnet ihre Prüfsumme aus, hochgeladen wird nichts. Der Nachweis ist mit einem Schlüssel signiert, dessen öffentliche Hälfte dort liegt, dazu mit zwei Zeitstempeln, einer davon in der Bitcoin-Blockchain verankert. Wer uns nicht glaubt, prüft mit OpenSSL selbst; die Anleitung steht auf der Seite.

Die Kennzeichnung sitzt im Bild und in der Datei

Jeder Render mit KI-Material trägt unten rechts das Zeichen „KI-verändert" und in der Datei den maschinenlesbaren Vermerk nach IPTC. Dass das bis zum 25.09. in Murnau nicht stimmte, obwohl die Datenbank es behauptete, steht oben. Aufgefallen ist es erst, als jemand an der Datei nachsah statt am Feld.

Freigabe — nur, wo eine synthetische Person oder Stimme drin ist

Enthält ein Export eine erzeugte Person (ein Clip nach einer Figur) oder eine erzeugte Stimme (Voiceover, Dialog, Synchron), hält er vor dem Export an und verlangt einen Satz:

„Ich habe diesen Export angesehen und gebe ihn frei. Er enthält synthetisch erzeugte oder veränderte Personen oder Stimmen."

Festgehalten werden Konto, Zeitpunkt und die Fassung dieses Wortlauts; die Prüfseite zeigt nur das Datum. Ton, den ein Videomodell selbst mitliefert, löst keine Freigabe aus. Und freigeben kann nur ein angemeldeter Mensch in der Oberfläche — ein Agent über MCP bekommt an dieser Stelle eine Absage. Ein Satz, der sagt „ich habe es angesehen", ist wertlos, wenn ihn eine Maschine unterschreiben kann.

Was der Nachweis nicht belegt — und das steht auch auf der Prüfseite. Die Timecodes gelten für den Export aus FilmLab, nicht für die gesendete Fassung; dazwischen liegen Conform, Grading, Transcode. Die Einordnung je Clip folgt dem, was das System beim Erzeugen festgehalten hat, nicht dem Urteil eines Menschen — und wo es nichts festgehalten hat, steht „nicht festgehalten", nicht eine Vermutung.

Und was er nicht ist: kein C2PA-Zertifikat mit Kette zu einer Prüfstelle. Er ist ein eigener, offengelegter Nachweis. Synchronfassungen, die über den Kurzweg entstehen, bekommen noch keinen. Aufbewahrt wird er in reduzierter Fassung zehn Jahre über das Vertragsende hinaus, damit er auch dann noch prüfbar ist, wenn das Projekt längst gelöscht ist.

Und was wir ausgeschlossen haben#

Nicht jede Messung endet in einer Funktion. Manche enden darin, dass ein Weg zugemacht wird — und das ist die billigste Art, Geld zu sparen.

Die Frage vom 19.07.: lässt sich für die Lippenbewegung eine freigegebene Mundregion per Maske neu generieren, während der Rest des Bildes stehenbleibt? Drei bezahlte Läufe, in denen genau eine Variable getauscht wurde:

LaufMaskeAuftragsstatusSichtbare Wirkung
Entwurfstatisches Bildcompletedkeine
hohe Qualitätstatisches Bildcompletedkeine
Nachfolgeechtes Maskenvideo, Bild für Bild deckungsgleichcompletedkeine
Kontaktabzug: vier Vollbilder und 31 Mund-Ausschnitte aus einem Lauf, in allen bleibt der Mund geschlossen
Der Beleg, aus dem Archiv zurückgeholt. Oben vier Vollbilder, unten 31 Mund-Ausschnitte aus genau der Region, die per Maske freigegeben war. Kein Bild unterscheidet sich vom nächsten. Der Quellclip war das Demo-Material des Anbieters, die Figur ist synthetisch.

Alle drei meldeten Erfolg. Der Mund blieb in allen drei geschlossen — nachgesehen auf einem Kontaktabzug aus 31 Einzelbildern, einmal ganz und einmal als Mund-Ausschnitt. Ohne diesen Blick wäre der Weg als „funktioniert" in die Pipeline gewandert.

Die Lehre steht seither über allem hier: ein Anbieter, der ein Feld dokumentiert, liefert damit noch keine Wirkung. Der Statuscode sagt, dass etwas lief. Ob es etwas getan hat, sagt nur das Bild.

Wo es nicht funktioniert hat#

Zwei Presets taten etwas, das niemand bestellt hatte. Beide Fehler steckten in der Formulierung, nicht im Modell — und beide alten Fassungen bleiben wählbar, damit niemandem etwas unter den Händen weggezogen wird.

„Haut wird zu Bändern" — und der Mantel war weg

vorher
Psychedelisches Konzertplakat, Figur ohne Kleidung
Die Zeile beschrieb eine Fläche, ohne zu sagen welche Haut. Die Engine schafft sich die Fläche, die der Satz verlangt.
nachher
Dasselbe Plakat, Figur im Mantel
Kleidung ausdrücklich erhalten, nur ohnehin sichtbare Haut wird zu Bändern. Schrift buchstabengetreu.

„Subject" war für die Engine das Bild, nicht die Person

vorher
Türrahmen aus Luftballons, Person davor bleibt fotografisch
Der Türrahmen wurde zur Skulptur, die Person blieb ein Foto — genau umgekehrt zum Auftrag.
nachher
Die Figur selbst besteht aus Luftballons
Das Motiv zuerst und in Großbuchstaben benannt. Jetzt ist die Figur aus Ballons: Mantel, Beine, Stiefel, Haar.

Zwei Grenzen, die keine Formulierung verschiebt

Der Content-Filter der Bildmodelle ist Teil der Produktionsplanung. Eine Figur, deren Beschreibung eine Selbstverletzung enthält — weil die Szene sie enthält —, bekam sechs von sechs Einstellungen abgelehnt. Bei einer anderen Figur scheiterte genau eine Einstellung, und zwar sechsmal hintereinander: die Kombination aus „zitternde Hände, starre Haltung wie bei mechanischer Atmung" und „auf die Kamera zugehend" liest der Prüfer als Notlage. Das ist kein Zufallsfehler, den ein zweiter Klick löst.

Wir schreiben solche Beschreibungen nicht um, um einen Filter zu überlisten. Die Figur gehört dem Buch, nicht dem Anbieter. Was wir stattdessen tun: den Ausfall benennen. Die Antwort sagt seit dem 2026-09-02 ausdrücklich, welche Einstellungen nicht entstanden sind — vorher fehlten sie schlicht in der Liste, und ein halbes Sheet sah aus wie ein ganzes.

Und für Kinder beschreibt das System keine Anatomie — mit Absicht. Für Erwachsene trägt es das Alter automatisch als Anatomie in jede Ansage: bei vierunddreißig „erste feine Stirnfalten, noch straffe Kieferlinie", bei siebenundsiebzig „tief zerfurchtes Gesicht, hängende Lider, Altersflecken". Unter achtzehn trägt es nichts, und das ist keine Lücke, sondern eine festgelegte Grenze dieses Produkts.

Der Preis dafür ist real und soll hier stehen: eine Zehnjährige kam zweimal als Fünfjährige zurück, obwohl ihre Beschreibung Zehnjährigen- Proportionen nannte. Wo die Beschreibung dünn ist, setzt das Modell sein eigenes Alter, und dagegen hilft an dieser Stelle nur genaue Handarbeit in den Figurenfeldern — und Hinsehen.

Streuung ist real. Derselbe Prompt sitzt mal im ersten, mal erst im zweiten Anlauf. Ein Fehlschlag bei einem harten Stilwechsel ist meistens kein Preset-Fehler, sondern ein zweiter Klick.

Und eine Grenze, die keine Textregel schließt: Sachfehler. Ein Overlay kann einen Schrägheck-Kleinwagen „SEDAN" nennen — ein echtes, richtig geschriebenes, falsches Wort. Das fällt nur beim Hinsehen auf.

Was es kostet — die Befunde dahinter#

Tarife, Credit-Preise, eigene Schlüssel und Team-Sitze stehen im Handbuch unter „Preise" — an einer Stelle, live abgefragt, damit sie nicht an zwei Orten auseinanderlaufen. Hier nur, was gemessen wurde und warum das Kostenmodell so aussieht.

Hier stand bis zum 28.09. morgens bei Studio „drei Sitze, geteilte Projekte, Prioritäts-Queue" — gebaut war davon nichts, und die Zeile wurde gestrichen. Seit dem Abend ist beides da.

Wer zahlt, steht an jeder Buchung. Was ein Mitglied im Studio auslöst, geht vom Studio-Guthaben ab und trägt den Namen des Mitglieds; eine Erstattung geht dorthin zurück, wo abgebucht wurde — auch wenn die Mitgliedschaft inzwischen endete. Der bisherige Erstattungsweg schrieb dem gut, der den Auftrag ausgelöst hatte — im Studio wären das Credits des Studios auf dem Konto des Mitglieds gewesen.

Und eine Tür, die dabei zuging: in Murnau konnte bis zum 28.09. jedes angemeldete Konto jedes Projekt öffnen, das aus dem Composer übergeben worden war. Der Quelltext sagte selbst, dass das nur bis zum ersten echten Mehrbenutzer trägt. Jetzt entscheidet der Eigentümer des Composer-Projekts.

Hier stand bis zum 28.09. „ein Bild 5–6 Credits, eine Tonspur 30" — das Bild galt nur für zwei Modelle, und die Tonspur war seit dem 2. September billiger, als diese Seite sagte. Seither: ein Bild je nach Modell 3 bis 21, eine Tonspur 28.

Die Kostenzeile nannte bis zum 26.09. den Einkaufspreis beim Modellanbieter. Das war eine Zahl, mit der niemand etwas bezahlt; seither nennt sie Credits und den Euro-Bereich, den ein Credit je nach Kaufweg kostet.

Zwischen Modellen liegt Faktor sechs, nicht zwischen Anbietern. Gemessen: derselbe Zehn-Sekünder in 720p kostet beim einen Modell rund das Sechsfache des anderen. Deshalb ist der Router das Produkt und nicht der Modell-Zoo.

Der Preis steht vor dem Absenden. Das ist keine Bequemlichkeit, sondern eine bezahlte Lektion: ein Testtag ohne Preflight kostete 45 $, wo 7,50 $ gereicht hätten.

Loslegen#