Film Lab · Befunde
Die Belege hinter dem Handbuch: jede Messreihe mit Datum, jeder Fehlschlag mit Namen, und zu fast jeder Eigenschaft des Produkts die Messung, die sie verursacht hat. Wer wissen will, wie man etwas bedient, ist im Handbuch richtig; wer wissen will, warum es so gebaut ist und wo es kippt, hier.
Drei Fragen, die eine Produktseite beantworten muss, bevor sie irgendetwas zeigt. Hier stehen sie zuerst — und der Rest der Seite belegt sie.
Vom Exposé zum pitchfähigen Look: Stoff, Figuren, Orte, Bild, Bewegung, Schnitt, Export. Nicht ein Werkzeug für Clips, sondern die Strecke dazwischen — und der Anschluss an Kalkulation und Rechtenachweis.
Ein Nachmittag statt drei Wochen Konzeptarbeit. Der Preis steht vor dem Absenden, nicht auf der Rechnung. Und was das Werkzeug kann, ist gemessen und nachlesbar, statt behauptet.
Solo-Regie und Autorinnen mit einem Exposé, das visuell werden muss. Produktionsfirmen von zwei bis fünfzehn Leuten, die im Jahr drei bis zehn Stoffe pitchen. Werbe- und Imagefilm, wo ein Look-Konzept vor den Dreh muss.
Der bezahlte Anlass ist dabei nicht Kreativität, sondern Termindruck mit Geld dahinter: Einreichfrist, Pitch-Termin, Kundenpräsentation. Wer nächste Woche einreichen muss, vergleicht keine sechs Werkzeuge — der zahlt dafür, bis Freitag pitchfähig zu sein.
Und was es nicht wird, damit du nicht das Falsche erwartest: kein weiterer Modell-Zoo, kein Wettbewerb um das beste Videomodell, kein Preiskampf gegen Flatrate-Anbieter. Wer nur Clips am Fließband will, ist woanders günstiger bedient. Der Wert sitzt in der Planung und im DACH-Kontext.
Dieselbe Ordnung wie in der Vorführung, wo eine einzelne Einstellung durch alle Stufen läuft. Hier die Übersicht.
Der Stoff, die Menschen, die Orte. Was ein Team am Tisch klärt, bevor eine Kamera aufgebaut wird.
Prompt, Bild, Bewegung, Ton. Hier entsteht, was man ansehen kann — und hier sitzen die Kosten.
Aus Einstellungen wird eine Sequenz, aus der Sequenz ein Film in den Formaten, die jemand abnimmt.
Film Stocks (Portra, Cinestill, Tri-X …), Cinematic Looks und Grafik-Stile, die das ganze Bild umschreiben — Bauhaus-Plakat, Anime-Cel, Blindprägung, Siebdruck. Presets mit fester Schrift haben Eingabefelder: die Wörter im Bild sind deine, nicht unsere.
48 Presets, jedes mit Referenzbild am selben MotivKuratierte Parameter statt generischer Prompt-Wrapper: jedes Preset trägt die Handschrift eines Gewerks. Für Filmleute sofort lesbar, weil es die Sprache am Set spricht und nicht die des Modells.
Belichtung, Kontrast, Farbton, Sättigung, Korn — als Regler, nicht als
Prompt. Der Grade rechnet direkt aufs Bild: derselbe Look trifft jeden
Still gleich, reproduzierbar und ohne einen Credit zu verbrennen, weil
kein Modell mehr rät. „Vom Colorist-Brief ausgehen" nimmt den Look der
Crew-Konfiguration als Startpunkt, die Regler feinen darüber. Denselben
Grade gibt es als MCP-Werkzeug lab_grade — ein KI-Agent
setzt den Look über dieselben Regler, ohne die App zu öffnen.
70 Looks. Zwanzig sind frei entworfen, 17 davon benannt in drei Familien:
Dazu drei technische für Material, das als Cineon-Log ankommt (log-neutral, print-warm, print-kühl) — sie erwarten Log und geben Rec.709 aus, auf normalem Material sehen sie falsch aus.
Die übrigen fünfzig sind Referenz-Looks, seit dem 27.09.: jeder einem bestimmten Filmbild nachgebaut, aus drei Leitfarben des Bildes und unserer Grade-Mathematik — Kurve, Sättigung, Korn —, gebacken als eigene LUT. Im Pult steht jeder mit seinem Standbild und der genauen Angabe darunter: Film, Jahr, Regie, Kamera. Gewählt wird er über den Film, deshalb schlägt der Begleiter ihn nicht nach Motiv vor. Die vollständige Liste steht unter den Werkzeugen.
Anwenden ist zerstörungsfrei — das Original bleibt, das gegradete Bild ist eine neue Galerie-Zeile. Der Begleiter (Pipeline-Agent) schlägt einen Look vor und wendet ihn auf Freigabe an: im Pult geführt oder im Chat („welcher Look passt zu diesem Shot?").
70 Looks (20 frei entworfen, 50 nach Filmbild) · im Pult, als MCP-Tool lab_grade, über den Begleiter · deterministisch, keine KI-Credits · live seit 2026-09-21Der Router ordnet je Absicht nach Qualität, cappt die Kosten und nimmt innerhalb einer Modellfamilie den günstigsten verdrahteten Zugang. Findet er keinen unter dem Deckel, sagt er das mit Zahlen — statt still das teuerste Modell zu nehmen.
Preis vor dem Absenden, nicht danachTimeline, Transport, zwei Monitore, Export. Die Einstellungen aus der Pipeline landen direkt darin, ohne Umweg über einen Download-Ordner.
Die App im Browser. Ein MCP-Server, über den KI-Agenten dieselbe Pipeline bedienen — 82 Werkzeuge. Und eine Brücke, die in DaVinci Resolve läuft und seit dem 27.09. mit dem MCP eine gemeinsame Fassade bildet: ein Agent sieht FilmLab und die offene Resolve-Timeline zugleich. Was Geld kostet, läuft dort in zwei Schritten — erst der Preis, dann eine Freigabe, die nur für genau diesen Aufruf und fünfzehn Minuten gilt.
App · MCP (OAuth oder Brücken-Schlüssel) · Resolve-Brücke 0.67 · Details untenJeder Look trägt die Nummer, unter der er im Pult steht
(filmlab-ref-01 bis -50). Die Standbilder zeigen wir
nur im Pult, als Beleg, woran der Look Maß genommen hat; die Rechte an den
Bildern liegen bei den Rechteinhabern der Filme.
| Nr. | Film | Jahr | Regie | Kamera |
|---|---|---|---|---|
| 01 | American Honey | 2016 | Andrea Arnold | Robbie Ryan |
| 02 | Drive | 2011 | Nicolas Winding Refn | Newton Thomas Sigel |
| 03 | Aftersun | 2022 | Charlotte Wells | Gregory Oke |
| 04 | Sicario | 2015 | Denis Villeneuve | Roger Deakins |
| 05 | Aftersun | 2022 | Charlotte Wells | Gregory Oke |
| 06 | The Florida Project | 2017 | Sean Baker | Alexis Zabé |
| 07 | The Florida Project | 2017 | Sean Baker | Alexis Zabé |
| 08 | Fish Tank | 2009 | Andrea Arnold | Robbie Ryan |
| 09 | Fish Tank | 2009 | Andrea Arnold | Robbie Ryan |
| 10 | Fish Tank | 2009 | Andrea Arnold | Robbie Ryan |
| 11 | This Is England | 2006 | Shane Meadows | Danny Cohen |
| 12 | This Is England | 2006 | Shane Meadows | Danny Cohen |
| 13 | This Is England | 2006 | Shane Meadows | Danny Cohen |
| 14 | Under the Skin | 2013 | Jonathan Glazer | Daniel Landin |
| 15 | Portrait of a Lady on Fire | 2019 | Céline Sciamma | Claire Mathon |
| 16 | Portrait of a Lady on Fire | 2019 | Céline Sciamma | Claire Mathon |
| 17 | The Master | 2012 | Paul Thomas Anderson | Mihai Malaimare Jr. |
| 18 | Blade Runner 2049 | 2017 | Denis Villeneuve | Roger Deakins |
| 19 | In the Mood for Love | 2000 | Wong Kar-wai | Christopher Doyle / Mark Lee Ping-Bing |
| 20 | In the Mood for Love | 2000 | Wong Kar-wai | Christopher Doyle / Mark Lee Ping-Bing |
| 21 | In the Mood for Love | 2000 | Wong Kar-wai | Christopher Doyle / Mark Lee Ping-Bing |
| 22 | Drive | 2011 | Nicolas Winding Refn | Newton Thomas Sigel |
| 23 | Buffalo '66 | 1998 | Vincent Gallo | Lance Acord |
| 24 | The Master | 2012 | Paul Thomas Anderson | Mihai Malaimare Jr. |
| 25 | Sicario | 2015 | Denis Villeneuve | Roger Deakins |
| 26 | Uncut Gems | 2019 | Josh & Benny Safdie | Darius Khondji |
| 27 | The Neon Demon | 2016 | Nicolas Winding Refn | Natasha Braier |
| 28 | Moonlight | 2016 | Barry Jenkins | James Laxton |
| 29 | The Florida Project | 2017 | Sean Baker | Alexis Zabé |
| 30 | Drive | 2011 | Nicolas Winding Refn | Newton Thomas Sigel |
| 31 | Good Time | 2017 | Josh & Benny Safdie | Sean Price Williams |
| 32 | American Honey | 2016 | Andrea Arnold | Robbie Ryan |
| 33 | Chungking Express | 1994 | Wong Kar-wai | Christopher Doyle / Andrew Lau |
| 34 | Chungking Express | 1994 | Wong Kar-wai | Christopher Doyle / Andrew Lau |
| 35 | Good Time | 2017 | Josh & Benny Safdie | Sean Price Williams |
| 36 | Good Time | 2017 | Josh & Benny Safdie | Sean Price Williams |
| 37 | Uncut Gems | 2019 | Josh & Benny Safdie | Darius Khondji |
| 38 | Uncut Gems | 2019 | Josh & Benny Safdie | Darius Khondji |
| 39 | Paris, Texas | 1984 | Wim Wenders | Robby Müller |
| 40 | Paris, Texas | 1984 | Wim Wenders | Robby Müller |
| 41 | The Neon Demon | 2016 | Nicolas Winding Refn | Natasha Braier |
| 42 | The Neon Demon | 2016 | Nicolas Winding Refn | Natasha Braier |
| 43 | Buffalo '66 | 1998 | Vincent Gallo | Lance Acord |
| 44 | Under the Skin | 2013 | Jonathan Glazer | Daniel Landin |
| 45 | Under the Skin | 2013 | Jonathan Glazer | Daniel Landin |
| 46 | Moonlight | 2016 | Barry Jenkins | James Laxton |
| 47 | Moonlight | 2016 | Barry Jenkins | James Laxton |
| 48 | Blade Runner 2049 | 2017 | Denis Villeneuve | Roger Deakins |
| 49 | Blade Runner 2049 | 2017 | Denis Villeneuve | Roger Deakins |
| 50 | Paris, Texas | 1984 | Wim Wenders | Robby Müller |
Jede Stufe hängt am Prompt, und der Prompt ist die Stelle, an der die meisten Anläufe verbrannt werden. Der Dreamer ist deshalb kein Textfeld, sondern ein Werkzeugkasten.
Aus einer Idee einen vollständigen, gegliederten Prompt bauen — Licht, Optik, Kamera ergänzt, statt sie zu vergessen.
Eine Szene in vier bis acht nummerierte Panels zerlegen, jedes ein eigenständiger Bild-Prompt mit Einstellungsgröße und Winkel.
In Sektionen strukturieren, den Wortfluss glätten, cinematische Details ergänzen oder um rund ein Drittel kürzen — der Kern bleibt.
Licht, Optik, Kamera, Material, Farbe, Komposition, Bewegung, Stil werden im Text eingefärbt — gespeist aus dem Filmlexikon. Man sieht, wovon der Prompt redet und wovon nicht.
Film Stocks, Cinematic Looks, Grafik-Stile. Presets, die Schrift ins Bild setzen, haben Eingabefelder — die Wörter im Bild sind deine.
Ein winziges Testbild zum Prompt für rund einen Drittel-Cent. Es wird nicht gespeichert; es beantwortet nur die Frage, ob der Prompt trägt.
~$0,003 je BlickIm Blocking Board werden Figuren und Requisiten im Kader platziert statt umschrieben. Der Prompt fällt dabei als Nebenprodukt ab — siehe unten.
Jeder Schritt ist umkehrbar, bis zwanzig zurück. Wer probiert, muss zurückkönnen, sonst probiert er nicht.
Warum das ein Werkzeugkasten ist und keine Automatik: wir haben gemessen, ob ein handgeschriebener Prompt besser trägt als ein generierter — 110 Würfe, drei Anläufe, kein Unterschied. Die Werkzeuge sparen also keine Qualität herbei, sie sparen Anläufe. Das ist der ehrliche Anspruch, und er ist mehr wert als der andere.
Fast jede Eigenschaft hier hat eine Messung als Ursache — oft eine, die gegen die eigene Erwartung ausging. Die Reihe von links nach rechts: wann, was gemessen wurde, was daraus im Produkt wurde.
Immer nach demselben Muster: eine Frage, zwei Arme, abwechselnd im selben Lauf geworfen — sonst misst man die Tagesform des Modells statt der Sache. Am Ende ein Kontaktbogen, auf dem jeder Wurf mit seinen Messwerten steht, damit nachvollziehbar ist, was gezählt wurde.
Was Messen kostet. Die Nacht vom 22.08.: 110 Würfe, rund 8,80 $. Die Stil-Runde vom 02.09.: 18 Generierungen, 2,70 $. Zusammen weniger als ein einziger falsch geratener Kundenjob.
Und warum das hier steht. Weil ein Werkzeug, das nur seine Treffer zeigt, dich die Lücken selbst finden lässt — im Zweifel am Tag vor der Einreichung.
48 Stück, alle am selben Motiv gerendert. Nur so ist der Unterschied der Stil und nicht das Motiv — und nur so fällt auf, wenn einer nicht tut, was draufsteht.
Fünfzehn neue Grafik-Stile, jedes Bild angesehen und jedes Wort darin gelesen:
Die häufigste Abweichung ist harmlos und wiederkehrend: das Plakat kommt als abfotografiertes Objekt statt vollflächig. Die seltene ist es nicht — und die zwei Fälle stehen unten.
Eine Figur, die im zweiten Bild anders aussieht als im ersten, ist keine Figur. Der Abdruck ist die trainierte Identität: einmal angelegt, danach in jeder Einstellung abrufbar.
Die Identität einer Figur wird über ein Referenzbild gehalten, nicht über Wiederholung im Text. Das funktioniert so gut, dass es ein eigenes Problem erzeugt: die Referenz überstimmt auch das, was sie gar nicht überstimmen soll. Wir haben gemessen, wann — an einer Figur, vier Einstellungen, je zehn Läufen pro Arm, Kriterium vorher festgelegt.
Die zwei, die brachen, waren Etiketten: „full side profile" und „dynamic action pose" — Namen für Einstellungen, die ein Modell auch großzügig vergibt. Die zwei, die hielten, beschrieben ohnehin schon Mechanik: „hands resting on thighs", „mid-stride toward camera". Die Referenz frisst keine Haltung. Sie frisst ein Etikett.
Praktisch heißt das: Streitstellen sind an der Formulierung ablesbar, statt sie einzeln messen zu müssen. Steht dort, was zu sehen sein soll, hält es. Steht dort der Name einer Einstellung, gewinnt das Referenzbild.
Ein Sheet ist eine Referenz, kein fertiges Bild. Alles, was darin an Licht steckt — ein Standschatten, ein Boden, der zum Horizont ausläuft — erbt jede Folgeszene und muss dort gegen das Licht der Szene kämpfen. Die Sheet-Ansichten verlangten bisher einen „grauen Hintergrund, gleichmäßiges Studiolicht", also einen fotografierten Hintergrund. Seit dem 2026-10-01 verlangen sie ein Farbfeld: ein einheitliches Mittelgrau an jedem Pixel, ohne Boden, Wand oder Horizont, schattenlos beleuchtet, ohne Schatten und ohne Lichtspill außerhalb der Figur.
Die Messung: Ansicht „Ganzkörper", je drei Läufe pro Arm, Helligkeit der Bildecken und ein Streifen am Boden gegen einen am Kopf. Mit Referenz geprüft (Anker plus fünf weitere Ansichten, Gesichtsähnlichkeit gegen den Anker) hat sich die Identität nicht verschlechtert: bei gleichem Anker für beide Arme 0,684 → 0,735, Unterschied +0,05 bei einem 95-%-Intervall von −0,01 bis +0,12 (13 Paare). Der Gewinn kommt fast nur vom Profil; ohne das sind die Ansichten gleich. Das ist „kein Verlust", nicht „ein Gewinn".
Der Fehlschlag, den wir dabei selbst eingebaut hatten.
Mit dem Farbfeld wurde der Detail-Anker — das Porträt, aus dem alle weiteren Ansichten abgeleitet werden — bei vielen Figuren kein Porträt mehr, sondern ein Halb- oder Ganzkörperbild. Aufgefallen ist es, als wir die Identität mit einer echten Figur nachmaßen: bei einem Lauf mit anderem Anker sah „neu" plötzlich schlechter aus, und die Ursache war nicht die Ähnlichkeit, sondern der Ausschnitt. Der Beschreibungstext der Figur (hier: „Standing at full length, the whole figure inside the frame, both shoes fully visible", bei einer anderen: „trousers and brown leather boots") gewinnt gegen die Ansage „großes Porträt", und der Satz über „die Figur" im Farbfeld hilft dem nicht. Es ist dieselbe Mechanik wie bei Etikett und Geometrie: die Referenz — hier der Text — überstimmt die Ansage.
Der Fix steht seit dem 2026-10-02 in den Ansichten „detail" und „detail_smile": ein Satz am Ende, der den Kopf-und-Schultern-Ausschnitt über jede Kadrierung im Beschreibungstext stellt. Als Ganzkörper gilt ein Gesicht unter 20 % der Bildhöhe. Grenzen: Figur 190 (echt, zehn Läufe je Arm) und zwei erfundene Testfiguren (je fünf Läufe) sind eine kleine Stichprobe; einzelne Ausschnitte sind jetzt sehr eng, an einer Stirn ist das Haar angeschnitten. Nicht neu gemessen ist, wie gut die Folgeansichten mit dem neuen Anker die Identität halten. Bereits gespeicherte Sheets ändern sich nicht; wer einen Ganzkörper-Anker bekommen hat, erzeugt das Sheet neu.
Ein Drehbuch verlangte für eine Figur beides: eine Siebenundsiebzigjährige im Bett und dieselbe Frau mit achtundzwanzig, in Rückblenden, die ein Drittel der Folge tragen. Zwei getrennte Figuren im System — und damit zwei Gesichter, die nichts miteinander zu tun haben.
Dieselbe Familie über vier Sheets: Tochter, Mutter, Großmutter jung, Großmutter alt. Alle vier tragen dieselbe Augenfarbe, und die trägt sichtbar durch.
„Dieselbe Person, nur jünger" hätte nichts getragen — das ist wieder ein Etikett. Und die Merkmale dürfen nicht von der älteren Figur abgeschrieben werden: „schmales Gesicht mit hohen Wangenknochen" ist an einer Siebenundsiebzigjährigen vom Alter geschnitzt und bringt es rückwärts mit. Der erste Versuch lieferte prompt eine Frau von fünfzig.
Der Descriptor ist der Text, aus dem jedes Bild einer Figur entsteht, und er ist Handarbeit — einer im Bestand trägt 1349 Zeichen und wurde an einem Tag dreimal geschärft. Bis zum 2. September hatte diese Spalte keine Historie: kein Änderungsdatum, keine Versionen. Ein falsches Überschreiben war endgültig, und die einzige Absicherung waren von Hand angelegte Sicherungsdateien.
Jetzt schreibt die Datenbank jede Fassung selbst mit, samt Zeitpunkt und Herkunft. Bewusst in der Datenbank und nicht in der Anwendung: das Reparatur-Werkzeug, mit dem am selben Tag dreizehn Figuren instand gesetzt wurden, schreibt direkt in die Tabelle und wäre an einer Absicherung in der Anwendung vorbeigelaufen. Ein Schutz, der nur die bekannten Wege kennt, schützt nicht vor dem nächsten Werkzeug. Der Bestand hat seinen damaligen Stand als erste Fassung bekommen — 189 Figuren, damit auch die unangetasteten eine Vergangenheit haben.
Die Einwilligung ist ein Tor, kein Häkchen. Jeder Schritt fragt sie ab, und der Weg mit Fotos einer realen Person ist zwar gebaut, aber ohne Kennung aus dem Likeness-Register nicht befahrbar. Ein Abdruck ist die Identität eines Menschen — er entsteht nicht nebenbei.
Und wenn die Einwilligung zurückgenommen wird? Dann ist der Weg sofort zu — ist das Register nicht erreichbar, gilt das Tor ebenfalls als zu, nicht als offen. Gelöscht wird dagegen nicht automatisch, sondern nach Sichtung: eine Liste führt jeden Abdruck, dessen Einwilligung nicht mehr trägt, und meldet ihn bei jedem Prüflauf wieder, bis er weg ist. Beim Löschen geht seit dem 27.09. auch das Trainingsarchiv mit den Fotos mit — vorher blieb es liegen. Was beim Trainingsanbieter nach dem Lauf verbleibt, erreicht unser Löschen nicht; das steht hier, weil es sonst niemand sagt.
Und was uns dieser eine Durchlauf gekostet hat: acht Fehler, die keine grüne Testsuite gefunden hätte — ein Zeitlimit am schnellsten Modell gemessen, ein Preis, der still auf den Referenzwert zurückfiel, ein Netz für Erstattungen, das übersprungen wurde, weil die Ausnahme darüber flog. Alle acht kamen erst aus echten Läufen mit echtem Geld.
Ein Standbild in Bewegung zu setzen ist der Schritt, an dem am meisten Geld hängt. Deshalb ist er gemessen und nicht geraten.
Gemessen wird, ob der Kader wirklich stillsteht: Rauschabstand zwischen erstem und letztem Bild im unbewegten Bildteil links — dort, wo sich laut Anweisung nichts bewegen darf. Je höher der Wert, desto ruhiger die Kamera.
| Modell | Stufe | Credits | geliefert | Kader | Urteil |
|---|---|---|---|---|---|
| Seedance 2.5 * | 720p | 655 | 10,04 s | 43,3 dB | steht still |
| Seedance 2.0 | 1080p | 944 | 10,04 s | 39,3 dB | hält |
| Gemini Omni Flash | fest | 173 | 10,00 s | 38,4 dB | hält, mit Ton |
| Seedance 2.0 | 720p | 420 | 10,04 s | 38,2 dB | hält |
| FLUX 3 Video | 720p | 236 | 10,04 s | 33,4 dB | leichtes Wandern |
| MiniMax H3 | 720p | 83 | 10,12 s | 29,4 dB | wandert |
| Veo 3.1 fast | 720p | 139 | 8,00 s | 22,8 dB | wandert deutlich, zu kurz |
Die Tabelle oben misst eine einzige Eigenschaft: ob der Kader steht. Wie ein Modell aussieht, entscheidet sie nicht. Vier typische Läufe, jeder ohne Nachbearbeitung — zum Ansehen, nicht zum Vergleichen: es sind verschiedene Motive und verschiedene Anweisungen.
Dieselben vier Läufe stehen seit dem 2. September auch in der Werkbank, unter der Modellauswahl in der Stufe „Video". Bis dahin las man dort dreizehn Modellnamen mit je einem Satz Beschreibung und wählte blind — die Dateien lagen seit vier Tagen fertig daneben, verlinkt hatte sie niemand.
Alle mit demselben Zuschnitt gemessen — untereinander vergleichbar, nicht mit fremden Messungen. * Seedance 2.5 lief als einziges an einem anderen Startbild (dunkler Innenraum statt Balkon, siehe unten). Dunkle, detailarme Flächen heben den Wert; die 43,3 dB stehen deshalb neben der Liste, nicht in ihr.
Der billigste ist nicht der schlechteste, und der teuerste nicht der beste. MiniMax H3 kostet ein Zehntel von Seedance in 1080p und liefert die volle Länge — nur eben eine Kamera, die wandert. Für ein Stimmungsbild reicht das; für eine Anschlussfolge nicht. Genau diese Wahl trifft der Router, wenn man ihm sagt, worauf es ankommt.
Bestellt zehn Sekunden, geliefert acht — jetzt zum zweiten Mal. Beim ersten Mal, in 1080p, war es eine Beobachtung. Mit einem zweiten Lauf in 720p ist es ein Muster: Veo 3.1 fast kürzt, und abgerechnet wird die volle Länge.
Seedance 2.5 lehnt Gesichter ab — und das ist wichtiger als sein Spitzenwert. Der erste Versuch mit dem Balkon-Standbild wurde vom Anbieter zurückgewiesen: das Bild könne „likenesses of real people" enthalten. Es zeigt eine KI-erzeugte Frau; dass sie erfunden ist, kann der Anbieter nicht wissen. Dasselbe Bild hat Seedance 2.0 zweimal anstandslos animiert — die Schranke ist neu in 2.5.
Der Gegenversuch beantwortet die Frage. Dasselbe Modell, derselbe Auftrag, aber ein Startbild ohne sichtbares Gesicht — die Figur von hinten im Sessel, die Identität als Referenz mitgegeben statt im Bild. Es lief durch, in voller Länge, und hielt den Kader ruhiger als alles andere im Test. Die Grenze ist also nicht das Können des Modells, sondern eine Inhaltsschranke: für Nahaufnahmen von Figuren ist Seedance 2.5 auf dem i2v-Weg nicht zu gebrauchen, für alles andere ist es das Ruhigste, was wir gemessen haben. Genau diese Unterscheidung gehört in die Modellwahl und nicht in die Überraschung zur Laufzeit.
Und ein Fund, den dieser Lauf selbst bezahlt hat: beim Ausweichen wich der Router korrekt auf Veo 3.1 fast aus, abgerechnet wurden aber 655 Credits statt 139. Der Fallback liefert das billige Modell und rechnet das teure ab — 516 Credits Differenz an einem einzigen Clip. Notiert, mit Reproduktion und Zahlen, und wird behoben.
Und die Auflösung ist selten das Geld wert: derselbe Clip in 720p statt 1080p kostet weniger als die Hälfte, und der Kader liegt 1,1 dB darunter — bei einem Abstand von 16 dB zwischen bestem und schwächstem Modell. Die Wahl des Modells entscheidet, nicht die Stufe.
Startbild, Schlussbild, Referenzbilder, ein Video als Vorlage, Ton als Eingang oder Ausgang: das unterscheidet sich von Modell zu Modell mehr als der Preis. Seit dem 27.09. trägt jedes der 42 Videomodelle seine Eingabe-Rollen, abgeleitet aus derselben Tabelle, die den Aufruf baut — nicht aus einer Beschreibung daneben. Das Schlussbild-Feld erscheint nur, wo das Modell eines nimmt.
Gefunden hat die Tabelle einen Fehler, den die Modellliste für Agenten bis dahin trug: drei Anbieterwege standen dort als reine Text-Modelle und nehmen in Wahrheit ein Startbild.
Seedance 2.5 lehnt Gesichter auch als Referenz ab. Oben steht, dass der Umweg über ein Startbild ohne Gesicht funktioniert, mit der Identität als Referenz. Die Sonde vom 28.09. hat die Referenz selbst geprüft: ein Referenzbild mit Gesicht wird ebenfalls zurückgewiesen, ein reines Ortsbild geht durch. Für Figuren bleibt damit nur Seedance 2.0 — oder ein Modell, das wandert.
Und der Bearbeitungsmodus staucht die Zeit: aus 60 Bildern Vorlage wurden 58. Für einen Schnitt, der auf Bild genau anschließen soll, ist das ein Fehler, kein Rundungsdetail.
Wer nur beschreibt, wo jemand steht, bekommt es selten. Wer es hinstellt, bekommt es — das ist gemessen, nicht behauptet.
Ein grauer Rohbau gibt die Fahrt vor, das Modell soll ihr folgen. Gemessen wurde, wie weit der Schwerpunkt der Silhouette wandert — also ob die Kamera wirklich den geplanten Weg nimmt:
| Lauf | Schwerpunkt wandert | Kamerafolge |
|---|---|---|
| Steuervorlage (der Rohbau selbst) | 7,48 px | 100 % |
| ohne Bildanker | 6,53 px | 87 % |
| mit Bildanker | 1,69 px | 23 % |
Der Bildanker war die Ursache. Ein frontales Referenzfoto überstimmt die Fahrt — es hält das Bild fest, statt es mitzunehmen. Ohne ihn folgt das Modell dem Rohbau.
Der eigentliche Ausschlag ist aber nicht die Prozentzahl: über den Rohbau braucht die volle Fahrt sechs Generierungen statt 360. Das ist der Unterschied zwischen einem Nachmittag und einer Woche.
Eine Straße mit zwanzig Leuten ist das, was ein Videomodell am zuverlässigsten verdirbt: Gesichter verschwimmen, Menschen verschmelzen, die Hälfte steht in der Luft. Deshalb entstehen Komparsen hier nicht im Modell, sondern als eigene Ebene über der Plate.
Im Composer-Schritt Ebenen: Figuren als Karten erzeugen, auf der Plate verteilen, rendern. Die Plate darf ein Standbild sein oder ein Video mit Kamerabewegung, die Komparsen ein Standbild oder ein kurzer Clip mit Freistellung.
| Schritt | Credits | was dabei passiert |
|---|---|---|
| Komparsen-Karte | 6 | Figur im Hochformat, mit Füßen — fehlen sie, wird auf unsere Kosten einmal nachgeworfen |
| Komparsen-Clip | 27 | 6 s, auf Grün gedreht und lokal freigestellt; „stehen" oder „Gespräch"; Erstattung, wenn nichts entsteht |
| Kamera tracken | 0 | für bewegte Plates; rund eine Minute je fünf Sekunden Shot, mit Urteil „trackbar" oder nicht |
| Verdeckung, Licht, Render | 0 | auf unseren Maschinen, 17–39 s bei 12–30 Figuren |
Die Größe. Ohne Anhaltspunkt nimmt die Rechnung Augenhöhe als Kamerahöhe an — bei Untersicht war die Menge dadurch zweieinhalb- bis dreimal zu klein. Jetzt klickst du Fuß und Scheitel der Hauptfigur und gibst ihre Größe ein; die Komparsen bekommen daraus ihre, 1,72 m im Mittel, per Regler zwischen 70 und 130 %.
Die Verdeckung. Steht die Hauptfigur vor der Menge, muss die Menge hinter ihr verschwinden. Vier Modelle für die Personenmaske getestet, eines ohne Fehlalarm — das ist eingebaut. Dasselbe für Gegenstände: Säulen, Laternen, Kioske verdecken seit dem 26.09. von selbst, gemessen an einer Plate mit 99,2 % korrekt gestanzt und 0,015 % zu viel.
Das Tracking. Auf vier KI-erzeugten Plates hat der globale Rekonstruktionsweg drei vollständig erfasst, der übliche schrittweise keinen, das Tracking in Blender einen von drei. KI-Plates sind für klassisches Tracking schwerer als echtes Material; wo es nicht reicht, sagt das Urteil „nicht trackbar", statt eine rutschende Menge zu liefern.
Gehen geht nicht. Null von sechs Geh-Clips zeigten einen Gehzyklus. Die Menge steht oder redet; eine Menge, die läuft, ist gesperrt, bis ein Modell es kann.
Und dreimal war die Korrektur selbst der Fehler. Figuren schwebten um bis zu 7,7 % ihrer Höhe über dem Boden, Komparsen maßen 1,31–1,49 m statt 1,72, und die Kamera lag eine Vierundzwanzigstelsekunde neben dem Bild. Jede dieser Stellen war schon einmal „behoben" worden. Seither wird eine Korrektur gemessen, bevor sie als Korrektur gilt.
Depth Map. Für jedes Plate-Video eine Tiefenkarte, nah hell und fern
dunkel wie in Resolve, gratis. Gerechnet mit Depth Anything V2 in der kleinen
Fassung — die größeren stehen unter einer Lizenz, die kommerzielle Nutzung
ausschließt, und sind deshalb gesperrt. Für Gegenstände trägt sie (100 %
getroffen), für Personen nicht: sie ordnet Menschen hintereinander in drei
von vier, im schwierigen Fall nur in jedem zweiten Bild richtig. Die
Personenmaske bleibt deshalb ein eigener Weg. Erreichbar ist die Tiefenkarte
derzeit über das MCP-Werkzeug lab_depth_map und die Resolve-Brücke,
noch nicht in der App.
Magic Mask als Personenmaske. Wer die Hauptfigur in Resolve sauberer freistellt als die Automatik, schickt die Matte über die Brücke zurück; sie ersetzt dann die automatische Maske und lässt sich wieder abschalten. Den Klick auf die Figur macht ein Mensch in Resolve — per Skript gesetzte Punkte haben in sechs Varianten kein einziges Bild erzeugt.
Stufe ⑧ heißt „Video + Ton". Die Tonhälfte bot bis zum 2. September fünf Werkzeuge an und hatte eines. Suno, ElevenLabs, ElevenLabs SFX, Freesound standen im Auswahlfeld und antworteten mit einem Fehler. Ein Menüpunkt, der nichts tut, beschwert sich nicht — er wird einfach nicht mehr angeklickt, und dann fällt es niemandem mehr auf.
Jetzt sind es drei, und alle drei laufen. Zwei sind hinzugekommen (ElevenLabs SFX v2 für Geräusche, ElevenLabs TTS Multilingual v2 für Sprache), zwei sind verschwunden: Suno gibt es bei unserem Anbieter nicht — die Suche liefert einen anderen Hersteller mit ähnlichem Namen —, und Freesound ist keine Generierung, sondern eine Bibliothek. Suchen, Lizenz prüfen, Namensnennung mitführen ist ein anderes Werkzeug, kein Häkchen im selben Feld.
| Werkzeug | rechnet nach | Beispiel | Credits | wofür |
|---|---|---|---|---|
| ElevenLabs SFX v2 | Sekunde | 3 s | 1 | Geräusche, 0,5–22 s |
| ElevenLabs TTS Multilingual v2 | 1000 Zeichen | 95 Zeichen | 2 | Sprache, Voiceover |
| Stable Audio 2.5 | Lauf | bis 190 s | 28 | Musik, Atmo, lange Betten |
Drei Werkzeuge, drei Abrechnungseinheiten — und das ist der Punkt. Bis zum 2. September kostete jeder Tonlauf dasselbe: einen Pauschalpreis, der von Stable Audio hergeleitet war, weil es lange nichts anderes gab. Ein Drei-Sekunden-Geräusch hätte darunter dreißigmal so viel gekostet wie es soll.
Aufgefallen ist das nicht durch eine Beschwerde, sondern beim Anschließen der neuen Werkzeuge: der Preis fiel auf, bevor ihn jemand bezahlt hat. Beim Video war dieselbe Sache eine Woche zuvor andersherum gelaufen — dort wurde erst gezahlt und dann gerechnet.
Stufe ⑨. Aus Einstellungen wird eine Sequenz. Die Rechenarbeit dafür kostet nichts: hier wird nichts generiert, sondern angeordnet.
Zwölf Look-Vorgaben tragen Filmnamen statt Farbwerte — Blade Runner 2049, In the Mood for Love, Grand Budapest Hotel, 2001, Chinatown, Tree of Life, Amélie, Mad Max: Fury Road, Moonlight, Parasite, Drive, Stalker. Das ist keine Koketterie: wer im Schneideraum sagt „mach das mehr wie Moonlight", wird verstanden, und ein Zahlenpaar für Farbtemperatur und Sättigung wird es nicht.
| Block | Länge | was er ist |
|---|---|---|
| Titel | 5 s | Titel und Unterzeile; leer heißt Projekttitel |
| Abspann | 8 s | Rolle und Name, zeilenweise |
| KI-Kennzeichnung | 4 s | Pflicht nach Art. 50 Abs. 4 KI-VO |
Der dritte Block ist kein Angebot. Art. 50 Abs. 4 der KI-Verordnung verlangt bei KI-erzeugten Personen eine Offenlegung. Sie steht deshalb nicht in einer Checkliste, die man abhaken kann, sondern als Baustein neben Titel und Abspann — an derselben Stelle, an der man ohnehin arbeitet, mit vorformuliertem Text und vier Sekunden Standzeit.
Ehrlicher Nachtrag vom 28.09.: „Pflicht" ist an diesem Block eine Beschriftung, keine Sperre — ein Export ohne ihn wird nicht verweigert. Was nicht abwählbar ist, sitzt seit dem 25.09. eine Ebene tiefer: jeder Render mit KI-Material trägt das Kennzeichen im Bild und in der Datei, ob der Block drin ist oder nicht. Mehr dazu unter Herkunft.
In Murnau steht rechts neben dem Schnittbereich eine eigene Spalte mit drei Eingabezeilen — Schnitt, VFX, Ton —, darüber ein kleines Zeichen und der Name Lotte. Dort stand bis zum 17. September 2026 „AI". Der Name ist keine Verpackung: er zeigt auf Lotte Reiniger, die 1926 mit Die Abenteuer des Prinzen Achmed den ersten abendfüllenden Animationsfilm gemacht hat — aus geschnittenem schwarzem Papier, von hinten durchleuchtet, die Flächen dahinter von Hand eingefärbt.
Das Zeichen ist seit dem 22. September 2026 ein Korridor: fünf dunkle Bänder, die nach außen ziehen, auf einer leuchtenden Scheibe in Glut-Orange. Die Bänder wandern in 21 Sekunden durch sechs tiefe Töne — Dunkelbraun, Karmin, Violett, Nachtblau, Petrol, Tannengrün —, an ihren Rändern laufen zwei farbige Säume gegeneinander, wie ein Objektiv Rot und Blau verschieden weit bricht. Spektralfarben, wie hier bis zum 28.09. stand, sind es nicht: auf dem hellen Orange hielt keine davon genug Abstand, gemessen 1,04:1 bis 2,64:1. Dunkel auf Licht, das bleibt Reinigers Prinzip.
Die Saisons sind geblieben, anders als hier bis zum 28.09. stand:
Halloween, Weihnachten, Ostern und Silvester färben die Scheibe, die Figur
bleibt dieselbe. Die Berlinale gibt es nur über ?saison=berlinale
— ein Festivaltermin folgt keiner Formel. ?saison=aus erzwingt
den Grundton.
Das Zeichen sagt auch, was gerade läuft. Ruhig braucht ein Band fünf Sekunden nach außen; während sie antwortet, 1,35; während sie liest, zieht es rückwärts — sie nimmt auf, statt zu senden. Liegt ein Vorschlag an, wickelt sich der Korridor zu einer Spirale auf, die sich über die Gültigkeit des Vorschlags (15 Minuten) wieder abwickelt. Ist sie am Kern angekommen, ist der Vorschlag verfallen. Wer keine Bewegung sehen will, bekommt über die Systemeinstellung ein stehendes Bild in voller Stärke.
Bis zum 19. September 2026 standen an dieser einen Zeile drei Knöpfe. Apply schickte den Text an einen Klassifikator, Fragen an Lotte, Inspire war gar kein Modell, sondern eine Liste — und wählte aus sechs festen Sätzen einen zufällig aus. Der Nutzer musste sich also vor dem Tippen entscheiden, ob er ändern oder fragen will. Das ist eine Entscheidung, die man erst nach der Antwort treffen kann.
Jetzt geht alles an Lotte. Sie darf das erst, seit sie mehrere Schnitte in einem Zug vorschlagen kann und die Regler kennt — vorher hätte ein Verb die Fähigkeit gekostet, mit einer Anweisung jede Einstellung zu treffen. Erst das Werkzeug, dann die Bedienung.
Die sechs Anregungen stehen als Auswahl unter dem leeren Feld und verschwinden, sobald du tippst. Eine Anregung neben einem halb getippten Satz ist kein Angebot mehr, sondern Ablenkung.
In allen drei Flächen stand dieselbe Lotte — obwohl FilmRadar seit Juli eine ganze Besetzung führt: zehn Gewerke und zwanzig Board-Fassungen, mit Namen, Werdegang und Denkweise. Murnau kam nur nicht heran.
| Fläche | Wer dort steht | Gewerk |
|---|---|---|
| Schnitt | Tarek Mansouri | Filmeditor, denkt in Rhythmus, Ellipsen, Kontrasten |
| Ton | Rafael Duarte | Komponist und Sound Designer, denkt beides als Einheit |
| VFX | Anders Marder | Bildgestaltung — Licht, Textur, Farbe, Raum |
Das Zeichen bleibt Lottes. Der Lichtkorridor ist die Handschrift der Assistenz, nicht der Ausweis einer Person — er trägt jetzt drei Namen. Fällt die Registry aus, steht wieder „Lotte" da: die Besetzung ist Anreicherung, kein Betrieb. Ein Editor, der nicht mehr antwortet, weil eine fremde Datenbank klemmt, wäre ein schlechter Tausch gegen einen Namen.
In der Registry sind sie Gutachter — hier arbeiten sie. Jede Persona endet mit „Antworte IMMER als JSON mit exakt diesen Feldern: score, headline, strengths, concerns". So sind sie für das Urteils-Tier von ScriptLab gebaut. Für Murnau wird genau dieser Teil abgeschnitten: es kommt nur der Mensch mit, nicht das Formular. Eine Bedienerin, die auf jede Anweisung eine Note zurückgibt, wäre unbrauchbar — und sie täte es, weil ein Vertrag im Prompt schwerer wiegt als jede spätere Bitte.
Das Zeichen trug einen Tag lang fünf Zustände — Schere, Filmstreifen, fertiger Schnitt, gerissener Bogen. Bei 36 Pixeln war das die falsche Bühne: was liest, wartet auf dich und fehlgeschlagen unterscheidet, braucht Worte, keine Silhouette. Und der Stern für den fertigen Vorschlag stand dreißig Pixel neben dem Stern des Inspire-Knopfs.
Heute sind es vier Zustände aus einer einzigen Figur — bereit, denkt, liest, Vorschlag —, unterschieden nur durch die Bewegung, nie durch ein Symbol. Alles Genaue steht am Feld, wo das Auge beim Tippen ohnehin ist und wo volle Breite zur Verfügung steht: ein Balken am unteren Feldrand während der Arbeit, die Zeile darunter für Antwort, nachgeschlagene Werkzeuge und Fehler.
Murnaus /ai/interpret hatte drei handgeschriebene Systemprompts,
jeder mit seiner eigenen Aufzählung des Nichtmöglichen. Am 2026-09-17 gemessen
war die Schnitt-Fassung bei vier von fünf Punkten falsch: sie erklärte
Schneiden, Löschen, Umsortieren und Übergänge für unmöglich, obwohl alle vier
im Editor stehen.
Für den Nutzer sieht das nicht wie eine Schnittstellen-Grenze aus, sondern wie
eine Produkt-Grenze. Er fragt einmal, liest „gibt es nicht", und fragt nicht
wieder. Eine Liste in Prosa veraltet, weil kein Wächter zwei Sätze vergleichen
kann; diese veraltet nicht, weil jeder Eintrag einen Beleg trägt, den
scripts/ci/check_playbook_belege.py in jedem Pull Request
nachschlägt — und zwar in beide Richtungen. Wer splitClipAtFrame
baut und den Eintrag auf nein stehen lässt, wird rot.
Seit dem 25.09. sitzt Lotte auch rechts im Composer, der Werkstatt mit den zehn Stufen. Dort liest sie, was ein Mensch vor einer Entscheidung nachsehen würde: wo das Projekt steht, was ein Schritt kostet, welcher Tarif was enthält, wie viel Guthaben übrig ist. Nennt sie eine Stufe, dann beim Namen und nicht beim internen Schlüssel — das stand bei der Abnahme einmal falsch da.
Sie schlägt vor, statt zu handeln, und trennt dabei zwei Sorten:
Kann sie den Preis nicht sicher erfragen, gibt es den bezahlten Vorschlag nicht — ein Knopf ohne Zahl darauf wird nicht gebaut. Ausgeführt wird ohnehin nur, was du anklickst.
Braucht eine Frage ein Gewerk, holt sie es beim Namen dazu: eine der zehn Crew-Rollen, höchstens zwei je Antwort. Fällt die Besetzung aus, antwortet sie selbst, statt zu schweigen. Und in Murnau führt sie seit dem 24.09. ein Protokoll — die letzten zwölf Antworten, neueste oben; vorher löschte jede Antwort die vorige. Jeder Schritt darin nennt seine Dauer, auch der gescheiterte.
Mit der Resolve-Brücke kennt sie auch die offene Resolve-Timeline und kann dort Tiefe und Magic Mask vorschlagen. Einen Clip schlägt sie dort nicht vor: dafür bräuchte es ein Quellbild, das es an der Stelle nicht gibt.
Wenn Lotte etwas Falsches sagt, kann sie es zurücknehmen. Der Widerruf landet nicht als Löschung, sondern als Korrektur neben der Quelle: eine gelöschte Falschauskunft kommt bei der nächsten Aufnahme wieder, eine korrigierte nicht. Die Korrektur trägt, wer sie geschrieben hat — ohne Identität gibt es keinen Schreibweg, und was du korrigierst, sieht niemand sonst.
Unter jeder der drei Leisten sitzt eine Reihe Schieber. Sie sehen aus wie
Bedienelemente, und bis zum 19. September 2026 waren sie keine: der Wert
wanderte in ein Objekt, das Objekt reiste als sliders mit dem Auftrag
mit, und im Prompt landete es als nackte Zeile —
{"pace":100,"tension":50,"rhythm":50,"flow":75}
ohne Einheit, ohne Skala, ohne ein Wort Erklärung. Pace 0 und Pace 200 erzeugten dieselbe Anweisung. Was das Modell daraus ableitete, war Glückssache.
| Regler | Bereich · Vorgabe | hoch heißt | niedrig heißt |
|---|---|---|---|
| Pace | 0–200 · 100 | straffen — Totzeit raus, früher schneiden | Luft lassen, Pausen stehen lassen |
| Tension | 0–100 · 50 | auf die Bewegung schneiden, gegen Ende kürzen | ausatmen lassen, auslaufen lassen |
| Rhythm | 0–100 · 50 | gleichmäßige Längen, auf den Takt | bewusst ungleich — lang gegen kurz |
| Flow | 0–100 · 75 | weiche Übergänge, J- und L-Schnitte | harte Schnitte, Brüche stehen lassen |
| Regler | Bereich · Vorgabe | hoch heißt | niedrig heißt |
|---|---|---|---|
| Intensity | 0–100 · 100 | voll ausspielen | zurücknehmen — angedeutet |
| Blend | 0–100 · 100 | nahtlos — Korn, Farbe, Licht angeglichen | sichtbar aufgesetzt, als eigenes Element |
| Detail | 0–100 · 50 | Haare und Kanten sauber — langsamer, teurer | grob halten |
| Edge | 0–100 · 75 | harte, präzise Kante | weich und ausgefranst — richtig bei Bewegungsunschärfe und Haar |
| Regler | Bereich · Vorgabe | hoch heißt | niedrig heißt |
|---|---|---|---|
| Loudness | −24…0 · −14 | lauter Richtung 0 — Social-Ende | leiser — Kino und Archiv |
| Dynamics | 0–100 · 50 | leise und laut auseinanderlassen | komprimieren — gleichmäßig laut |
| Clarity | 0–100 · 60 | Sprache nach vorn, Störgeräusch zurück | den Raum ungeschönt lassen |
| Depth | 0–100 · 40 | Hall und Tiefe zulassen | trocken und nah |
Loudness ist kein Geschmack, sondern eine Norm. Das sind LUFS, und die Zielwerte stehen in diesem Handbuch schon weiter unten: −14 für Web und YouTube, −12 für Social, −24 für Kino und Archiv. Wer dort schiebt, wählt eine Abgabe-Norm, keine Klangfarbe.
Genau dieser Regler ist beim Inventarisieren zweimal übersehen worden — er ist der einzige mit negativem Bereich, und die Messung, die ihn finden sollte, ließ kein Minuszeichen zu. Ein Regler mit negativem Bereich sieht in einer Zählung, die nur positive Zahlen kennt, aus wie gar keiner. Gefunden hat ihn der Wächter beim ersten Lauf.
Nur Abweichungen. Ein Regler auf Vorgabe ist keine Anweisung, sondern die Abwesenheit einer — stünde er trotzdem im Text, wäre die eine Abweichung, auf die es ankommt, zwischen drei belanglosen versteckt. Stehen alle auf Vorgabe, bekommt das Modell den Satz „entscheide nach dem Material".
Jede Leiste schickt ihre eigene Gruppe. Pace und Tension sagen einem Compositing-Auftrag nichts; vorher hätte die VFX-Leiste die Schnitt-Bedeutungen vorgesetzt bekommen und darin keinen einzigen ihrer Namen wiedergefunden.
Und die Bedeutung steht an einer Stelle, für beide Wege — den schnellen Klassifikator und die Werkzeugschleife. Ein Regler, der an einem Weg gilt und am anderen nicht, ist schlimmer als einer, der nirgends gilt: du schiebst ihn, siehst eine Wirkung, und beim nächsten Mal bleibt sie aus.
Unter der Timeline liegt eine zusätzliche Spur, beschriftet CUES. Sie beantwortet eine Frage, die sonst niemand stellt, weil sie zu mühsam ist: Ist das, was im Prompt steht, im Bild tatsächlich passiert?
Ein Cue ist eine einzelne Aussage aus dem Prompt, gebunden an ein Fenster im Schnitt. „Harter Schnitt bei 00:01.50, Kamera auf den Helden, medium" ist ein Cue. Er steht nicht als Kommentar daneben, sondern liegt auf den Frames, für die er gilt — und ist damit vergleichbar mit dem, was dort wirklich zu sehen ist.
Zehn Typen, und zwei davon verhalten sich anders als die acht
übrigen. Die ersten acht kommen aus SceneFlow und gelten jeweils
einem Zeitfenster: dialogue, action,
camera, shot, audio, vfx,
transition, environment.
Die beiden anderen gelten dem ganzen Clip. regel kommt
aus POSITIVE CONSTRAINTS beziehungsweise RULES („genau drei
Personen, keine vierte"), referenz satzweise aus
ACTIVE REFERENCES („@Video1 ist die alleinige Autorität für Kamera,
Schnitte und Timing"). Eine Regel hat kein Fenster, in dem sie gilt — sie
gilt immer. Deshalb stehen beide in der Spur links als Zählung
(@ 9 · § 7) und nicht als Block an einer Stelle.
Jeder Cue trägt ein Urteil. Vier sind möglich, und der Unterschied zwischen den letzten beiden ist der, auf den es ankommt:
| Befund | Bedeutung | Was er über das Modell sagt |
|---|---|---|
offen | noch niemand hat hingesehen | nichts — es ist keine Aussage, sondern deren Abwesenheit |
da | steht so im Bild | die Anweisung ist angekommen |
fehlt | kommt im Bild nicht vor | die Anweisung wurde überhört |
anders | etwas passiert, aber nicht das | die Anweisung wurde verstanden und uminterpretiert |
Die Trennung ist keine Erbsenzählerei. fehlt
heilt man mit Nachdruck — die Anweisung deutlicher, früher, wiederholt.
anders heilt man damit nie: das Modell hat die Stelle gelesen und
sich anders entschieden. Da hilft nur, die Anweisung umzuschreiben.
Wer beides in einen Topf wirft, probiert die falsche Abhilfe so lange, bis er
das Modell für unbrauchbar hält.
Die Beschriftung der Spur nennt immer zuerst, was offen ist: „12 offen · 31 da · 6 fehlt · 2 anders (79 %)". Eine Quote, die zwölf ungeprüfte Cues verschweigt, liest sich wie ein Ergebnis und ist eine Zwischenmeldung.
Im Kopf der Prompt-Ansicht steht „19 von 19 Stelle(n) markiert". Beide Zahlen sehen aus, als müssten sie gleich sein. Sie sind es nicht, und der Unterschied ist der ganze Sinn der Anzeige.
Die zweite Zahl gehört dem Quellclip und kennt alle seine Cues. Die erste gehört diesem Vorkommen im Schnitt — und ein getrimmter Clip enthält die Beats außerhalb seines Fensters nicht. Am 18. September 2026 meldete der Kopf „19 Stellen markiert", gezeichnet waren 17: das Vorkommen war auf 19 von 96 Frames getrimmt, zwei der drei Beats fielen heraus. Die Zahl stimmte für den Quellclip und log für das, was auf dem Schirm stand.
Die Fehlenden werden genannt, nicht verschwiegen. Steht hinter der Bilanz „· 2 außerhalb dieses Schnitts", dann ist das die Auskunft, die ein Schnittmensch braucht. Ohne sie vergleicht er Prompt und Ansicht, findet zwei Stellen zu wenig und sucht den Fehler bei sich.
Der Prompt ändert sich, die Cues werden neu aus ihm gelesen — und die Urteile wären weg. Sie sind es nicht: ein Befund hängt an Typ, Wortlaut und Zeitfenster, nicht an der Stelle im Text.
Die Zeichen-Offsets zählen ausdrücklich nicht mit. Sie verschieben
sich schon, wenn anderswo im Prompt ein Zeichen dazukommt — und ein Urteil
gilt nicht der Stelle, an der ein Satz steht, sondern dem, was er sagt. Was
sich nicht wiederfindet, wird nicht stillschweigend fallen gelassen: die
Antwort nennt befunde_übernommen und
befunde_verworfen, damit ein Verlust auffällt, statt sich als
leere Spur zu tarnen.
Was die Spur nicht tut: urteilen. Die Cues liest sie aus dem Prompt, das Fenster rechnet sie aus dem Schnitt — den Befund setzt ein Mensch, der sich das Bild angesehen hat. Es gibt keine automatische Abnahme und keine Quote, die von selbst entsteht. Eine Maschine, die ihre eigene Anweisungstreue benotet, benotet ihre eigene Lesart des Prompts.
Bis zum 23.09. sahen der Mensch in Murnau und ein Agent über MCP zwei verschiedene Schnitte derselben Sequenz. Das Speichern im Editor schrieb in die eigene Sitzung, der Agent las woanders.
Jetzt schreibt jedes Speichern, auch das automatische, den Schnitt dorthin durch, wo der Agent liest. Überschreibt es dabei Arbeit des Agenten, sagt die Speicherzeile, was weg ist — „3 Clips des Agenten überschrieben (8 s, 2 Blenden, 2 Tonspuren)" — und legt vorher einen Stand an, aus dem es zurückkommt. Das war nötig: am 24.09. hat ein einziger Klick eine Sequenz mit einem Clip überschrieben, weil der Editor bei zehn Sequenzen im Projekt geraten hatte, welche gemeint war. Gerettet hat sie der Stand. Seither rät er nicht mehr: ist das Ziel unklar, fragt er.
Die Schnittliste als Tabelle: Spur, Quell-Ein und -Aus, Timeline-Ein, Dauer, Quelle, Shot — in Timecode. Nur Bildspuren.
Einem Stand einen Namen geben — im Kopf „Stände", dann „Stand sichern". Benannte Fassungen fallen nie unter den Deckel von 50 automatischen Ständen und zählen nicht dagegen.
Die Liste der Stände, und zu jedem auf Abruf: was änderte sich? Wer geändert hat — du oder ein Agent — steht dabei.
Ansehen ja, Zurückholen aus dieser Liste noch nichtWas nach dem Einfügepunkt liegt, rückt um die volle Dauer; ein Clip, der über den Punkt reicht, wird geteilt. Vorher legte der Knopf übereinander — siehe oben.
Eine Sequenz lässt sich als OTIO ausgeben und wieder hereinholen, etwa aus einem anderen Schnittprogramm zurück. Der Rückweg legt immer eine neue Sequenz an und überschreibt nichts; die Kennung jedes Clips reist mit, damit er drüben und hier derselbe bleibt.
Bildgenau, nicht bitgleich. 5,5 Sekunden kommen als 5,52 zurück — 138 Bilder bei 25 fps, weil ein halbes Bild in die Länge gehört und nicht verschwinden darf. Wird ein Clip drüben geteilt, behält nur das erste Stück seine Kennung.
Und wo der Knopf ist: noch nirgends. Beide Richtungen sind gebaut und getestet, erreichbar sind sie heute über die Schnittstelle, nicht über die Oberfläche.
Die Resolve-Brücke läuft in DaVinci Resolve, nicht daneben. Das ist keine Stilfrage: Resolve aus dem App Store lässt sich von außen nicht skripten — die Schnittstelle antwortet schlicht mit nichts, gemessen am 12.09. Von innen geht es.
Seit dem 27.09. bilden Brücke und MCP-Server eine gemeinsame Fassade. Ein Agent — etwa Claude am Schreibtisch — sieht damit FilmLab und die offene Timeline zugleich. Dazu gehört ein Viewer, der das Bild unter dem Abspielkopf zeigt und eine Tiefenkarte per Wischblende darüberlegen kann — gebaut, aber noch nicht in jedem Agenten-Programm abgenommen.
| Seite | Werkzeuge | davon schreibend |
|---|---|---|
| FilmLab (MCP) | 82 | Generieren, Grade, Tiefe, Schnitt — bezahlte nur mit Freigabe |
| Resolve (Brücke 0.67) | 14 | 3: Magic Mask tracken, Matte exportieren, Ergebnis an die Timeline |
Jedes der drei schreibenden Resolve-Werkzeuge legt vorher ein Duplikat der Timeline an. Ein Agent, der in deinem Schnitt arbeitet, soll ihn nicht verlieren können.
Den Klick macht ein Mensch. Magic Mask lässt sich per Skript tracken und exportieren, aber nicht anstoßen: in sechs Varianten gesetzte Punkte haben kein einziges Bild erzeugt. Die Figur anklicken musst du selbst.
Und drei Grenzen aus dem ersten Tag: Tracking läuft nur bei offener Fusion-Seite; der Dialog „Render completed!" hält Resolve an, bis ihn jemand wegklickt; und ein Aufruf hat zwanzig Sekunden, bevor der Agent aufgibt.
Zwei Stufen, wo es Geld kostet. Ein Agent bekommt zuerst den Preis in Credits und Euro, dann eine Freigabe-Kennung, die genau für diesen Aufruf mit genau diesen Angaben gilt, einmal und fünfzehn Minuten lang. Eine Hintertür, beliebigen Code in Resolve auszuführen, gibt es nicht.
Stufe ⑩. Auch sie kostet keine Credits — gerechnet wird auf unseren Maschinen, nicht bei einem Modellanbieter.
Ein Export ist nicht „eine Datei in einer Auflösung". Er ist ein Bündel aus Farbraum, Dynamik, Codec, Container und Lautheit — und die Lautheit ist die Zahl, an der die meisten Abgaben scheitern, weil sie im Schnittprogramm nicht auffällt.
| Ziel | Farbraum | Codec | Auflösung | Lautheit |
|---|---|---|---|---|
| Web / FrameZero | sRGB · SDR | H.264 / MP4 | 1080p | −14 LUFS |
| Social (IG/TikTok) | sRGB · SDR | H.264 / MP4 | 1080×1920 | −12 LUFS |
| YouTube | Rec.709 · SDR | H.264 / MP4 | 2160p | −14 LUFS |
| Streaming HDR | Rec.2020 · HDR10 | H.265 / MP4 | 2160p | −14 LUFS |
| Kino-Projektion | DCI-P3 · HDR | ProRes / MOV | 4K DCI | −24 LUFS |
| Archiv / Master | Rec.2020 · HDR | ProRes 4444 | 4K | −24 LUFS |
Die Lautheit ist der Unterschied, der weh tut. Zehn Dezibel liegen zwischen Social und Kino — −12 gegen −24 LUFS. Wer einen Kinomix bei Instagram hochlädt, wird leise gedreht und klingt dünn; wer umgekehrt liefert, fällt bei der Abnahme durch. Es ist dieselbe Sequenz, und es sind zwei verschiedene Dateien.
Quer über alle sechs Ziele liegen drei Qualitätsstufen: Draft (halbe Auflösung, für den schnellen Blick), Standard und High Quality (doppelte). Die Stufe ändert Auflösung und Datenrate, nicht das Profil — Farbraum und Lautheit bleiben, wo das Ziel sie hinlegt.
Ein Sender, ein Festival, eine Förderung fragt irgendwann: was in diesem Film ist KI, und wer hat es freigegeben? Seit dem 26.09. liegt die Antwort neben jeder Filmdatei — und ist prüfbar, ohne uns zu vertrauen.
Zu jedem Export entsteht ein Herkunftsnachweis, als PDF zum Lesen und als JSON für Maschinen, mit einem Link auf die Prüfseite. Er liegt neben der Filmdatei, nicht in ihr: ein Nachweis, der in der Datei steckt, deren Prüfsumme er nennt, wäre zirkulär.
| Was drinsteht | Was nie öffentlich wird |
|---|---|
| Prüfsumme der Filmdatei, Dauer, ob die Kennzeichnung im Bild ist, Freigabe mit Datum | Prompts — die sieht nur, wem das Projekt gehört |
| je Clip: Timecode, Quelle, Art (z. B. Bild zu Video), Werkzeug, Anbieter, Erzeugungszeit | Einwilligungs-Kennungen, E-Mail, Konto |
Prüfen geht unter seal.thefilmradar.com/herkunft: die Datei hineinziehen, der Browser rechnet ihre Prüfsumme aus, hochgeladen wird nichts. Der Nachweis ist mit einem Schlüssel signiert, dessen öffentliche Hälfte dort liegt, dazu mit zwei Zeitstempeln, einer davon in der Bitcoin-Blockchain verankert. Wer uns nicht glaubt, prüft mit OpenSSL selbst; die Anleitung steht auf der Seite.
Jeder Render mit KI-Material trägt unten rechts das Zeichen „KI-verändert" und in der Datei den maschinenlesbaren Vermerk nach IPTC. Dass das bis zum 25.09. in Murnau nicht stimmte, obwohl die Datenbank es behauptete, steht oben. Aufgefallen ist es erst, als jemand an der Datei nachsah statt am Feld.
Enthält ein Export eine erzeugte Person (ein Clip nach einer Figur) oder eine erzeugte Stimme (Voiceover, Dialog, Synchron), hält er vor dem Export an und verlangt einen Satz:
„Ich habe diesen Export angesehen und gebe ihn frei. Er enthält synthetisch erzeugte oder veränderte Personen oder Stimmen."
Festgehalten werden Konto, Zeitpunkt und die Fassung dieses Wortlauts; die Prüfseite zeigt nur das Datum. Ton, den ein Videomodell selbst mitliefert, löst keine Freigabe aus. Und freigeben kann nur ein angemeldeter Mensch in der Oberfläche — ein Agent über MCP bekommt an dieser Stelle eine Absage. Ein Satz, der sagt „ich habe es angesehen", ist wertlos, wenn ihn eine Maschine unterschreiben kann.
Was der Nachweis nicht belegt — und das steht auch auf der Prüfseite. Die Timecodes gelten für den Export aus FilmLab, nicht für die gesendete Fassung; dazwischen liegen Conform, Grading, Transcode. Die Einordnung je Clip folgt dem, was das System beim Erzeugen festgehalten hat, nicht dem Urteil eines Menschen — und wo es nichts festgehalten hat, steht „nicht festgehalten", nicht eine Vermutung.
Und was er nicht ist: kein C2PA-Zertifikat mit Kette zu einer Prüfstelle. Er ist ein eigener, offengelegter Nachweis. Synchronfassungen, die über den Kurzweg entstehen, bekommen noch keinen. Aufbewahrt wird er in reduzierter Fassung zehn Jahre über das Vertragsende hinaus, damit er auch dann noch prüfbar ist, wenn das Projekt längst gelöscht ist.
Nicht jede Messung endet in einer Funktion. Manche enden darin, dass ein Weg zugemacht wird — und das ist die billigste Art, Geld zu sparen.
Die Frage vom 19.07.: lässt sich für die Lippenbewegung eine freigegebene Mundregion per Maske neu generieren, während der Rest des Bildes stehenbleibt? Drei bezahlte Läufe, in denen genau eine Variable getauscht wurde:
| Lauf | Maske | Auftragsstatus | Sichtbare Wirkung |
|---|---|---|---|
| Entwurf | statisches Bild | completed | keine |
| hohe Qualität | statisches Bild | completed | keine |
| Nachfolge | echtes Maskenvideo, Bild für Bild deckungsgleich | completed | keine |
Alle drei meldeten Erfolg. Der Mund blieb in allen drei geschlossen — nachgesehen auf einem Kontaktabzug aus 31 Einzelbildern, einmal ganz und einmal als Mund-Ausschnitt. Ohne diesen Blick wäre der Weg als „funktioniert" in die Pipeline gewandert.
Die Lehre steht seither über allem hier: ein Anbieter, der ein Feld dokumentiert, liefert damit noch keine Wirkung. Der Statuscode sagt, dass etwas lief. Ob es etwas getan hat, sagt nur das Bild.
Zwei Presets taten etwas, das niemand bestellt hatte. Beide Fehler steckten in der Formulierung, nicht im Modell — und beide alten Fassungen bleiben wählbar, damit niemandem etwas unter den Händen weggezogen wird.
Der Content-Filter der Bildmodelle ist Teil der Produktionsplanung. Eine Figur, deren Beschreibung eine Selbstverletzung enthält — weil die Szene sie enthält —, bekam sechs von sechs Einstellungen abgelehnt. Bei einer anderen Figur scheiterte genau eine Einstellung, und zwar sechsmal hintereinander: die Kombination aus „zitternde Hände, starre Haltung wie bei mechanischer Atmung" und „auf die Kamera zugehend" liest der Prüfer als Notlage. Das ist kein Zufallsfehler, den ein zweiter Klick löst.
Wir schreiben solche Beschreibungen nicht um, um einen Filter zu überlisten. Die Figur gehört dem Buch, nicht dem Anbieter. Was wir stattdessen tun: den Ausfall benennen. Die Antwort sagt seit dem 2026-09-02 ausdrücklich, welche Einstellungen nicht entstanden sind — vorher fehlten sie schlicht in der Liste, und ein halbes Sheet sah aus wie ein ganzes.
Und für Kinder beschreibt das System keine Anatomie — mit Absicht. Für Erwachsene trägt es das Alter automatisch als Anatomie in jede Ansage: bei vierunddreißig „erste feine Stirnfalten, noch straffe Kieferlinie", bei siebenundsiebzig „tief zerfurchtes Gesicht, hängende Lider, Altersflecken". Unter achtzehn trägt es nichts, und das ist keine Lücke, sondern eine festgelegte Grenze dieses Produkts.
Der Preis dafür ist real und soll hier stehen: eine Zehnjährige kam zweimal als Fünfjährige zurück, obwohl ihre Beschreibung Zehnjährigen- Proportionen nannte. Wo die Beschreibung dünn ist, setzt das Modell sein eigenes Alter, und dagegen hilft an dieser Stelle nur genaue Handarbeit in den Figurenfeldern — und Hinsehen.
Streuung ist real. Derselbe Prompt sitzt mal im ersten, mal erst im zweiten Anlauf. Ein Fehlschlag bei einem harten Stilwechsel ist meistens kein Preset-Fehler, sondern ein zweiter Klick.
Und eine Grenze, die keine Textregel schließt: Sachfehler. Ein Overlay kann einen Schrägheck-Kleinwagen „SEDAN" nennen — ein echtes, richtig geschriebenes, falsches Wort. Das fällt nur beim Hinsehen auf.
Tarife, Credit-Preise, eigene Schlüssel und Team-Sitze stehen im Handbuch unter „Preise" — an einer Stelle, live abgefragt, damit sie nicht an zwei Orten auseinanderlaufen. Hier nur, was gemessen wurde und warum das Kostenmodell so aussieht.
Hier stand bis zum 28.09. morgens bei Studio „drei Sitze, geteilte Projekte, Prioritäts-Queue" — gebaut war davon nichts, und die Zeile wurde gestrichen. Seit dem Abend ist beides da.
Wer zahlt, steht an jeder Buchung. Was ein Mitglied im Studio auslöst, geht vom Studio-Guthaben ab und trägt den Namen des Mitglieds; eine Erstattung geht dorthin zurück, wo abgebucht wurde — auch wenn die Mitgliedschaft inzwischen endete. Der bisherige Erstattungsweg schrieb dem gut, der den Auftrag ausgelöst hatte — im Studio wären das Credits des Studios auf dem Konto des Mitglieds gewesen.
Und eine Tür, die dabei zuging: in Murnau konnte bis zum 28.09. jedes angemeldete Konto jedes Projekt öffnen, das aus dem Composer übergeben worden war. Der Quelltext sagte selbst, dass das nur bis zum ersten echten Mehrbenutzer trägt. Jetzt entscheidet der Eigentümer des Composer-Projekts.
Hier stand bis zum 28.09. „ein Bild 5–6 Credits, eine Tonspur 30" — das Bild galt nur für zwei Modelle, und die Tonspur war seit dem 2. September billiger, als diese Seite sagte. Seither: ein Bild je nach Modell 3 bis 21, eine Tonspur 28.
Die Kostenzeile nannte bis zum 26.09. den Einkaufspreis beim Modellanbieter. Das war eine Zahl, mit der niemand etwas bezahlt; seither nennt sie Credits und den Euro-Bereich, den ein Credit je nach Kaufweg kostet.
Zwischen Modellen liegt Faktor sechs, nicht zwischen Anbietern. Gemessen: derselbe Zehn-Sekünder in 720p kostet beim einen Modell rund das Sechsfache des anderen. Deshalb ist der Router das Produkt und nicht der Modell-Zoo.
Der Preis steht vor dem Absenden. Das ist keine Bequemlichkeit, sondern eine bezahlte Lektion: ein Testtag ohne Preflight kostete 45 $, wo 7,50 $ gereicht hätten.