Die Erstellung der ersten AI-geklonten Anzeige, die ich jemals an einen Kunden gesendet habe, kostete mich 7,42 US-Dollar und es dauerte 11 Minuten vom „Ablegen des Referenzvideos“ bis zum „Ansehen der gerenderten MP4“. Das Original – ein erfolgreicher TikTok-Spot UGC, den einer seiner Konkurrenten sechs Wochen lang geschaltet hatte – hätte ungefähr 280 US-Dollar gekostet, um es mit einem menschlichen Ersteller auf Fiverr neu zu machen, plus drei bis fünf Tage Wartezeit, zwei Überarbeitungsrunden und das unvermeidliche „Können Sie die Schlusszeile noch einmal drehen?“ Thread auf Slack.
Die geklonte Version war nicht perfekt. Die linke Hand des Avatars bewegte sich etwa eine halbe Sekunde lang unnatürlich um die 8-Sekunden-Marke herum. Bei der Nahaufnahme des Produkts ist etwas an Textur verloren gegangen, die man auf einem Telefonfoto sehen würde. Aber die Stimmung – das Tempo, die Drehbuchstruktur, die Energie, der Rahmen – stimmte fast eins zu eins überein. Und es lag in einem Ordner und war bereit zum A/B-Test gegen drei andere Varianten. Claude Code hatte das gleiche Quellmaterial entwickelt, während ich Kaffee kochte.
Das ist der Workflow, den ich in den letzten sechs Wochen im Stillen ausgeführt habe: ein Claude Code-Agent, der mit dem externen Arcads API verbunden ist, Referenzvideos auseinandernimmt, sie um ein neues Produkt herum neu aufbaut und den Neuaufbau über Sora 2 (oder Seedance 2.0, je nachdem, was die Szene benötigt) vorantreibt. Es ist keine Magie. Es bricht auf bestimmte, vorhersehbare Weise. Und es verändert die Einheitsökonomie des UGC-Anzeigentests so grundlegend, dass ich denke, dass die meisten Agenturen, die bezahlte soziale Netzwerke betreiben, bis Ende 2026 ganz anders aussehen werden.
Das habe ich beim Testen gelernt.
Warum ich aufgehört habe, UGC-Ersteller einzustellen (meistens)
Zwei Jahre lang habe ich bei jedem E-Commerce-Kunden die gleiche Schleife durchlaufen. Finden Sie eine erfolgreiche Konkurrenzanzeige. Informieren Sie einen UGC-Ersteller. Warten. Zahlen Sie 200 bis 500 US-Dollar pro Video. Holen Sie sich die Ausgabe. Finden Sie eine Sache falsch. Warte noch einmal. Brennen Sie noch eine Woche. Testen Sie die Anzeige. Entweder hat es funktioniert (selten) oder nicht (häufiger) und wir haben von vorne angefangen.
Es wurde immer schwieriger, die Mathematik zu verteidigen. Laut den 2026 UGC-Preisleitfäden, die ich beim Schreiben überprüft habe, verlangen Anfänger bei UGC 75 bis 300 US-Dollar pro Video, Mittelklasse-Creator zahlen 300 bis 1.000 US-Dollar und Top-Creator in der Technologie- oder Beauty-Branche verlangen 600 bis 3.000 US-Dollar pro Leistung. Die Preisaufschlüsselung 2026 von Influee beziffert das durchschnittliche Einzelvideo auf 212 $. Dabei handelt es sich um Grundpreise: Nutzungsrechte kommen zusätzlich um 25 bis 150 Prozent hinzu, Whitelisting-Tarife belaufen sich auf etwa 30 Prozent pro Monat und die Eilzustellung beträgt weitere 25 bis 50 Prozent.
Für einen Kunden, der vier Anzeigenvarianten pro Woche testet, sind das allein 4.000 bis 12.000 US-Dollar pro Monat an Erstellergebühren. Briefingzeit nicht mitgerechnet. Revisionszyklen nicht mitgerechnet. Ohne die Varianten zu berücksichtigen, die wir nie gemacht haben, weil das Budget erschöpft war.
Der Auslöser, der mich dazu bewog, Arcads + Claude Code ernsthaft zu testen, waren jedoch nicht die Kosten. Es war die Geschwindigkeitslücke. Die Halbwertszeit einer erfolgreichen Anzeige auf TikTok im Jahr 2026 ist brutal – die meisten Kreativen beginnen innerhalb von 10 bis 14 Tagen zu ermüden. Als eine von Menschenhand geschaffene Variante zurückkommt, kühlt die ursprüngliche Werbung bereits ab und wir verfolgen den falschen Blickwinkel. Das von AI generierte UGC ersetzt menschliche Ersteller nicht, weil es besser ist. Es ersetzt menschliche Schöpfer, weil es schnell genug ist, um mit dem Algorithmus Schritt zu halten. Das ist ein Vorteil der anderen Art, und die meisten Agenturen haben ihn noch nicht eingepreist.
Warten – Sora 2, Seedance 2.0 oder „C Dance“? Eine schnelle Namensentwirrung
Bevor ich fortfahre, muss ich einen Namensknoten klären, der mich in der ersten Woche verwirrt hat und den ich in allen YouTube-Tutorials immer wieder sehe: Die Leute verwenden „C Dance 2.0“, „Seedance 2.0“ und „Sora 2“, als wären sie austauschbar. Das sind sie nicht.
- Sora 2 ist OpenAIs Videomodell. Es ist das Modell, zu dem die meisten Creator greifen, wenn sie eine Person vor der Kamera brauchen, die ein Produkt hält, spricht und gestikuliert – der klassische UGC-Look. Laut der offiziellen OpenAI Sora 2 API-Preisübersicht kostet es je nach Auflösung ungefähr 0,10 bis 0,50 US-Dollar pro Sekunde, also etwa 1,50 bis 7,50 US-Dollar für einen 15-Sekunden-Clip.
- Seedance 2.0 ist ByteDances Videomodell. Die C Dance AI-Erklärseite trennt es sauber: Seedance 2.0 ist das zugrunde liegende Modell, während „C Dance 2.0“ ein darauf aufgebautes Workflow-Produkt ist. Andere Ebene, andere Preise.
- Arcads ist die Orchestrierungsplattform. Es ist kein Modell, sondern ein Dienst mit 1.000+ vorgeklonten Avataren, Prompt-Vorlagen und API-Endpunkten, die Requests an das passende zugrunde liegende Modell routen. Laut der Arcads API-Dokumentation unterstützt die Plattform aktuell Sora 2, Veo 3.1, Kling 3.0, Seedance 2.0 und Nano Banana hinter einer einzigen API.
Warum ist das wichtig? Weil das von Ihnen ausgewählte Modell die Ausgabe ändert. Sora 2 erzeugt die natürlichste menschliche Bewegung – Blinzeln, Gewichtsverlagerungen, Gesten-Timing. Seedance 2.0 eignet sich besser für filmische Kamerabewegungen und Produktheldenaufnahmen. Der Sinn dieser Ausführung über Claude Code besteht darin, dass Sie das Modell nicht manuell pro Szene auswählen. Der Agent liest das Referenzvideo, entscheidet, welches Modell welchen Beat verarbeitet, und leitet die Anfragen automatisch weiter.
Nun zum Arbeitsablauf.
Der Stack: Drei Tools, eine Pipeline
Die Pipeline besteht aus drei Teilen. Jeder hat eine bestimmte Aufgabe, und die Nahtstellen dazwischen sind der Punkt, an dem die meisten öffentlichen Tutorials vage werden. Ich werde konkret sein.
Arcads ist die Avatar- und Rendering-Ebene. Gemäß ihrer öffentlichen Preisgestaltung vom April 2026 beträgt der Starter-Plan 110 /month für 10 Videos (11 /video), der Creator 220 /month für 20 Videos und der Pro-Plan ist zu einem individuellen Preis mit API-Zugriff, unbegrenzten Videos und Klonen von Schauspielern erhältlich. Der API ist derjenige, der mir am Herzen liegt – die Chat-Benutzeroberfläche eignet sich gut für einmalige Anzeigen, lässt sich aber nicht skalieren. Für eine Agentur, die Variantentests in großem Umfang durchführt, ist Pro die einzige Stufe, die Sinn macht.
Claude Code ist der Orchestrator. Es ist das, was das Referenzvideo liest, den Ton transkribiert, das Video in Beats aufteilt, das Skript für das neue Produkt neu schreibt, entscheidet, welches Arcads-Modell pro Szene aufgerufen werden soll, die API-Anfragen auslöst, die Fertigstellung abfragt und die zurückgegebenen Clips in den endgültigen Schnitt einfügt. Die offizielle Integration ist Open Source – das krusemediallc/arcads-claude-code GitHub-Repo stellt Agentenfähigkeiten, Eingabeaufforderungsvorlagen und einen Cursor/Claude Arbeitsbereich bereit, der die Authentifizierung über .env übernimmt. Sie installieren es einmal und fügen nie wieder einen API-Schlüssel in den Chat ein.
Sora 2 + Seedance 2.0 (über Arcads) sind die eigentlichen generativen Modelle. Zum Zeitpunkt, als ich dies schreibe, sind beide 15-second-pro-Clip. Sora 2 ist für Szenen mit Menschen vor der Kamera. Seedance 2.0 ist für filmische Produktaufnahmen und B-Rolls vorgesehen. Auf beide wird über POST /v2/videos/generate auf dem externen Arcads API mit einem model-Parameter im JSON-Körper zugegriffen, und beide geben eine Asset-ID zurück, die Sie auf GET /v1/assets/{id} abfragen, bis der Status von pending zu generated wechselt.
Das ist es. Drei Schichten. Der Trick – und der Teil, den Ihnen niemand in den Komplettlösungen auf YouTube verrät – besteht darin, dass die Qualität der Eingabeaufforderung wichtiger ist als das Modell, das Sie auswählen. Die interne Eingabeaufforderungsbibliothek von Arcads stellt fest, dass Eingabeaufforderungen, die kürzer als 100 Wörter sind, eine vage Ausgabe erzeugen und Eingabeaufforderungen, die länger als 260 Wörter sind, das Modell überfordern. Der Sweet Spot liegt bei 150 bis 200 Wörtern, und Claude Code bringt Sie zuverlässig dorthin.