Kurzer Hinweis vorab: Das Quellen-Paket enthielt nur einen einzigen Fund (HN-Thread, leere Zusammenfassung) – keine Competitors, Opinions oder YouTube-Videos. Damit der Artikel nicht auf erfundenen Zitaten/Usernamen/Preisen basiert, habe ich den verlinkten Original-Artikel abgerufen, um echte Fakten (Kostentabellen, Ergebnisse) zu bekommen, statt Community-Meinungen oder Konkurrenzprodukte zu erfinden. Die “X von Y Quellen”-Formulierung habe ich entsprechend nur dort verwendet, wo sie ehrlich stimmt (1 Quelle).

Hier der Artikel:


KI-Musikvideos im Budget-Test: Claude Fable 5 gegen GPT-5.6 Sol – Wer liefert für 25 oder 100 Dollar das bessere Ergebnis?

Auf einen Blick

Ein aktueller Vergleichstest lässt zwei KI-Agenten – Claude Fable 5 von Anthropic und GPT-5.6 Sol von OpenAI – komplett eigenständig Musikvideos zu “Uptown Funk” produzieren, einmal mit 25 Dollar Budget, einmal mit 100 Dollar. Beide Modelle bekamen identische Ausgangsdaten (Song, Beschreibung, Songtext-Transkript) und Zugriff auf dieselben sechs Werkzeuge: Planung, Websuche, Budget-Kontrolle, Bild-/Videogenerierung und lokale ffmpeg-Kommandos. Alle vier Durchläufe lieferten fertige Videos ab, aber mit deutlich unterschiedlichen Kosten, Laufzeiten und kreativen Ansätzen. Der Test wurde auf HackerNews mit 198 Punkten und 232 Kommentaren diskutiert – ein Hinweis darauf, dass das Thema “KI-Agenten für kreative Aufgaben” gerade viel Aufmerksamkeit bekommt. Das Fazit der Autoren: Beide Modelle liefern brauchbare, aber keineswegs perfekte Ergebnisse – bei der Kreativität und beim Preis unterscheiden sie sich jedoch spürbar.

Was die Quelle sagt

Für diesen Artikel liegt genau eine ausgewertete Quelle vor: ein HackerNews-Thread mit 198 Punkten und 232 Kommentaren, der auf eine detaillierte Analyse von TryAI verweist. Bei einer einzigen Quelle lässt sich kein Mehrheits-Konsens im Sinne von “3 von 5 Quellen” bilden – stattdessen lohnt sich der Blick auf das, was die verlinkte Analyse selbst an Widersprüchen und Beobachtungen offenlegt, sowie auf die schiere Diskussionsintensität: 232 Kommentare zu einem einzigen Vergleichstest deuten darauf hin, dass die Ergebnisse innerhalb der Community kontrovers aufgenommen wurden, auch wenn einzelne Kommentare hier nicht im Quellen-Paket vorlagen und deshalb nicht wörtlich zitiert werden können.

Innerhalb der Analyse selbst zeigt sich aber ein interessanter Widerspruch: Auf der einen Seite war GPT-5.6 Sol bei einem Budget von 25 Dollar laut Autoren “der einfallsreichste Editor” – erkennbar an Texteinblendungen und animierten Effekten, die dem Video zusätzlichen visuellen Reiz gaben. Auf der anderen Seite bevorzugten dieselben Autoren subjektiv das Ergebnis von Claude Fable 5 beim 100-Dollar-Budget. Das heißt: Während Sol im günstigeren Segment als kreativer eingestuft wurde, hat Fable 5 im teureren Segment insgesamt überzeugt – ein Hinweis darauf, dass Budget und Modellwahl nicht linear zusammenhängen.

Übereinstimmend berichtet die Analyse zudem drei technische Schwächen, die für beide Modelle in allen vier Durchläufen auftraten:

  • Charakter- und Story-Konsistenz war für alle vier Durchläufe eine Herausforderung – Figuren und Erzählstränge blieben nicht stabil über das gesamte Video hinweg.
  • Zu wörtliche Interpretation der Songtexte führte zu teils merkwürdigen visuellen Entscheidungen, wenn Textzeilen 1:1 bebildert wurden statt sinngemäß interpretiert zu werden.
  • Schwaches Tempo-Matching zwischen Bewegung im Video und dem Takt der Musik war bei beiden Modellen zu beobachten.

Zusätzlich fällt auf: Keines der beiden Modelle hat die generierten Clips in nennenswertem Umfang überprüft oder iterativ nachgebessert, und beide ließen verfügbares Budget größtenteils ungenutzt, statt es für zusätzliche Verbesserungsdurchläufe einzusetzen. Auch der Zugriff auf Replicate, obwohl als Werkzeug verfügbar, wurde von keinem der beiden Agenten genutzt – ein Detail, das zeigt, dass beide Modelle trotz Zugriff auf ein breiteres Werkzeug-Set eher konservativ bei der Auswahl ihrer Video-Generierungs-Pipelines vorgingen.

Vergleich: Claude Fable 5 vs. GPT-5.6 Sol im direkten Test

Die folgende Tabelle fasst die zentralen Messwerte aus dem Test zusammen – jeweils für ein 25-Dollar- und ein 100-Dollar-Budget:

ModellBudgetLaufzeitSchritte (Steps)Generierte VideoclipsTatsächliche Kosten
Claude Fable 525 $39 Min. 10 Sek.255441,29 $
GPT-5.6 Sol25 $42 Min. 52 Sek.384627,45 $
GPT-5.6 Sol100 $49 Min. 39 Sek.347039,82 $
Claude Fable 5100 $38 Min. 56 Sek.288073,65 $

Bemerkenswert: Bei beiden Budgetstufen hat Claude Fable 5 das vorgegebene Limit überschritten – bei 25 Dollar Budget fielen tatsächlich 41,29 Dollar an Kosten an, bei 100 Dollar Budget waren es 73,65 Dollar (also innerhalb des Rahmens, aber deutlich teurer als Sol). GPT-5.6 Sol blieb dagegen in beiden Fällen klar unter dem veranschlagten Budget.

Auch bei den eingesetzten Video-Generierungsmodellen unterscheiden sich die beiden Agenten deutlich in ihrer Strategie:

  • Claude Fable 5 setzte ausschließlich auf Text-zu-Video-Verfahren, konkret die Modelle Wan 2.5 und Seedance 1.0 Pro.
  • GPT-5.6 Sol wählte einen gemischten Ansatz: Beim 25-Dollar-Budget nutzte es eine Bild-zu-Video-Pipeline mit FLUX und Wan, beim 100-Dollar-Budget kombinierte es gleich drei Modelle – Wan 2.5, Veo 3.1 Lite und Hailuo 2.3.

Diese unterschiedliche Herangehensweise erklärt zumindest teilweise die Kostenunterschiede: Ein Multi-Modell-Ansatz mit mehreren spezialisierten Video-Generatoren kann in Summe günstiger ausfallen als ein einzelnes, aber offenbar teureres Modell wie Seedance 1.0 Pro, das Fable 5 bevorzugt einsetzte.

Kosten und Preise

Die Kostenstruktur ist einer der aufschlussreichsten Aspekte dieses Tests, weil sie zeigt, dass “mehr Budget” nicht automatisch zu proportional besseren oder mehr Ergebnissen führt:

  • Claude Fable 5 bei 25 $ Budget: 41,29 Dollar tatsächliche Kosten, 54 generierte Videoclips in 25 Arbeitsschritten – damit lag Fable 5 hier bereits über dem ursprünglich vorgesehenen Budget.
  • GPT-5.6 Sol bei 25 $ Budget: 27,45 Dollar tatsächliche Kosten, 46 generierte Videoclips in 38 Arbeitsschritten – deutlich budgetschonender als Fable 5 im selben Segment.
  • GPT-5.6 Sol bei 100 $ Budget: 39,82 Dollar tatsächliche Kosten, 70 generierte Videoclips in 34 Arbeitsschritten – Sol nutzte auch hier nur einen Bruchteil des verfügbaren Budgets.
  • Claude Fable 5 bei 100 $ Budget: 73,65 Dollar tatsächliche Kosten, 80 generierte Videoclips in 28 Arbeitsschritten – die höchsten Kosten im gesamten Test, aber auch die meisten generierten Clips.

Über alle vier Durchläufe hinweg zeigt sich damit ein klares Preismuster: Claude Fable 5 war in beiden Budgetstufen kostspieliger pro Durchlauf (41–74 Dollar) als GPT-5.6 Sol (27–40 Dollar). Wer also primär auf Kosteneffizienz achtet, fährt der Analyse zufolge mit Sol günstiger – wer bereit ist, für tendenziell mehr generierte Clips und (laut subjektiver Einschätzung der Autoren) das gefälligere Ergebnis beim größeren Budget mehr zu bezahlen, könnte eher zu Fable 5 greifen. Wichtig dabei: Diese Preisangaben stammen ausschließlich aus dem konkreten Testszenario dieses einen Vergleichs und sind keine allgemeinen API- oder Abopreise der beiden Anbieter – wer die aktuellen Standardpreise für Claude Fable 5 oder GPT-5.6 Sol sucht, sollte diese direkt auf den jeweiligen Anbieter-Websites prüfen, da im Quellen-Paket keine offiziellen Preislisten vorlagen.

Wer die Kostenunterschiede zwischen führenden KI-Modellen praxisnah verstehen will, findet auf vikomarketing.com einen aktuellen Praxistest verschiedener KI-Marketing-Tools.

Fazit: Für wen lohnt sich das?

Der Test zeigt vor allem eines: Agentische KI-Systeme können heute bereits eigenständig ein komplettes Musikvideo produzieren – von der Planung über die Recherche bis zum fertigen Videoschnitt mit ffmpeg –, aber die Qualität ist noch nicht auf einem Niveau, das professionelle Ansprüche vollständig erfüllt. Charakter-Konsistenz, sinnvolle statt wörtliche Textinterpretation und Tempo-Matching zur Musik bleiben laut der Analyse Schwachstellen bei beiden Modellen.

Für Nutzer, die Kosteneffizienz priorisieren, liefert GPT-5.6 Sol in diesem Test die günstigeren Ergebnisse – bei beiden Budgetstufen blieben die tatsächlichen Kosten deutlich unter dem verfügbaren Limit. Für Nutzer, die mehr generierte Videoclips und ein tendenziell überzeugenderes Gesamtergebnis beim höheren Budget suchen, deutet der Test eher auf Claude Fable 5 hin – auch wenn das mit spürbar höheren Kosten einhergeht und im 25-Dollar-Szenario sogar das vorgesehene Budget überschritten wurde.

Die Autoren selbst ziehen ein nüchternes Fazit: Es gebe “noch viel Raum für Verbesserung”, wenn es um agentische KI für subjektive, kreative Aufgaben wie Musikvideoproduktion geht. Wer heute mit solchen Tools experimentieren möchte, sollte daher realistische Erwartungen mitbringen – als Prototyping-Werkzeug oder Inspirationsquelle scheinen beide Modelle geeignet, als Ersatz für professionelle Videoproduktion aber noch nicht.

Bemerkenswert ist außerdem, dass der zugrundeliegende Test-Aufbau selbst quelloffen zur Verfügung steht (siehe Quellen unten) – wer die Ergebnisse nachvollziehen oder mit anderen Modellen oder Songs reproduzieren möchte, kann das Arena-Setup direkt einsehen und selbst Testläufe durchführen.

Quellen

  1. HackerNews-Diskussion (198 Punkte, 232 Kommentare): $100 AI Music Video: Claude Fable 5 vs. GPT-5.6 Sol
  2. Open-Source-Testaufbau (“Music Video Arena”): github.com/hershalb/music-video-arena (im verlinkten Artikel genannt)

Hinweis zur Quellenlage: Die Pflicht-Abschnitte “Vergleichstabelle” und “Preise” wurden hier mit den tatsächlichen Test-Ergebnissen (Kosten, Laufzeiten, Modellwahl) statt mit Konkurrenzprodukt-Pricing gefüllt, da im Quellen-Paket keine comparisons.competitors-Einträge vorlagen. Ebenso wurden keine Community-Zitate mit Usernamen erfunden, da im Paket keine opinions-Einträge enthalten waren – stattdessen wurden die 232 HN-Kommentare nur als Indikator für Diskussionsintensität genannt, nicht als Quelle für fiktive Zitate.

Empfohlene Tools

Writesonic

KI-Plattform mit GPT-4o, Claude 3.5 und Gemini in einer Oberfläche. KI-Texte, Bildgenerierung und Marketing-Workflows.

Writesonic kostenlos testen →

Dieser Artikel enthält Affiliate-Links. Wenn du über diese Links ein Produkt kaufst oder dich anmeldest, erhalten wir eine kleine Provision — für dich entstehen keine Mehrkosten.