Adobe Firefly kann jetzt Musik, Voiceover und Soundeffekte erstellen
Adobe hat Generate Music, Generate Speech und Generate Sound Effects am 20. August aus der Betaphase entfernt. Alle drei sind für die kommerzielle Nutzung freigegeben, und das ist der Teil, der wirklich zählt.
Adobe hat am 20. August drei KI-Audio-Tools in Firefly allgemein verfügbar gemacht, was bedeutet, dass jeder im Web und in mobilen Apps sie jetzt nutzen kann, anstatt auf den Beta-Zugang warten zu müssen. Generate Music erstellt Originaltitel, die auf die Länge und Stimmung Ihres Videos abgestimmt sind. Generate Speech verwandelt ein Drehbuch in ein Voice-Over mit Kontrolle über Stimme, Tempo und Emotionen. „Soundeffekte generieren“ erstellt individuelle Effekte aus einer Textaufforderung, abgestimmt auf das, was auf dem Bildschirm passiert.
Die Einzelheiten sind wissenswert. Generate Music läuft auf Adobes eigenem Firefly-Musikmodell. Generate Speech bietet Ihnen die Wahl zwischen dem Firefly Speech-Modell von Adobe und einem von ElevenLabs, dem Sprachspezialisten. Adobe gibt an, dass alle drei für die kommerzielle Nutzung freigegeben sind, was in der Praxis bedeutet, dass Ihnen die Trainingsdaten nicht zurückkommen, um Sie zu beißen. Neben den Audio-Tools eröffnete Adobe eine kostenlose Betaversion seines Firefly AI Assistant mit einem täglichen Kontingent von Generationen und fügte Gemini Omni Flash von Google zu den bereits in Firefly verfügbaren Drittanbietermodellen hinzu und ergänzte damit Kling AI, Luma AI und Runway. Gemini Omni Flash akzeptiert neben Text auch Video-, Audio- und Bildeingaben.
Der Lizenzanspruch bezieht sich hier auf das eigentliche Produkt, nicht auf die Audioqualität. Viele Tools können eine passable Hintergrundspur erzeugen. Was die meisten von ihnen nicht können, ist, einer Marketingabteilung, hinter der ein Unternehmen von der Größe Adobe steht, zu sagen, dass die Ergebnisse sicher für eine bezahlte Kampagne verwendet werden können. Aus diesem Grund wiederholt Adobe in seinen eigenen Materialien immer wieder den Ausdruck „kommerziell sicher“, und aus diesem Grund hat sich Firefly in aller Stille zu einem Frontend mit mehreren Modellen und nicht zu einem Einzelmodell entwickelt. Adobe setzt darauf, dass Profis einen Ort mit klaren Rechten und einer Auswahl an Engines wollen, und nicht die beste Engine mit unklaren Rechten. Ein fairer Vorbehalt: „Zur kommerziellen Nutzung freigegeben“ ist Adobes eigene Einschätzung seiner eigenen Trainingsdaten, und kein Gericht hat sie überprüft.
Was das für Sie bedeutet: Wenn Sie Videos für ein kleines Unternehmen, einen Club oder einen Kanal erstellen, werden drei separate Abonnements zu einem zusammengefasst und die umständliche Suche nach lizenzfreier Musik, die nicht nach Wartemusik klingt, entfällt. Probieren Sie zunächst „Soundeffekte generieren“ aus, denn dort ist AI-Audio am zuverlässigsten und dort sind Standardbibliotheken am nervigsten. Wenn Sie eher neugierig als engagiert sind, ist die kostenlose Firefly AI Assistant-Stufe eine kostengünstige Möglichkeit, zu hören, wie diese Modelle tatsächlich klingen. Und wenn Sie mit Sprechern arbeiten, ist die ehrliche Lektüre, dass Sprache in ElevenLabs-Qualität in einem Mainstream-Adobe-Produkt die Ökonomie von kurzen Drehbucherzählungen verändert, allerdings noch nicht von allem, was echte Schauspielerei erfordert.
Quellen
- Adobe Firefly erweitert sein kreatives KI-Studio Adobe
- Adobe Firefly fügt AI-Audio-Tools und Googles Gemini Omni Flash, The Decoder hinzu
- Adobe erweitert generatives KI-Audio mit Firefly-Musik, Sprache und Soundeffekten, SiliconANGLE
- Firefly-Musik-, Voiceover- und Soundeffekt-Tools jetzt allgemein verfügbar, 9to5Mac
Dieser Roboter lernt eine neue Aufgabe anhand eines kurzen Videos, keine Schulung erforderlich
GEN-1.5 von Generalist AI nimmt als Aufforderung eine Demonstration von drei bis zwölf Sekunden und führt die Aufgabe mit einer Erfolgsquote von 59 Prozent aus, die nach fünf Minuten Daten auf 83 Prozent ansteigt. Alle Zahlen stammen vom Unternehmen.