Modely a platformy AI

Adobe představuje Firefly Image Model 5 s vrstevným editováním a vlastním vytvořením AI

mm
Přidejte Unite.AI mezi své preferované zdroje na Google

Adobe (ADBE ) spustila Firefly Image Model 5 na Adobe MAX 2025, představující vrstevné editování obrázků a vlastní tvorbu modelů spolu s rozšířenými nástroji pro generování audia. Veřejná beta verze představuje nejvýznamnější aktualizaci generativního AI od Adobe, zaměřenou na profesionální tvůrce, kteří požadují větší kontrolu nad obsahem generovaným AI.

Firefly Image Model 5 generuje obrázky s rozlišením až 4 megapixely bez použití upscale, poskytující vylepšenou fotorealistiku a lepší renderování lidských postav. Model pohání nový nástroj Prompt to Edit, který kombinuje generování a editování obrázků, umožňující tvůrcům popisovat změny v přirozeném jazyce. Adobe integrovala třetí strany modely od Topaz Bloom, ElevenLabs Multilingual v2, Google’s Gemini 2.5 Flash a Black Forest Labs’ FLUX.1 Kontext do aplikací Creative Cloud.

Vrstevné editování obrázků,目前 ve vývoji, umožňuje přesné, kontextově-aware kompozice, které zachovávají vizuální koherenci napříč všemi změnami provedenými na obrázku. Firefly Custom Models vstoupily do soukromé beta fáze a budou široce dostupné příští měsíc, umožňující tvůrcům personalizovat modely AI tím, že přetáhnou a upustí obrázky, ke kterým mají práva. Vlastní modely zůstávají soukromé ve výchozím nastavení a vyžadují autorizaci tvůrce pro přístup třetích stran.

Obrázek: Adobe

Audio funkce pro tvůrce videa

Adobe představila Generate Soundtrack a Generate Speech ve veřejné beta verzi, řešící problémy s licencemi, které sužovaly producenty videa. Generate Soundtrack analyzuje nahrané video klipy a navrhuje tematicky vhodné instrumentální skladby, které se automaticky synchronizují s časováním obsahu. Tvůrci mohou vybrat z přednastavených stylů, včetně lofi, hip-hop, klasické hudby a EDM, nebo popsat požadované zvuky v přirozeném jazyce. Všechny generované skladby mají plné komerční licence.

Generate Speech kombinuje hlasy z Adobe’s Firefly Speech Model s možnostmi od partnera ElevenLabs, podporující generování textu na řeč v několika jazycích. Tvůrci mohou upravit důraz, emoce, tempo a individuální word stress pro přirozenou dodávku voiceover. Alexandru Costin, viceprezident Adobe pro generativní AI a Sensei, zdůraznil komerční bezpečnost obou nástrojů, uváděje, že byly “navrženy s tvůrci na mysli” pro eliminaci DMCA strike a licenčních poplatků.

Ceny a přístup pro podniky

Firefly Image Model 5 je dostupná prostřednictvím stávajících tarifních plánů Adobe: Standard za 9,99 $ měsíčně s 2 000 generativními kredity, Pro za 29,99 $ měsíčně s 7 000 kredity a Premium za 199,99 $ měsíčně s 50 000 kredity. Předplatitelé Creative Cloud All Apps obdrží 1 000 zahrnutých kredity měsíčně. Do 1. prosince mohou předplatitelé Creative Cloud Pro a Firefly generovat neomezené množství obrázků.

Adobe vyškolila modely Firefly na licencovaném obsahu a poskytuje komerční odškodnění pro firemní uživatele. Model automaticky vkládá Content Credentials pro transparentnost. Plány pro podniky s vlastním cenovým plánem a vyhrazenou podporou jsou dostupné pro týmy s více než 250 členy.

Nástroje pro audio a obrázky doplňují nový časový editor videa ve soukromé beta verzi, který umožňuje tvůrcům přidávat voiceover, soundtracky a tituly do vícestopého editačního rozhraní. Integrovaný přístup umožňuje Adobe soutěžit se samostatnými generátory hudby AI a nástroji pro editování fotografií AI tím, že vkládá funkce přímo do známých pracovních postupů Creative Cloud.

Alex McFarland je AI novinář a spisovatel, který zkoumá nejnovější vývoj v oblasti umělé inteligence. Spolupracoval s mnoha AI startupy a publikacemi po celém světě.