NyhetLjud

Adobe Firefly får Generate Speech – kontrollera språket före manuset

Firefly kan nu göra röstpålägg från text och låter dig välja mellan Adobes egen talmodell och en partnermodell. För ett svenskt manus är första uppgiften inte att finjustera rösten, utan att bevisa att rätt modell klarar språket.

Publicerad · Senast granskad

Montagebord rakt uppifrån med två horisontella film- och pappersspår på en grålila skiva, en solfjäder av små svartvita kort, svarta materialremsor, en penna och ett magentafärgat streck mellan spåren.
De två spåren står för Firefly Speech och partnermodellen. Det magenta strecket markerar kontrollen som ska göras innan hela manuset går vidare.

Kort sagt

Generate Speech ingår i Fireflys augustiuppdatering och är märkt som beta hos Adobe. Adobes publicerade språklista för modellen Firefly Speech innehåller bland annat nederländska, engelska, franska, tyska och spanska, men inte svenska. Gränssnittet erbjuder också ElevenLabs Multilingual v2 som partnermodell. Det är ett separat modellval, inte en garanti för att ditt svenska manus fungerar. Kör därför samma korta prov i de alternativ som faktiskt visas på ditt konto och spara modell, röst och inställningar tillsammans med resultatet.

Vad Adobe har lagt till

I Fireflys officiella nyhetsöversikt står Generate Speech med i uppdateringen för augusti 2026. Funktionen gör tal av inklistrad text eller en uppladdad DOCX- eller TXT-fil. I Adobes arbetsgång väljer du först modell och röst, därefter kan du förhandslyssna och justera de kontroller som hör till modellen innan ljudet genereras och laddas ned.

För modellen Firefly Speech beskriver Adobe kontroller för språk eller accent, hastighet och tonhöjd. Textverktygen omfattar förhandslyssning, uttalskorrigering och ton på markerade ord eller fraser. Det gör funktionen intressant för exempelvis en speakerröst till en kort instruktionsfilm. Men många reglage betyder inte att det första modellvalet är rätt. Om grundspråket faller hjälper det sällan att börja med mer ton eller högre likhet.

Den språklista Adobe publicerar för Firefly Speech räknar den 16 augusti upp nederländska, engelska, franska, tyska, hindi, italienska, mandarin och spanska i tolv språk-/lokalkombinationer. Svenska finns inte med. Det betyder inte att inget svenskt ljud kan komma ur modellen, men det betyder att Adobe inte dokumenterar svenska som ett stött språk där. För skarpt svenskt arbete är det tillräckligt skäl att stoppa före ett helt manus.


Håll isär två modellvägar

I samma Generate Speech-vy går det enligt Adobe att välja ElevenLabs Multilingual v2 som partnermodell. Då visas en dialog om skillnaderna mellan modellerna innan du fortsätter. Partnervägen har egna inställningar: Adobe nämner hastighet, stabilitet, likhet, stilöverdrift och högtalarförstärkning. Firefly Speech har i stället den dokumenterade språklistan samt kontroller för bland annat hastighet och tonhöjd.

Skriv därför aldrig bara ”Firefly” i projektets följesedel. Två ljud som skapats på samma sida kan komma från olika modeller och ha olika reglage. Anteckna modellnamnet exakt som det visas, vald röst, eventuellt språk eller accent och vilka reglage du ändrade. Om en kollega senare ska göra om en mening är ”Firefly, lugn röst” inte en reproducerbar beställning.

Partneralternativet löser inte automatiskt språkfrågan. Adobes partnersida visar hur modellen väljs och vilka röstreglage som finns, men sidan ger inte en fullständig lista över språk för varje röst i just Firefly-flödet. Det säkra arbetsbeslutet kommer därför från ett lyssningsprov i ditt eget konto, med den röst och den svenska text som projektet kräver.


Språkprovet före hela manuset

Provet tar bara några minuter och använder ett kort svenskt stycke. Det innehåller ett namn, två tal- och tidsuttryck, ett sammansatt ord och en mening med tydlig betoning. De delarna avslöjar fler problem än en neutral hälsningsfras. Klistra inte in kundens fulla manus ännu; poängen är att fatta modellbeslutet innan du lägger tid på manusmärkning.

Testmanus — använd samma text för varje modell
Välkommen till Sjövikens kulturhus. Torsdag den 27 augusti öppnar vår nya ljudutställning klockan 18.30. Ta med hörlurar om du vill prova hela programmet. Observera att förhandsvisningen börjar i foajén – inte i stora salen. Fråga efter Mikael vid informationsdisken.

1. Kontrollera språkfältet. Välj Firefly Speech och öppna listan för språk eller accent. Finns svenska inte i listan ska protokollet säga ”svenska ej dokumenterat i valt språkfält”. Välj inte ett närliggande språk och döp om det till svenska. Provet är redan då en kontroll av begränsningen, även om du går vidare för att höra hur modellen beter sig.

2. Spela endast teststycket. Använd förhandslyssningen innan du genererar mer. Lyssna särskilt på ”Sjövikens”, ”27 augusti”, ”18.30”, ”ljudutställning”, pausen före ”inte” och namnet ”Mikael”. Markera varje punkt som rätt, tveksam eller fel. Ett allmänt intryck som ”låter naturligt” är för vagt för att styra nästa försök.

3. Byt modell, inte text. Om ElevenLabs Multilingual v2 finns på kontot, läs dialogen om partnermodellen och kör exakt samma stycke med en vald röst. Ändra inga röstreglage i första jämförelsen. Då hör du främst skillnaden mellan modellvägarna. Först efter ett godkänt grundspråk provar du hastighet, stabilitet, tonhöjd eller andra reglage som modellen visar.

4. Rätta ett uttal. Markera ett enda felord och använd uttalsverktyget om det är tillgängligt för din valda modell. Adobe beskriver en fonetisk ersättning som kan gälla den markerade förekomsten eller alla förekomster. Spela sedan hela teststycket, inte bara ordet. En lokal rättning är godkänd först när ordet fungerar utan att rytmen i meningen går sönder.

5. Fatta ett stoppbeslut. Gå vidare till hela manuset bara om rätt modell och röst klarar alla kritiska ord, betoningen går att styra och du kan återskapa inställningarna. Om två eller fler kritiska punkter fortfarande faller efter en uttalsrättning är resultatet ”byt röst, modell eller verktyg”. Att skriva in hundra fler meningar ger inte ett bättre grundspråk.

Provprotokoll — spara med ljudfilen
MODELL: [Firefly Speech / exakt partnernamn]
RÖST: [namn i gränssnittet]
SPRÅK/ACCENT: [valet som faktiskt visas / saknas]
ÄNDRADE REGLAGE: [inga i första provet]

Sjövikens: [rätt / tveksam / fel]
27 augusti: [rätt / tveksam / fel]
18.30: [rätt / tveksam / fel]
ljudutställning: [rätt / tveksam / fel]
betoning på ”inte”: [rätt / tveksam / fel]
Mikael: [rätt / tveksam / fel]

UTTALSRÄTTNING: [ord + fonetisk skrivning / ingen]
TON ELLER PAUS: [markerad fras + val / ingen]
BESLUT: [gå vidare / byt röst / byt modell / byt verktyg]
KONTROLLDATUM: [ÅÅÅÅ-MM-DD]

Uttal, ton och pauser kommer efter språkvalet

Adobes uttalsverktyg låter dig skriva hur ett markerat ord ska låta och sedan förhandslyssna på rättningen. Det passar egennamn, facktermer och ord med flera möjliga uttal. Använd ”Fix” för en förekomst när sammanhanget skiljer sig och ”Fix all” först när varje förekomst verkligen ska låta likadant. Kontrollprovet är hela meningen före och efter ordet; annars kan ett korrekt namn fortfarande få en konstig upptakt.

Tonverktyget kan märka markerade ord eller fraser med neutrala, positiva, negativa eller uttrycksfulla kategorier. Lägg inte sådana markörer över hela texten. Börja med en enda betydelsebärande kontrast, som ”inte i stora salen”, och jämför mot versionen utan tonmarkering. Behåll markören bara om en lyssnare utan manus hör rätt innebörd. En märkning som bara syns i editorn men inte hörs har inte löst uppgiften.

Arbetar du vidare med ett längre röstpålägg behöver manuset dessutom skrivas för örat: korta satsdelar, avsiktliga pauser och en kontroll i den bild eller ljudmiljö där rösten ska användas. Den fulla metoden finns i guiden om röst och ljud. Spara modellvalet och provprotokollet tillsammans med beställningen enligt arbetsgången för genererat material, så kan nästa person återskapa rösten i stället för att börja om.


Källor och kontrolltid

Fyra av Adobes officiella hjälpsidor lästes den 16 augusti 2026. De stödjer uppgifterna om vad som släpptes, vilka språk som listas, partnermodellen och uttalsverktyget. Femminuterstestet, följesedeln och stoppregeln är AI-kreatörs eget arbetssätt. Sidorna kunde inte kontrolleras om automatiserat den 9 september 2026 — helpx.adobe.com avvisar maskinella anrop — och behöver läsas i webbläsare vid nästa kontroll.

Nästa kontroll senast den 16 november 2026, eller tidigare om Adobe ändrar språklistan, byter partnermodell eller flyttar funktionen mellan planer. Språklistan är den uppgift som åldras snabbast.

Definition av klart

Du har kontrollerat vilka språk som faktiskt visas för vald modell, kört samma korta svenska text i relevanta modellalternativ och markerat sex uttals- och betoningspunkter som rätt, tveksamma eller fel. Projektets följesedel innehåller exakt modellnamn, röst, språk eller accent, ändrade reglage, eventuell uttalsrättning och kontrolldatum. Hela manuset läggs in först när grundspråket klarar provet.