← Tillbaka till bloggen Teknik

Frilägga utan greenscreen: vad AI verkligen klarar i dag — och vad det kostar

”Med AI behöver du ingen grön duk längre.” Den meningen står numera i nästan varje broschyr. Den stämmer — delvis. Det som aldrig står bredvid är siffrorna som allt hänger på i lokalen: hur lång tid ett frilägg tar, på vilken hårdvara, och vad som händer när de två inte passar ihop.

Vi har mätt efter, på fyra riktiga kamerabilder med 30 megapixel. Resultaten är obekvämare än broschyren.

Vad ”AI-frilägg” tekniskt är

En modell uppskattar för varje pixel hur mycket den hör till motivet — inte bara ja eller nej, utan andelsvis. Just det är avgörande vid hår: en enda slinga täcker trettio procent av en pixel, och den som gör ett hårt ja eller nej av det får den utklippta pappfiguren som alla känner igen direkt.

Det finns två familjer. Små modeller räknar på millisekunder och sitter i själva programvaran. Stora modeller ser betydligt mer vid hårkanten, men väger ett halvt gigabyte och räknar i motsvarande grad längre.

Siffran ingen nämner: beräkningstid

Uppmätt på en bild med 30 megapixel, varje gång modellens rena beräkningstid:

  • Inbyggd modell: 0,2 sekunder med grafikkort — 0,85 sekunder utan.
  • Stor modell: 2,5 till 3,0 sekunder med grafikkort — 23 sekunder utan.

Samma fil, samma programkod, faktor åtta i skillnad. Det är inte programvaran som avgör det, utan datorn under bordet. Och 23 sekunder är inte ”något långsammare”: så länge står en gäst framför stationen utan att veta om något mer kommer.

Frågan till en leverantör lyder därför inte ”Kan ni AI-frilägg?”, utan: ”Hur lång tid tar det på exakt den dator jag använder?” Den som inte kan nämna en uppmätt siffra har aldrig kontrollerat det. Hos BoothDock står tiden bredvid varje modell — uppmätt på stationen själv, inte hämtad ur vår dokumentation.

Mer upplösning gör det sämre, inte bättre

Den närliggande tanken: om kanten är orolig räknar jag bara i högre upplösning. Motsatsen gäller — och det misstaget har vi gjort själva.

En friläggsmodell tränas på en viss bildstorlek, typiskt 512 pixlar. Ger man den 2048 ändras inte dess skärpa utan dess synfält: den ser bara utsnitt och känner inte längre igen människan som helhet. Resultatet faller isär i fragment. Ett reglage som går till 4096 är därför inget kvalitetstecken, utan en fälla.

Omvänt gäller det dock inte heller. Vid 512 förlorade samma modell en hel axel på en bild med 30 megapixel — mörk jacka mot mörkt lövverk, för liten skillnad för modellen. Rätt var i båda fallen 1024. Om någon visar dig ett kvalitetsreglage, fråga vad modellen tränats på. Allt däröver är ingen marginal, utan risk.

Ordningen som de flesta får om bakfoten

Nästan varje fotobox erbjuder filter — svartvitt, sepia, kraftiga färger. Och nästan överallt räknas filtret in i bilden först och frilägget sker efteråt. Det är precis tvärtom, av tre skäl:

  • Borttagningen av grönstick räknar med riktigt grönt. Efter ett varmt filter är det gröna inte grönt längre.
  • Kantförfiningen orienterar sig efter färgbilden. Uppmätt på riktiga bilder: med färg förbättrar den kanten med fjorton procent, på en svartvit bild försämrar den den med tjugoen procent. Ett monofilter tar ifrån den precis det den behöver för att arbeta.
  • Modellen tränades på naturliga foton. En ”pop”-look är för den bildbrus.

Rätt är: frilägg först, lägg sedan looken över den färdiga bilden — då ligger den också över den nya bakgrunden, vilket ändå hänger ihop bättre. Vid en visning: be om ett foto med kraftigt svartvitt filter och frilägg. Vid hårkanten ser du genast i vilken ordning det räknas.

När den gröna duken ändå vinner

AI ersätter inte greenscreen överallt. Tre skäl talar fortfarande för duken:

  • Gästen ser sig själv i bakgrunden i förväg. En chroma key följer med i sökaren, praktiskt taget utan fördröjning. En stor AI-modell behöver närmare tre sekunder — för långsamt för en liveförhandsvisning.
  • Det fungerar på all hårdvara. En grön duk behöver inget grafikkort, utan jämnt ljus.
  • Det är förutsägbart. Välbelyst grönt ger alltid samma resultat. AI:n är vid svåra motiv ömsom bättre, ömsom sämre.

AI:n vinner där det inte finns plats för en duk, där uppställningen ska stå på fem minuter — och vid gäster med hatt, glasögon eller upphållna rekvisita, som en chroma key gärna misslyckas med.

Vad du bör se upp med vid köp

  • Be att få se den uppmätta beräkningstiden på din hårdvara, inte på leverantörens demomaskin.
  • Fråga om det finns ett återfall till den snabba modellen när datorn är för långsam — annars väntar gästen.
  • Kontrollera ordningen mellan filter och frilägg på en bild med kraftig look.
  • Fråga efter träningsupplösningen innan du drar upp ett kvalitetsreglage.
  • Be att få se ett resultat i originalstorlek, inte som miniatyr. Vid åttahundra pixlars bredd ser varje frilägg bra ut.

Testa BoothDock kostnadsfritt →