← Naar de blog Techniek

Uitsnijden zonder greenscreen: wat AI vandaag echt kan — en wat het kost

„Met AI hebt u geen groen doek meer nodig." Die zin staat inmiddels in bijna elke brochure. Hij klopt — gedeeltelijk. Wat er nooit naast staat, zijn de getallen waar in de zaal alles van afhangt: hoe lang een uitsnede duurt, op welke hardware, en wat er gebeurt als die twee niet bij elkaar passen.

Wij hebben het nagemeten, op vier echte camerafoto's van 30 megapixel. De uitkomsten zijn ongemakkelijker dan de brochure.

Wat „AI-uitsnede" technisch is

Een model schat voor elke pixel hoezeer die bij het onderwerp hoort — niet alleen ja of nee, maar naar verhouding. Precies dat is bij haar doorslaggevend: één lok bedekt een pixel voor dertig procent, en wie daar een hard ja of nee van maakt, krijgt de uitgeknipte kartonnen figuur die iedereen meteen herkent.

Er zijn twee families. Kleine modellen draaien in milliseconden en zitten in de software. Grote modellen zien aan de haargrens duidelijk meer, maar wegen een halve gigabyte en rekenen navenant langer.

Het getal dat niemand noemt: rekentijd

Gemeten op een foto van 30 megapixel, telkens de pure rekentijd van het model:

  • Ingebouwd model: 0,2 seconde met grafische kaart — 0,85 seconde zonder.
  • Groot model: 2,5 tot 3,0 seconden met grafische kaart — 23 seconden zonder.

Hetzelfde bestand, dezelfde programmacode, factor acht verschil. Niet de software bepaalt dat, maar de computer onder de tafel. En 23 seconden is geen „iets langzamer": zo lang staat een gast voor de box zonder te weten of er nog iets komt.

De vraag aan een leverancier luidt dus niet „Kunt u AI-uitsnede?", maar: „Hoe lang duurt die op precies de computer die ik inzet?" Wie daar geen gemeten getal bij kan noemen, heeft het nooit gecontroleerd. Bij BoothDock staat de tijd naast elk model — gemeten op de box zelf, niet overgenomen uit onze documentatie.

Meer resolutie maakt het slechter, niet beter

De voor de hand liggende gedachte: als de rand rommelig is, reken ik toch gewoon in hogere resolutie. Het tegendeel is waar — en die fout hebben we zelf gemaakt.

Een uitsnijmodel wordt op een bepaald beeldformaat getraind, meestal 512 pixels. Geeft u het 2048, dan verandert niet zijn scherpte maar zijn blikveld: het ziet alleen nog uitsneden en herkent de mens niet meer als geheel. Het resultaat valt uiteen in fragmenten. Een schuifregelaar die tot 4096 gaat, is daarom geen kwaliteitskenmerk maar een valkuil.

Omgekeerd geldt het echter ook niet. Bij 512 verloor hetzelfde model op een foto van 30 megapixel een hele schouder — donkere jas voor donker blad, te weinig verschil voor het model. In beide gevallen was 1024 juist. Laat iemand u een kwaliteitsregelaar zien, vraag dan waarop het model getraind is. Alles daarboven is geen reserve maar risico.

De volgorde waar de meeste systemen op stuklopen

Bijna elke fotobox biedt filters aan — zwart-wit, sepia, krachtige kleuren. En bijna overal wordt eerst het filter in het beeld gerekend en daarna uitgesneden. Dat is precies andersom, om drie redenen:

  • Het verwijderen van de groenzweem rekent met echt groen. Na een warm filter is het groen geen groen meer.
  • De randverfijning gebruikt het kleurbeeld als houvast. Gemeten op echte foto's: met kleur verbetert ze de rand met veertien procent, op een zwart-witbeeld verslechtert ze die met eenentwintig procent. Een monofilter neemt haar precies weg wat ze nodig heeft om te werken.
  • Het model is op natuurlijke foto's getraind. Een „pop"-look is voor hem beeldruis.

Juist is: eerst uitsnijden, dan de look over het afgewerkte beeld leggen — dan ligt hij ook over de nieuwe achtergrond, wat sowieso samenhangender oogt. Laat bij een demonstratie een foto maken met een krachtig zwart-witfilter én uitsnede. Aan de haargrens ziet u meteen in welke volgorde er gerekend wordt.

Wanneer het groene doek toch wint

AI vervangt het greenscreen niet overal. Drie redenen pleiten nog steeds voor het doek:

  • De gast ziet zichzelf vooraf in de achtergrond. Een chroma key loopt mee in de zoeker, praktisch zonder vertraging. Een groot AI-model heeft bijna drie seconden nodig — te traag voor een liveweergave.
  • Het draait op elke hardware. Een groen doek heeft geen grafische kaart nodig, maar gelijkmatig licht.
  • Het is voorspelbaar. Goed uitgelicht groen levert altijd hetzelfde resultaat. AI is bij lastige onderwerpen dan eens beter en dan eens slechter.

AI wint daar waar geen plaats voor een doek is, waar de opbouw in vijf minuten moet staan — en bij gasten met hoed, bril of omhooggehouden props, waar een chroma key graag op stukloopt.

Waar u bij aankoop op moet letten

  • Laat u de gemeten rekentijd op uw hardware tonen, niet op de demomachine van de leverancier.
  • Vraag of er een terugval op het snelle model is als de computer te traag is — anders wacht de gast.
  • Controleer de volgorde van filter en uitsnede op een beeld met een krachtige look.
  • Vraag naar de trainingsresolutie voordat u een kwaliteitsregelaar omhoogtrekt.
  • Laat u een resultaat op ware grootte zien, niet als miniatuur. Op achthonderd pixel breed ziet elke uitsnede er goed uit.

BoothDock gratis proberen →