Gruppsex
Tre eller fler personer i samma scen — tekniskt sett den svåraste kategorin att generera och den där skillnaden mellan modellgenerationer syns tydligast. 268 AI-genererade filmer, varje enskild noggrant utvald ur ett stort antal förkastade utkast.
Utvalda scener
Fyra i fokus
Fyra kroppar som håller ihop genom hela klippet. Vår mest sedda gruppscen.
Loftfest
Öppen planlösning och hårt sidoljus. Fem personer i bild.
Cirkeln
Kameran rör sig runt scenen i en obruten cirkel — svårt att få stabilt.
Efter midnatt
Mörk miljö med enda ljuskälla i bild. Tre personer.
Nicole Berg — Sommar
Nicole i en av våra ljusaste gruppscener.
Midsommarnatt
Svensk sommarnatt, gruppscen utomhus i skymningsljus.
Om kategorin gruppsex
Gruppsex är kategorin där generativ video fortfarande visar var gränsen går. Allt som är svårt med en kropp blir exponentiellt svårare med fyra, och kategorin fungerar därför som ett slags stresstest — kan en modell göra en bra gruppscen klarar den i praktiken allt annat också.
Varför det är så svårt
Kärnproblemet heter ockludering. När två kroppar överlappar i bild måste modellen hålla reda på vad som finns bakom det som skyms, och när de separerar igen måste den återskapa det korrekt. En arm som försvinner bakom en axel i bildruta 30 ska komma tillbaka som samma arm, med samma hudton, samma vinkel och samma antal fingrar, i bildruta 45. Modeller som inte klarar det producerar det klassiska felet där lemmar byter ägare mitt i en rörelse.
Ovanpå det ligger identitetsproblemet. Fyra personer i bild betyder fyra ansikten som var och en måste hålla sig konsekventa genom hela klippet, samtidigt som de inte får glida mot varandra. Utan tillräcklig separation i modellen börjar ansiktena konvergera — efter några minuter ser alla fyra ut som samma person, ungefär som när man tittar för länge på en spegling.
Det tredje problemet är rent räknemässigt. Fler kroppar i bild betyder mindre upplösning per kropp. Ett ansikte som upptar en åttondel av bilden har helt enkelt färre pixlar att bygga detaljer med än ett ansikte som fyller halva rutan, och det är i de detaljerna trovärdigheten sitter.
Hur vi arbetar runt det
Vi använder tre knep. Det första är att hålla miljön extremt enkel. En gruppscen har redan så mycket som kan gå fel i förgrunden att en detaljrik bakgrund bara ökar risken — därför är väggarna släta och rummen sparsamt möblerade i nästan alla våra gruppscener.
Det andra är ljussättning som skiljer kroppar åt. Genom att låta huvudljuset komma från sidan i stället för framifrån får varje kropp en tydlig skuggkant, vilket ger modellen en starkare signal om var en person slutar och nästa börjar. Loftfest och Efter midnatt är båda byggda kring den principen.
Det tredje är längre tagningar med färre snitt. Det låter kontraintuitivt — längre tagning borde ge mer tid att glida — men i praktiken är varje snitt en omstart där modellen måste återetablera fyra identiteter samtidigt. Det är därför kategorins snittlängd ligger på 29 minuter, klart högst på sajten.
Bortfallet är ändå betydande. En publicerad gruppscen har i regel ett par hundra förkastade utkast bakom sig, mot en handfull för en scen med två personer.
Bortfall per antal personer
| Personer i bild | Utkast per publicerad scen | Vanligaste felet | Andel filmer |
|---|---|---|---|
| 3 | ca 60 | Ansikten som glider mot varandra | 54 % |
| 4 | ca 180 | Lemmar som byter ägare | 31 % |
| 5 | ca 420 | Kroppar som smälter ihop vid överlapp | 12 % |
| 6 | ca 900 | Allt ovanstående samtidigt | 3 % |
Siffrorna är våra egna och gäller den videomodell vi kör sedan februari 2026. Med föregående generation låg motsvarande tal ungefär tre gånger högre.
Vanliga frågor om gruppsex
Varför finns det färre filmer i gruppsex än i andra kategorier?
För att bortfallet är enormt. En scen med fyra personer kräver i storleksordningen tio gånger fler utkast än en scen med två, eftersom modellen måste hålla ihop fyra separata kroppar samtidigt utan att blanda ihop lemmar mellan dem.
Vad är det svåraste tekniska problemet i gruppscener?
Att kroppar smälter ihop. När två personer överlappar i bild har modellen svårt att avgöra vilken arm som hör till vem, och resultatet blir armar som byter ägare mellan bildrutor eller ben som utgår från fel höft.
Hur många personer är det som mest i en scen?
Sex. Över det blir bortfallet så stort att det inte är praktiskt genomförbart — i princip varje utkast har minst ett synligt fel någonstans i bild.