Demonstrationen var en kanna och några vindruvor

Nvidia använde sitt SIGGRAPH-anförande den 20 juli i Los Angeles, med titeln Next Era of Graphics: Neural Rendering, World Models and Simulation, för att visa vad DLSS 5 gör med ett stilleben. Företaget lade upp en renderad scen med flaskor, vindruvor och en kanna, och därefter samma scen där vart och ett av objekten fick sin egen neurala behandling. Det var demonstrationen, och den väger tyngre än de prestandadiagram som normalt följer med en DLSS-presentation.

Skälet ligger i vem som gör arbetet. Varje tidigare DLSS-generation var något som en spelare slog på och som en utvecklare integrerade en gång. Det Nvidia visade i Los Angeles är en uppsättning reglage som bor inne i spelmotorn och fäster vid enskilda tillgångar, vilket gör resultatet till något som någon på studion måste besluta, skapa och kontrollera.

Vad den tredje kategorin faktiskt gör

DLSS började som pixelrekonstruktion, som lyfte en billigare rendering till en högre utmatningsupplösning. Den andra kategorin var bildgenerering, med insättning av mellanliggande bildrutor. DLSS 5 lägger till en tredje: neural rendering i realtid. Modellen tar en vanlig färgbuffert, rörelsevektorer och interna motordata, och berikar slutbilden i stället för att enbart rekonstruera den.

De konkreta mål Nvidia nämnde är just de delar av en scen som är dyra att beräkna ärligt. Kvaliteten på global belysning, spridning under ytan på figurers hud, hur ljus samspelar med hår och tygers fysiska beteende. Algoritmen under är en kompakt diffusionstransformer destillerad från större kärnnätverk, och det är vad som över huvud taget får en generativ teknik att rymmas i en realtidsbudget per bildruta. Simuleringen definierar världen och genereringen berikar dess utseende, som en av talarna formulerade det.

Tre modeller är ett beslut, inte ett standardvärde

Nvidia visade tre nätverk, helt enkelt benämnda Modell A, Modell B och Modell C, som var och en ger en egen tolkning av samma renderade scen. De skiljer sig i rekonstruktionskvalitet, precision i global belysning, texturgenerering, strukturell detalj och beräkningskostnad. Utvecklare kan välja mellan dem och använda olika modeller för olika scener inom samma titel.

Det är ett verkligt redaktionellt beslut förklätt till en teknisk inställning. En grottinteriör och en regnvåt gata fallerar på olika sätt under generativ berikning, och den modell som smickrar den ena kan synbart få den andra ur balans. Någon måste nu sätta sig med de tre resultaten och scen för scen avgöra vilken som matchar den konstnärliga riktningen, och sedan försvara det beslutet när en recensent noterar att håret ser annorlunda ut i kapitel fyra.

Hårdvaruribban sjönk och arbetsribban steg

Lättnaden är verklig. I mars visade Nvidia på GTC DLSS 5 på en konfiguration med två GPU:er, vilket många studior läste som en teknik som inte skulle nå konsumentmaskiner på flera år. Nvidia har nu uppgett att dubbelkortsriggen var en utvecklingskonfiguration och inte målet för konsumentledet, och att DLSS 5 vid lanseringen kör på en enda GPU i RTX 50-serien. Den barriär som spelade roll för spridningen är borta.

Det som ersätter den är en arbetskostnad snarare än en kiselkostnad. Masker per objekt måste skapas inne i motorn, var och en med egna inställningar för struktur och ton. De måste granskas, eftersom en mask som ser rätt ut i ett ljustest kan bete sig fel när samma tillgång dyker upp under andra förhållanden. Och de måste underhållas, eftersom tillgångar arbetas om och ljussättning justeras sent. Inget av detta fanns i en budget för DLSS 4-integration, och tekniken kommer hösten 2026 med Bethesda, Capcom och Ubisoft redan bundna, så arbetet landar i produktionscykler vars omfattning redan är fastställd.

Vad en studio med höstsläpp bör göra nu

Behandla modellval och maskering som en leverans inom technical art med en namngiven ägare, inte som ett integrationsärende. Den praktiska enheten är scenen, så den första användbara produkten är en lista över de scener där generativ berikning påtagligt förändrar uttrycket, vilket i de flesta titlar blir betydligt färre än totalen. Skapa masker för dem, låt resten stå på ett standardvärde, och ni har ett omfång som ett litet team faktiskt hinner slutföra och granska.

Bestäm sedan reservpositionen medvetet. DLSS 5 kan stängas av per objekt, och en titel som säljs över ett spann av hårdvara behöver ett definierat svar på hur scenen ser ut utan. Europeiska studior har ytterligare ett skäl att hålla det svaret skarpt: en titel som säljs i EU och Storbritannien möter en bred installerad bas av äldre hårdvara, och ett uttryck som bara håller ihop med neural rendering påslagen är ett uttryck som en betydande andel av de betalande kunderna aldrig får se som det var tänkt.