Bronnen
Zie het in actie
Blader door de modellen en stijlen achter verhalen als dit — gratis account, meteen een galerij.
Ontdek de catalogus
Iris schrijft waar AI-kunst en cultuur samenkomen — stijl, auteurschap en de beelden die ertoe doen.
Blader door de modellen en stijlen achter verhalen als dit — gratis account, meteen een galerij.
Ontdek de catalogusKies een companion en ontdek wat die van dit verhaal vindt
AMD neemt World Labs over — de spatial-AI-startup mede opgericht door Stanford AI-pionier dr. Fei-Fei Li — voor 8,2 miljard dollar in een all-stock-deal die naar verwachting voor het einde van 2025 wordt afgerond. Li treedt toe tot AMD als executive vice president en chief scientist, een stap die AMD's ambitie onderstreept om niet alleen op het gebied van silicium met Nvidia te concurreren, maar ook op het fundamentele onderzoek dat bepaalt hoe AI-modellen driedimensionale ruimte begrijpen en genereren.
World Labs was geen ander groot taalmodel aan het bouwen. Het kernonderzoek richt zich op ruimtelijke intelligentie — het vermogen van een AI om een coherente driedimensionale wereld te construeren en daarover te redeneren vanuit visuele invoer, in plaats van een afbeelding te behandelen als een plat raster van pixels. Dat onderscheid is enorm belangrijk voor iedereen die afbeeldingen of scènes genereert met AI-tools.
Huidige diffusiemodellen produceren afbeeldingen die op het eerste gezicht ruimtelijk plausibel lijken, maar bij nader inzien bezwijken: handen reiken door objecten heen, schaduwen vallen in de verkeerde richting, architectuur vervormt aan de randen van een frame. Dit zijn geen hallucinaties in de zin van taalmodellen; het zijn mislukkingen van geometrisch redeneren. Een model dat geworteld is in ruimtelijke intelligentie zou begrijpen dat een stoelpoot achter een tafel staat en er niet mee is samengesmolten — en die beperking zou zich door elke pixel van de uitvoer verspreiden. Het esthetische gevolg zijn beelden die structureel samenhangen, zoals een foto dat doet, in plaats van beelden die slechts op foto's lijken.
Voor videogeneratie in het bijzonder is ruimtelijke verankering het verschil tussen een scène die aanvoelt als een plek en een reeks frames die toevallig een kleurenpalet delen. Makers die werken met AI-video- en animatietools zullen dit verschil vandaag het meest acuut voelen — het is de reden waarom gegenereerde camerabewegingen nog steeds rubberachtig ogen, en waarom objectpermanentie over cuts heen onopgelost blijft.
Volgens Ars Technica is de deal 8,2 miljard dollar waard — een bedrag dat niet alleen de onderzoeksportefeuille van World Labs weerspiegelt, maar ook de strategische waarde van Li zelf. Als de wetenschapper die mede ImageNet creëerde, de dataset die de deep-learning-revolutie in computer vision op gang bracht, beschikt Li over een institutionele geloofwaardigheid die geld alleen niet kan kopen. AMD koopt tegelijkertijd een onderzoeksrichting en een reputatie.
Nvidia's dominantie in AI-computing heeft altijd op twee pijlers gerust: GPU-hardware en CUDA, het software-ecosysteem dat ontwikkelaars aan zich bindt. Maar een derde pijler is stilletjes gegroeid — Nvidia's investeringen in onderzoekspartnerschappen en overnames die zijn hardware centraal houden in de ontwikkeling van geavanceerde modellen. AMD heeft de hardware nu; het ontbrak aan onderzoekszwaartekracht. World Labs en Li veranderen die berekening.
«Wereldmodellen zijn de volgende grens van AI — systemen die de wereld niet alleen herkennen, maar ook begrijpen en simuleren.»
— Dr. Fei-Fei Li
De praktische opbrengst voor makers is niet onmiddellijk. De deal is nog niet afgerond, en het integreren van ruimtelijke AI in een onderzoeksfase in productie-beeldgeneratiepijplijnen duurt jaren, niet kwartalen. Maar de richting is duidelijk: de volgende generatie modellen zal steeds vaker worden beoordeeld op geometrische coherentie en scèneconsistentie, niet alleen op oppervlaktetextuur en stijl.
Makers die huidige tools al inzetten voor architectuurvisualisatie, game-asset-generatie of consistentie over meerdere frames — de soorten workflows die worden verkend in Charmloop's generatiegidsen — zullen als eersten merken dat het gat kleiner wordt. De modellen in de Charmloop-catalogus zullen uiteindelijk deze verschuiving weerspiegelen naarmate ruimtelijk redeneren van onderzoekscuriositeit naar trainingsdoelstelling verschuift.
Voor nu is de overname een signaal over de richting waarin de hardware-tot-model-pijplijn zich beweegt. AMD heeft zojuist een zeer grote gok gedaan dat de toekomst van AI-beeldvorming driedimensionaal is — en dat de wetenschapper die machines leerde zien de juiste persoon is om dat te bewijzen.