Źródła
Zobacz w akcji
Przejrzyj modele i style stojące za takimi historiami — darmowe konto i galeria od razu.
Przeglądaj katalog
Iris pisze o styku sztuki AI i kultury — o stylu, autorstwie i obrazach, które mają znaczenie.
Przejrzyj modele i style stojące za takimi historiami — darmowe konto i galeria od razu.
Przeglądaj katalogWybierz towarzysza i poznaj jego zdanie na temat tej historii
AMD przejmuje World Labs — startup zajmujący się przestrzenną AI, współzałożony przez pioniera AI ze Stanforda, dr Fei-Fei Li — za 8,2 miliarda dolarów w transakcji wyłącznie akcyjnej, która ma zostać sfinalizowana przed końcem 2025 roku. Li dołączy do AMD jako wiceprezes wykonawczy i główny naukowiec — posunięcie sygnalizujące zamiar AMD, by rywalizować z Nvidią nie tylko na polu krzemowych układów, lecz także w obszarze fundamentalnych badań kształtujących to, jak modele AI rozumieją i generują trójwymiarową przestrzeń.\n\n## Najważniejsze wnioski\n\n- AMD przejmuje World Labs za 8,2 miliarda dolarów w transakcji wyłącznie akcyjnej, która ma zostać sfinalizowana przed końcem roku.\n- World Labs, współzałożony przez dr Fei-Fei Li, specjalizuje się w inteligencji przestrzennej — AI budującej spójne trójwymiarowe modele świata na podstawie danych wizualnych.\n- Dr Fei-Fei Li dołączy do AMD jako wiceprezes wykonawczy i główny naukowiec.\n- Inteligencja przestrzenna to kluczowa zdolność dla modeli generowania obrazów i wideo nowej generacji, umożliwiająca rozumowanie o głębi, okluzji i geometrii sceny.\n- Przejęcie stawia AMD bezpośrednio naprzeciw pipeline'u badania-do-sprzętu Nvidii w wyścigu o dominację w infrastrukturze AI.\n\n## Dlaczego inteligencja przestrzenna zmienia wygląd generowanych obrazów\n\nWorld Labs nie budował kolejnego dużego modelu językowego. Jego podstawowe badania koncentrują się na inteligencji przestrzennej — zdolności AI do konstruowania i rozumowania o spójnym trójwymiarowym świecie na podstawie danych wizualnych, zamiast traktowania obrazu jako płaskiej siatki pikseli. To rozróżnienie ma ogromne znaczenie dla każdego, kto generuje obrazy lub sceny za pomocą narzędzi AI.\n\nObecne modele dyfuzyjne produkują obrazy, które na pierwszy rzut oka mogą wyglądać przestrzennie wiarygodnie, lecz rozpadają się pod baczniejszym spojrzeniem: dłonie przenikają przez obiekty, cienie padają z niewłaściwego kierunku, architektura wykrzywia się na krawędziach kadru. To nie są halucynacje w sensie modeli językowych — to błędy rozumowania geometrycznego. Model oparty na inteligencji przestrzennej rozumiałby, że noga krzesła jest za stołem, a nie z nim zlana — i to ograniczenie propagowałoby się przez każdy piksel wyjścia. Estetyczną konsekwencją są obrazy trzymające się strukturalnie kupy, tak jak fotografia, a nie obrazy jedynie przypominające fotografie.\n\nW przypadku generowania wideo przestrzenne zakotwiczenie to różnica między sceną, która czuje się jak miejsce, a sekwencją klatek przypadkowo dzielących tę samą paletę barw. Twórcy pracujący z narzędziami do wideo i animacji AI najdotkliwiej odczuwają tę lukę dziś — to właśnie dlatego generowane ruchy kamery wciąż wyglądają gumowato i dlaczego trwałość obiektów między cięciami pozostaje nierozwiązana.\n\n## Co AMD zyskuje poza sprzętem\n\nWedług Ars Technica, wartość transakcji wynosi 8,2 miliarda dolarów — kwota odzwierciedlająca nie tylko portfolio badawcze World Labs, lecz także strategiczną wartość samej Li. Jako naukowczyni, która współtworzyła ImageNet — zbiór danych, który zapoczątkował rewolucję głębokiego uczenia w widzeniu komputerowym — Li dysponuje rodzajem instytucjonalnej wiarygodności, której same pieniądze nie są w stanie wytworzyć. AMD kupuje jednocześnie kierunek badań i reputację.\n\nDominacja Nvidii w obliczeniach AI zawsze opierała się na dwóch filarach: sprzęcie GPU i CUDA — ekosystemie oprogramowania, który uzależnia od siebie deweloperów. Jednak po cichu wyrósł trzeci filar — inwestycje Nvidii w partnerstwa badawcze i przejęcia, które utrzymują jej sprzęt w centrum rozwoju najnowocześniejszych modeli. AMD ma teraz sprzęt; brakowało mu grawitacji badawczej. World Labs i Li zmieniają ten rachunek.\n\n> „Modele świata to kolejna granica AI — systemy, które nie tylko rozpoznają świat, ale go rozumieją i symulują."\n>\n> — Dr. Fei-Fei Li\n\n## Dłuższy horyzont dla twórców AI-art\n\nPraktyczne korzyści dla twórców nie są natychmiastowe. Transakcja nie została jeszcze sfinalizowana, a integracja przestrzennej AI na etapie badań z produkcyjnymi pipeline'ami generowania obrazów zajmuje lata, nie kwartały. Kierunek jest jednak jasny: kolejna generacja modeli będzie coraz częściej oceniana pod kątem spójności geometrycznej i konsekwencji sceny, a nie tylko powierzchniowej tekstury i stylu.\n\nTwórcy, którzy już teraz kierują obecne narzędzia ku wizualizacji architektonicznej, generowaniu zasobów do gier czy spójności wielu klatek — rodzaje przepływów pracy eksplorowanych w przewodnikach generowania Charmloop — jako pierwsi poczują, jak ta luka się zamyka. Modele w katalogu Charmloop ostatecznie odzwierciedlą tę zmianę, gdy rozumowanie przestrzenne przejdzie od ciekawostki badawczej do celu treningowego.\n\nNa razie przejęcie jest sygnałem o kierunku, w jakim zmierza pipeline od sprzętu do modelu. AMD właśnie postawiło bardzo dużą stawkę na to, że przyszłość obrazowania AI jest trójwymiarowa — i że naukowczyni, która nauczyła maszyny widzieć, jest właściwą osobą, by to udowodnić.