Источники
Посмотри в деле
Полистай модели и стили, что стоят за такими историями — бесплатный аккаунт, галерея сразу.
Открыть каталогОбсуди это с
Выбери компаньона и узнай его мнение об этой истории

Ирис пишет о том, где ИИ-искусство встречается с культурой: стиль, авторство и образы, которые имеют значение.
Полистай модели и стили, что стоят за такими историями — бесплатный аккаунт, галерея сразу.
Открыть каталогВыбери компаньона и узнай его мнение об этой истории
AMD приобретает World Labs — стартап в области пространственного ИИ, сооснователем которого выступила пионер ИИ из Стэнфорда доктор Фэй-Фэй Ли, — за 8,2 млрд долларов в рамках сделки полностью в акциях, которую планируется закрыть до конца 2025 года. Ли войдёт в AMD в должности исполнительного вице-президента и главного научного сотрудника — шаг, недвусмысленно свидетельствующий о намерении AMD конкурировать с Nvidia не только на уровне кремния, но и на уровне фундаментальных исследований, определяющих то, как ИИ-модели понимают и генерируют трёхмерное пространство.
World Labs не создавала очередную большую языковую модель. Её основные исследования направлены на пространственный интеллект — способность ИИ строить связный трёхмерный мир на основе визуального ввода и рассуждать о нём, а не воспринимать изображение как плоскую сетку пикселей. Это различие имеет огромное значение для всех, кто генерирует изображения или сцены с помощью ИИ-инструментов.
Современные диффузионные модели создают изображения, которые на первый взгляд выглядят пространственно правдоподобно, но рассыпаются при ближайшем рассмотрении: руки проходят сквозь объекты, тени падают не в ту сторону, архитектура искажается по краям кадра. Это не галлюцинации в смысле языковых моделей — это сбои геометрического мышления. Модель, основанная на пространственном интеллекте, понимала бы, что ножка стула находится за столом, а не сливается с ним, — и это ограничение распространялось бы на каждый пиксель результата. Эстетическое следствие — изображения, которые держатся структурно, как фотография, а не просто напоминают фотографии.
Для генерации видео в частности пространственная привязка — это разница между сценой, ощущаемой как место, и последовательностью кадров, которые случайно разделяют одну цветовую палитру. Создатели, работающие с инструментами ИИ-видео и анимации, острее всего ощущают этот разрыв сегодня — именно поэтому сгенерированные движения камеры всё ещё выглядят резиновыми, а постоянство объектов между монтажными склейками остаётся нерешённой задачей.
По данным Ars Technica, сумма сделки составляет 8,2 млрд долларов — цифра, отражающая не только исследовательский портфель World Labs, но и стратегическую ценность самой Ли. Как учёный, создавший ImageNet — набор данных, катализировавший революцию глубокого обучения в компьютерном зрении, — Ли обладает институциональным авторитетом, который невозможно купить за деньги. AMD одновременно приобретает исследовательское направление и репутацию.
Доминирование Nvidia в ИИ-вычислениях всегда держалось на двух столпах: GPU-железе и CUDA — программной экосистеме, удерживающей разработчиков в своей орбите. Но тихо вырос третий столп — инвестиции Nvidia в исследовательские партнёрства и поглощения, удерживающие её железо в центре разработки передовых моделей. У AMD теперь есть железо; ей не хватало исследовательского притяжения. World Labs и Ли меняют этот расчёт.
«Модели мира — следующий рубеж ИИ: системы, которые не просто распознают мир, но понимают и симулируют его.»
— Dr. Fei-Fei Li
Практическая отдача для создателей не наступит немедленно. Сделка ещё не закрыта, а интеграция пространственного ИИ исследовательского уровня в производственные конвейеры генерации изображений занимает годы, а не кварталы. Но направление очевидно: модели следующего поколения будут всё больше оцениваться по геометрической связности и согласованности сцен, а не только по поверхностной текстуре и стилю.
Создатели, которые уже сегодня используют существующие инструменты для архитектурной визуализации, генерации игровых ассетов или многокадровой согласованности — такие рабочие процессы исследуются в руководствах по генерации Charmloop — первыми почувствуют, как этот разрыв сокращается. Модели в каталоге Charmloop в конечном счёте отразят этот сдвиг по мере того, как пространственное мышление перейдёт из разряда исследовательского курьёза в обучающую цель.
Пока же это поглощение — сигнал о том, куда движется конвейер от железа к модели. AMD только что сделала очень крупную ставку на то, что будущее ИИ-изображений трёхмерно, — и что учёный, научивший машины видеть, — именно тот человек, который это докажет.