COMPUTEX 2026: ИИ-фабрики наступают, облако отдыхает
Народ, я с COMPUTEX 2026. Там такое творится, что сразу хочется выдохнуть.
Берем ASUS RUC-2000 и AMD Helios. У Helios, кстати, 72 GPU. Семьдесят две. Это не "еще один сервер для галерки". Это можно поставить на склад или в цех и забыть про облако на полгода. Раньше все было про облако: если у тебя 50 пользователей ладно, плати и работай. Сейчас другая история. Скорость, приватность, локальная задержка все это решается железом, а не арендой мощностей у дяди.
72 графики это серьезно. На них можно натянуть большие модели, делать inference локально, гонять распознавание видео в реальном времени, проверять качество на конвейере без нервотрепки с сетью. AMD Helios выглядит монстром именно для такого: дофига GPU, память шустрая, и NVLink там вроде нормально завезли связали их по-человечески. ASUS RUC-2000 поменьше, для тех, кто хочет поставить стойку в соседней комнате от офиса и не париться с дата-центрами.
Цены? Не бюджетно. Но если у вас фабрика висит на сотне камер и надо делать инспекции, амортизация быстро съест начальные вложения. Другое дело энергопотребление, охлаждение, место. Тот, кто думал, что это просто, никогда не видел счета за электричество. Сравните с постоянным облачным трафиком и платой за запрос по 0.ху* центов. Иногда локально реально дешевле. Считайте сами, математика за вами.
В коридорах поговаривают, что это начало новой волны. Уже не просто дата-центры, а "ИИ-фабрики" локальные кластеры под конкретные задачи. Производство, логистика, медицина, розница. Локально данные никуда не уезжают. Это плюс для конфиденциальности и для тех, кто под регуляцией. Минус: надо кого-то, кто это поставит и поддержит. Supermicro и ASUS предлагают готовые наборы, чтобы системные администраторы не изобретали велосипед с квадратными колесами.
С софтом, как обычно, геморрой. Железо есть, но чтобы заставить его работать с вашим пайплайном, придется портировать модели, оптимизировать под конкретные GPU, возиться с драйверами, контейнерами и оркестрацией. Если думаете, что возьмете модель "из облака" и она поедет на 72 GPU не обольщайтесь. Но возможности огромные. Один стартап показал демку для инспекции на линии. Говорят, задержка упала в 5-10 раз по сравнению с облаком.
Короче. Если у вас производство, логистика или просто куча данных и вы устали платить облаку, присмотритесь. Если вы маленький стартап с одним сервером в офисе, может, и не надо 72 GPU. Возьмите что-то попроще и посмотрите, что будет.
Железо мощное, идея простая: локальная ИИ-фабрика для реального сектора. А дальше кто быстрее внедрит и кто сможет прикрутить софт без месячных плясок с бубном.