COMPUTEX 2026 инфрабум
Короче, на COMPUTEX 2026 пошёл такой инфра‑бум, что прямо сразу хочется положить руки на стол и сказать "ну вот опять". ASUS и Supermicro привезли новые стоечные ИИ‑системы не игрушки. ASUS RUC-2000, AMD Helios с 72 GPU это не просто "еще один сервер", это шанс поставить себе локальную ИИ‑фабрику прямо в цеху или на складе и не думать про облако месяцами. Прошлые годы были про облако и если у тебя было 50 пользователей ок, платишь и работаешь, но тут другое: скорость, приватность, локальная задержка всё это решается железом.
Я к чему: 72 графики это вам не шутки. Теоретически можно натянуть большие модели, делать inference локально, распознавать видео, делать визуальный контроль качества на конвейере в реальном времени без миллисекундных сюрпризов сети. AMD Helios выглядит как зверь для такого: много GPU, пропускная способность памяти, вроде бы они нормально проработали поддержку NVLink/аналогов короче, связали их по‑человечески. ASUS RUC-2000 более компактный, будто для тех, кто хочет рядом с офисом поставить стоечку и не тащить всё в датасентр.
Ну и цены. Не дешево, но если у тебя фабрика с сотней камер и нужно делать инспекции, то амортизация окупается. Плюс энергопотребление, охлаждение и место под всё это кто думал, что это легко? Тот, кто не видел плату за электричество. Но если сравнивать с постоянным облачным трафиком и платой за inference по 0,х центов за запрос иногда локально выходит дешевле. Короче, математика за вами, считайте.
Народ в коридорах говорит, что это начало новой волны: не просто центры данных, а так называемые "ИИ‑фабрики" то есть локальные кластеры под конкретные задачи: производство, логистика, медицина, розница. Локально значит данные не уезжают к кому‑то, а это плюс для конфиденциальности и для тех, кто под регуляцией. Минус нужно кого‑то, кто это установит и поддержит. И тут как раз Supermicro и ASUS предлагают готовые наборы, чтобы системщики не выдумывали велосипед.
По софту это всегда гемморой. Железо есть, но чтобы заставить его работать с вашим пайплайном надо портировать модели, оптимизировать под конкретные GPU, смотреть на драйвера, контейнеры, оркестрацию. И да, если вы думаете, что возьмёте модель "из облака" и она просто поедет на 72 GPU не факт. Но возможности большие. Кто-то из стартапов уже показал демки для инспекции на линии говорят, задержка упала в 5–10 раз по сравнению с облаком.
В общем, если у вас производство, логистика или большие данные и вы устали платить облаку очень много присмотритесь. Если вы маленький стартап с одним сервером в офисе может и не нужно брать 72 GPU прямо сейчас, взять что‑то поменьше и понаблюдать. Короче, железо мощное, идеи простые локальная ИИ‑фабрика для реального сектора. А дальше кто быстрее внедрит и кто сможет прикрутить софт без месячных плясок с бубном.
