GMI Cloud на WAIC 2026: полный стек ИИ-решений — AI Cloud, MaaS, Agentbox и не только

NVIDIANVIDIA DataDirect Networks (DDN)DataDirect Networks (DDN)
GMI Cloud, входящий в число семи эталонных партнёров NVIDIA Cloud Partner, представил на WAIC 2026 полный спектр ИИ-инфраструктуры: AI Cloud, Cluster Engine, Inference Engine и платформу Agentbox. Компания также анонсировала кластер «AI Factory» на базе GB300 в Тайбэе и продемонстрировала совместные решения с DataDirect Networks (DDN).
GMI Cloud, один из семи эталонных партнёров NVIDIA Cloud Partner (Reference Platform NVIDIA Cloud Partner), выступил на WAIC 2026 с полным стеком решений для ИИ. Компания показала четыре ключевых продукта: AI Cloud — облачный сервис на базе GPU GB300, GB200, B200 и H200; Cluster Engine (Compute Engine) — платформу для управления и распределения вычислительных ресурсов с поддержкой bare metal и контейнеров; Inference Engine — высокопроизводительную платформу для вывода, интегрирующую глобальные модели и обеспечивающую доступ к более чем 200 API популярных LLM; и Agentbox — платформу полного цикла для развёртывания и коммерциализации AI-агентов. На стенде посетители могли через Inference Engine в реальном времени вызывать свыше 200 моделей. Также прошли сессии «Эксперт лицом к лицу» и мероприятие «Фестиваль без границ» по направлениям AI Coding и AI Video. GMI Cloud объявил о построенном в Тайбэе кластере «AI Factory» на 10000 GPU GB300. Совместно с DataDirect Networks (DDN) представлено инфраструктурное решение для высоконагруженных сценариев. В рамках программы объединён с AGI Bar, а с платформой Zhihu провёл акцию «Карта создателей» с выдачей значков. Генеральный директор GMI Cloud для Китая Цзян Цзяньбяо и VP по инженерии Цянь Юйцзин выступили с докладами о переходе от конкуренции моделей к комплексной глобальной ИИ-инфраструктуре и о производственном внедрении AI-агентов. Agentbox — полностью управляемая среда с выделенными CPU, безопасной мультитенантной «песочницей» и доступом к 170+ моделям через единый API; поддерживает мониторинг и двойную систему оплаты (по вычислительным ресурсам и токенам).
Сокращения
API = Application Programming Interface — программный интерфейс приложения
GPU = Graphics Processing Unit — графический процессор
LLM = Large Language Model — большая языковая модель
MaaS = Model as a Service — модель как услуга
Источник: QbitAI 量子位 — оригинал

Наши прошлые публикации по теме

Есть свежие новости