Start typing to search across invoices, services, domains, tickets, and more...
Если у вас уже есть собственные GPU-серверы, самый дешёвый в долгосрочной перспективе способ обслуживать AI-инференс в Азии или США — как правило, разместить их в дата-центре рядом с пользователями (колокация), а не арендовать облачные GPU почасово. IMIDC предлагает колокацию от 1U до целой стойки в Токио (Япония), Гонконге, Сингапуре и Лос-Анджелесе (США) с удалёнными руками (remote hands), аплинками 10 Гбит/с, блоками IP и BGP с вашим собственным ASN. Важно: IMIDC не сдаёт GPU в аренду — это формат «своё оборудование».
Колокация выигрывает, если GPU загружены большую часть суток на протяжении года и дольше; облако — для коротких всплесков и экспериментов.
| Критерий | Колокация своих GPU (IMIDC) | Аренда облачных GPU |
|---|---|---|
| Структура затрат | Капзатраты на железо + ежемесячно место, питание, канал | Почасовая или резервированная ставка, без капзатрат |
| Профиль нагрузки | Стабильный инференс 24/7 | Пиковый, краткосрочный или обучение |
| Выбор железа | Любые купленные GPU, CPU, RAM, NVMe | Каталог и наличие у провайдера |
| Расположение данных | Ваше оборудование в известном городе | Регион провайдера, иногда общая инфраструктура |
| Сетевая идентичность | Свой блок IP и ASN через BGP | IP провайдера |
| Скорость масштабирования | Недели (закупка, доставка, монтаж) | Минуты, если есть мощности |
| Отказы | Свой ЗИП, замену делают remote hands | Провайдер заменяет инстанс |
Частая схема — гибрид: базовый инференс на колоцированных серверах, пики и эксперименты — на арендованных мощностях.
Реальное ограничение GPU-колокации — электропитание, а не юниты, поэтому определите нужные кВт до покупки места.
| Типичное шасси | Пример конфигурации GPU | Примерное потребление под нагрузкой | Вариант колокации |
|---|---|---|---|
| Сервер 1U | 1–2 низкопрофильные карты для инференса | около 0,5–1 кВт | 1U–2U |
| Сервер 2U | 2–4 PCIe GPU | около 1,5–3 кВт | 2U–4U или часть стойки |
| Сервер 4U | 8 GPU PCIe или SXM | около 5–10+ кВт | Целая стойка, часто 1–2 сервера на стойку |
| Несколько 4U | Кластер для крупных моделей | Десятки кВт | Несколько стоек, планируется с отделом продаж |
Это типовые диапазоны, а не спецификации IMIDC: сверяйтесь с паспортными данными вендора и измеряйте под реальной нагрузкой. Практические советы:
# measure real draw under load before you size the rack
nvidia-smi --query-gpu=index,name,power.draw,power.limit,temperature.gpu --format=csv -l 5
# cap each GPU so the whole chassis fits the contracted power budget
sudo nvidia-smi -pm 1 # persistence mode
sudo nvidia-smi -i 0 -pl 300 # example: limit GPU 0 to 300 W
# whole-server reading from the BMC (IPMI)
ipmitool -I lanplus -H 198.51.100.20 -U admin -P '***' dcmi power reading
Трафик инференса мал на запрос, но чувствителен к задержкам, поэтому приоритет — качественная маршрутизация и собственное адресное пространство, а не голая полоса.
# example: serve an open-weight model with vLLM, API on localhost only
docker run -d --name vllm --gpus all --restart unless-stopped \
-p 127.0.0.1:8000:8000 --ipc=host \
-v /data/models:/models \
vllm/vllm-openai:latest \
--model /models/your-model --tensor-parallel-size 4
curl -s http://127.0.0.1:8000/v1/models
Выберите город, ближайший к большинству запросов, и проверьте задержку оттуда, где реально находятся пользователи.
| Площадка IMIDC | Основная аудитория | Примечания |
|---|---|---|
| Токио, Япония | Япония, Корея, Северная Азия | Нативные японские IP, сильный региональный пиринг |
| Гонконг | Большой Китай, Юго-Восточная Азия | CN2 GIA в материковый Китай; проверьте экспортные правила для мощных GPU |
| Сингапур | Юго-Восточная Азия, Индия, Океания | Настраивается через отдел продаж |
| Лос-Анджелес, США | Северная Америка, транстихоокеанский трафик | Маршруты Unicom 9929/4837 и CN2 в Китай |
# from a user-side test host, compare candidate locations
mtr -rwc 100 203.0.113.10 # Tokyo test IP (example)
mtr -rwc 100 203.0.113.20 # Singapore test IP (example)
Передовые AI-чипы подпадают под экспортный контроль, и ответственность за соблюдение правил несёте вы как владелец и отправитель.
Это краткий обзор, а не юридическая консультация. Обратитесь к специалисту по внешнеторговому комплаенсу.
Большинство задержек связано с документами и недостающими деталями, а не с монтажом.
После установки через тикет можно заказать замену GPU или дисков из вашего ЗИПа, переустановку компонентов и перезагрузку по питанию.
Подберите объём колокации по измеренной мощности, затем добавьте сетевые услуги.
Высокоплотное питание, колокация в Сингапуре и проекты на несколько стоек — индивидуальные конфигурации, их рассчитывает отдел продаж IMIDC.
IMIDC предлагает колокацию от 1U до целой стойки в Токио, Гонконге, Сингапуре и Лос-Анджелесе с remote hands и аплинками 10 Гбит/с. Перед отправкой оборудования согласуйте потребляемую мощность с отделом продаж.
Нет. IMIDC предоставляет место, питание, сеть и IP-ресурсы для вашего собственного оборудования. Колоцированные GPU можно дополнить выделенными серверами IMIDC для CPU-нагрузок.
Обычно несколько кВт, а иногда больше 10 кВт под полной нагрузкой — в зависимости от модели GPU. Измерьте реальное потребление, рассмотрите лимиты мощности и спланируйте целую стойку с отделом продаж.
Да. IMIDC поддерживает BGP-анонс с вашим ASN, аренду IPv4 включая целые /24 и Anycast.
Планируете GPU-развёртывание? Ознакомьтесь с колокацией и дата-центрами, BGP и Anycast и IP-ресурсами IMIDC, затем свяжитесь с отделом продаж, указав модель сервера и потребление, или откройте тикет, чтобы запланировать монтаж.