Start typing to search across invoices, services, domains, tickets, and more...
すでに GPU サーバーを保有しているなら、アジアや米国で AI 推論を長期的に提供する最も安価な方法は、多くの場合クラウド GPU を時間貸しで借りるのではなく、ユーザーに近いデータセンターへコロケーションすることです。IMIDC は東京(日本)、香港、シンガポール、ロサンゼルス(米国)で 1U からフルラックまでのコロケーションを提供し、リモートハンド、10Gbps アップリンク、IP ブロック、自社 ASN での BGP に対応します。なお IMIDC は GPU を貸し出しておらず、これは持ち込み(BYO)ハードウェア向けのサービスです。
GPU が 1 年以上、1 日の大半稼働するならコロケーション、短期のバーストや検証ならクラウドが有利です。
| 項目 | 自社 GPU のコロケーション(IMIDC) | クラウド GPU レンタル |
|---|---|---|
| コスト構造 | ハードウェア投資+月額のスペース・電力・帯域 | 時間課金または予約、初期投資なし |
| 向いている負荷 | 24 時間安定した推論 | 変動が大きい・短期・学習バースト |
| ハードウェア選択 | 購入した任意の GPU・CPU・RAM・NVMe | 事業者のラインナップと在庫次第 |
| データの所在 | 自社機材、所在地が明確 | 事業者リージョン、共有テナントの場合も |
| ネットワーク | 自社 IP ブロックと ASN を BGP で | 事業者の IP |
| 拡張スピード | 数週間(調達・輸送・設置) | 在庫があれば数分 |
| 障害対応 | 予備品を用意しリモートハンドが交換 | 事業者がインスタンスを差し替え |
よくあるのはハイブリッド構成で、ベースの推論はコロケーション、ピークや実験はレンタルで賄います。
GPU コロケーションで本当に制約になるのは U 数ではなく電力です。スペース契約前に必要な kW を確認しましょう。
| 代表的な筐体 | GPU 構成例 | 高負荷時の概算消費電力 | コロケーションの選択肢 |
|---|---|---|---|
| 1U サーバー | ロープロファイル推論 GPU 1〜2 枚 | 約 0.5〜1 kW | 1U〜2U |
| 2U サーバー | PCIe GPU 2〜4 枚 | 約 1.5〜3 kW | 2U〜4U または部分ラック |
| 4U サーバー | PCIe/SXM GPU 8 枚 | 約 5〜10 kW 以上 | フルラック(1 ラック 1〜2 台が多い) |
| 4U サーバー複数台 | 大規模モデル用クラスタ | 数十 kW | 複数ラック、営業と計画 |
上記は一般的な目安であり IMIDC の仕様ではありません。メーカーの銘板値を確認し、実負荷で測定してください。実務上のポイント:
# measure real draw under load before you size the rack
nvidia-smi --query-gpu=index,name,power.draw,power.limit,temperature.gpu --format=csv -l 5
# cap each GPU so the whole chassis fits the contracted power budget
sudo nvidia-smi -pm 1 # persistence mode
sudo nvidia-smi -i 0 -pl 300 # example: limit GPU 0 to 300 W
# whole-server reading from the BMC (IPMI)
ipmitool -I lanplus -H 198.51.100.20 -U admin -P '***' dcmi power reading
推論トラフィックは 1 リクエストあたり小さい一方で遅延に敏感なため、帯域よりも経路品質と自社アドレスを優先します。
# example: serve an open-weight model with vLLM, API on localhost only
docker run -d --name vllm --gpus all --restart unless-stopped \
-p 127.0.0.1:8000:8000 --ipc=host \
-v /data/models:/models \
vllm/vllm-openai:latest \
--model /models/your-model --tensor-parallel-size 4
curl -s http://127.0.0.1:8000/v1/models
リクエストの大半に最も近い都市を選び、実際のユーザー側から測定します。
| IMIDC 拠点 | 主な利用者 | 備考 |
|---|---|---|
| 東京(日本) | 日本、韓国、北東アジア | 日本のネイティブ IP、地域ピアリングが充実 |
| 香港 | 中華圏、東南アジア | 中国本土へ CN2 GIA。先端 GPU は輸出管理規則を要確認 |
| シンガポール | 東南アジア、インド、オセアニア | 営業経由で構成 |
| ロサンゼルス(米国) | 北米、太平洋横断 | 中国向け聯通 9929/4837・CN2 経路 |
# from a user-side test host, compare candidate locations
mtr -rwc 100 203.0.113.10 # Tokyo test IP (example)
mtr -rwc 100 203.0.113.20 # Singapore test IP (example)
先端 AI チップは輸出管理の対象であり、所有者かつ発送者であるお客様に遵守責任があります。
本節は概要であり法的助言ではありません。貿易コンプライアンスの専門家にご相談ください。
遅延の多くはラッキングではなく書類と部品不足が原因です。
設置後は、チケットでリモートハンドに予備品を使った GPU・ディスク交換、再装着、電源リセットを依頼できます。
実測電力でコロケーション規模を決め、ネットワークサービスを組み合わせます。
高密度電力、シンガポールのコロケーション、複数ラック案件はカスタム構成として IMIDC 営業がお見積りします。
IMIDC は東京、香港、シンガポール、ロサンゼルスで 1U からフルラックまでのコロケーションを提供し、リモートハンドと 10Gbps アップリンクに対応しています。機材発送前に必要電力を営業と確認してください。
いいえ。IMIDC はお客様所有のハードウェア向けにスペース、電力、ネットワーク、IP リソースを提供します。CPU 処理は IMIDC の専用サーバーと組み合わせられます。
GPU 型番によりますが、高負荷時で数 kW、10 kW を超えることもあります。実負荷で測定し、電力制限も検討したうえで、フルラックを営業と計画してください。
できます。IMIDC は自社 ASN による BGP 広報、/24 単位を含む IPv4 リース、Anycast に対応しています。
GPU 導入をご検討中なら、IMIDC の コロケーション・データセンター設備、BGP/Anycast、IP リソース をご確認のうえ、サーバー型番と電力値を添えて 営業へお問い合わせいただくか、チケット で設置日程をご相談ください。