ESC

Start typing to search across invoices, services, domains, tickets, and more...

Search... Ctrl+K
活用シーンとソリューション

東京・香港・シンガポール・ロサンゼルスで自社 GPU サーバーをコロケーションして AI 推論:電力・ネットワーク・輸送ガイド

7 ステップ 11 分で読めます 14 回閲覧 0
目次

すでに GPU サーバーを保有しているなら、アジアや米国で AI 推論を長期的に提供する最も安価な方法は、多くの場合クラウド GPU を時間貸しで借りるのではなく、ユーザーに近いデータセンターへコロケーションすることです。IMIDC は東京(日本)、香港、シンガポール、ロサンゼルス(米国)で 1U からフルラックまでのコロケーションを提供し、リモートハンド、10Gbps アップリンク、IP ブロック、自社 ASN での BGP に対応します。なお IMIDC は GPU を貸し出しておらず、これは持ち込み(BYO)ハードウェア向けのサービスです。

ポイント
  • GPU コロケーション拠点:東京(日本)、香港、シンガポール、ロサンゼルス(米国)。シンガポールは営業経由。
  • 1U〜フルラック。ラックあたりの電力は発送前に必ず IMIDC 営業と確認。
  • リモートハンドでラッキング、配線、GPU/ディスク交換、電源リセットに対応。
  • 10Gbps アップリンク、DDoS 対策、IPv4 リース(/24 単位も可)、自社 ASN による BGP 広報。
  • IMIDC は GPU の販売・レンタルを行いません。ハードウェアの輸出管理コンプライアンスはお客様の責任です。

クラウド GPU よりコロケーションが有利になる条件

GPU が 1 年以上、1 日の大半稼働するならコロケーション、短期のバーストや検証ならクラウドが有利です。

項目自社 GPU のコロケーション(IMIDC)クラウド GPU レンタル
コスト構造ハードウェア投資+月額のスペース・電力・帯域時間課金または予約、初期投資なし
向いている負荷24 時間安定した推論変動が大きい・短期・学習バースト
ハードウェア選択購入した任意の GPU・CPU・RAM・NVMe事業者のラインナップと在庫次第
データの所在自社機材、所在地が明確事業者リージョン、共有テナントの場合も
ネットワーク自社 IP ブロックと ASN を BGP で事業者の IP
拡張スピード数週間(調達・輸送・設置)在庫があれば数分
障害対応予備品を用意しリモートハンドが交換事業者がインスタンスを差し替え

よくあるのはハイブリッド構成で、ベースの推論はコロケーション、ピークや実験はレンタルで賄います。

電力密度と冷却:最初に決めること

GPU コロケーションで本当に制約になるのは U 数ではなく電力です。スペース契約前に必要な kW を確認しましょう。

代表的な筐体GPU 構成例高負荷時の概算消費電力コロケーションの選択肢
1U サーバーロープロファイル推論 GPU 1〜2 枚約 0.5〜1 kW1U〜2U
2U サーバーPCIe GPU 2〜4 枚約 1.5〜3 kW2U〜4U または部分ラック
4U サーバーPCIe/SXM GPU 8 枚約 5〜10 kW 以上フルラック(1 ラック 1〜2 台が多い)
4U サーバー複数台大規模モデル用クラスタ数十 kW複数ラック、営業と計画

上記は一般的な目安であり IMIDC の仕様ではありません。メーカーの銘板値を確認し、実負荷で測定してください。実務上のポイント:

  • 測定と電力制限:適度な電力上限なら推論スループットはほとんど落ちません。
  • エアフロー:GPU サーバーは前面吸気・背面排気が基本。筐体の奥行きと風向きを IMIDC に伝え、ホット/コールドアイルに正しく設置してもらいます。
  • 冗長電源:A+B 系統の電源を依頼し、電力制限時に片系でも稼働できるか確認。
  • プラグ:大容量電源は C19/C20 が多いので、対応する電源ケーブルを同梱。
  • 液冷:直接液冷システムを購入する前に営業へ相談し、対応を前提にしないこと。
# measure real draw under load before you size the rack
nvidia-smi --query-gpu=index,name,power.draw,power.limit,temperature.gpu --format=csv -l 5

# cap each GPU so the whole chassis fits the contracted power budget
sudo nvidia-smi -pm 1          # persistence mode
sudo nvidia-smi -i 0 -pl 300   # example: limit GPU 0 to 300 W

# whole-server reading from the BMC (IPMI)
ipmitool -I lanplus -H 198.51.100.20 -U admin -P '***' dcmi power reading

ネットワーク:10Gbps、自社 IP、BGP

推論トラフィックは 1 リクエストあたり小さい一方で遅延に敏感なため、帯域よりも経路品質と自社アドレスを優先します。

  • 10Gbps アップリンク:モデルのダウンロード、拠点間レプリケーション、高同時接続 API に。
  • 自社 IP ブロック:IMIDC から IPv4 をリース(/24 単位まで)または持ち込み。
  • 自社 ASN で BGP:たとえば東京とロサンゼルスから同じプレフィックスを広報し、リナンバリングなしで拠点間のトラフィックを切り替え。Anycast にも対応。
  • 香港は中国本土向け CN2 GIA(AS4809)、ロサンゼルスは聯通 9929/4837 と CN2 経路があり、合法的な自社モデルを中国本土のユーザーに提供する場合に有効です(本土外のホスティングに ICP 届出は不要ですが、内容は法令に適合する必要があります)。
  • 推論は認証とレート制限付きのゲートウェイ経由でのみ公開し、モデルサーバーは localhost かプライベート VLAN にバインド。
# example: serve an open-weight model with vLLM, API on localhost only
docker run -d --name vllm --gpus all --restart unless-stopped \
  -p 127.0.0.1:8000:8000 --ipc=host \
  -v /data/models:/models \
  vllm/vllm-openai:latest \
  --model /models/your-model --tensor-parallel-size 4

curl -s http://127.0.0.1:8000/v1/models

ユーザーへの遅延で拠点を選ぶ

リクエストの大半に最も近い都市を選び、実際のユーザー側から測定します。

IMIDC 拠点主な利用者備考
東京(日本)日本、韓国、北東アジア日本のネイティブ IP、地域ピアリングが充実
香港中華圏、東南アジア中国本土へ CN2 GIA。先端 GPU は輸出管理規則を要確認
シンガポール東南アジア、インド、オセアニア営業経由で構成
ロサンゼルス(米国)北米、太平洋横断中国向け聯通 9929/4837・CN2 経路
# from a user-side test host, compare candidate locations
mtr -rwc 100 203.0.113.10     # Tokyo test IP (example)
mtr -rwc 100 203.0.113.20     # Singapore test IP (example)

輸出管理:GPU を送る前に必ず確認

先端 AI チップは輸出管理の対象であり、所有者かつ発送者であるお客様に遵守責任があります。

  • 米国輸出管理規則(EAR)は一部の先端計算チップやシステムについて、特定の仕向地・最終需要者向けの輸出を制限しており、その多くは香港・マカオにも適用されます。
  • 日本やシンガポールなどにも独自の輸出・再輸出規制があります。
  • 使用する GPU 型番の該非判定をメーカーに確認し、用途と最終需要者を記録、必要な許可を発送前に取得してください。
  • IMIDC はスペース・電力・ネットワーク・リモートハンドを提供するもので、お客様機材の輸出管理上の適否を判断・保証するものではありません。

本節は概要であり法的助言ではありません。貿易コンプライアンスの専門家にご相談ください。

輸送・通関・設置チェックリスト

遅延の多くはラッキングではなく書類と部品不足が原因です。

  1. まず IMIDC にチケットを起票:拠点、U 数、電力(kW と系統数)、配送先住所、受け入れ時間を確認。
  2. 型番・シリアル番号・HS コード・申告価格を記載したコマーシャルインボイスを用意し、輸入者(IOR)を決める。
  3. 保険を付け、純正またはフォーム梱包。GPU は実装状態か静電防止袋で発送。
  4. すべての箱に会社名と IMIDC のチケット番号を記載。
  5. レール、電源ケーブル(必要に応じて C13/C19)、光モジュールや DAC、予備のディスク・ファンを同梱。
  6. BMC/IPMI に固定 IP と強力なパスワードを設定し、BIOS の通電復帰を「オン」に。
  7. ラック図と配線計画を送付。リモートハンドが設置・電源投入し、リンクと BMC 接続を確認します。

設置後は、チケットでリモートハンドに予備品を使った GPU・ディスク交換、再装着、電源リセットを依頼できます。

最適な IMIDC 構成の選び方

実測電力でコロケーション規模を決め、ネットワークサービスを組み合わせます。

  • 推論サーバー 1 台(GPU 1〜4 枚):東京またはロサンゼルスで 1U〜4U、IP 数個。
  • 8 GPU サーバー:専用電力付きフルラック。購入前に営業と確認。
  • マルチリージョン API:東京とロサンゼルスにラックを置き、自社プレフィックスを BGP で広報、必要に応じて Anycast。
  • CPU 側サービス:API ゲートウェイ、ベクトル DB、キューは同じデータセンターの IMIDC 専用サーバーへ。

高密度電力、シンガポールのコロケーション、複数ラック案件はカスタム構成として IMIDC 営業がお見積りします。

よくある質問

東京や香港で自社 GPU サーバーをコロケーションできるのはどこ?

IMIDC は東京、香港、シンガポール、ロサンゼルスで 1U からフルラックまでのコロケーションを提供し、リモートハンドと 10Gbps アップリンクに対応しています。機材発送前に必要電力を営業と確認してください。

IMIDC は GPU サーバーをレンタルしていますか?

いいえ。IMIDC はお客様所有のハードウェア向けにスペース、電力、ネットワーク、IP リソースを提供します。CPU 処理は IMIDC の専用サーバーと組み合わせられます。

8 GPU サーバーのコロケーションにはどれくらいの電力が必要?

GPU 型番によりますが、高負荷時で数 kW、10 kW を超えることもあります。実負荷で測定し、電力制限も検討したうえで、フルラックを営業と計画してください。

コロケーションした GPU サーバーから自社 IP ブロックを広報できますか?

できます。IMIDC は自社 ASN による BGP 広報、/24 単位を含む IPv4 リース、Anycast に対応しています。

GPU 導入をご検討中なら、IMIDC の コロケーション・データセンター設備、BGP/Anycast、IP リソース をご確認のうえ、サーバー型番と電力値を添えて 営業へお問い合わせいただくか、チケット で設置日程をご相談ください。

この回答はお役に立ちましたか?

関連チュートリアル