Start typing to search across invoices, services, domains, tickets, and more...
Si ya tienes servidores con GPU, la forma más económica a largo plazo de ofrecer inferencia de IA en Asia o EE. UU. suele ser alojarlos en colocation en un centro de datos cercano a tus usuarios, en lugar de alquilar GPU en la nube por horas. IMIDC ofrece colocation desde 1U hasta un rack completo en Tokio (Japón), Hong Kong, Singapur y Los Ángeles (EE. UU.), con manos remotas, enlaces de 10 Gbps, bloques de IP y BGP con tu propio ASN. Importante: IMIDC no alquila GPU; es un servicio para hardware propio.
La colocation gana cuando tus GPU trabajan la mayor parte del día durante un año o más; la nube gana para picos cortos y experimentos.
| Factor | Colocation de GPU propias (IMIDC) | Alquiler de GPU en la nube |
|---|---|---|
| Estructura de costes | Inversión en hardware + cuota mensual de espacio, energía y ancho de banda | Tarifa por hora o reservada, sin inversión |
| Perfil de uso ideal | Inferencia estable 24/7 | Picos, corto plazo o entrenamiento |
| Elección de hardware | Cualquier GPU, CPU, RAM y NVMe que compres | Catálogo y disponibilidad del proveedor |
| Ubicación de datos | Tu hardware en una ciudad conocida | Región del proveedor, a veces compartida |
| Identidad de red | Tu bloque IP y ASN vía BGP | IP del proveedor |
| Velocidad de escalado | Semanas (compra, envío, instalación) | Minutos, si hay capacidad |
| Averías | Tienes repuestos; las manos remotas los cambian | El proveedor sustituye la instancia |
Un patrón habitual es el híbrido: inferencia base en servidores en colocation y picos o pruebas en capacidad alquilada.
La verdadera limitación de la colocation de GPU es la energía, no las unidades de rack, así que confirma los kW necesarios antes de contratar espacio.
| Chasis típico | Ejemplo de GPU | Consumo aproximado en carga | Opción de colocation |
|---|---|---|---|
| Servidor 1U | 1-2 GPU de inferencia de perfil bajo | aprox. 0,5-1 kW | Espacio de 1U-2U |
| Servidor 2U | 2-4 GPU PCIe | aprox. 1,5-3 kW | 2U-4U o rack parcial |
| Servidor 4U | 8 GPU PCIe o SXM | aprox. 5-10+ kW | Rack completo, a menudo uno o dos servidores por rack |
| Varios 4U | Clúster para modelos grandes | Decenas de kW | Varios racks; planificar con ventas |
Son rangos típicos, no especificaciones de IMIDC: consulta la placa del fabricante y mide con carga real. Consejos prácticos:
# measure real draw under load before you size the rack
nvidia-smi --query-gpu=index,name,power.draw,power.limit,temperature.gpu --format=csv -l 5
# cap each GPU so the whole chassis fits the contracted power budget
sudo nvidia-smi -pm 1 # persistence mode
sudo nvidia-smi -i 0 -pl 300 # example: limit GPU 0 to 300 W
# whole-server reading from the BMC (IPMI)
ipmitool -I lanplus -H 198.51.100.20 -U admin -P '***' dcmi power reading
El tráfico de inferencia es pequeño por petición pero sensible a la latencia, así que prioriza buen enrutamiento y direcciones propias sobre el ancho de banda bruto.
# example: serve an open-weight model with vLLM, API on localhost only
docker run -d --name vllm --gpus all --restart unless-stopped \
-p 127.0.0.1:8000:8000 --ipc=host \
-v /data/models:/models \
vllm/vllm-openai:latest \
--model /models/your-model --tensor-parallel-size 4
curl -s http://127.0.0.1:8000/v1/models
Elige la ciudad más cercana a la mayoría de peticiones y mide desde donde están realmente tus usuarios.
| Ubicación IMIDC | Público habitual | Notas |
|---|---|---|
| Tokio, Japón | Japón, Corea, norte de Asia | IP nativas japonesas; buen peering regional |
| Hong Kong | Gran China, Sudeste Asiático | CN2 GIA a China continental; revisa las normas de exportación para GPU avanzadas |
| Singapur | Sudeste Asiático, India, Oceanía | Se configura vía ventas |
| Los Ángeles, EE. UU. | Norteamérica, tráfico transpacífico | Rutas Unicom 9929/4837 y CN2 hacia China |
# from a user-side test host, compare candidate locations
mtr -rwc 100 203.0.113.10 # Tokyo test IP (example)
mtr -rwc 100 203.0.113.20 # Singapore test IP (example)
Los chips de IA avanzados están sujetos a control de exportaciones y tú, como propietario y remitente, eres responsable de cumplirlo.
Esto es un resumen breve, no asesoramiento legal. Consulta a un especialista en cumplimiento comercial.
La mayoría de retrasos vienen de la documentación y de piezas que faltan, no del montaje.
Tras la instalación, puedes pedir por ticket cambios de GPU o discos con tus repuestos, reasentar componentes y reinicios eléctricos.
Ajusta el tamaño de la colocation a la potencia medida y añade los servicios de red.
La alta densidad de potencia, la colocation en Singapur y los proyectos de varios racks son configuraciones a medida que cotiza el equipo de ventas de IMIDC.
IMIDC ofrece colocation desde 1U hasta rack completo en Tokio, Hong Kong, Singapur y Los Ángeles, con manos remotas y enlaces de 10 Gbps. Confirma tu necesidad de potencia con ventas antes de enviar el hardware.
No. IMIDC proporciona espacio de colocation, energía, red y recursos IP para el hardware que es tuyo. Puedes combinar tus GPU en colocation con servidores dedicados de IMIDC para cargas de CPU.
Normalmente varios kW y a veces más de 10 kW a plena carga, según el modelo de GPU. Mide con carga real, valora limitar la potencia y planifica un rack completo con ventas.
Sí. IMIDC admite anuncio BGP con tu propio ASN, alquiler de IPv4 incluidos bloques /24 completos, y Anycast.
¿Planificas un despliegue de GPU? Revisa la colocation y centros de datos, BGP y Anycast y los recursos IP de IMIDC, y después contacta con ventas con el modelo de servidor y su consumo, o abre un ticket para programar la instalación.