Lista de verificación para la conversión de una granja de minería en un centro de datos de IA

Lista de verificación para la conversión de una granja de minería en un centro de datos de IA

Una mina puede tener 5 MW de potencia en teoría y, aun así, no pasar una revisión de implementación de IA.

El problema, por lo general, no es la cifra de potencia indicada en el titular. Es la brecha entre la capacidad de la red eléctrica y la capacidad útil de la IA: la carga de los transformadores, la calidad de la energía, la distribución a nivel de rack, el enfriamiento por líquido, la conectividad de red, la seguridad de las instalaciones, los procedimientos de puesta en marcha y el mantenimiento a largo plazo deben funcionar en conjunto.

El camino más rápido de la minería a la IA no consiste en reutilizar todos los activos existentes, sino en identificar qué sistemas de energía, refrigeración, control y de la instalación son realmente reutilizables.

Esta lista de verificación para la conversión de una granja de minería en un centro de datos de IA explica cómo los operadores pueden evaluar una instalación existente antes de invertir en una modernización del sistema de enfriamiento o en una actualización de la infraestructura de GPU.


1. Comienza con una auditoría de reutilización

El primer paso consiste en clasificar los activos existentes en tres categorías:

Categoría de activosEjemplosResultado de la evaluación
Potencialmente reutilizableConexión de servicios públicos, subestación, parque de transformadores, caminos, cimientos, cercado perimetralReutilizar únicamente después de verificar la capacidad, el estado y el cumplimiento de las normas
Reutilizable con modificacionesContenedores, distribución eléctrica, sistema de monitoreo, trazados de fibra óptica, sistemas de drenaje y contra incendiosRequiere un rediseño o una ampliación de ingeniería
Por lo general, se reemplazan o se agregan nuevosEnfriamiento de racks de GPU, CDU, red de alta velocidad, detección de fugas, tuberías de líquido y controles preparados para IADebe diseñarse en función de la nueva carga de trabajo

Es posible que un contenedor para minería se haya optimizado para la densidad de los ASIC, el flujo de aire y una distribución sencilla de la energía. Un centro de datos de inteligencia artificial requiere un equilibrio diferente entre la estabilidad eléctrica, la topología de enfriamiento, el rendimiento de la red y la facilidad de mantenimiento.

Por lo tanto, el sitio actual debe considerarse un punto de partida, no una instalación de IA ya terminada.

Datos del sitio que se deben recopilar antes de la etapa de ingeniería

Los operadores deben prepararse:

  • País y ubicación del proyecto

  • Capacidad del servicio público y carga permitida

  • Potencia continua real disponible en el sitio

  • Potencia nominal, tensión e impedancia del transformador

  • Configuración del tablero principal y de las líneas de distribución

  • Información sobre las PDU o los gabinetes de distribución existentes

  • Plataforma de GPU y consumo eléctrico previsto del rack

  • Número de racks y fases de expansión

  • Temperaturas de diseño en verano e invierno

  • Altitud y humedad

  • Calidad del agua y condiciones de congelación

  • Contenedores, edificios y cimientos existentes

  • Ancho de la vía, acceso para grúas y ruta de entrega de equipos

  • Disponibilidad de fibra óptica y opciones de proveedores de red

  • Información sobre protección contra incendios, drenaje y seguridad física

Sin estos datos, un proveedor puede cotizar el equipo, pero el equipo del proyecto no puede confirmar con certeza si el sitio está listo para la IA.

Consejo de experto: Pide una ficha técnica de la instalación antes de solicitar una cotización definitiva de sistemas de enfriamiento. Un análisis serio de viabilidad comienza con las condiciones de operación, no solo con el nombre del equipo solicitado.


2. La potencia disponible no es lo mismo que la capacidad preparada para la IA

Las empresas mineras suelen comenzar con una afirmación como “el sitio cuenta con 5 MW disponibles”. Es necesario desglosar esa cifra.

Los cuatro números de potencia deben separarse

  1. Capacidad de servicio público o de interconexión
    La capacidad máxima aprobada o contratada con la empresa de servicios públicos local.

  2. Capacidad de transformación
    La clasificación de los transformadores instalados y sus límites de funcionamiento en las condiciones ambientales locales.

  3. Capacidad de distribución
    La capacidad real de los tableros de distribución, las barras colectoras, los alimentadores, los sistemas PDU, los dispositivos de protección y los cables.

  4. Capacidad de IA desplegable
    El suministro continuo y confiable de energía que se puede proporcionar a los racks de GPU, al tiempo que se mantienen el margen operativo, la redundancia y el acceso para el mantenimiento.

Estos cuatro números pueden ser muy diferentes.

Por ejemplo, una instalación puede tener una conexión a la red eléctrica de 5 MW, pero solo 3 MW de capacidad de transformación instalada. Las instalaciones pueden contar con transformadores de 3 MW, pero carecer de una distribución de baja tensión suficiente para racks de alta densidad. Por otro lado, la capacidad de distribución podría ser adecuada, pero carecer por completo de redundancia de mantenimiento.

Carga de TI y carga de las instalaciones

La planificación de la infraestructura de IA debe distinguir entre:

  • Carga de TI: Servidores con GPU, CPU, equipos de almacenamiento y de red

  • Carga de enfriamiento: Bombas CDU, ventiladores de enfriadores en seco, enfriadores u otros equipos mecánicos

  • Pérdidas en la distribución eléctrica: Transformadores, equipos de conmutación, cables y PDU

  • Carga de la instalación: El consumo total de energía de la infraestructura de TI y de apoyo

Una relación de planificación simple es:

Potencia de la instalación = Carga de TI × PUE

Si un proyecto tiene una carga de TI de 1 MW y un PUE estimado de 1,30:

1 MW × 1,30 = aproximadamente 1,30 MW de demanda de la instalación

Este es un ejemplo de planeación, no un valor de diseño definitivo. El PUE real depende de las condiciones ambientales, la arquitectura de enfriamiento, la eficiencia de las bombas y los ventiladores, las pérdidas eléctricas, los controles y el ámbito de medición.

Es posible que una instalación minera que anteriormente operaba a un alto índice de utilización no cuente con suficiente margen para las cargas de trabajo de IA, incluso cuando su capacidad nominal parezca suficiente.

La calidad de la energía es más importante en entornos de alta densidad

Los sistemas con GPU pueden imponer requisitos más estrictos en cuanto a:

  • Estabilidad de voltaje

  • Equilibrio de fase

  • Protección contra cortocircuitos

  • Rendimiento armónico

  • Puesta a tierra y conexión a masa

  • Estrategia de UPS o de continuidad de suministro

  • Coordinación de generadores

  • Derivación de mantenimiento

  • Doble ruta de alimentación

  • Selectividad de protección

Un transformador dimensionado únicamente para una carga promedio podría no ser adecuado para situaciones de arranque, comportamientos transitorios o expansiones futuras.

Consejo de experto: No utilices el número de mineros ASIC antiguos como base para el diseño eléctrico de la GPU. Comienza con la plataforma de GPU seleccionada, la potencia del rack, la ruta de alimentación y el plan de expansión.


3. Las cargas de los mineros ASIC y las de los racks de GPU son diferentes

Una granja de minería con ASIC y una instalación de IA/HPC pueden consumir una cantidad similar de electricidad, pero sus requisitos de infraestructura pueden ser muy diferentes.

Características típicas de un sitio de minería con ASIC

Una instalación de minería con ASIC suele incluir:

  • Muchas máquinas mineras individuales

  • Diseños repetitivos de estantes o repisas

  • Enfriamiento por aire o enfriamiento directo por líquido

  • Tráfico de red simple entre el este y el oeste

  • Requisitos de almacenamiento limitados

  • Muchas horas de funcionamiento

  • Gran énfasis en el costo por kilovatio-hora

  • Reemplazo rápido de máquinas individuales

El sistema eléctrico puede distribuirse entre muchas cargas similares. El diseño del sistema de enfriamiento suele centrarse en la eliminación total del calor, la organización del flujo de aire, el control del polvo o las conexiones de líquidos a nivel de los mineros.

Características típicas de la IA y la HPC

Una implementación de IA o HPC puede requerir:

  • Racks de GPU de alta densidad

  • Interconexiones de alta velocidad entre GPU

  • Grandes flujos de datos de este a oeste

  • Almacenamiento de alto rendimiento

  • Redes de gestión dedicadas

  • Mayor densidad térmica a nivel de rack

  • Enfriamiento por líquido directo al chip u otra arquitectura de enfriamiento por líquido

  • Control estricto de la temperatura y el flujo

  • Procedimientos de puesta en servicio y mantenimiento más complejos

  • Controles físicos y de ciberseguridad más estrictos

NVIDIA describe el GB200 NVL72 como un diseño a escala de rack con enfriamiento por líquido que conecta 36 CPU Grace y 72 GPU Blackwell. Este tipo de arquitectura demuestra por qué una configuración tradicional de minería no puede evaluarse únicamente en función de los megavatios totales o la superficie ocupada.

La pregunta importante no es:

“¿Puede la planta actual suministrar suficiente electricidad?”

La pregunta más adecuada es:

“¿Puede la instalación actual proporcionar energía estable, disipación de calor, rendimiento de red y facilidad de mantenimiento a los racks de IA seleccionados?”

Por qué la densidad de los racks modifica el diseño

Los contenedores de minería pueden distribuir la energía y el calor entre muchas máquinas. Los racks de IA pueden concentrar una carga térmica y eléctrica mucho mayor en un espacio más reducido.

Eso cambia:

  • Dimensionamiento de PDU y canaletas de alimentación

  • Tendido de cables

  • Espacios libres en los racks

  • Caudal del circuito de enfriamiento

  • Cálculos de caída de presión

  • Capacidad de la CDU

  • Selección de bombas

  • Dimensionamiento de intercambiadores de calor

  • Zonificación para la protección contra incendios

  • Acceso al servicio

  • Diseño de rutas de red

La documentación sobre racks y servidores del fabricante de la GPU debe definir la carga real, la interfaz de enfriamiento y los requisitos ambientales. Las etiquetas genéricas del tipo “listo para IA” no son suficientes para obtener la aprobación de ingeniería.


4. ¿Puede una instalación minera tradicional refrigerada por aire soportar sistemas de GPU de alta densidad?

A veces sí. A menudo requiere una remodelación importante.

La respuesta depende de la plataforma de GPU seleccionada y de las condiciones existentes en el lugar.

Activos que pueden reutilizarse

Una mina tradicional puede contar con infraestructura útil, como por ejemplo:

  • Terrenos y acceso a los emplazamientos

  • Conexión de servicios públicos

  • Estación de transformadores

  • Edificios o contenedores ya existentes

  • Fundamentos

  • Vías internas

  • Drenaje

  • Cercado perimetral

  • Puertas de seguridad

  • Rutas de entrada de fibra óptica

  • Personal de operaciones

  • Monitoreo remoto existente

Estos activos pueden reducir el costo del proyecto y el tiempo de implementación si pasan la inspección.

Activos que suelen necesitar una revalidación

Antes de la conversión, se deben volver a evaluar los siguientes elementos:

  • Potencia nominal continua del transformador

  • Distribución de baja tensión

  • Configuración de la PDU y del gabinete

  • Capacidad de la bandeja para cables

  • Sistema de conexión a tierra

  • Ubicación de la planta de refrigeración

  • Espacio para enfriador seco al aire libre

  • Ubicación de la estación de bombeo

  • Tratamiento del agua

  • Drenaje y contención de fugas

  • Detección y extinción de incendios

  • Sala de redes y rutas de fibra óptica

  • Control de acceso físico

  • Espacios libres para mantenimiento

La refrigeración por aire puede seguir siendo adecuada para sistemas de GPU de menor densidad o cargas de trabajo híbridas, siempre y cuando el equipo seleccionado se mantenga dentro de los límites térmicos de la instalación. No se debe dar por sentado que los mismos ventiladores, filtros y diseño del contenedor puedan ser compatibles con un rack de alta densidad refrigerado por líquido.

Una decisión práctica sobre la conversión

Es más probable que un sitio sea adecuado cuando:

  • La capacidad de potencia se documenta, en lugar de estimarse

  • Los transformadores y los equipos de conmutación han demostrado su capacidad operativa

  • El sitio cuenta con una conexión de fibra óptica estable

  • Hay espacio para enfriadores secos y estaciones de bombeo

  • El terreno es adecuado para los cimientos de los equipos

  • Las carreteras facilitan el transporte de maquinaria pesada

  • El clima y la altitud se tienen en cuenta en los cálculos de rechazo de calor

  • Se pueden gestionar los requisitos relacionados con el agua, el glicol y la filtración

  • El operador puede crear una zona de operación segura para la IA

  • Los sistemas eléctricos y de refrigeración se pueden ampliar por módulos

Un sitio es menos adecuado cuando sus únicas ventajas son la electricidad barata y los terrenos baldíos.

Consejo de experto: Para una primera conversión a IA, considera mantener la operación minera existente mientras se construye un bloque piloto de 200 kW con control independiente. Esto permite realizar una prueba operativa real antes de convertir toda la planta.


5. Comprender el lado primario y el lado secundario de la CDU

Una CDU, o unidad de distribución de refrigerante, se utiliza habitualmente para separar y gestionar dos circuitos de enfriamiento.

El diseño exacto depende de la plataforma de la GPU, el tipo de refrigerante, la carga térmica y la arquitectura de la instalación, pero el concepto básico es el siguiente.

Lado primario: Sistema de agua de la instalación

El lado primario está conectado al sistema de disipación de calor de la instalación. Puede conectarse a:

  • Enfriador seco

  • Torre de enfriamiento

  • Enfriador

  • Bomba principal

  • Depósito de expansión

  • Sistema de tratamiento de agua

  • Tuberías para exteriores

  • Intercambiador de calor dentro de la CDU

El circuito primario transporta el calor desde la CDU hasta el equipo de disipación de calor exterior.

Lado secundario: Sistema de enfriamiento tecnológico

El lado secundario abastece a los equipos de TI. Puede conectarse a:

  • Placas de enfriamiento para GPU

  • Colectores de servidor

  • Colectores de bastidor

  • Colectores de entrada y salida del sistema de refrigeración

  • Bomba secundaria

  • Filtros

  • Componentes de expansión

  • Detección de fugas

  • Sensores de temperatura, presión y flujo

El CDU transfiere calor entre ambos lados mientras controla las condiciones del refrigerante secundario que se suministra a los bastidores.

Cadena de frío básica

Un circuito simplificado de enfriamiento por líquido es:

Placa de enfriamiento de la GPU → Retorno del rack → Intercambiador de calor y bomba de la CDU → Suministro del rack → Placa de enfriamiento de la GPU

La ruta desde el lado de la instalación es:

Retorno primario de la CDU → Enfriador seco u otro sistema de disipación de calor → Suministro primario → CDU

Esta separación puede ayudar al operador a controlar la calidad del refrigerante, la presión, la temperatura y los requisitos de mantenimiento en el ámbito de la tecnología de la información.

Para obtener una explicación detallada de la arquitectura de enfriamiento, consulta CDU para centros de datos de IA.

Lo que debe definirse en las especificaciones

Las especificaciones del proyecto deben definir:

  • Temperatura de alimentación y de retorno del lado primario

  • Temperatura de entrada y salida del lado secundario

  • Caudal en cada lado

  • Rango de presión

  • Cabezal de la bomba

  • Capacidad del intercambiador de calor

  • Caída de presión máxima permitida

  • Tipo de refrigerante

  • Compatibilidad de materiales

  • Nivel de filtración

  • Método de expansión y llenado

  • Método de detección y aislamiento de fugas

  • Protocolo de control

  • Estrategia de redundancia

  • Derivación de mantenimiento

Una cotización de CDU sin condiciones operativas está incompleta.


6. Dimensiona el sistema de enfriamiento en función de la carga térmica, no solo de la potencia disponible en el sitio

No se debe elegir un enfriador seco o una unidad de condensación (CDU) únicamente porque la mina cuente con un servicio eléctrico de 1 MW, 5 MW o 10 MW.

El diseño del sistema de enfriamiento debe partir del calor real que hay que disipar.

Marco básico para la disipación de calor

Un modelo práctico de planificación es:

Capacidad de enfriamiento requerida = Carga térmica de los equipos de TI + Calor generado por las bombas + Calor generado por los ventiladores + Pérdidas de distribución + Margen de diseño

La mayor parte de la energía eléctrica que consumen los equipos de TI acaba convirtiéndose en calor. Sin embargo, no toda la carga eléctrica de las instalaciones entra en el mismo circuito de enfriamiento.

El equipo de ingeniería debería aclarar lo siguiente:

  • Carga de TI

  • Porcentaje de la carga de TI gestionada mediante enfriamiento por líquido

  • Carga auxiliar refrigerada por aire

  • Potencia de la bomba CDU

  • Potencia del ventilador del enfriador seco

  • Calor en la habitación o en el contenedor

  • Temperatura nominal de diseño exterior

  • Redundancia requerida

  • Margen de expansión futura

Ejemplo de cálculo de caudal

A modo de ejemplo, consideremos una carga de enfriamiento por líquido de 200 kW que utiliza agua con una diferencia de temperatura entre el suministro y el retorno de 10 °C:

Caudal = Carga térmica / Calor específico / Diferencia de temperatura

El flujo estimado es de aproximadamente:

200 kW / 4,18 kJ/kg·K / 10 K = 4,8 kg/s

Esto equivale aproximadamente a 17 m³/h de agua.

Con los mismos supuestos:

Carga de enfriamiento por líquidoCaudal aproximado a 10 °C con un Delta T
200 kW17 m³/h
500 kW43 m³/h
1 MW86 m³/h

Estos son ejemplos de ingeniería, no especificaciones definitivas del producto. La concentración de glicol, la temperatura del fluido, la densidad, la capacidad térmica, la altitud y el margen de diseño requerido influirán en el resultado.

Temperatura de aproximación

La temperatura de aproximación describe la diferencia de temperatura entre el fluido que sale del intercambiador de calor y la temperatura ambiente o la del lado de la instalación utilizada para la disipación de calor.

Una temperatura de entrada más baja puede requerir:

  • Mayor superficie de intercambio de calor

  • Mayor flujo de aire

  • Más poder de los fans

  • Temperatura más baja del líquido

  • Mayor superficie ocupada por el enfriador seco

Una temperatura ambiente elevada puede reducir la capacidad del enfriador seco. Es posible que un sistema diseñado para un clima templado no ofrezca la misma capacidad de disipación de calor durante las condiciones más intensas del verano.

Leer Enfriador seco para la refrigeración líquida de centros de datos antes de definir la estrategia de rechazo de calor en exteriores.

Consejo de experto: Solicita que se evalúe el rendimiento del enfriador por evaporación a la temperatura de diseño real del proyecto durante el verano, y no solo en condiciones favorables de laboratorio.


7. Revisa el líquido refrigerante, la calidad del agua y la protección contra la congelación

La refrigeración líquida no consiste simplemente en agregar tuberías a una instalación de minería.

La calidad del fluido de trabajo puede afectar:

  • Rendimiento de transferencia de calor

  • Riesgo de corrosión

  • Vida útil de la bomba

  • Carga del filtro

  • Rendimiento del intercambiador de calor

  • Confiabilidad de la placa de enfriamiento

  • Cumplimiento de la garantía

  • Costo de mantenimiento a largo plazo

Las especificaciones finales del fluido deben cumplir con los requisitos de la GPU, el servidor, la CDU y los materiales de las tuberías.

Calidad del agua

El equipo del proyecto debe definir:

  • Conductividad

  • Dureza

  • pH

  • Control de la corrosión

  • Límites de partículas

  • Control microbiológico

  • Método de filtración

  • Frecuencia de muestreo

  • Procedimiento de reposición de agua

No elijas un refrigerante solo porque sea barato o porque lo puedas conseguir en tu zona.

Protección contra el hielo

Las tuberías exteriores y los sistemas de enfriamiento en seco pueden estar expuestos a temperaturas bajo cero. El proyecto podría requerir:

  • Mezcla de glicoles

  • Cableado calefactor

  • Aislamiento

  • Diseño de drenaje

  • Recirculación durante el modo de espera

  • Alarmas de baja temperatura

  • Enclavamientos de protección contra el congelamiento

El glicol puede alterar la viscosidad, la capacidad térmica y la caída de presión. Es necesario actualizar el dimensionamiento de las bombas y los cálculos de caudal cuando se introduce glicol.

Detección de fugas

En un proyecto de conversión se debe tener en cuenta lo siguiente:

  • Sensores de fuga puntuales

  • Detección de fugas mediante cable

  • Bandejas colectoras CDU

  • Válvulas de aislamiento a nivel de rack

  • Apagado automático de la bomba

  • Escalamiento de alarmas

  • Alarmas visuales locales

  • Notificaciones remotas

  • Drenaje de emergencia

  • Sellos y mangueras de repuesto

El objetivo no es solo detectar una fuga visible, sino identificar cualquier anomalía en los niveles de humedad o en el comportamiento del flujo antes de que cause daños al equipo informático.


8. Establece controles en torno a las operaciones, no solo a la instalación

Un sistema de enfriamiento en funcionamiento requiere una buena visibilidad de su funcionamiento.

Un sistema de monitoreo práctico puede incluir:

  • Temperatura de suministro

  • Temperatura de retorno

  • Diferencia de temperatura

  • Presión de alimentación

  • Presión de retorno

  • Presión diferencial

  • Caudal

  • Velocidad de la bomba

  • Estado de la bomba

  • Velocidad del ventilador

  • Temperatura ambiente

  • Nivel de líquido refrigerante

  • Presión diferencial del filtro

  • Estado de la fuga

  • Estado de la puerta o del acceso

  • Calidad de la energía

  • Historial de alarmas

Un PLC puede gestionar secuencias locales y enclavamientos. Un sistema de gestión de edificios (BMS), un sistema de gestión de infraestructura de data center (DCIM) o una plataforma de monitoreo remoto pueden ofrecer visibilidad de mayor nivel, análisis de tendencias y gestión de alarmas.

La lógica de las alarmas debe definirse desde el principio

El equipo del proyecto debe especificar:

  • Umbrales de alerta

  • Límites de disparo

  • Retrasos en las alarmas

  • Comportamiento ante una falla del sensor

  • Respuesta ante una falla de la bomba

  • Respuesta ante una falla del ventilador

  • Respuesta a altas temperaturas

  • Respuesta a bajo caudal

  • Respuesta ante fugas

  • Respuesta ante la pérdida de comunicación

  • Reglas de anulación manual

  • Procedimiento de reinicio

El monitoreo remoto solo es útil cuando la alarma tiene un responsable claro y una respuesta definida.

El proyecto también debe tomar en cuenta la ciberseguridad, los permisos de los usuarios, el acceso remoto seguro y la segmentación de la red. Conectar un PLC a Internet sin control de acceso genera un nuevo riesgo operativo.


9. Requisitos de red, fibra óptica y seguridad física

Las granjas de minería pueden funcionar con requisitos de red relativamente sencillos. Los sistemas de IA y HPC pueden requerir una comunicación de alto ancho de banda y baja latencia entre servidores, conmutadores y dispositivos de almacenamiento.

Un plan de conversión debe evaluar:

Infraestructura de red

  • Disponibilidad de fibra óptica en el lugar

  • Diversidad de portadoras

  • Vías de ingreso

  • Topología de la red troncal

  • Requisitos de Ethernet de alta velocidad o InfiniBand

  • Ubicación del conmutador en la parte superior del rack

  • Red de gestión

  • Acceso fuera de banda

  • Red de almacenamiento

  • Rutas de red redundantes

  • Conectación y etiquetado de fibra óptica

  • Separación electromagnética de los cables de alimentación

Los materiales actuales de NVIDIA sobre la arquitectura de IA a escala de rack hacen hincapié en que las redes son una parte fundamental del desempeño de la IA a gran escala. Aunque el sistema de enfriamiento sea técnicamente excelente, la implementación podría fallar si la red no puede soportar la carga de trabajo.

Seguridad física

Los operadores deben revisar:

  • Perímetro del sitio

  • Control de vehículos y visitantes

  • Cobertura de las cámaras

  • Registros de acceso

  • Acceso al estante o al contenedor

  • Acceso a la sala de redes

  • Salidas de emergencia

  • Detección de incendios

  • Extinción de incendios

  • Protección de cables

  • Energía de respaldo para sistemas de seguridad

  • Normativas locales y requisitos de seguros

Una instalación minera puede estar ubicada en un lugar físicamente remoto y, aun así, requerir un control de acceso de nivel de centro de datos una vez que aloje cargas de trabajo de IA de los clientes.


10. Planificar la expansión en bloques de 200 kW, 500 kW y 1 MW

La expansión por etapas reduce el riesgo técnico y financiero.

Estos valores deben considerarse como rangos de referencia para la carga de TI, a menos que las especificaciones del proyecto indiquen lo contrario.

Fase 1: Proyecto piloto de 200 kW

La fase de 200 kW se puede utilizar para validar:

  • Compatibilidad con plataformas de GPU

  • Enfriamiento por líquido a nivel de rack

  • Funcionamiento de la CDU

  • Rendimiento del enfriador seco

  • Calidad del agua

  • Detección de fugas

  • Alarmas del PLC

  • Rendimiento de la red

  • Procedimientos de mantenimiento

  • PUE real

El proyecto piloto debe diseñarse de manera que permita realizar mediciones y resolver problemas. No debe implementarse como un experimento aislado que no pueda conectarse a bloques futuros.

Fase 2: Ampliación de 500 kW

Con una potencia de 500 kW, el proyecto debería formalizar:

  • Capacidad de la CDU modular

  • Disposición de los módulos del enfriador seco

  • Redundancia de bombas

  • Bloques de distribución de energía

  • Expansión de la red

  • Piezas de repuesto

  • Acceso al servicio

  • Derivación de mantenimiento

  • Estrategia N+1 cuando sea necesario

N+1 significa que el sistema cuenta con el número requerido de módulos operativos más un módulo adicional. La aplicación correcta depende del objetivo de tiempo de actividad del cliente y de su filosofía de mantenimiento.

Fase 3: Bloque de producción de 1 MW

Con una potencia de 1 MW, el proyecto debería evaluar:

  • Zonas separadas de alimentación eléctrica y refrigeración

  • Distribución de energía A/B

  • Varios módulos CDU

  • N+1 bombas o ventiladores

  • Redundancia en la disipación de calor

  • Zonificación contra incendios

  • Redundancia de rutas de red

  • Estrategia de transformadores o alimentadores de reserva

  • Procedimientos de mantenimiento programado

  • Pruebas completas de aceptación en fábrica y en obra

Una sola máquina de enfriamiento de gran tamaño puede parecer una opción sencilla en una cotización. Sin embargo, varios módulos coordinados pueden ofrecer una mayor facilidad de mantenimiento y flexibilidad de expansión.

Para obtener información sobre un marco de implementación modular más amplio, consulta Guía de diseño de una granja minera modular de 5 MW.

Consejo de experto: Diseña el bloque de 200 kW de manera que pueda constituir una zona operativa completa dentro de la futura instalación de 1 MW. La expansión futura resulta más sencilla cuando la primera fase ya cuenta con sus propias válvulas, sensores, controles, límites de potencia e identidad de red.


11. ¿Qué sitios mineros son buenos candidatos para la conversión a IA?

Candidatos sólidos

Una mina es una opción más sólida cuando cuenta con:

  • Documentación verificada de empresas de servicios públicos y transformadores

  • Margen de potencia continua suficiente

  • Aparamenta y protección modernas

  • Puesta a tierra y conexión a masa adecuadas

  • Espacio para la instalación de la CDU y el enfriador seco

  • Acceso confiable por carretera y con grúa

  • Conectividad de fibra estable

  • Buen drenaje y protección contra inundaciones

  • Perímetro seguro y acceso controlado

  • Cimientos expandibles

  • Un clima y una altitud que se pueden soportar

  • Servicio de mantenimiento local especializado

  • Requisitos claros en materia de permisos y seguros

Candidatos débiles

Hay que tener cuidado con un sitio web cuando presenta:

  • Solo una promesa de servicio público sin una red de distribución instalada

  • Transformadores de capacidad insuficiente

  • Restricciones de energía estacionales

  • Mala calidad de la tensión

  • No hay espacio para ampliarse

  • Conectividad de fibra deficiente

  • Riesgo de inundaciones o de agua estancada

  • Calles estrechas o acceso limitado para grúas

  • No hay un lugar seguro para las bombas y los enfriadores en seco

  • Calidad del agua no controlada

  • No existe un procedimiento de respuesta ante fugas

  • Seguridad física deficiente

  • No hay capacidad de servicio local

La electricidad a bajo costo es valiosa, pero no compensa una instalación inadecuada.


12. Lista de verificación para la conversión de una granja de minería en un centro de datos de IA

ÁreaPreguntas para confirmarPruebas que se deben solicitar
Energía de la red eléctrica¿Qué es lo que se contrata, se instala y se puede implementar de manera continua?Documentos de servicios públicos, estudio de carga, diagrama unifilar
Transformador¿La potencia nominal del transformador es adecuada para un funcionamiento continuo en modo AI?Placa de identificación, informe de pruebas, ajustes de protección
Distribución¿Pueden los tableros de distribución, los alimentadores, las PDU y los cables soportar la carga a nivel de rack?Planos eléctricos, lista de cables, registros de inspección
Carga de trabajo de la GPU¿Qué plataforma de GPU, tipo de servidor y consumo de energía del rack se tienen previstos?Ficha técnica del fabricante original y especificaciones del rack
Carga de enfriamiento¿Qué porcentaje de la carga de TI cuenta con enfriamiento por líquido?Fundamentos del diseño térmico
CDU¿Qué son las temperaturas primaria y secundaria, y los límites de flujo y presión?Ficha técnica y secuencia de control de la CDU
Enfriador seco¿Qué capacidad está disponible a la temperatura ambiente de diseño?Curva de rendimiento y condiciones de prueba
Tuberías¿Son adecuados los tamaños de las tuberías, los materiales, las válvulas y los soportes?Diagrama y plano de tuberías
Líquido refrigerante¿Qué límites se aplican en cuanto a fluidos, filtración y calidad del agua?Especificaciones del líquido refrigerante y análisis del agua
Protección contra el hielo¿Qué pasa cuando hace frío o hay un corte de luz?Secuencia de protección contra la congelación
Fuga¿Dónde se encuentran los sensores, las válvulas de aislamiento y las alarmas?Esquema de detección de fugas
Controles¿Quién recibe las alarmas y quién puede reiniciar los equipos?Lista de puntos del PLC y matriz de alarmas
Red¿Son suficientes las redes de fibra, de estructura, de almacenamiento y de administración?Topología de la red e información sobre los operadores
Seguridad¿Puede el sitio proteger los equipos y las credenciales de los clientes?Plan de seguridad y procedimiento de control de acceso
Logística¿Pueden llegar los camiones, las grúas y la maquinaria al área de instalación?Plano de emplazamiento, levantamiento topográfico de la carretera y plano de elevación
Puesta en servicio¿Qué son los criterios de aceptación FAT, SAT y de pruebas de carga?Procedimientos de prueba y formularios de aceptación
Operaciones¿Quién se encarga del mantenimiento de los filtros, las bombas, los ventiladores, el líquido refrigerante y las piezas de repuesto?Plan de operación y mantenimiento y matriz de responsabilidades

13. Decisión de seguir adelante o no

Un proyecto minero solo debe seguir adelante cuando se cuente con respuestas claras a las siguientes preguntas:

  1. ¿Puede la planta suministrar la potencia continua requerida, y no solo la capacidad contratada?

  2. ¿El transformador y el sistema de distribución tienen capacidad para soportar los racks de GPU seleccionados?

  3. ¿Puede el sistema de enfriamiento disipar el calor calculado en las peores condiciones ambientales de diseño del proyecto?

  4. ¿Puede la CDU mantener la temperatura, el caudal y la presión requeridos en el circuito secundario?

  5. ¿Puede la planta controlar la calidad del refrigerante, la filtración y la protección contra la congelación?

  6. ¿Pueden los controles detectar y responder ante condiciones anómalas?

  7. ¿Puede la red soportar la carga de trabajo y la expansión futura?

  8. ¿Puede el sitio cumplir con los requisitos de seguridad física y protección contra incendios?

  9. ¿Se puede entregar, izar, instalar y dar mantenimiento al equipo?

  10. ¿Podrá el proyecto superar las pruebas de fábrica, la puesta en marcha en el sitio y la aceptación por parte del cliente?

Si hay varias respuestas que no están claras, el proyecto aún se encuentra en la etapa de viabilidad. Es demasiado pronto para aprobar una lista definitiva de equipos o prometer una fecha de implementación.

Drolin Box puede analizar los requisitos del proyecto y preparar el alcance técnico adecuado para contenedores mineros modulares, sistemas de enfriamiento por líquido, integración de CDU, implementación de enfriadores secos y expansión por etapas de la infraestructura de computación.

Para la evaluación del proyecto, envíe:

  • País del proyecto y ubicación de la obra

  • Potencia disponible y potencia objetivo

  • Información sobre el transformador

  • Modelo de GPU o de servidor

  • Cantidad prevista por estante

  • Distribución actual del yacimiento minero

  • Temperatura ambiente y altitud

  • Agua y condiciones de congelación

  • Fotografías o planos del sitio

  • Fase de implementación requerida

También puedes consultar el Guía de riesgos para la selección del emplazamiento de un centro de datos de 500 MW antes de evaluar una oportunidad de mayor potencia, o ponte en contacto con Caja Drolin para hablar sobre un proyecto.


Preguntas frecuentes

¿Es posible convertir todas las granjas de minería en centros de datos de IA?

No. Es posible que una instalación minera cuente con recursos útiles de energía y terreno, pero es necesario reevaluar los sistemas de transformadores, distribución, refrigeración, red, seguridad y permisos para la carga de trabajo de IA seleccionada.

¿Se requiere una CDU para cada centro de datos con GPU?

No necesariamente. La arquitectura de enfriamiento depende de la plataforma de la GPU, el diseño del rack, el método de enfriamiento por líquido y la estrategia de agua de la instalación. Por lo general, se utiliza una CDU cuando el circuito de enfriamiento de la tecnología requiere separación y una transferencia de calor controlada respecto al circuito de la instalación.

¿Se puede usar un contenedor minero refrigerado por aire para servidores con GPU?

Depende del diseño térmico del servidor y de la densidad de potencia del rack. Los sistemas de menor densidad o los híbridos pueden utilizar enfriamiento por aire, mientras que muchas plataformas de GPU de alta densidad requieren enfriamiento líquido directo u otra arquitectura especializada.

¿Debería la capacidad del enfriador seco ser igual a la capacidad eléctrica total de la granja de minería?

No. El dimensionamiento de un enfriador seco debe basarse en la carga de rechazo de calor, la fracción enfriada por líquido, la temperatura ambiente de diseño, el caudal, la temperatura de aproximación, la redundancia y la expansión futura.

¿Cuál es el primer paso más seguro para la implementación de la inteligencia artificial en una mina?

Comience con un análisis de viabilidad documentado y un proyecto piloto modular. Un proyecto piloto de 200 kW permite validar la potencia, la refrigeración, los controles, la red y los procedimientos operativos antes de que el proyecto se amplíe a 500 kW o 1 MW.

¿Qué información deben preparar los compradores antes de solicitar una cotización?

Prepara la información sobre el país, la potencia disponible, la capacidad del transformador, el modelo de la GPU o del servidor, la cantidad de racks, las condiciones ambientales, la altitud, la calidad del agua, las fotos del sitio, los planos de distribución, la ruta de entrega y la fase de expansión prevista.

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Formulario en blanco (#5)