Nebius
Plataforma de nube de IA que ofrece clústeres de GPU de NVIDIA escalables para entrenamiento e inferencia, con orquestación gestionada de Kubernetes y Slurm.
| Qué es | Plataforma de nube de IA que ofrece clústeres de GPU de NVIDIA escalables para entrenamiento e inferencia, con orquestación gestionada de Kubernetes y Slurm. |
|---|---|
| Precios | Paid |
| Plan gratuito | No |
| Plataforma | Web Application |
| API | Sí |
| Ideal para | training large language models, running AI inference at scale |
| Dominio registrado | 2004 |
Datos actualizados 15 de agosto de 2026
¿Qué hace Nebius?
Nebius es una plataforma de computación en la nube especializada, diseñada específicamente para cargas de trabajo de IA. Proporciona acceso bajo demanda a potentes clústeres de GPU de NVIDIA (incluyendo los modelos H100, H200, B200 y los próximos GB200) optimizados tanto para tareas de entrenamiento como de inferencia. La plataforma se encarga de toda la infraestructura subyacente, desde la red InfiniBand de alto rendimiento hasta los controladores preconfigurados, lo que permite que los investigadores y desarrolladores se centren únicamente en sus modelos de IA.
Lo que diferencia a Nebius es su profunda optimización para los flujos de trabajo de IA. La plataforma ofrece clústeres gestionados de Kubernetes y Slurm que pueden escalar hasta miles de GPU, junto con servicios totalmente gestionados como MLflow, PostgreSQL y Apache Spark. Los usuarios pueden aprovisionar recursos a través de Terraform, API, CLI o una consola web, y obtener acceso a soluciones y tutoriales preconfigurados. La empresa incluso diseña sus propios servidores y centros de datos específicamente para cargas de trabajo de IA, incluyendo la supercomputadora clasificada como la número 1 globally.
Esta plataforma es ideal para investigadores de IA, ingenieros de ML y empresas que ejecutan cargas de trabajo de IA generativa a gran escala. Los casos de uso del mundo real incluyen el entrenamiento de sistemas de IA de edición genética como CRISPR-GPT, la optimización de marcos de inferencia de código abierto como vLLM y el soporte de servicios de IA en producción como la generación de respuestas de Brave Search, que gestiona más de 11 millones de consultas diarias.
Características principales
Qué la hace destacar¿Para quién es Nebius?
Quién saca más provecho de esta herramientaPrecios
NVIDIA HGX B200
- 5.5 price per GPU hour
- 16 vCPUs
- 200 GB de RAM
NVIDIA HGX H200
- 3.5 price per GPU hour
- 16 vCPUs
- 200 GB de RAM
NVIDIA HGX H100
- 2.95 price per GPU hour
- 16 vCPUs
- 200 GB de RAM
NVIDIA L40S GPU with AMD
- 1.82 price per GPU hour from
- De 16 a 192 vCPUs
- De 96 a 1152 GB de RAM
NVIDIA L40S GPU with Intel
- 1.55 price per GPU hour from
- De 8 a 40 vCPUs
- De 32 a 160 GB de RAM
AMD EPYC Genoa
- 0.1 price per hour from
- De 4 a 64 vCPUs
- De 16 a 256 GB de RAM
Intel Ice Lake
- 0.05 price per hour from
- De 2 a 80 vCPUs
- De 8 a 320 GB de RAM
Confianza y presencia
Galería
Haz clic en cualquier imagen para ampliarlaAlternativas en Inferencia de AI
Plataforma en la nube que alquila GPUs NVIDIA H100/B200/B300 para entrenar y ejecutar modelos de IA a escala
Acceso bajo demanda a clústeres de GPU en la nube NVIDIA H100, H200 y AMD MI300 para cargas de trabajo de IA y aprendizaje profundo.
Plataforma de GPU serverless para desplegar modelos de aprendizaje automático en minutos, con autoescalado y precios de pago por uso.
Infraestructura en la nube alimentada por energía renovable y servicio de inferencia gestionada para ejecutar grandes modelos de IA.
Plataforma de infraestructura serverless para desplegar y escalar modelos de IA con aceleración por GPU
Una red global de GPU para ejecutar modelos de IA a escala: inferencia serverless, dedicada o por lotes con precios por token.
Plataforma de infraestructura en la nube para desplegar aplicaciones de baja latencia con GPUs, Kubernetes y precios fijos
Plataforma gestionada de infraestructura de GPU: convierte tu flota de GPU en espacios de trabajo de IA de autoservicio con Kubernetes, Slurm y endpoints de inferencia