Nebius

Plataforma de nube de IA que ofrece clústeres de GPU de NVIDIA escalables para entrenamiento e inferencia, con orquestación gestionada de Kubernetes y Slurm.

Verificada API disponible ~6.5k visitas mensuales
Datos rápidos
Qué es Plataforma de nube de IA que ofrece clústeres de GPU de NVIDIA escalables para entrenamiento e inferencia, con orquestación gestionada de Kubernetes y Slurm.
Precios Paid
Plan gratuito No
Plataforma Web Application
API
Ideal para training large language models, running AI inference at scale
Dominio registrado 2004

Datos actualizados 15 de agosto de 2026

¿Qué hace Nebius?

Nebius es una plataforma de computación en la nube especializada, diseñada específicamente para cargas de trabajo de IA. Proporciona acceso bajo demanda a potentes clústeres de GPU de NVIDIA (incluyendo los modelos H100, H200, B200 y los próximos GB200) optimizados tanto para tareas de entrenamiento como de inferencia. La plataforma se encarga de toda la infraestructura subyacente, desde la red InfiniBand de alto rendimiento hasta los controladores preconfigurados, lo que permite que los investigadores y desarrolladores se centren únicamente en sus modelos de IA.

Lo que diferencia a Nebius es su profunda optimización para los flujos de trabajo de IA. La plataforma ofrece clústeres gestionados de Kubernetes y Slurm que pueden escalar hasta miles de GPU, junto con servicios totalmente gestionados como MLflow, PostgreSQL y Apache Spark. Los usuarios pueden aprovisionar recursos a través de Terraform, API, CLI o una consola web, y obtener acceso a soluciones y tutoriales preconfigurados. La empresa incluso diseña sus propios servidores y centros de datos específicamente para cargas de trabajo de IA, incluyendo la supercomputadora clasificada como la número 1 globally.

Esta plataforma es ideal para investigadores de IA, ingenieros de ML y empresas que ejecutan cargas de trabajo de IA generativa a gran escala. Los casos de uso del mundo real incluyen el entrenamiento de sistemas de IA de edición genética como CRISPR-GPT, la optimización de marcos de inferencia de código abierto como vLLM y el soporte de servicios de IA en producción como la generación de respuestas de Brave Search, que gestiona más de 11 millones de consultas diarias.

#ai cloud#ai inference#gpu-clusters#high performance computing#managed kubernetes#ml training#nvidia gpus

Características principales

Qué la hace destacar
01
Clusters de GPU de NVIDIA totalmente escalables (H100, H200, B200 y GB200), ideales tanto para el entrenamiento de modelos como para tareas de inferencia.
02
Orquestación de Kubernetes y Slurm gestionada para ejecutar cargas de trabajo de AI en múltiples nodos.
03
Redes InfiniBand de alto rendimiento, optimizadas específicamente para soportar las cargas de trabajo de AI.
04
Servicios de ML totalmente gestionados (MLflow, PostgreSQL, Apache Spark)
05
Aprovisionamiento mediante Terraform, API y CLI, con el respaldo de arquitectos expertos.

¿Para quién es Nebius?

Quién saca más provecho de esta herramienta
training large language models
running AI inference at scale
deploying production AI services

Precios

NVIDIA HGX B200

Personalizado
  • 5.5 price per GPU hour
  • 16 vCPUs
  • 200 GB de RAM

NVIDIA HGX H200

Personalizado
  • 3.5 price per GPU hour
  • 16 vCPUs
  • 200 GB de RAM

NVIDIA HGX H100

Personalizado
  • 2.95 price per GPU hour
  • 16 vCPUs
  • 200 GB de RAM

NVIDIA L40S GPU with AMD

Personalizado
  • 1.82 price per GPU hour from
  • De 16 a 192 vCPUs
  • De 96 a 1152 GB de RAM

NVIDIA L40S GPU with Intel

Personalizado
  • 1.55 price per GPU hour from
  • De 8 a 40 vCPUs
  • De 32 a 160 GB de RAM

AMD EPYC Genoa

Personalizado
  • 0.1 price per hour from
  • De 4 a 64 vCPUs
  • De 16 a 256 GB de RAM

Intel Ice Lake

Personalizado
  • 0.05 price per hour from
  • De 2 a 80 vCPUs
  • De 8 a 320 GB de RAM

Confianza y presencia

Dominio Dominio registrado en 2004

Galería

Haz clic en cualquier imagen para ampliarla

Alternativas en Inferencia de IA

Lambda Verificada Inferencia de IA

Plataforma en la nube que alquila GPUs NVIDIA H100/B200/B300 para entrenar y ejecutar modelos de IA a escala

QSC Cloud Verificada Inferencia de IA

Acceso bajo demanda a clústeres de GPU en la nube NVIDIA H100, H200 y AMD MI300 para cargas de trabajo de IA y aprendizaje profundo.

Inferless Verificada Inferencia de IA

Plataforma de GPU serverless para desplegar modelos de aprendizaje automático en minutos, con autoescalado y precios de pago por uso.

Crusoe Verificada Inferencia de IA

Infraestructura en la nube alimentada por energía renovable y servicio de inferencia gestionada para ejecutar grandes modelos de IA.

Cerebrium Verificada Inferencia de IA

Plataforma de infraestructura serverless para desplegar y escalar modelos de IA con aceleración por GPU

Parasail.io Verificada Inferencia de IA

Una red global de GPU para ejecutar modelos de IA a escala: inferencia serverless, dedicada o por lotes con precios por token.

Akamai Verificada Inferencia de IA

Plataforma de infraestructura en la nube para desplegar aplicaciones de baja latencia con GPUs, Kubernetes y precios fijos

n8n Sitio del top 1k
Saturn Cloud Verificada Inferencia de IA

Plataforma gestionada de infraestructura de GPU: convierte tu flota de GPU en espacios de trabajo de IA de autoservicio con Kubernetes, Slurm y endpoints de inferencia

Compartir X LinkedIn Telegram
Nebius Visitar