Plataforma de cómputo de IA serverless para ejecutar modelos de código abierto de LLM, imagen, vídeo y audio a escala
Inferencia de IA — herramientas de IA
283 herramientas en esta categoríaInfraestructura para ejecutar modelos en producción: despliegue de checkpoints mediante una API, alquiler de GPUs por segundo, procesamiento de trabajos por lotes y monitoreo de la latencia y el coste por solicitud. Se sitúa después de la etapa de entrenamiento; es aquí donde el modelo se convierte en un recurso que una aplicación puede invocar.
Hardware y software de aceleración de inferencia de IA para edge computing: procesamiento de IA de alto rendimiento en formatos compactos.
El wrapper ligero de PyTorch para investigación de IA de alto rendimiento. Escala modelos, no código repetitivo. Lightning es uno de los frameworks de aprendizaje profundo más populares. A diferencia de Keras, ofrece flexibilidad total. A diferencia de PyTorch, no requiere una tonelada de código repetitivo.
Ofrece clústeres de GPU dedicados y alta infraestructura de rendimiento para cargas de trabajo de inferencia y entrenamiento de IA a gran escala.
Plataforma de infraestructura en la nube especializada, creada específicamente para cargas de trabajo de IA y computación por GPU
Descarga modelos de ML preoptimizados, desarrolla en dispositivos en la nube y despliega aplicaciones en hardware de Qualcomm
Plataforma gestionada de infraestructura de GPU: convierte tu flota de GPU en espacios de trabajo de IA de autoservicio con Kubernetes, Slurm y endpoints de inferencia
Plataforma de GPU en la nube para desarrollar, entrenar y desplegar modelos de IA/ML con GPUs NVIDIA H100.
Una plataforma gestionada para ejecutar y escalar cargas de trabajo de IA/ML creadas con el framework de código abierto Ray, desde el procesamiento de datos hasta el entrenamiento y la inferencia.
Plataforma en la nube que ofrece acceso bajo demanda a múltiples aceleradores de IA para cargas de trabajo de desarrollo, entrenamiento e inferencia.
Plataforma de monitoreo del rendimiento de aplicaciones: rastrea errores, cierres inesperados y problemas de rendimiento en apps web y móviles.
Una empresa de desarrollo de software a medida que crea agentes de IA, agentes de voz y software inteligente para negocios.
Modelos de IA multimodales de código abierto para desarrolladores: crea apps con capacidades de texto, imagen y contexto largo
Plataforma para desarrolladores con acceso API a más de 200 modelos de IA, despliegue de modelos personalizados, nube de GPU y sandboxes seguros para agentes.
Ingeniero de software de IA que gestiona de forma autónoma tareas complejas de programación como refactorizaciones, migraciones y revisiones de PR.
Un kit de herramientas para desarrolladores para crear aplicaciones de IA con seguridad de tipos: incluye validación, framework de agentes, observabilidad y evaluación.
Plataforma de infraestructura en la nube para desplegar aplicaciones de baja latencia con GPUs, Kubernetes y precios fijos
Plataforma de IA empresarial que ofrece infraestructura de razonamiento para crear sistemas de IA autónomos y gobernados
Plataforma de virtualización de GPU que maximiza la eficiencia de las cargas de trabajo de IA ejecutando múltiples modelos en hardware fraccionado
Infraestructura de nube de IA: alquila GPUs NVIDIA H100 bajo demanda o resérvalas para entrenamiento e inferencia
Desarrolla sistemas autónomos y software impulsados por IA para aplicaciones militares y de defensa.
Plataforma de nube de IA full-stack para desplegar y gestionar cargas de trabajo de IA
Plataforma de inferencia de modelos de IA: accede a múltiples LLM y modelos multimodales mediante una sola API con precios previsibles
Modelos fundacionales de IA nativos para dispositivos que funcionan en móviles, portátiles y coches; ajústalos y despliégalos localmente.