Plataforma de computación de IA que ofrece GPUs, software e infraestructura para entrenar y desplegar modelos de IA en diversas industrias
Inferencia de IA — herramientas de IA
266 herramientas en esta categoríaInfraestructura para ejecutar modelos en producción: despliegue de checkpoints mediante una API, alquiler de GPUs por segundo, procesamiento de trabajos por lotes y monitoreo de la latencia y el coste por solicitud. Se sitúa después de la etapa de entrenamiento; es aquí donde el modelo se convierte en un recurso que una aplicación puede invocar.
Plataforma de nube de IA que ofrece clústeres de GPU de NVIDIA escalables para entrenamiento e inferencia, con orquestación gestionada de Kubernetes y Slurm.
Alquila GPUs de alto rendimiento bajo demanda para IA, aprendizaje automático y renderizado de gráficos a costes significativamente menores.
API de inferencia de IA de alta velocidad y bajo coste para ejecutar modelos de lenguaje extensos con una latencia mínima.
Plataforma en la nube que alquila GPUs NVIDIA H100/B200/B300 para entrenar y ejecutar modelos de IA a escala
Organiza imágenes, convierte formatos de anotación, preprocesa, aumenta, comparte y despliega más. Eliminamos el código repetitivo que todo equipo de visión artificial debe escribir.
Plataforma de infraestructura de IA: despliega, sirve y escala modelos de machine learning en producción con inferencia optimizada
Plataforma de observabilidad impulsada por IA que monitoriza aplicaciones, infraestructura y seguridad en tiempo real
Plataforma de GPU en la nube para desarrolladores de IA: despliega, entrena y escala modelos de IA con infraestructura bajo demanda
Editor de código impulsado por IA que te ayuda a escribir, comprender y depurar código más rápido con asistencia inteligente.
Plataforma de IA empresarial que ofrece inferencia de alto rendimiento para modelos de lenguaje extensos y flujos de trabajo de IA agéntica.
Plataforma de código abierto de extremo a extremo para crear y desplegar modelos de aprendizaje automático en entornos diversos
Plataforma no-code para entrenar y desplegar modelos personalizados de visión artificial: sube imágenes, elige un modelo y despliega en cualquier dispositivo.
Ejecuta o despliega modelos de machine learning, trabajos de cómputo masivamente paralelos, colas de tareas, web apps y más, sin infraestructura propia.
Plataforma de nube distribuida para desplegar y escalar la inferencia y el cómputo de IA globalmente
Ejecuta y gestiona modelos de lenguaje extensos localmente en tu equipo para una automatización de IA privada y segura.
El motor de escala de oblea de tercera generación de Cerebras (WSE-3) es el procesador de IA más rápido de la Tierra. Supera a todos los demás procesadores en núcleos optimizados para IA, velocidad de memoria y ancho de banda de la estructura en el chip.
Infraestructura en la nube alimentada por energía renovable y servicio de inferencia gestionada para ejecutar grandes modelos de IA.
Plataforma de IA empresarial para crear modelos de lenguaje seguros y personalizables que se ejecutan en tu propia infraestructura.
Procesadores de IA perimetral que permiten aplicaciones de aprendizaje profundo de alto rendimiento en dispositivos con un consumo energético ultrabajo.
Motor de inferencia de LLM de alto rendimiento para un servicio de modelos de IA rápido y eficiente en memoria.
Plataforma de inferencia de IA de alto rendimiento: despliega y escala modelos de código abierto como Llama y Gemma con una sola llamada a la API.
Hardware y software de aceleración de inferencia de IA para edge computing: procesamiento de IA de alto rendimiento en formatos compactos.
El wrapper ligero de PyTorch para investigación de IA de alto rendimiento. Escala modelos, no código repetitivo. Lightning es uno de los frameworks de aprendizaje profundo más populares. A diferencia de Keras, ofrece flexibilidad total. A diferencia de PyTorch, no requiere una tonelada de código repetitivo.