CVAT
Una plataforma de código abierto para anotar imágenes, videos y datos 3D para entrenar modelos de aprendizaje automático.
| Qué es | Una plataforma de código abierto para anotar imágenes, videos y datos 3D para entrenar modelos de aprendizaje automático. |
|---|---|
| Precios | Freemium — de $33/mo |
| Plan gratuito | Sí |
| Plataforma | Web Application |
| API | Sí |
| Ideal para | labeling medical images for disease detection models, annotating video for autonomous vehicle training data |
| Dominio registrado | 2022 |
Datos actualizados 15 de agosto de 2026
¿Qué hace CVAT?
CVAT es una plataforma de anotación de datos creada específicamente para generar datos de entrenamiento para modelos de visión artificial y aprendizaje automático. Ofrece una interfaz basada en la web donde los equipos pueden etiquetar, de forma manual o automática, imágenes, videos y datos de nubes de puntos 3D. La tarea principal consiste en dibujar cuadros delimitadores, polígonos, puntos y otros marcadores sobre datos visuales para enseñar a los modelos de IA qué deben reconocer.
Funciona permitiendo que los usuarios carguen conjuntos de datos, a menudo desde almacenamiento en la nube como AWS S3, y utilicen diversas herramientas de anotación. Una característica destacada es la autoanotación, que permite usar un modelo de IA preentrenado o uno propio para sugerir etiquetas, acelerando así el proceso. CVAT es compatible con una amplia gama de tipos de anotación, desde la simple clasificación de imágenes hasta cuboides 3D complejos y el seguimiento de objetos en video. También exporta datos en 19 formatos diferentes, lo que lo hace compatible con la mayoría de los frameworks de ML.
Esta herramienta es más útil para equipos profesionales que desarrollan IA en campos como la salud, el comercio minorista, la automoción y la fabricación. Por ejemplo, un equipo de investigación médica puede usarla para etiquetar radiografías y así entrenar un modelo para la detección temprana de enfermedades. Una empresa que desarrolle coches autónomos puede anotar horas de metraje de video para enseñar a su sistema a identificar peatones y señales de tráfico. Está diseñada para escalar, manejando grandes conjuntos de datos y proporcionando analíticas de gestión para rastrear el progreso de la anotación y la productividad del equipo.
Características principales
Qué la hace destacar¿Para quién es CVAT?
Quién saca más provecho de esta herramientaPrecios
Plan gratuito disponible — empieza sin tarjeta de créditoFree
- 3 tasks
- 1 projects
- 1 cloud storage
- 1 GB internal storage
- 100 external AI calls
- 100 internal AI calls
- Soporte para imágenes
- Soporte para video
- Soporte para 3D
- Acceso a la API
- Exportación de datos (solo anotaciones)
- Webhooks (1)
- Llamadas de AI internas (100/mes)
- Llamadas de AI externas (100/mes)
Solo
- 250 tasks
- 10 projects
- 3 cloud storage
- 25 GB internal storage
- Fair usage external AI calls
- 10,000 internal AI calls
- Soporte para imágenes
- Soporte para video
- Soporte para 3D
- Acceso a la API
- Exportación de datos (anotaciones + imágenes)
- Webhooks (10)
- Llamadas de AI internas (10,000/mes)
- Proyectos (10)
- Tareas (250)
- Almacenamiento interno (25 GB)
- Almacenamiento en la nube (3)
Team
- 23 price per user yearly
- 33 price per user monthly
- Colaboración en equipo
- Soporte para imágenes
- Soporte para video
- Soporte para 3D
- Acceso a la API
- Exportación de datos (anotaciones + imágenes)
- Revisión manual
- Tareas de Ground Truth
- Honey pot
- Reportes y analíticas
- Control de acceso basado en roles
- Logs de auditoría
- Webhooks
- Llamadas de AI internas
- Llamadas de AI externas
- Anotación automática
- Integración con Hugging Face y Roboflow
- SAM 2 y SAM 3
- SAM 2 para video
CVAT for Enterprises
- 12,000 minimum yearly price
- Alojamiento seguro de CVAT en tu propia infraestructura
- Seguridad mejorada
- Cumplimiento normativo
- Control total sobre los datos
- Ideal para equipos de cualquier tamaño
Confianza y presencia
Galería
Haz clic en cualquier imagen para ampliarlaAlternativas en Imagen y Arte
Extensión de navegador y aplicación web con IA para recopilar, organizar y buscar tu biblioteca de imágenes con un solo clic.
Convierte imágenes 2D en experiencias 3D inmersivas que se pueden ver en cualquier dispositivo sin gafas especiales
Generador de fuentes con IA gratuito: escribe tu texto, elige entre más de 100 estilos y descarga un PNG/JPG al instante.
Gestor de activos digitales con IA para equipos: organiza, edita y aloja fotos en un espacio de trabajo colaborativo.
Plataforma para crear, entrenar y desplegar modelos de visión artificial: gestiona conjuntos de datos, ajusta modelos y pasa a producción.
Galería gratuita de prompts de IA predefinidos: copia y usa al instante con GPT Image 2, Nano Banana, Midjourney y otros modelos.
Herramienta impulsada por IA que transforma tus fotos en retratos de preboda personalizados con diferentes temas y estilos.
Un boletín semanal gratuito con las últimas noticias de arte con IA generativa, entrevistas a artistas y recursos.
Herramientas similares
Servicios de anotación de datos para equipos de IA: etiquetado de imágenes, video, 3D y texto para entrenar modelos de visión artificial y aprendizaje automático.
Plataforma de anotación de datos automatizada para visión artificial: usa IA para etiquetar imágenes 15 veces más rápido y con precisión.
Una plataforma web para etiquetar imágenes, videos y datos 3D para entrenar modelos de aprendizaje automático.
Plataforma inteligente de anotación de datos todo en uno para crear conjuntos de datos de entrenamiento para modelos de IA en múltiples tipos de datos
Plataforma impulsada por IA para acelerar el desarrollo de modelos de visión artificial con etiquetado de datos automatizado y control de calidad.
Plataforma de etiquetado de datos multisensor para robótica y vehículos autónomos: etiqueta imágenes 2D y nubes de puntos 3D conjuntamente.
Herramienta de anotación de datos con IA: sube imágenes, marca objetos una vez y obtén anotaciones por lotes al instante
Plataforma de código abierto para etiquetar datos para entrenar, ajustar y evaluar modelos de IA en texto, imágenes, audio y video.