CVAT
Это open-source платформа для разметки изображений, видео и 3D-данных. В общем, всё, что нужно, чтобы качественно подготовить датасеты для обучения ваших ML-моделей.
| Что это | Это open-source платформа для разметки изображений, видео и 3D-данных. В общем, всё, что нужно, чтобы качественно подготовить датасеты для обучения ваших ML-моделей. |
|---|---|
| Цены | Freemium — от $33/mo |
| Бесплатный тариф | Да |
| Платформа | Web Application |
| API | Да |
| Хорошо подходит для | labeling medical images for disease detection models, annotating video for autonomous vehicle training data |
| Домен зарегистрирован | 2022 |
Данные обновлены 1 августа 2026 г.
Что делает CVAT?
CVAT is a data annotation platform built specifically for creating training data for machine learning and computer vision models. It provides a web-based interface where teams can manually or automatically label images, videos, and 3D point cloud data. The core task is drawing bounding boxes, polygons, points, and other markers on visual data to teach AI models what to recognize.
It works by letting users upload datasets, often from cloud storage like AWS S3, and use a variety of annotation tools. A standout feature is auto-annotation, where you can use a pre-trained AI model or your own to suggest labels, speeding up the process. CVAT supports a wide array of annotation types, from simple image classification to complex 3D cuboids and video object tracking. It also exports data in 19 different formats, making it compatible with most ML frameworks.
This tool is most useful for professional teams building AI in fields like healthcare, retail, automotive, and manufacturing. For example, a medical research team can use it to label X-rays to train a model for early disease detection. A company developing self-driving cars can annotate hours of video footage to teach its system to identify pedestrians and traffic signs. It's built for scale, handling large datasets and providing management analytics to track annotation progress and team productivity.
Ключевые возможности
Что выделяет инструментДля кого CVAT?
Кому подходит этот инструментЦены
Есть бесплатный тариф — можно начать без банковской картыFree
- 3 tasks
- 1 projects
- 1 cloud storage
- 1 GB internal storage
- 100 external AI calls
- 100 internal AI calls
- Image support
- Video support
- 3D support
- API Access
- Data export (annotations only)
- Webhooks (1)
- Internal AI calls (100/month)
- External AI calls (100/month)
Solo
- 250 tasks
- 10 projects
- 3 cloud storage
- 25 GB internal storage
- Fair usage external AI calls
- 10,000 internal AI calls
- Image support
- Video support
- 3D support
- API Access
- Data export (annotations + images)
- Webhooks (10)
- Internal AI calls (10,000/month)
- Projects (10)
- Tasks (250)
- Internal storage (25 GB)
- Cloud storage (3)
Team
- 23 price per user yearly
- 33 price per user monthly
- Team collaboration
- Image support
- Video support
- 3D support
- API Access
- Data export (annotations + images)
- Manual review
- Ground truth job
- Honey pot
- Reports & analytics
- Role-based access controls
- Audit logs
- Webhooks
- Internal AI calls
- External AI calls
- Automatic annotation
- Integration with Hugging Face & Roboflow
- SAM 2 and SAM 3
- SAM 2 for video
CVAT for Enterprises
- 12,000 minimum yearly price
- Host CVAT securely within your own infrastructure
- Enhanced security
- Compliance
- Control over data
- Suitable for teams of all sizes
Доверие и присутствие
Галерея
Нажмите на изображение, чтобы увеличитьАльтернативы в категории Изображения и арт — прочее
AI-расширение для браузера и веб-приложение, которое помогает собирать, организовывать и мгновенно находить нужное изображение в вашей библиотеке всего одним кликом.
Превращайте 2D-изображения в захватывающие 3D-проекты. Смотрите их на любом устройстве — для погружения не нужны специальные очки.
AI-инструмент для управления цифровыми активами в команде. Организуйте, редактируйте и храните фотографии в одном общем рабочем пространстве.
Генератор текстовых эффектов на базе AI: создавайте эффектное стекло, неоновые вывески, 3D-объемы, киберпанк и еще более 100 визуальных стилей буквально за пару секунд. Можно попробовать бесплатно.
Платформа для тех, кто создает компьютерное зрение: от сборки и обучения моделей до их полноценного запуска. Здесь можно удобно управлять датасетами, донастраивать модели и быстро выводить их в продакшн.
Бесплатная галерея готовых промптов для AI-генераторов. Просто копируйте понравившийся вариант и используйте его в Midjourney, GPT Image 2, Nano Banana и других моделях.
Подборка жутких и тревожных AI-изображений — отличный источник вдохновения для тех, кто готовит контент к Halloween или просто хочет добавить в свои проекты немного мрачной эстетики.
Еженедельная рассылка о мире AI-арта: новости, интервью, полезные инструменты и ресурсы.
Похожие инструменты
Сервисы для разметки данных под команды, работающие с AI: аннотирование изображений, видео, 3D-моделей и текста для обучения компьютерного зрения и моделей машинного обучения.
Платформа для автоматической разметки данных в Computer Vision. С помощью AI она размечает изображения в 15 раз быстрее, при этом сохраняя высокую точность.
Это веб-платформа для разметки изображений, видео и 3D-данных. В общем, всё, что нужно, чтобы качественно подготовить датасеты для обучения ваших ML-моделей.
Все в одной платформе для разметки данных: создавайте обучающие наборы для AI-моделей с любыми типами данных. Умный, быстрый и интуитивно понятный инструмент для ваших проектов.
Платформа на базе AI для ускоренной разработки компьютерного зрения: автоматическая разметка данных и контроль качества.
Платформа для разметки данных с нескольких сенсоров, созданная специально для робототехники и беспилотников. Главная фишка в том, что здесь можно размечать 2D-изображения и 3D-облака точек в единой связке.
AI-инструмент для разметки данных — загружайте изображения, один раз отметьте объекты и мгновенно получайте пакетные аннотации.
Платформа с открытым исходным кодом для разметки данных. Используйте её для обучения, тонкой настройки и оценки AI-моделей, работающих с текстом, изображениями, аудио и видео.