Дополнение Mixup и CutMix
Mixup и CutMix — это методы увеличения данных, которые создают новые обучающие примеры путем смешивания двух изображений и их меток.
Обзор
Mixup linearly interpolates whole images and labels, while CutMix pastes a rectangular patch from one image onto another and mixes labels by patch area — both reduce overfitting and improve robustness.
Глубокое погружение
Mixup (Чжан и др., 2017) формирует новую выборку как x̃ = λ·x_a + (1−λ)·x_b с меткой ỹ, смешанной с тем же λ, где λ взято из бета-распределения. Это побуждает модель вести себя линейно между примерами, сглаживая границы принятия решений и улучшая калибровку. CutMix (Yun et al., 2019) вместо этого вырезает прямоугольную область из изображения B и вставляет ее в изображение A; веса меток определяются долей пикселей, вносимых каждым изображением. Поскольку CutMix сохраняет локально согласованные области изображения (а не призрачные переходы), он сохраняет полезную пространственную структуру, в то же время заставляя модель учитывать несколько объектов и частей. Оба метода действуют как сильные регуляризаторы, повышают точность тестов в масштабе ImageNet и заметно повышают устойчивость к искажениям и состязательным воздействиям.
Техническая информация
Оба метода изменяют цель потерь, а не только входные данные. Метка становится мягкой, смешанной целью, поэтому потеря перекрестной энтропии представляет собой взвешенную по λ комбинацию двух классов — фактически форму сглаживания меток, привязанную к коэффициенту смешивания пикселей. В CutMix λ равен доле неизмененных пикселей, вычисляемой на основе площади рамки обрезки, разделенной на общую площадь изображения, что обеспечивает согласованность пропорций метки с тем, какая часть каждого изображения видна.
Стратегическое воздействие
Стоимость и бюджет
Архитектурные решения влияют на производительность и эксплуатационные расходы на протяжении многих лет.
Более четкие решения
Техническое образование помогает командам выбрать правильный стек, а не только самый новый.
Контроль качества
Лучший инженерный выбор снижает вероятность возникновения проблем с надежностью на производстве.
Будущее микширования и расширения CutMix
Дополнение на основе миксов теперь является стандартом в строгих рецептах классификации изображений и лежит в основе современных конвейеров обучения преобразователей зрения, которые часто нуждаются в серьезной регуляризации. Продолжаются исследования вариантов с учетом значимости (например, размещение вырезок в информационных областях), микширования на уровне токенов для преобразователей и расширений для аудио, текста и 3D-данных. Ожидается, что стратегии смешивания останутся дешевым рычагом повышения точности, калибровки и надежности, поскольку архитектуры становятся все более требовательными к данным.
Реальная реализация
Обучение классификаторов ImageNet с помощью CutMix для повышения точности и улучшения локализации объектов.
Применение Mixup для улучшения калибровки модели, чтобы прогнозируемая достоверность лучше соответствовала истинной точности.
Сильная регуляризация преобразователей зрения (например, DeiT) с комбинированием Mixup и CutMix для обучения на ограниченных данных.
Повышение устойчивости к искажениям изображений и нераспределенным входным данным в системах машинного зрения, критически важных для безопасности.
Риски и ограничения
Оптимизация одного теста может скрыть более широкие недостатки системы.
Затраты на инфраструктуру и техническое обслуживание часто недооцениваются.
Пробелы в безопасности и наблюдаемости могут увеличиваться по мере усложнения систем.
Дорожная карта реализации
Определите целевые показатели задержки, качества и стоимости перед внедрением.
Тестирование при реалистичной нагрузке и условиях данных.
Мониторинг прибора на наличие ошибок, дрейфа и влияния пользователя.
Перед масштабированием подготовьте пути отката и реагирования на инциденты.
Продолжайте исследовать
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Mixup and CutMix Augmentation quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Следующее руководство
Увеличение времени тестирования
Часто задаваемые вопросы
What is Mixup and CutMix Augmentation?
Mixup и CutMix — это методы увеличения данных, которые создают новые обучающие примеры путем смешивания двух изображений и их меток. Mixup линейно интерполирует целые изображения и метки, а CutMix вставляет прямоугольный патч из одного изображения в другое и смешивает метки по областям патча, что позволяет уменьшить переобучение и повысить надежность.
Как Mixup создает новый обучающий пример?
Микс формирует x̃ = λx_a + (1−λ)x_b и смешивает метки с одинаковыми λ, взятыми из бета-распределения.
В чем основная разница между CutMix и Mixup?
CutMix копирует прямоугольную область из одного изображения в другое, сохраняя локально согласованное содержимое, а не объединяя два изображения вместе.
Как в CutMix определяется вес смешивания (лямбда) этикеток?
Пропорция метки в CutMix задается площадью вставленного поля относительно всего изображения, обеспечивая соответствие меток видимым пикселям.
Что еще изменяют Mixup и CutMix, помимо входного изображения?
Оба метода также смешивают метки, создавая мягкие цели, которые действуют как зависимая от данных форма сглаживания меток.
Какое распределение обычно используется для выборки коэффициента смешивания лямбда?
Mixup и CutMix обычно извлекают λ из бета-распределения, которое контролирует, насколько сильно смешаны два примера.