РЪКОВОДСТВО за визуален AI

Оценка на човешката поза

Оценката на човешката поза открива позициите на ставите на тялото, като лакти, колене и рамене, за да изгради цифров скелет на човек от изображения или видео.

2 min readПоследна актуализация

Преглед

It turns raw pixels into structured data about how people move.

Дълбоко гмуркане

Оценката на поза локализира набор от ключови точки на тялото (обикновено 17 до 33 стави) и ги свързва в скелет. Съществуват две основни стратегии. Методите отгоре надолу първо откриват всеки човек с ограничителна кутия, след което оценяват ставите вътре в нея; те са точни, но бавни, когато присъстват много хора. Методите отдолу нагоре, като OpenPose, откриват всички ключови точки в изображението наведнъж и след това ги групират в индивиди, което се мащабира по-добре в тълпи. Моделите могат да извеждат 2D координати или да ги повдигат в 3D. Популярните инструменти включват OpenPose, MoveNet и MediaPipe на Google и HRNet, който запазва функции с висока разделителна способност за прецизно съвместно локализиране. Технологията захранва приложения за фитнес, улавяне на движение и спортни анализи.

Техническа информация

Вместо да регресират директно координатите на ставата, най-точните модели предвиждат топлинна карта за става, вероятностна карта, чийто най-ярък пиксел маркира вероятното местоположение на ставата. Системите отдолу нагоре добавят Part Affinity Fields, векторни карти, кодиращи посоката на крайниците, така че откритите ключови точки могат да бъдат свързани в правилни скелети дори с припокриващи се хора. Гръбнаците с висока разделителна способност като HRNet поддържат фини пространствени детайли в цялата мрежа, подобрявайки прецизността за малки или близко разположени стави.

Стратегическо въздействие

Speed and scale

Visual AI може да автоматизира задачи за проверка, откриване и маркиране в мащаб.

Build choices

Творческите екипи могат да създават прототипи на концепции по-бързо с по-малко ръчни ревизии.

Team and workflow

Операциите могат да използват изображения и видео сигнали, които преди са били трудни за обработка.

Бъдещето на оценката на човешката поза

Оценката на позата се движи към 3D в реално време на потребителски устройства, стабилно проследяване на много хора и модели на цялото тяло плюс ръка плюс лице за по-богато улавяне на изражението. Улавянето на движение без маркери заменя скъпите студийни костюми във филмите и биомеханиката. Очаквайте по-тясно сливане с разпознаване на действия, за да разберете не само позата, но и дейността, нарастващото използване в здравеопазването за анализ на походката и рехабилитацията и моделите на устройството, които защитават поверителността, като никога не изпращат видео в облака.

Внедряване в реалния свят

Приложения за фитнес и йога, които проверяват формата на потребителя и броят повторенията от камерата на телефона

Улавяне на движение без маркери за анимиране на герои във филми и видео игри

Спортен анализ, измерващ ставните ъгли, крачка и техника на спортист

Физикална терапия и анализ на походката, проследяващи възстановяването и качеството на движение на пациента

Рискове и предпазни огради

Правата върху изображението и съгласието могат да се превърнат в правни рискове, ако произходът е неясен.

Производителността на модела може да варира в зависимост от осветлението, демографските данни и средата.

Фалшивите положителни резултати могат да останат незабелязани, освен ако не се наблюдават праговете на достоверност.

Пътна карта за изпълнение

1

Определете критерии за приемане за прецизност, извикване и разходи за грешки.

2

Тествайте с данни, които съответстват на реалните производствени условия.

3

Добавете преглед от човек за прогнози с ниска степен на сигурност или с голямо въздействие.

4

Проследявайте дрейфа на модела и проверявайте отново след промени в камерата или набора от данни.

Продължете да изследвате

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Human Pose Estimation quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Start quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Монокулярна оценка на дълбочината

Frequently asked questions

What is Human Pose Estimation?

Оценката на човешката поза открива позициите на ставите на тялото, като лакти, колене и рамене, за да изгради цифров скелет на човек от изображения или видео. Той превръща необработените пиксели в структурирани данни за това как се движат хората.

Какво основно открива оценката на човешката поза?

Оценката на поза локализира ключови точки на тялото като лакти, колене и рамене, след което ги свързва в скелет.

Как работят методите за оценка на поза отгоре надолу?

Методите отгоре надолу първо откриват всеки човек с ограничителна кутия и след това оценяват ставите в нея, което е точно, но се забавя при много хора.

Какво прогнозират най-точните модели на пози за всяка става вместо необработени координати?

Моделите обикновено извеждат топлинна карта за всяка става, чийто най-ярък пиксел показва най-вероятната позиция на ставата, която се обучава по-стабилно от директната регресия.

За какво помагат полетата за афинитет на части, използвани от OpenPose?

Полетата за афинитет на части кодират посоката на крайниците като векторни карти, позволявайки на методите отдолу нагоре да свързват правилно ключови точки, дори когато хората се припокриват.

Защо методите отдолу нагоре, като OpenPose, се мащабират по-добре в сцени с много хора?

Методите отдолу нагоре откриват всяка ключова точка в изображението с едно преминаване и след това ги групират, така че цената да не расте с всеки допълнителен човек.