Vizuální průvodce AI

Deformovatelné konvoluce

Deformovatelné konvoluce umožňují neuronové síti ohýbat svou vzorkovací mřížku tak, aby sledovala skutečný tvar objektů, místo aby je tlačila skrz tuhé čtvercové okno.

2 minuty čteníNaposledy aktualizováno

Přehled

This makes models far better at handling odd shapes, scale changes, and geometric distortion.

Hluboký ponor

Normální konvoluce vzorkuje pixely s pevnými posuny – úhledná mřížka 3x3 vycentrovaná na každém místě. To funguje dobře pro textury, ale problémy, když jsou objekty nakloněny, nataženy nebo podivně tvarovány. Deformovatelné konvoluce, které představil Dai a kolegové z Microsoft Research v roce 2017, přidávají ke každému z těchto vzorkovacích bodů malý naučený offset. Síť se dívá na vstup a předpovídá 2D posun pro každou pozici mřížky, takže přijímací pole se může deformovat a obejmout zakřivenou hranu nebo sledovat šikmou končetinu. Deformovatelné sdružování návratnosti investic aplikuje stejnou myšlenku na prvky regionu. Verze 2 (2018) přidala modulační váhy na bod a umožnila vrstvě ztlumit nebo zesílit každý vzorek, což zvýšilo přesnost detekce objektů na benchmarcích, jako je COCO.

Technický přehled

Offsety jsou vytvářeny extra konvoluční vrstvou běžící paralelně a na výstupu jsou 2N hodnoty pro N-bodové jádro (jeden dx, jeden dy na bod). Vzhledem k tomu, že předpokládané offsety jsou zlomkové, jsou vzorkované hodnoty pixelů počítány pomocí bilineární interpolace, která udržuje celou operaci diferencovatelnou. Offsety se učí end-to-end prostřednictvím normálního zpětného šíření – neexistuje žádný samostatný dohled, který by sděloval síti, kde má hledat. Přidané náklady jsou mírné, protože offsetová větev je v porovnání s mapami hlavních prvků lehká.

Strategický dopad

Rychlost a měřítko

Vizuální AI může automatizovat úkoly inspekce, detekce a označování ve velkém měřítku.

Volby sestavy

Kreativní týmy mohou prototypovat koncepty rychleji s menším počtem ručních revizí.

Tým a pracovní postup

Operace mohou využívat obrazové a video signály, které bylo dříve obtížné zpracovat.

Budoucnost deformovatelných konvolucí

Deformovatelná pozornost se stala páteří moderní detekce: Deformovatelná DETR používá naučené odchylky vzorkování, aby pozornost transformátoru byla řídká a rychlá, čímž se oproti původnímu DETR dramaticky zkracuje doba školení. Očekávejte, že se deformovatelný princip bude dále šířit do videa, 3D mračen bodů a modelů vizuálního jazyka, kde adaptivní vzorkování pomáhá zvládat pohyb, okluzi a nepravidelnou geometrii. S tím, jak se zlepšuje hardwarová podpora pro nepravidelný přístup k paměti, by se deformovatelní operátoři měli také zlevnit a měli by být více nasazováni na okrajová zařízení.

Real-World Implementace

Detekce objektů na COCO, kde deformovatelné vrstvy zvyšují přesnost na protáhlých nebo otočených objektech, jako jsou vlaky a žirafy

Sémantická segmentace pouličních scén, pomáhá modelům sledovat zakřivené pruhy a nepravidelné obrysy budov

Deformovatelný DETR pro end-to-end detekci, využívající naučené offsety, aby byla pozornost transformátoru efektivní

Lékařské zobrazování, kde mají nádory a orgány netuhé tvary, které pevné mřížky špatně zachycují

Rizika a zábradlí

Obrazová práva a souhlas se mohou stát právním rizikem, pokud je původ nejasný.

Výkon modelu se může lišit podle osvětlení, demografických údajů a prostředí.

Falešně pozitivní mohou zůstat bez povšimnutí, pokud nejsou monitorovány prahové hodnoty spolehlivosti.

Plán implementace

1

Definujte kritéria přijatelnosti pro přesnost, stažení a náklady na chyby.

2

Testujte s daty, která odpovídají reálným výrobním podmínkám.

3

Přidejte lidskou kontrolu pro předpovědi s nízkou spolehlivostí nebo velkým dopadem.

4

Sledujte posun modelu a znovu ověřte po změnách kamery nebo datové sady.

Pokračujte v objevování

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Deformable Convolutions quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Spustit kvíz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Další průvodce

Hloubkově oddělitelné konvoluce

Často kladené otázky

What is Deformable Convolutions?

Deformovatelné konvoluce umožňují neuronové síti ohýbat svou vzorkovací mřížku tak, aby sledovala skutečný tvar objektů, místo aby je tlačila skrz tuhé čtvercové okno. Díky tomu modely mnohem lépe zvládají zvláštní tvary, změny měřítka a geometrické zkreslení.

Co přidává deformovatelná konvoluce ve srovnání se standardní konvolucí?

Deformovatelné konvoluce předpovídají naučený offset (dx, dy) pro každé vzorkovací místo a umožňují, aby se mřížka deformovala, aby odpovídala tvarům objektu.

Jak se generují odchylky vzorkování v deformovatelné konvoluci?

Paralelní konvoluční větev vydává offsety, které jsou učeny end-to-end prostřednictvím zpětného šíření.

Protože předpokládané offsety jsou obvykle zlomkové, jak jsou na těchto pozicích vzorkovány hodnoty pixelů?

Zlomkové offsety vyžadují bilineární interpolaci, která udržuje operaci rozlišitelnou pro trénování.

Co Deformable ConvNets v2 (2018) přidal oproti originálu?

v2 zavedla modulaci, naučenou váhu na vzorkovací bod, která může zesílit nebo potlačit jeho vliv a zlepšit přesnost.

Proč jsou deformovatelné konvoluce zvláště užitečné pro objekty nepravidelného tvaru?

Ohnutím vzorkovací mřížky se efektivní přijímací pole zarovná s geometrií objektu namísto pevného čtverce.