Odometria wizualna
Odometria wizualna szacuje, w jaki sposób kamera porusza się po świecie, śledząc, jak obraz zmienia się klatka po klatce.
Przegląd
Ma to znaczenie, ponieważ pozwala robotom, dronom i urządzeniom AR znać swoją pozycję bez GPS, wykorzystując wyłącznie wzrok.
Głębokie nurkowanie
Odometria wizualna (VO) stopniowo szacuje ruch kamery, jej przesunięcie i obrót, analizując kolejne obrazy. Potok oparty na funkcjach wykrywa punkty kluczowe, dopasowuje je lub śledzi w klatkach i oblicza względną pozycję na podstawie relacji geometrycznej między dopasowanymi punktami, a następnie łączy te przyrosty w trajektorię. Zamiast tego metody bezpośrednie minimalizują błąd fotometryczny (różnice w intensywności pikseli) bez wyraźnych cech. VO to interfejs wielu systemów SLAM, ale tam, gdzie pełny SLAM tworzy i utrzymuje globalną mapę z zamknięciem pętli, zwykły VO skupia się na lokalnym ruchu klatka po klatce. Jego słabością jest dryf: z czasem kumulują się małe błędy przypadające na klatkę. VO zasila samochody autonomiczne, łaziki planetarne, drony w środowiskach pozbawionych sygnału GPS oraz umożliwia śledzenie gogli w AR/VR.
Wgląd techniczny
Monokularowy VO odzyskuje ruch z podstawowej matrycy, która koduje geometrię epipolarną pomiędzy dwoma widokami i rozkłada się na rotację i translację, ale tylko do nieznanej skali. Kamery stereo lub RGB-D rozwiązują tę niejednoznaczność skali, korzystając ze znanej linii bazowej lub głębokości. Wiele nowoczesnych systemów łączy VO z IMU (odometrią wizualno-inercyjną), ściśle łącząc dane z akcelerometru i żyroskopu, aby poprawić niezawodność podczas szybkiego ruchu, niskiej tekstury lub rozmycia ruchu.
Wpływ strategiczny
Szybkość i skala
Wizualna sztuczna inteligencja może automatyzować zadania inspekcji, wykrywania i znakowania na dużą skalę.
Buduj wybory
Zespoły kreatywne mogą szybciej prototypować koncepcje przy mniejszej liczbie ręcznych poprawek.
Zespół i przepływ pracy
Operacje mogą wykorzystywać sygnały obrazu i wideo, które wcześniej były trudne do przetworzenia.
Przyszłość odometrii wizualnej
VO zmierza w stronę podejścia wyuczonego i hybrydowego: głębokie sieci szacują głębokość, przepływ optyczny i pozę, a nawet trenują w sposób samonadzorowany, stosując spójność syntezy widoku. Ściślejsza fuzja wizualno-inercyjna, kamery zdarzeń rejestrujące mikrosekundowe zmiany jasności oraz akceleratory neuronowe w urządzeniu sprawiają, że VO staje się ekstremalnie niezawodne w ciemności, przy dużej prędkości i dynamicznych scenach, stając się podstawową warstwą dla maszyn autonomicznych i obliczeń przestrzennych.
Implementacja w świecie rzeczywistym
Łaziki marsjańskie, takie jak Perseverance, wykorzystują wizualną odometrię do śledzenia poślizgu kół i poruszania się po terenie bez GPS
Zestawy słuchawkowe AR/VR śledzą pozycję głowy za pomocą wbudowanych kamer w celu śledzenia od wewnątrz do 6DoF
Drony utrzymujące stabilny lot i nawigację w pomieszczeniach lub w środowiskach pozbawionych sygnału GPS
Samobieżne samochody i roboty łączące ruch kamery z danymi IMU w celu lokalizacji pomiędzy aktualizacjami map
Zagrożenia i poręcze
Prawa do wizerunku i zgoda mogą stanowić ryzyko prawne, jeśli pochodzenie jest niejasne.
Wydajność modelu może się różnić w zależności od oświetlenia, demografii i środowiska.
Fałszywie pozytywne wyniki mogą pozostać niezauważone, chyba że monitorowane są progi ufności.
Plan wdrożenia
Zdefiniuj kryteria akceptacji dotyczące kosztów precyzji, wycofania i błędów.
Przetestuj na danych odpowiadających rzeczywistym warunkom produkcyjnym.
Dodaj weryfikację manualną, aby prognozy były mało pewne lub miały duży wpływ.
Śledź dryf modelu i przeprowadzaj ponowną weryfikację po zmianie kamery lub zbioru danych.
Odkrywaj dalej
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Visual Odometry quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Następny poradnik
Wizualne odpowiadanie na pytania
Często zadawane pytania
Co to jest odometria wizualna?
Odometria wizualna szacuje, w jaki sposób kamera porusza się po świecie, śledząc, jak obraz zmienia się klatka po klatce. Ma to znaczenie, ponieważ pozwala robotom, dronom i urządzeniom AR znać swoją pozycję bez GPS, wykorzystując wyłącznie wzrok.
Co przede wszystkim szacuje odometria wizualna?
Odometria wizualna śledzi, jak obraz zmienia się pomiędzy klatkami, aby oszacować względną pozycję aparatu i połączyć je w trajektorię.
Co to jest „dryft” w odometrii wizualnej?
Ponieważ VO szacuje ruch przyrostowo, drobne błędy w każdym kroku nasilają się w czasie, powodując, że szacowana ścieżka odbiega od prawdziwej ścieżki.
Dlaczego w jednoocznej odometrii wzrokowej występuje niejednoznaczność skali?
Z pojedynczego strumienia widoku podstawowa matryca zapewnia tłumaczenie tylko do nieznanej skali; Aby określić rzeczywistą skalę, potrzebne są stereofoniczne czujniki linii bazowej lub czujniki głębokości.
W jaki sposób odometria wizualno-inercyjna poprawia wytrzymałość?
Łączenie wizualnych szacunków ruchu z pomiarami bezwładnościowymi pomaga w przypadku szybkiego ruchu, rozmycia ruchu lub scen o niskiej teksturze, w których problemem jest samo widzenie.
Czym zwykła odometria wizualna różni się od w pełni wizualnej SLAM?
VO jest zazwyczaj front-endowym estymatorem ruchu; SLAM dodaje globalne mapowanie i zamykanie pętli, aby skorygować skumulowany dryf.