Articolo di ricerca

Tecnologia turistica in realtà aumentata basata su un algoritmo ORB migliorato e una matrice di omografia

DOI:

10.3791/69514

14 aprile 2026

In questo articolo

Sommario

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Questo studio presenta un metodo migliorato di abbinamento dei punti di caratteristiche e di registrazione 3D per il turismo di realtà aumentata, migliorando allineamento, stabilità e accuratezza dell'abbinamento. Combinando ORB migliorato, flusso ottico LK e matrice omografica migliorata, l'approccio raggiunge tassi di corrispondenza corretti e precisione di registrazione più elevati, migliorando la fusione virtuale-reale delle scene nelle applicazioni turistiche.

Abstract

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Questo studio propone un metodo migliorato di abbinamento dei punti caratteristici e registrazione 3D per applicazioni di turismo in realtà aumentata. Questo metodo affronta problemi come scarso allineamento, bassa stabilità in ambienti complessi e bassa accuratezza di adattamento delle caratteristiche. Viene introdotto un metodo migliorato di abbinamento dei punti di caratteristiche per le immagini turistiche, che combina l'algoritmo Speeded Up Robust Features (SURF) con un algoritmo FAST orientato e BRIEF rotazionato migliorato. In questo metodo, i punti caratteristiċi vengono inizialmente rilevati tramite l'algoritmo SURF, e la loro orientazione viene determinata tramite analisi della risposta a wavelet. Il metodo di flusso ottico Lucas-Kanade viene utilizzato per il tracciamento dei punti caratteristiche. L'algoritmo di consenso a campioni casuali viene quindi utilizzato per eliminare i punti tracciati erroneamente. Inoltre, è proposta una tecnica di registrazione 3D per il turismo in realtà aumentata basata su una matrice omografica migliorata per superare i limiti delle matrici omografiche tradizionali, come la bassa accuratezza dell'abbinamento e l'efficienza della registrazione. Le prestazioni del metodo proposto sono state analizzate attraverso esperimenti comparativi con gli algoritmi SIFT, SURF e ORB originali sotto varie trasformazioni dell'immagine, tra cui scala, sfocatura, illuminazione e rotazione. Il tasso di corrispondenza e il tempo di abbinamento corretti sono stati utilizzati come metriche di valutazione. Sono stati condotti test di simulazione per la registrazione 3D utilizzando diversi modelli 3D. L'accuratezza della registrazione e il conteggio delle registrazioni riuscite sono stati valutati con modifiche rotazionali. I risultati hanno indicato che il tasso medio di corrispondenza corretta dell'algoritmo proposto è aumentato rispettivamente del 44,08%, 36,51% e 16,09% sotto variazione di scala rispetto all'algoritmo di trasformazione delle caratteristiche invarianti in scala, all'algoritmo delle caratteristiche robuste accelerate e all'algoritmo non migliorato. Il tasso di corrispondenza corretta sotto la trasformazione fuzzy è aumentato rispettivamente del 33,46%, 19,65% e 9,35%. La precisione media della registrazione della tecnica proposta per la registrazione 3D era del 98,74% durante la trasformazione rotazionale. I risultati rivelano che l'approccio suggerito dallo studio può migliorare con successo l'effetto di fusione virtuale e reale della scena e offre un approccio innovativo all'uso della tecnologia di realtà aumentata nell'industria dei viaggi.

Introduzione

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

La tecnologia è emersa come uno strumento chiave per promuovere il progresso sinergico della cultura e del turismo nell'economia digitale in rapidaevoluzione. Negli ultimi anni, la tecnologia della realtà aumentata (AR) ha visto un'ondata di adozione in vari settori, tra cui turismo, istruzione, medicina e industria. La RA è un campo emergente all'interno del più ampio panoramatecnologico 2. Nel campo del turismo, questa tecnologia è in grado di sovrapporre informazioni virtuali a scene reali, offrendo un'esperienza immersiva e interattiva per i turisti. Questa tecnologia può non solo migliorare l'esperienza di viaggio dei turisti, ma anche innovare la scena del consumo turistico e promuovere la trasformazione digitale della cultura e del settoreturistico. Tuttavia, l'adozione diffusa della RA in ambienti turistici dinamici e non strutturati è ancora ostacolata da significative sfide tecniche. Le tecniche AR esistenti spesso mostrano scarsa robustezza nelle applicazioni pratiche. Sono caratterizzati da una bassa accuratezza nell'abbinamento delle caratteristiche, un allineamento inadeguato tra oggetti virtuali e reali e una stabilità limitata in condizioni ambientali complesse, come scale variabili, variazioni di illuminazione eocclusioni 4. Queste limitazioni possono portare a un'esperienza utente frustrante, con contenuti virtuali che tremano, si spostano o non si ancorano correttamente, minando così la sensazione di immersione e realismo. Pertanto, esplorare una tecnica AR robusta ed efficiente per il turismo che possa operare in modo affidabile in contesti reali è una priorità attuale della ricerca. Come algoritmo rapido di estrazione e descrizione dei punti di caratteristica (FPE), il FAST orientato e il BRIEF ruotato (ORB) sono ampiamente utilizzati nell'FPE per immagini grazie alla sua alta efficienza e invarianzarotazionale 5.

Zhang et al.6 hanno proposto un metodo FPE migliorato per le mappe dense ORB-SLAM2, con l'obiettivo di migliorare l'efficienza e ridurre i costi per l'acquisizione di mappe 3D di ambienti interni. Il metodo ha eseguito un'estrazione efficiente dei punti di caratteristica (FP) tramite la consistenza asintotica del campione per ridurre l'uso della memoria. Si scoprì che il metodo poteva essere utilizzato per il processo di navigazione con superiore precisione FPE e alta efficienza ditracciamento 6. Wu propose un algoritmo di abbinamento rapido delle caratteristiche che combina ORB e consenso casuale per campioni (RANSAC) per affrontare problemi di errore di allineamento rotazionale su larga scala, basso tasso di allineamento, casualità e instabilità. L'efficacia di questo approccio è stata dimostrata dai risultati, che hanno dimostrato che il metodo proposto mostrava un'elevata accuratezza nell'abbinamento FP e una stabilitàrobusta 7. Chen et al. hanno proposto un metodo di corrispondenza delle caratteristiche che combina l'ORB migliorato con l'algoritmo di flusso ottico (OF) Lucas-Kanade (LK) per affrontare il problema della bassa accuratezza del matching delle caratteristiche dell'immagine. Il metodo utilizzava il metodo di contrasto di Michelson per l'FPE, e la struttura quadtree veniva utilizzata per omogeneizzare i FP estratti al fine di ridurre la quantità computazionale di corrispondenza delle caratteristiche. I risultati hanno dimostrato che l'uniformità e la precisione FP del metodo sono migliorate rispettivamente dello 0,22% e del 50,47%. Zuo et al. hanno proposto un algoritmo sferico migliorato per il matching FP di immagini di campo ottico completamente focalizzato, con l'obiettivo di aumentare la precisione e la robustezza del metodo FPE e di matching dell'immagine. Il metodo è stato migliorato perfezionando l'algoritmo ORB convenzionale per aumentare il numero e la precisione delle FPE per immagini completamente focalizzate nel campoluminoso 9. Anggara et al. suggerirono un metodo di estrazione delle caratteristiche che fonde la mappa dei colori e del rivelatore ORB in AR. Il metodo estraeva innanzitutto le caratteristiche di speckle e bordo dell'immagine utilizzando un metodo di tracciamento delle caratteristiche naturali basato sulle caratteristiche, quindi converteva l'immagine a colori in un'immagine in scala di grigi usando un rivelatore ORB nel tentativo di migliorare l'efficienza di rilevamento delle caratteristiche. I risultati indicarono che l'approccio suggerito potrebbe migliorare con successo l'estrazione delle caratteristiche10.

Grazie alla sua capacità di combinare accuratamente dati virtuali e scene reali con tecnologie AR, la matrice di omografia (HM) ha suscitato molto interesse negli ultimianni 11,12. Kim et al. hanno proposto un sistema AR online in tempo reale basato su HM. Il metodo utilizzava una fotocamera 3D con localizzazione e costruzione di mappe simultanee per tracciare le informazioni della scena, e un HM veniva utilizzato per riempire i fotogrammi sorgente dell'immagine nel tentativo di migliorarne la qualità. I risultati hanno dimostrato che il metodo poteva ridurre efficacemente le incongruenze visive e gli artefatti e migliorare l'esperienza utentedell'AR 13. Clement propose un metodo di descrizione delle caratteristiche a tre livelli basato su filtraggio AR per il potenziamento della direzione. Il metodo impiegava un HM per descrivere il movimento del bersaglio tra diversi fotogrammi al fine di migliorare la robustezza del matching delle caratteristiche dell'immagine. I risultati hanno indicato che il metodo ha raggiunto punteggi di ripetibilità del 100%, 100% e 99% per il cambio di illuminazione, il cambio di sfocatura e il cambio di punto di vista,rispettivamente 14. Liu et al. hanno proposto un metodo di incontro locale del movimento per l'acquisizione di immagini da remoto basato su HM, con l'obiettivo di eliminare l'errata corrispondenza delle caratteristiche dell'immagine. Il metodo in esame rappresentava la coerenza del moto locale dell'immagine da parte di HM e introdusse un metodo di ricampionamento. I risultati hanno dimostrato che il metodo proposto mostrava una performance di matching superiore15.

Come rivisto sopra, la ricerca tecnica di un robusto abbinamento delle funzionalità e della registrazione è fondamentalmente guidata dalla richiesta che la sua applicazione crei esperienze utente coinvolgenti. Per collocare questo lavoro tecnico nel contesto più ampio della ricerca sul turismo AR, è essenziale confrontarsi con studi recenti che esaminano empiricamente gli effetti psicologici e comportamentali dell'AR sui turisti. Ad esempio, Zhu et al. hanno esplorato il meccanismo attraverso cui autenticità e trasporto narrativo nel turismo AR influenzano il passaparola tramite l'attaccamento AR, utilizzando modellizzazione strutturale delle equazioni. I risultati hanno rivelato che l'allegato AR media la relazione tra autenticità, trasporto narrativo e passaparola, offrendo un approccio fresco al marketing del turismostorico 15. Contemporaneamente, Ngan e Lei hanno analizzato l'impatto della RA sulle esperienze degli eventi sportivi e hanno rivisitato l'intenzione. Il loro studio ha indicato che gli utenti di AR hanno mostrato un coinvolgimento cognitivo significativamente più alto e che le dimensioni esperienziali hanno influenzato in modo significativo l'intenzione di rivisitare, confermando l'efficacia della AR nel migliorare l'attrattività e l'immersione deglieventi 16. Inoltre, Zhu et al. hanno indagato il meccanismo di impatto della presenza turistica nelle esperienze AR sul passaparola (WOM), utilizzando dati di indagine da una mostra AR presso il Palace Museum. I risultati hanno dimostrato che la presenza poteva influenzare positivamente la WOM, e l'autenticità ha avuto un ruolo mediatore significativo inquesto 17.

In conclusione, numerosi studiosi hanno condotto un significativo corpus di ricerche sulle tecniche AR basate sull'algoritmo ORB con HM, ottenendo risultati superiori. Tuttavia, l'algoritmo ORB soffre ancora di scarsa robustezza e inefficienza dell'FPE sotto variazione di scala, modifica di illuminazione e occlusione18. Inoltre, la HM tradizionale è spesso un collo di bottiglia caratterizzato da bassa precisione di matching e efficienza di registrazione. Ciò porta a disallineamenti e instabilità degli oggetti virtuali in ambienti turistici dinamici. La discrepanza tra le prestazioni dei metodi attuali e i requisiti per esperienze AR stabili e immersive nel turismo rimane una sfida critica e non affrontata. Per affrontare queste sfide persistenti e consentire un'esperienza AR più stabile e immersiva nel turismo, questo studio è motivato ad aumentare l'efficacia della registrazione FPE e 3D. Questo lavoro ha tre contributi teorici. Innanzitutto, presenta un nuovo framework di abbinamento delle caratteristiche che combina la proprietà di invariabilità scala del rivelatore SURF con la migliorata efficienza computazionale del descrittore ORB. Questa integrazione è migliorata determinando l'orientamento delle caratteristiche tramite la risposta a wavelet e affinando il set di punti utilizzando i criteri di Harris corner. Questo fornisce un modello teorico più robusto per la corrispondenza delle caratteristiche sotto trasformazioni, rendendolo più che semplice sequenciale. In secondo luogo, introduce un miglioramento teorico al processo di stima dell'omografia impiegando un metodo di retrocalcolo virtuale per oggetti reali. Questo approccio mira a superare i limiti delle matrici omografiche tradizionali offrendo un modello di proiezione più stabile e preciso per la registrazione 3D. Infine, combinando sistematicamente questi componenti migliorati, lo studio offre un approccio teorico consolidato per ottenere una fusione virtuale-reale superiore, specificamente adattata alle complessità degli scenari del turismo all'aperto.

Questa tecnica migliorata è altamente rilevante per i principali stakeholder del turismo. Permette ai marketing di destinazione e ai tour operator di sviluppare applicazioni AR stabili e immersive che rappresentano proposte di valore uniche. Per i gestori di siti del patrimonio culturale, offre uno strumento affidabile per creare sovrapposizioni educative senza danneggiare reperti fisici. In definitiva, per i turisti, il metodo migliora direttamente l'esperienza offrendo una fusione fluida e stabile delle informazioni virtuali con l'ambiente reale. Questo elimina la frustrazione causata da contenuti virtuali disallineati o tremolanti. Di conseguenza, l'immersione è significativamente più profonda, la comprensione contestuale si arricchisce e la soddisfazione generale verso il servizio turistico aumenta. L'innovazione di questa ricerca è la seguente: (1) L'immagine viene smussata tramite filtraggio gaussiano e la risposta a wavelet viene utilizzata per determinare la direzione delle FP. Inoltre, per aumentare la precisione e la stabilità del rilevamento FP, i migliori FP sono filtrati integrandosi con la tecnica di rilevamento dei punti d'angolo di Harris. (2) L'algoritmo RANSAC viene introdotto per eliminare i FP tracciati male e migliorare ulteriormente la robustezza del feature matching. (3) L'HM è migliorato dal metodo di calcolo inverso virtuale-reale degli oggetti, che mira ad affrontare i limiti dell'HM tradizionale, come la bassa precisione di corrispondenza FP e l'efficienza della registrazione.

Accesso limitato. Accedi o avvia una prova gratuita per visualizzare questo contenuto.

Protocollo

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Questa sezione propone innanzitutto un metodo di corrispondenza FP per immagini turistiche combinando SURF e un algoritmo ORB migliorato per migliorare la robustezza dell'adattamento FP. Successivamente, lo studio propone una tecnica di registrazione 3D per il turismo AR basata su una HM migliorata per potenziare l'effetto di fusione tra informazioni virtuali e mondo reale. Gli esperimenti sono stati condotti utilizzando dataset di immagini disponibili pubblicamente. In particolare, è stato utilizzato il dataset Oxford Visual Geometry Group (VGG), che include sequenze di immagini con variazioni di scala, sfocatura, illuminazione e punto di vista, ed è ampiamente adottato per valutare algoritmi di corrispondenza e registrazione delle caratteristiche nella visione artificiale. Non era richiesta l'approvazione di un comitato etico per l'uso di questo dataset pubblicamente disponibile.

Combinare SURF e un algoritmo ORB migliorato per l'abbinamento FP nelle immagini turistiche

Con lo sviluppo in forte espansione dell'industria turistica, la domanda di tecnologia AR nei servizi turistici automatizzati è in aumento. L'algoritmo ORB è un efficiente algoritmo di rilevamento e descrizione FP. La tecnologia AR è stata ampiamente utilizzata19. Tuttavia, nel processo di abbinamento FP delle immagini turistiche, l'algoritmo ORB esistente soffre di difetti come scarsa robustezza ai cambiamenti di scala, bassa accuratezza nel matching delle caratteristiche e il dispendioin termini di tempo 20. Per aumentare l'accuratezza e la robustezza del matching, questo studio propone un metodo robusto di feature matching che integra SURF con un algoritmo ORB migliorato. Per ottenere l'invarianza di scala, l'immagine di ingresso subisce filtraggio gaussiano e costruzione a piramide. L'algoritmo SURF rileva FP invarianti in scala, con orientamenti determinati tramite risposte a wavelet. La qualità delle caratteristiche è migliorata perfezionando i punti iniziali usando il criterio dell'angolo di Harris e mantenendo quelli più distintivi. Il metodo di flusso ottico Lucas-Kanade traccia le caratteristiche attraverso i fotogrammi, mentre l'algoritmo RANSAC elimina i punti non corrispondenti. La lacuna metodologica qui affrontata non riguarda semplicemente l'applicazione sequenziale di SURF e ORB, ma una nuova strategia di ibridazione progettata per superare le limitazioni specifiche degli ibridi standard in ambienti turistici complessi. A differenza degli approcci SURF-ORB convenzionali, che utilizzano SURF per il rilevamento e poi applicano direttamente un descrittore ORB, il metodo attuale introduce due miglioramenti fondamentali. Per prima cosa, l'orientamento di ogni FP localizzato da SURF viene ricalcolato utilizzando la sua risposta a wavelet. Questo fornisce una stima direzionale più robusta rispetto a SURF da solo, utilizzando il metodo standard basato su wavelet di Haar. In secondo luogo, e più importante, i punti SURF iniziali non vengono usati direttamente. Al contrario, vengono rigorosamente raffinati utilizzando il criterio degli angoli di Harris per filtrare punti non distintivi con risposte basse situate in regioni piatte o lungo i bordi.

Preprocessing dell'immagine

Nella fase di pre-elaborazione delle immagini turistiche, lo studio estrae le caratteristiche dalle immagini in scala di grigi. Per caratterizzare ulteriormente le caratteristiche locali dell'immagine, lo studio utilizza la componente gradiente per identificare e classificare l'immagine21. L'equazione (1) ne ha dimostrato la espressione.

figure-protocol-1(1)

Nell'Equazione (1) I(x,y) indica il valore in pixel dell'immagine alla coordinata (x,y). figure-protocol-2 indica il vettore gradiente dell'immagine in (x,y). figure-protocol-3 e figure-protocol-4 mostrare le derivate parziali dell'immagine rispettivamente nelle direzioni x e y. T indica la trasposta del vettore gradiente.

Rilevamento dei punti di caratteristica

Dopo aver riconosciuto l'immagine tramite componenti di gradiente, lo studio utilizza le caratteristiche del test dei segmenti accelerati (FAST) nell'algoritmo ORB per rilevare i FP dell'immagine. Inoltre, i FP sono fortemente abbinati utilizzando l'algoritmo di descrizione binario robusto e indipendente delle caratteristiche elementari indipendenti (BRIEF) 22. Lo schema del rilevamento delle caratteristiche e dell'abbinamento di questo algoritmo è mostrato nella Figura 1.

figure-protocol-5
Figura 1: Diagramma schematico del matching delle caratteristiche tra l'algoritmo FAST di rilevamento delle caratteristiche e l'algoritmo di descrizione BRIEF. Clicca qui per visualizzare una versione più grande di questa figura.

La Figura 1 illustra il processo di rilevamento delle caratteristiche degli algoritmi FAST e BRIEF. La Figura 1A è un diagramma schematico del rilevamento delle caratteristiche utilizzando l'algoritmo FAST. Un modello circolare da 16 pixel viene utilizzato per confrontare la luminosità attorno al pixel centrale e permettere una rapida rilevazione delle caratteristiche degli angoli nell'immagine. La Figura 1B è uno schema dell'abbinamento delle caratteristiche nell'algoritmo BRIEF. Selezionando diverse coppie di pixel attorno ai punti caratteristiche per il confronto in scala di grigi, vengono generati descrittori binari e si utilizza l'abbinamento con forza bruta per ottenere la corrispondenza dei punti caratteristica tra due immagini. Il miglioramento prevede l'utilizzo iniziale del metodo di filtraggio gaussiano, che serve a smussare l'immagine e mitigare il rumore ad alta frequenza. Successivamente, viene impiegato il metodo di down-sampling per ridurre la risoluzione spaziale dell'immagine, diminuendo così la complessità computazionale preservando le caratteristiche primarie dell'immagine. Lo studio utilizza un metodo di costruzione a piramide d'immagini, sfruttando le due tecniche sopra menzionate per garantire che le FP dell'immagine presentino proprietà di invarianza discala 23. L'espressione per levigare l'immagine tramite un filtro passa-basso è mostrata nell'Equazione (2).

figure-protocol-6 (2)

Nell'Equazione (2), ge(x,y) indica la funzione filtro gaussiana. e è la deviazione standard (SD) della funzione gaussiana. exp indica la funzione esponenziale. La piramide delle immagini costruita tramite filtraggio gaussiano è mostrata schematicamente nella Figura 2.

figure-protocol-7
Figura 2: Diagramma schematico della piramide immagine costruito tramite filtraggio gaussiano. Clicca qui per visualizzare una versione più grande di questa figura.

La Figura 2 mostra la struttura a piramide dell'immagine, dove più immagini di risoluzione inferiore vengono gradualmente generate tramite filtraggio gaussiano e downsampling. Tra questi, il filtro gaussiano riduce il rumore ad alta frequenza nell'immagine sfocandolo tramite un'operazione di convoluzione. Come checkpoint visivo durante questa fase di preelaborazione, può essere visualizzata la piramide dell'immagine generata. Va notato che ogni livello della piramide presenta una risoluzione progressivamente inferiore rispetto all'immagine originale. Si nota un aumento evidente della sfocatura e una riduzione dei dettagli fini grazie al filtraggio gaussiano applicato e al downsampling. Per migliorare l'efficacia nell'identificare le FP in un'immagine, lo studio utilizza un algoritmo SURF per localizzare queste FP nell'immagine. Questo metodo prevede la quantificazione della regione circostante della FP e l'utilizzo della risposta wavelet per determinare la direzione della FP. A causa dell'esistenza di FP duplicati e invalidi estratti da SURF, il loro numero eccessivo ridurrà la velocità di riconoscimento delle caratteristiche dell'immagine target (TI). Pertanto, lo studio utilizza l'algoritmo di rilevamento puntuale dell'angolo Harris per identificare i FPottimali dell'immagine 24. L'equazione (3) mostra il valore della risposta angolare dell'algoritmo.

figure-protocol-8 (3)

Nell'Equazione (3), H indica la matrice di Harris. u(x,y) indica la funzione di peso della finestra. Ix eI y indicano la dimensione del valore grigio (GV) del punto pixel. A indica il valore di risposta dell'angolo di Harris. det H e traceH indicano rispettivamente il determinante e la traccia della matrice di Harris. k indica il valore del coefficiente. Lo schema della direzione delle FP selezionate dall'algoritmo SURF e la finestra scorrevole dell'algoritmo di rilevamento dell'angolo di Harris sono mostrati nella Figura 3.

figure-protocol-9
Figura 3: Diagramma schematico dell'algoritmo SURF, selezione FP e finestra scorrevole per l'algoritmo di rilevamento degli angoli di Harris. Clicca qui per visualizzare una versione più grande di questa figura.

La Figura 3 mostra la composizione dell'algoritmo SURF per rilevare i FP in un'immagine. La Figura 3A mostra il diagramma schematico della selezione della direzione dei punti di caratteristiche nell'algoritmo SURF. Calcolando la direzione principale della risposta delle wavelet di Haar nel quartiere dei punti caratteristici, si determina la direzione invariante della rotazione del punto caratteristico, solitamente rappresentata intuitivamente da frecce o segmenti di linea direzionali. La Figura 3B è uno schema della finestra scorrevole dell'algoritmo di rilevamento degli angoli di Harris, che mostra il processo di movimento della finestra all'interno dell'area dell'immagine. I punti d'angolo vengono rilevati calcolando i cambiamenti in scala di grigi dei pixel all'interno della finestra, e le aree con valori di risposta elevati sono identificate come punti d'angolo.

Abbinamento delle caratteristiche

Dopo aver rilevato gli FP delle immagini, lo studio utilizza il metodo LK OF per tracciare gli FP dell'immagine rilevati. Questo metodo calcola il movimento tra fotogrammi immagine vicini tracciando il movimento degli FP nell'immagine per ottenere l'adattamento FP nella sequenza video. Il metodo LK OF deve soddisfare le assunzioni di pixel GV costante, piccolo movimento e coerenza del movimento regionale quando calcola il movimento tra fotogrammi immagineadiacenti 25. Il metodo Lucas-Kanade è adottato strategicamente considerando la sua efficienza computazionale, cruciale per le applicazioni di turismo AR in tempo reale. Le sue ipotesi sono mitigate nel contesto specifico. L'elevata frequenza di fotogrammi della cattura video generalmente garantisce piccoli spostamenti tra fotogrammi, soddisfacendo il requisito di piccoli movimenti. Sebbene la costanza assoluta della luminosità sia ideale, la breve finestra di tracciamento tra fotogrammi consecutivi minimizza le violazioni gravi. Soprattutto, il successivo algoritmo RANSAC gestisce in modo robusto i potenziali errori di tracciamento derivanti da violazioni delle assunzioni filtrando gli outlier. Pertanto, LK funge da tracciatore iniziale efficiente il cui output è rigorosamente validato, rendendolo adatto a un sistema in tempo reale, in cui il bilanciamento della velocità e della robustezza è essenziale. Secondo l'assunzione di pixel costante GV, l'espressione è mostrata nell'Equazione (4).

figure-protocol-10 (4)

Nell'Equazione (4), I(x,y,t) indica il pixel GV dell'immagine nella posizione (x,y) nel momento t . Ix e Ix indicano lo spostamento del pixel nelle direzioni x e y, rispettivamente. i e j indicano le componenti OF del punto pixel. Ix,I y eI t indicano la differenza dell'immagine nelle direzioni x, y e t, rispettivamente. L'assunzione di coerenza del moto regionale viene calcolata nell'Equazione (5).

figure-protocol-11 (5)

Nell'equazione (5), Itb indica la derivata parziale del punto b-esimo pixel nel dominio nella direzione temporale t . v x v indica la dimensione dell'area di dominio selezionata. b indica tutti i punti pixel all'interno del dominio. In conclusione, il presente studio utilizza il descrittore BRIEF per corrispondere ai FP tracciati e l'algoritmo RANSAC per rifiutare i FP tracciati erroneamente dall'ORB. Questa combinazione di metodi contribuisce a migliorare la robustezza del featurematching 26. La Figura 4 mostra il diagramma schematico del metodo LK OF.

figure-protocol-12
Figura 4: Diagramma schematico del metodo LK OF. Clicca qui per visualizzare una versione più grande di questa figura.

La Figura 4 mostra il processo di implementazione del LK streaming optical hair, che utilizza un metodo di ottimizzazione iterativa per lo spostamento FP tra fotogrammi adiacenti. Per la validazione qualitativa dell'algoritmo di corrispondenza delle caratteristiche, i FP abbinati tra il template e le immagini di test possono essere sovrapposti visivamente. Le coppie di punti correttamente abbinate sono tipicamente collegate da linee verdi o contrassegnate con indicatori verdi. Al contrario, l'algoritmo RANSAC può visualizzare outlier con marcatori rossi. Questo fornisce una valutazione visiva immediata della robustezza e accuratezza dell'abbinamento prima dell'analisi quantitativa. Lo studio utilizza l'algoritmo RANSAC per calcolare l'HM dei corrispondenti FP nell'immagine, eliminando così quelli che non sono correttamente abbinati. I FP che sono accuratamente abbinati vengono poi mantenuti. In questo caso, l'HM e l'espressione del parametro di scala dell'algoritmo RANSAC sono mostrate nell'Equazione (6).

figure-protocol-13 (6)

Nell'equazione (6), M indica HM. m indica l'elemento nella matrice M. S indica il parametro della scala. (x,y) e (x',y') indicano rispettivamente le posizioni FP dell'immagine modello e dell'immagine di test. Dopo aver acquisito le coordinate delle FP dell'immagine di test, lo studio effettua un'analisi comparativa delle distanze tra esse e le FP abbinate. L'equazione (7) illustra che aggiorna anche il numero di iterazioni e determina il numero di punti interni.

E = log(1 - c)/log(1 - ηn) (7)

Nell'Equazione (7), E sono le iterazioni. C indica il livello di fiducia. η indica la proporzione di punti interni. n è la quantità di campioni. Allora l'espressione per la SD dell'iterazione E è mostrata nell'Equazione (8).

figure-protocol-14 (8)

Nell'Equazione (8), Sd(E) indica il Punto di Marcia (SD). Il miglioramento dell'algoritmo ORB descritto sopra si dimostra fornire una base di corrispondenza di caratteristiche di alta qualità per la successiva tecnologia di registrazione 3D. Questo miglioramento mostra maggiore accuratezza e robustezza nelle scene complesse. Alcune di queste scene includono il cambio di scala, il cambio di luce e l'occlusione.

Il pseudocodice per un ORB migliorato con SURF e un'omografia potenziata per il turismo AR è il seguente.

Algoritmo 1: ORB migliorato con SURF e Omografia Migliorata per il Turismo AR
Input: Sequenza di immagini turistiche I, modello virtuale 3D M
Output: Scena AR renderizzata con oggetto virtuale registrato
Passo 1: Preprocessing dell'immagine
1: I_gray ← ConvertToGrayscale(I)
2: I_smooth ← GaussianBlur(I_gray, kernel=5×5, σ=1.2)
3: Piramide ← BuildImagePyramid(I_smooth, livelli=4, scala=1.2)

Passo 2: Rilevamento dei Punti di Funzionalità
4: keypoints_SURF ← SURF_Detect(Piramide, Soglia Assiana=1000)
5: per ogni KP in keypoints_SURF fare
6: orientamento ← ComputeWaveletResponse(kp)
7: fine per
8: keypoints_Harris ← HarrisCornerFilter(keypoints_SURF, k=0,04)
9: descrittori ← ImprovedORB_Describe(keypoints_Harris)

Passo 3: Abbinamento delle caratteristiche
10: keypoints_tracked ← LucasKanadeOpticalFlow(keypoints_Harris, window=15×15)
11: corrisponde ← BruteForceMatcher(descrittori)
12: inliers, H ← RANSAC(matches, maxIterations=2000, reprojThreshold=3.0)

Passo 4: Registrazione 3D con Omografia Migliorata
13: H_improved ← ComputeImprovedHomography (inliers, camera_intrinsics)
14: R, t ← DecomposeHomography(H_improved)
15: pose ← ComposeCameraPose(R, t)// Passo 5: Rendering AR
16: virtual_object ← Load3DModel(M)
17: scene_rendered ← OpenGL_Render(virtual_object, posa, sfondo=I)
18: ritorno scene_rendered

Tecnica di registrazione 3D del turismo AR basata su un miglioramento della HM

Dopo aver abbinato accuratamente le caratteristiche delle immagini turistiche tramite il metodo FP matching, è necessario applicarla ulteriormente alla tecnologia AR. La tecnologia di registrazione 3D è una tecnologia fondamentale per la realizzazione di sistemi AR. Calcola le informazioni sulla posa della telecamera nel mondo reale attraverso la proiezione di un'immagine turistica target. Questo consente un corrispondenza accurata e una fusione tra oggetti virtuali e scenereali 27. La HM può mappare l'oggetto virtuale al mondo reale dalla prospettiva dell'utente, potenziando così l'effetto di fusione tra informazioni virtuali e mondo reale. Inoltre, può risolvere il problema di registrare la realtà virtuale quando il logo è parzialmente nascosto. Tuttavia, l'efficienza di registrazione della HM nella tecnologia effettiva di registrazione 3D è bassa e porta a un disallineamento degli oggetti virtuali, che porta all'instabilità degli oggettivirtuali 28. Pertanto, questo studio propone una tecnica di registrazione 3D basata su una HM migliorata. Utilizzando coppie FP accurate della Fase 1, la HM potenziata viene calcolata tramite un metodo di calcolo inverso virtuale-reale che incorpora l'intrinseca della camera. Questo metodo affronta efficacemente la bassa efficienza di registrazione e il disallineamento degli oggetti virtuali rispetto ai metodi tradizionali nelle scene dinamiche. La matrice viene scomposta in una matrice di rotazione e un vettore di traslazione per definire la posa della fotocamera. Il motore di rendering OpenGL proietta con precisione modelli virtuali 3D nel flusso video live basandosi sui parametri della posa. La mappatura delle texture e i modelli di illuminazione garantiscono una fusione fisicamente coerente.

Registrazione e visualizzazione 3D

Per realizzare la tecnica di registrazione 3D, lo studio deve prima costruire un modello di imaging stenopeico per mappare il mondo reale 3D su un'immagine 2D. L'espressione di questo modello è mostrata nell'Equazione (9).

figure-protocol-15 (9)

Nell'Equazione (9), X, Y e O indicano i tre assi della camera CS. (x,y,f) indica il vettore di coordinate. f indica la lunghezza focale (FL). λ indica il fattore di scala. Come dimostrato nella Figura 5, lo studio attuale esamina le proprietà di imaging della fotocamera stenopeica utilizzando la relazione di trasformazione tra il CS immagine e il CS della fotocamera.

figure-protocol-16
Figura 5: Modello di imaging a foro stenopeico e la relazione tra punti spaziali e punti di proiezione planari. Clicca qui per visualizzare una versione più grande di questa figura.

La Figura 5 mostra la struttura di base dell'imaging a foro stenopeico. La Figura 5A è un diagramma schematico del modello di imaging a foro stenopeico, che descrive la struttura geometrica di base per proiettare una scena tridimensionale su un piano di imaging bidimensionale attraverso un piccolo foro al centro della fotocamera, riflettendo i principi di propagazione dei raggi e proiezione prospettica. La Figura 5B illustra ulteriormente il processo di proiezione dei punti spaziali sui corrispondenti punti del piano di imaging attraverso il centro della camera, chiarendo la relazione proporzionale tra lunghezza focale, coordinate dei punti immagine e coordinate dei punti oggetto. Dopo aver costruito il modello di imaging a foro stenopeico, lo studio impiega ulteriormente la HM per costruire la mappatura delle relazioni tra il template e le immagini reali della scena catturate con la telecamera. Si assume che i punti di corrispondenza delle caratteristiche di due immagini I1 eI 2 siano nello stesso piano. Il piano deve soddisfare l'espressione mostrata nell'Equazione (10).

NZ P + d = 0 (10)

Nell'equazione (10), P indica il piano. N indica il vettore normale del piano P. d indica la distanza dal piano P all'origine. Z indica il vettore di traslazione. Per rotazioni e traslazioni, lo studio utilizza il metodo della decomposizione a valori singolari per la loro estrazione. L'espressione è mostrata nell'Equazione (11)29.

figure-protocol-17 (11)

Nell'Equazione (11), p1 e p2 indicano le coordinate dei pixel delle coppie di punti che corrispondono alle caratteristiche di ombre nelle immagini I1 e I2, rispettivamente. r1 e r2 indicano i fattori di scala dei punti pixel nelle immagini I1 e I2, rispettivamente. K indica la matrice di riferimento interna della fotocamera. R indica la matrice di rotazione. La HM ha un'elevata complessità computazionale ed è soggetta al problema dell'errore di corrispondenza FP. Pertanto, lo studio lo migliora utilizzando il metodo di calcolo inverso di oggetti virtualie reali 30. L'espressione migliorata dell'HM è mostrata nell'Equazione (12).

figure-protocol-18 (12)

Nell'Equazione (12), M' indica la HM migliorata. fx ef y indicano le FL della camera lungo gli assi X e Y, rispettivamente. U e v indicano le coordinate principali dei punti. γ indica il parametro sfascamento. La trasformazione fisica del metodo è mostrata nell'Equazione (13).

figure-protocol-19 (13)

Nell'Equazione (13), T' indica la matrice di trasformazione fisica. tx,t, y e to indicano le componenti di rotazione dei tre assi di coordinate. [R|Z] indica la matrice di trasformazione del mondo e della telecamera CS. Nell'implementazione della tecnologia AR, l'espressione della mappatura tra il template e l'immagine della scena reale in viaggio è mostrata nell'Equazione (14).

figure-protocol-20 (14)

Nell'Equazione (14), Is eI d indicano rispettivamente i punti sul riferimento e su Tis. Lo studio calcola inoltre l'accuratezza dell'allineamento dell'HM migliorato per indagare l'efficacia dell'allineamento del metodo, come espresso nell'Equazione (15).

figure-protocol-21 (15)

Nell'Equazione (15), Pre(M') indica la precisione dell'allineamento dell'HM migliorato. (xa,y a,o a) indica i FP effettivi. (x b,y b,o b) indica i FP allineati. n indica il numero di gruppi di punti abbinati. La Figura 6 mostra la mappatura tra il diagramma schematico e le foto dell'HM aggiornata.

figure-protocol-22
Figura 6: Mappatura della relazione tra immagini e il diagramma schematico dell'HM migliorata. Clicca qui per visualizzare una versione più grande di questa figura.

Come illustrato nella Figura 6, esiste una chiara corrispondenza tra l'immagine modello e il TI. Dopo l'applicazione dell'HM migliorato, un checkpoint visivo chiave consiste nel deformare e allineare l'immagine modello sull'immagine della scena di destinazione. I bordi del template proiettato dovrebbero allinearsi strettamente con le corrispondenti caratteristiche nel TI. Durante il rendering AR finale, ispeziona visivamente il modello virtuale 3D per assicurarti che sia ancorato in modo persistente e accurato alla posizione e all'orientamento corretti nella scena reale. Non dovrebbe esserci alcun tremolio o disallineamento evidente mentre la prospettiva della telecamera cambia.

Lo studio dimostra la mappatura dell'immagine modello tramite una matrice di influenza potenziata ma senza effetto. Per ottenere un'interazione in tempo reale tra oggetti virtuali e paesaggi turistici reali, lo studio utilizza la tecnologia OpenGL per renderizzare modelli 3D per la costruzione del sistema turistico AR. La tecnica imposta innanzitutto il contesto OpenGL, carica il modello 3D degli elementi turistici virtuali e calcola con texture mapping e illuminazione. Successivamente, il flusso video in tempo reale catturato dalla telecamera viene utilizzato come sfondo per fornire un riferimento per il rendering degli oggetti virtuali. Gli oggetti virtuali vengono sovrapposti con precisione al mondo reale tramite una HM, che li rende nella posizione e orientamento corretti per fonderli con la scena reale. Nel sistema di turismo AR, in cui il video viene catturato tramite la libreria OpenCV per il video in tempo reale deltour 31. L'elaborazione delle immagini utilizza un algoritmo ORB ottimizzato per identificare e abbinare le caratteristiche nei fotogrammi video. Nel modulo di registrazione 3D, lo studio utilizza una HM migliorata per fondere virtuale e realtà. L'output finale e l'interazione sono visualizzati tramite la tecnologia OpenGL. Il processo di implementazione della tecnologia dei tour AR è illustrato nella Figura 7, che mostra il processo complessivo di implementazione della tecnologia dei tour AR. La Figura 7 presenta il diagramma di flusso di implementazione del sistema della tecnologia turistica AR. Dopo l'avvio del sistema, il flusso video in tempo reale viene prima catturato tramite la telecamera, da cui viene estratta l'immagine bersaglio. Il processo entra quindi nella fase di elaborazione delle caratteristiche, eseguendo sequenzialmente l'estrazione e la descrizione dei punti di caratteristica per costruire le caratteristiche dell'immagine. Se l'abbinamento dei punti di caratteristica ha successo, il sistema procede alla fase di registrazione del tracciamento 3D, dove vengono calcolati i parametri della posa della telecamera. Questo viene combinato con modelli 3D dalla libreria di materiali virtuali per ottenere una fusione virtuale-reale, e l'effetto AR fuso finale viene mostrato all'utente in tempo reale. Se l'abbinamento fallisce, l'algoritmo RANSAC viene utilizzato per eliminare i punti discorrispondenti e la fase di elaborazione delle funzionalità viene riinserita per garantire stabilità e robustezza del sistema. L'intero processo costituisce un completo ciclo chiuso, dall'acquisizione delle immagini e l'elaborazione delle funzionalità fino alla registrazione 3D, fusione virtuale-reale e visualizzazione interattiva, illustrando il percorso tecnico per i sistemi turistici AR per raggiungere una fusione virtuale-reale stabile e in tempo reale in scene dinamiche.

figure-protocol-23
Figura 7: Diagramma schematico del processo di implementazione della tecnologia turistica AR. Clicca qui per visualizzare una versione più grande di questa figura.

Allestimento sperimentale e materiali

Per garantire la riproducibilità degli esperimenti, le specifiche hardware, l'ambiente software e i dataset utilizzati in questo studio sono esplicitamente elencati nella Tabella 1.

CategoriaVoceSpecifiche / Versione
HardwareFotocameraLogitech C920 HD Pro Webcam
Processore per computerProcessore AMD Ryzen 7 3700X 8-core
Memoria del computer32 GB di RAM
Sistema operativoWindows 10 (64 bit)
Software e librerieLinguaggio di programmazioneC++
Ambiente di sviluppoMicrosoft Visual Studio 2019
Biblioteca di Visione ArtificialeOpenCV 4.5.1
API graficaOpenGL 4.6
Piattaforma di simulazioneStrumenti di simulazione Visual Studio
DatasetDataset primarioOxford Dataset

Tabella 1: Configurazione sperimentale: specifiche hardware, software e dataset.

In OpenCV, la sfocatura gaussiana viene applicata utilizzando la funzione GaussianBlur(). La piramide immagine è costruita usando buildPyramid(). Il rilevatore SURF viene inizializzato con SURF.create(), impostando la soglia dell'Assia a 400. La risposta di Harris in angolo viene calcolata usando cornerHarris(), e successivamente viene applicata la soppressione non massima per filtrare i punti chiave. Il flusso ottico LK viene calcolato utilizzando la funzione calcOpticalFlowPyrLK(), che implementa il metodo piramidale di Lucas-Kanade. La funzione findHomography() viene utilizzata per la stima dell'omografia, con il metodo flag impostato su RANSAC per sfruttare la soglia di riproiezione specificata. L'HM risultante viene poi utilizzato con perspectiveTransform() per validare i punti inlier. Nella pipeline di rendering OpenGL, la HM viene convertita in una posa della camera e impostata usando glLoadMatrix(). I modelli virtuali 3D vengono caricati come file .obj e renderizzati utilizzando comandi standard di trasformazione OpenGL (glTranslate, glRotate). Il feed video in tempo reale da OpenCV viene passato ad OpenGL come texture usando glTexImage2D() per ottenere l'overlay AR finale. I parametri chiave per gli algoritmi utilizzati in questo studio sono esplicitamente definiti nella Tabella 2.

Algoritmo / ComponenteParametroValore
Filtro GaussianoDimensione del nucleo5 × 5 pixel
Deviazione standard1.2
Flusso ottico LKDimensione della finestra15 × 15 pixel
RANSACIterazioni massime2000
Soglia di riproiezione3,0 pixel
Rivelatore di caratteristiche ORBNumero massimo di caratteristiche1000
Fattore di scala (Piramide)1.2
Numero di livelli piramidali4
Rilevatore di caratteristiche SURFSoglia assiana1000
Rilevatore di angoli HarrisDimensione del diaframma3
K-valore0.04

Tabella 2: Parametri chiave dell'algoritmo per la riproducibilità.

Accesso limitato. Accedi o avvia una prova gratuita per visualizzare questo contenuto.

Risultati

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Prestazioni dell'algoritmo combinato SURF e ORB migliorato per l'abbinamento FP delle immagini turistiche

Per stabilire basi robuste sulle prestazioni e confronti di controllo, l'algoritmo proposto viene valutato rispetto a tre algoritmi di feature matching ampiamente utilizzati: la scale-invariant feature transform (SIFT), speeded-up robust features (SURF) e l'algoritmo ORB originale, non migliorato. Questi algoritmi fungono da gruppi di cont...

Accesso limitato. Accedi o avvia una prova gratuita per visualizzare questo contenuto.

Discussione

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Lo studio ha proposto un metodo di abbinamento FP per immagini turistiche che combinano SURF e un algoritmo ORB migliorato, con l'obiettivo di migliorare l'accuratezza dell'abbinamento delle caratteristiche. Per realizzare ulteriormente l'accurata corrispondenza e la fusione tra gli oggetti proposti e la scena reale, lo studio ha proposto una tecnica di registrazione 3D per il turismo AR basata su un miglioramento della HM. Per quanto riguarda la registrazione 3D, i risultati hanno illus...

Accesso limitato. Accedi o avvia una prova gratuita per visualizzare questo contenuto.

Dichiarazioni

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,

Gli autori dichiarano di non avere interessi concorrenti da divulgare.

Materiali

Elenco dei materiali utilizzati in questo articolo
NomeAziendaNumero di catalogoCommenti
Processore AMD Ryzen 7 3700X 8-coreAMDRyzen 7 3700X
FotocameraLogitechC920 HD Pro Webcam
Memoria del computer/32 GB di RAM
Logitech C920 HD Pro WebcamLogitechC920
Microsoft Visual Studio 2019Microsoft2019
OpenCVFondazione OpenCV4.5.1
OpenGLGruppo Khronos4.6
Oxford DatasetUniversità di Oxford/
Linguaggio di programmazione/C++
Strumenti di simulazione Visual StudioMicrosoftInclusi in VS 2019
Windows 10 (64 bit)Microsoft10 (64 bit)

Riferimenti

Loading...
$$\rightleftharpoonup{xx}$$ $$\longleftharp{xx}$$, $$\longrightharp{xx}$$,
  1. Tang, R. Digital economy drives tourism development—Empirical evidence based on the UK. Econ Res. 36 (1), 2003-2020 (2023).
  2. Nur Amin, S., et al. An augmented reality-based approach for designing interactive food menu of restaurant using android. Artif Intell Appl. 1 (1), 26-34 (2022).
  3. Ahmad, H., Butt, A., Muzaffar, A. Travel before you actually travel with augmented reality–role of augmented reality in future destination. Curr Issues Tour. 26 (17), 2845-2862 (2023).
  4. Long, X. M., Chen, Y. J., Zhou, J. Development of AR experiment on electric-thermal effect by open framework with simulation-based asset and user-defined input. Artif Intell Appl. 1 (1), 52-57 (2022).
  5. Xie, Y., Wang, Q., Chang, Y., Zhang, X. Fast target recognition based on improved ORB feature. Appl Sci. 12 (2), 786-799 (2022).
  6. Zhang, L., Zhang, Y. Improved feature point extraction method of ORB-SLAM2 dense map. Assembly Automat. 42 (4), 552-566 (2022).
  7. Wu, K. Creating panoramic images using ORB feature detection and RANSAC-based image alignment. Adv Comput Commun. 4 (4), 220-224 (2023).
  8. Chen, Q., et al. Horticultural image feature matching algorithm based on improved ORB and LK optical flow. Remote Sens. 14 (18), 4465-4482 (2022).
  9. Zuo, Y., Guan, H., Duan, F., Wu, T. A light field full-focus image feature point matching method with an improved ORB algorithm. Sensors. 23 (1), 123-136 (2022).
  10. Anggara, D. W., et al. Integrated colormap and ORB detector method for feature extraction approach in augmented reality. Multimed Tools Appl. 81 (25), 35713-35729 (2022).
  11. Tian, J., Wu, Y., Cai, Y., Fan, H., Yu, W. A novel mosaic method for spaceborne ScanSAR images based on homography matrix compensation. Remote Sens. 13 (15), 2866-2885 (2021).
  12. Kim, T., Kim, G. J. Real-time and on-line removal of moving human figures in hand-held mobile augmented reality. Vis Comput. 39 (7), 2571-2582 (2023).
  13. Clement, J. C. Directional intensified feature description using tertiary filtering for augmented reality tracking. Sci. Rep. 13 (1), 2571-2582 (2023).
  14. Liu, J., Liang, A., Zhao, E., Pang, M., Zhang, D. Homography matrix-based local motion consistent matching for remote sensing images. Remote Sens. 15 (13), 3379-3400 (2023).
  15. Zhu, C., Io, M. U., Hall, C. M., Ngan, H. F. B., Peralta, R. L. How to use augmented reality to promote a destination? The mediating role of augmented reality attachment. Int J Tour Res. 26 (1), e2603(2024).
  16. Ngan, H. F. B., Lei, W. S. Examining the effects of augmented reality on sport event experiences and revisit intention: A comparative analysis between AR and non-AR users. Issues Tour. 28 (4), 666-679 (2025).
  17. Zhu, C., Io, M. U., Hall, C. M., Ngan, H. F. B., Peralta, R. L. Exploring the influence of augmented reality on tourist word-of-mouth through the lens of museum tourism. J Herit Tour. 20 (1), 78-91 (2025).
  18. Jia, X., Xu, T., Bao, K., Wang, D., Dai, Y. Multi-point displacement measurement method based on ORB feature detection. Insight. 67 (2), 73-79 (2025).
  19. Chen, J., Ramakrishnan, K. K., Dhakazl, A., Ran, X. Networked architectures for localization-based multi-user augmented reality. IEEE Commun Mag. 61 (12), 104-110 (2023).
  20. Yang, M., Wang, S., Zhang, N., Zhou, A., Ma, X. Survey on tracking and registration technology for mobile augmented reality. Int J Web Grid Serv. 18 (2), 99-140 (2022).
  21. Lee, J., Lee, H., Mun, D. 3D convolutional neural network for machining feature recognition with gradient-based visual explanations from 3D CAD models. Sci Rep. 12 (1), 14864-14877 (2022).
  22. Ren, J., et al. Matching algorithms: Fundamentals, applications and challenges. IEEE Trans Emerg Top Comput Intell. 5 (3), 332-350 (2021).
  23. Li, L., Yang, M. Point cloud registration based on direct deep features with applications in intelligent vehicles. IEEE Trans Intell Transp Syst. 23 (8), 13346-13357 (2021).
  24. Hao, Z., Wang, X., Zheng, S. Recognition of basketball players’ action detection based on visual image and Harris corner extraction algorithm. J Intell Fuzzy Syst. 40 (4), 7589-7599 (2021).
  25. Liu, Q., Xi, X., Zhang, W., Yang, L., Hanajima, N. Improved image matching algorithm based on LK optical flow and grid motion statistics. Int J Comput Appl Technol. 68 (1), 49-57 (2022).
  26. Zhang, D., Zhu, J., Wang, F., Hu, X., Ye, X. GMS-RANSAC: A fast algorithm for removing mismatches based on ORB-SLAM2. Symmetry. 14 (5), 849-860 (2022).
  27. Fu, H., Yang, H., Chen, C., Zhang, H. 3D registration based on V-SLAM and application in augmented reality. J Comput Methods Sci Eng. 22 (3), 911-923 (2022).
  28. Bao, Y., Liu, J., Jia, X., Qie, J. An assisted assembly method based on augmented reality. Int J Adv Manuf Technol. 135 (1), 1035-1050 (2024).
  29. Cattari, N., Condino, S., Cutolo, F., Ferrari, M., Ferrari, V. In situ visualization for 3D ultrasound-guided interventions with augmented reality headset. Bioengineering. 8 (10), 131-146 (2021).
  30. Hong, H. A measurement method of the focal distance of the virtual image in an augmented reality or virtual reality device. J Soc Inf Disp. 29 (4), 230-236 (2021).
  31. Dinara, G., Evgeniy, Z., Vlada, K. Using OpenCV for augmented reality applications. Artif Life Robot. 3 (3), 179-184 (2022).
  32. Xu, H., Yuan, J., Ma, J. Murf: Mutually reinforcing multi-modal image registration and fusion. IEEE Trans Pattern Anal Mach Intell. 45 (10), 12148-12166 (2023).
  33. Li, W., Wang, J., Liu, M., Zhao, S., Ding, X. Integrated registration and occlusion handling based on deep learning for augmented-reality-assisted assembly instruction. IEEE Trans Ind Inform. 19 (5), 6825-6835 (2022).
  34. Lim, H., Kim, B., Kim, D., Mason Lee, E., Myung, H. Quatro++: Robust global registration exploiting ground segmentation for loop closing in LiDAR SLAM. Int J Rob Res. 43 (5), 685-715 (2024).
  35. Xu, N., et al. CubeMuseum AR: A tangible augmented reality interface for cultural heritage learning and museum gifting. Int J Hum Comput Interact. 40 (6), 1409-1437 (2024).
  36. Arshad, S., Kim, G. W. A robust feature matching strategy for fast and effective visual place recognition in challenging environmental conditions. Int J Control Autom Syst. 21 (3), 948-962 (2023).

Accesso limitato. Accedi o avvia una prova gratuita per visualizzare questo contenuto.

Ristampe e permessi

Richiedi il permesso di riutilizzare il testo o le figure di questo articolo JoVE

Richiedi permesso

Tag

Corrispondenza di punti caratteristicialgoritmo SURFregistrazione 3Dflusso ottico di Lucas KanadeRANSACtrasformazione d immagineaccuratezza della registrazione

Articoli correlati