#Computer Vision
Visione artificiale
September 13, 2026
Stima della profondità con un monocolo: dall'ordine relativo alla distanza metrica
Un'introduzione alla profondità monoculare: profondità relativa versus profondità metrica, ambiguità di scala, protocolli di valutazione e condizioni di guasto.
Guida allo studio · 3 min di lettura
Visione artificiale
September 13, 2026
Neural 3D: sintesi di una nuova prospettiva e valutazione visiva/geometrica separata.
Un'introduzione alle rappresentazioni neurali delle scene, alla sintesi di nuove viste, alle viste escluse e alla valutazione visiva e geometrica separate.
Guida allo studio · 3 min di lettura Visione artificiale September 4, 2026Guida introduttiva alla calibrazione della fotocamera: recupero della distorsione dell'obiettivo e dei parametri intrinseci.
La calibrazione della telecamera è il processo di recupero dei parametri intrinseci e della distorsione dell'obiettivo necessari per mappare le coordinate dei pixel nello spazio 3D. Partendo dal modello a foro stenopeico, passando per i modelli di distorsione radiale e tangenziale, il metodo del pattern planare di Zhang, l'ottimizzazione dell'errore di riproiezione, fino ad arrivare a ciò che non funziona a valle in Visual SLAM e VO quando la calibrazione si discosta: una panoramica sistematica con equazioni e diagrammi.
Fundamentals · 9 min di letturaIntroduzione all'omografia: descrizione della corrispondenza planare con una singola matrice 3x3.
L'omografia è la relazione che lega tra loro punti sullo stesso piano, o la vista di una telecamera puramente rotante, utilizzando una singola trasformazione proiettiva 3x3. Questo articolo tratta la stima basata sulla DLT, la robustezza con RANSAC, la decomposizione in rotazione, traslazione e normale al piano, e quando utilizzarla rispetto alla geometria epipolare, insieme ad applicazioni come l'unione di immagini e il tracciamento del piano AR, con equazioni e diagrammi.
Fundamentals · 9 min di lettura Visione artificiale September 4, 2026Introduzione alla stereoscopia multivista: come trasformare una nuvola di punti sparsa in una forma 3D densa.
La stereoscopia multivista (MVS) ricostruisce forme 3D dense a partire da numerose immagini, utilizzando pose di ripresa note. Questo articolo illustra in modo sistematico il principio fondamentale della coerenza fotografica, i due approcci classici basati su scansione planare e patch (PMVS), i metodi basati sul deep learning, esemplificati da MVSNet, e la creazione di mesh tramite fusione di mappe di profondità, insieme alla relazione con le telecamere stereo e di profondità, corredata da equazioni e diagrammi.
Fundamentals · 13 min di letturaIntroduzione alla ricostruzione 3D da immagini (Structure from Motion): recupero simultaneo di posizione 3D e posizione della telecamera da una serie di foto non ordinate.
La ricostruzione 3D da immagini (Structure from Motion, SfM) ricostruisce simultaneamente la struttura 3D di una scena e la posizione di ogni ripresa a partire da una serie di foto di cui non si conoscono l'ordine e le posizioni di scatto. Questo articolo analizza in modo sistematico la corrispondenza delle caratteristiche, la verifica geometrica, le due strategie di ricostruzione SfM incrementale e globale, la triangolazione, la relazione con il Bundle Adjustment e la differenza rispetto al Visual-SLAM, insieme ad implementazioni attuali come COLMAP.
Fundamentals · 12 min di lettura Apprendimento automatico September 4, 2026Introduzione all'apprendimento automatico: stima della posa
La stima della posa deduce i punti chiave di una persona o di un oggetto e la posa 6D dalle immagini. Questa introduzione tratta le coordinate, le perdite, l'occlusione, la valutazione e la sicurezza.
Fundamentals · 5 min di lettura
Visione artificiale
September 3, 2026
Geometria epipolare: lettura della profondità e del movimento della telecamera da due immagini
La geometria epipolare è la teoria che definisce i vincoli relativi alla proiezione di uno stesso punto 3D in due immagini diverse. Questo articolo illustra in modo sistematico la Matrice Fondamentale e la Matrice Essenziale, gli algoritmi a 8 e 5 punti, RANSAC, la triangolazione, la scelta tra geometria epipolare e omografia, la calibrazione, l'implementazione in OpenCV/COLMAP, le condizioni di errore e le recenti tecniche di stima basate sull'apprendimento automatico, con equazioni e diagrammi.
Fundamentals · 19 min di lettura
Visione artificiale
September 3, 2026
Introduzione al rilevamento delle caratteristiche
Il rilevamento delle caratteristiche seleziona "punti che è possibile ritrovare" in un'immagine e li utilizza per il confronto. Questo articolo collega i principi di angoli, blob, DoG, FAST, ORB e SIFT con robustezza, valutazione, strumenti attuali e metodi basati sull'apprendimento in un unico quadro coerente.
Fundamentals · 15 min di lettura