Articoli
Costruire, provare e analizzare la tecnologia. Esperimenti, realizzazione e ricerca spiegano perché funziona.
9

#Computer Vision

Visione artificiale September 13, 2026

Stima della profondità con un monocolo: dall'ordine relativo alla distanza metrica

Un'introduzione alla profondità monoculare: profondità relativa versus profondità metrica, ambiguità di scala, protocolli di valutazione e condizioni di guasto.

Guida allo studio · 3 min di lettura
Visione artificiale September 13, 2026

Neural 3D: sintesi di una nuova prospettiva e valutazione visiva/geometrica separata.

Un'introduzione alle rappresentazioni neurali delle scene, alla sintesi di nuove viste, alle viste escluse e alla valutazione visiva e geometrica separate.

Guida allo studio · 3 min di lettura
Visione artificiale September 4, 2026

Guida introduttiva alla calibrazione della fotocamera: recupero della distorsione dell'obiettivo e dei parametri intrinseci.

La calibrazione della telecamera è il processo di recupero dei parametri intrinseci e della distorsione dell'obiettivo necessari per mappare le coordinate dei pixel nello spazio 3D. Partendo dal modello a foro stenopeico, passando per i modelli di distorsione radiale e tangenziale, il metodo del pattern planare di Zhang, l'ottimizzazione dell'errore di riproiezione, fino ad arrivare a ciò che non funziona a valle in Visual SLAM e VO quando la calibrazione si discosta: una panoramica sistematica con equazioni e diagrammi.

Fundamentals · 9 min di lettura
Visione artificiale September 4, 2026

Introduzione all'omografia: descrizione della corrispondenza planare con una singola matrice 3x3.

L'omografia è la relazione che lega tra loro punti sullo stesso piano, o la vista di una telecamera puramente rotante, utilizzando una singola trasformazione proiettiva 3x3. Questo articolo tratta la stima basata sulla DLT, la robustezza con RANSAC, la decomposizione in rotazione, traslazione e normale al piano, e quando utilizzarla rispetto alla geometria epipolare, insieme ad applicazioni come l'unione di immagini e il tracciamento del piano AR, con equazioni e diagrammi.

Fundamentals · 9 min di lettura
Visione artificiale September 4, 2026

Introduzione alla stereoscopia multivista: come trasformare una nuvola di punti sparsa in una forma 3D densa.

La stereoscopia multivista (MVS) ricostruisce forme 3D dense a partire da numerose immagini, utilizzando pose di ripresa note. Questo articolo illustra in modo sistematico il principio fondamentale della coerenza fotografica, i due approcci classici basati su scansione planare e patch (PMVS), i metodi basati sul deep learning, esemplificati da MVSNet, e la creazione di mesh tramite fusione di mappe di profondità, insieme alla relazione con le telecamere stereo e di profondità, corredata da equazioni e diagrammi.

Fundamentals · 13 min di lettura
Visione artificiale September 4, 2026

Introduzione alla ricostruzione 3D da immagini (Structure from Motion): recupero simultaneo di posizione 3D e posizione della telecamera da una serie di foto non ordinate.

La ricostruzione 3D da immagini (Structure from Motion, SfM) ricostruisce simultaneamente la struttura 3D di una scena e la posizione di ogni ripresa a partire da una serie di foto di cui non si conoscono l'ordine e le posizioni di scatto. Questo articolo analizza in modo sistematico la corrispondenza delle caratteristiche, la verifica geometrica, le due strategie di ricostruzione SfM incrementale e globale, la triangolazione, la relazione con il Bundle Adjustment e la differenza rispetto al Visual-SLAM, insieme ad implementazioni attuali come COLMAP.

Fundamentals · 12 min di lettura
Apprendimento automatico September 4, 2026

Introduzione all'apprendimento automatico: stima della posa

La stima della posa deduce i punti chiave di una persona o di un oggetto e la posa 6D dalle immagini. Questa introduzione tratta le coordinate, le perdite, l'occlusione, la valutazione e la sicurezza.

Fundamentals · 5 min di lettura
Visione artificiale September 3, 2026

Geometria epipolare: lettura della profondità e del movimento della telecamera da due immagini

La geometria epipolare è la teoria che definisce i vincoli relativi alla proiezione di uno stesso punto 3D in due immagini diverse. Questo articolo illustra in modo sistematico la Matrice Fondamentale e la Matrice Essenziale, gli algoritmi a 8 e 5 punti, RANSAC, la triangolazione, la scelta tra geometria epipolare e omografia, la calibrazione, l'implementazione in OpenCV/COLMAP, le condizioni di errore e le recenti tecniche di stima basate sull'apprendimento automatico, con equazioni e diagrammi.

Fundamentals · 19 min di lettura
Visione artificiale September 3, 2026

Introduzione al rilevamento delle caratteristiche

Il rilevamento delle caratteristiche seleziona "punti che è possibile ritrovare" in un'immagine e li utilizza per il confronto. Questo articolo collega i principi di angoli, blob, DoG, FAST, ORB e SIFT con robustezza, valutazione, strumenti attuali e metodi basati sull'apprendimento in un unico quadro coerente.

Fundamentals · 15 min di lettura