Articoli
Costruire, provare e analizzare la tecnologia. Esperimenti, realizzazione e ricerca spiegano perché funziona.
16

Apprendimento automatico

Apprendimento automatico — Un percorso strutturato in robotica, controllo, agricoltura in ambiente controllato, energia ed elettronica di potenza.

Tutti gli argomenti

Apprendimento automatico September 8, 2026 Lab

Confronto tra LLM locali: prima risposta, tasso di generazione e memoria

Misurare il contenuto della prima risposta separatamente dalla velocità di generazione e dal controllo residency, caching and memory conditions.

Hands-on · 3 min di lettura
Apprendimento automatico September 5, 2026

Introduzione al rilevamento di oggetti e alla segmentazione semantica: leggere "cosa si trova dove" in un'immagine.

Il rilevamento degli oggetti disegna riquadri attorno agli oggetti; la segmentazione semantica colora ogni pixel in base al suo significato. Dalle differenze tra i due, passando per la segmentazione di istanze e panottica, la linea evolutiva da R-CNN a YOLO, DETR e DINO, fino alle loro controparti 3D basate su nuvole di punti: un percorso sistematico attraverso i fondamenti della comprensione delle scene.

Fundamentals · 17 min di lettura
Apprendimento automatico September 4, 2026

Introduzione all'apprendimento automatico: modelli generativi

I modelli generativi rappresentano le distribuzioni dei dati e creano output condizionali. Impara la verosimiglianza, VAE, GAN, diffusione, valutazione, provenienza e sicurezza.

Fundamentals · 5 min di lettura
Apprendimento automatico September 4, 2026

Introduzione all'apprendimento automatico: fondamenti - Progettazione dei dati, funzione di perdita e generalizzazione

L'apprendimento automatico non si limita alla selezione del modello: bisogna definire il compito, la suddivisione dei dati, la perdita di dati, la valutazione e le modifiche da apportare all'implementazione.

Fundamentals · 6 min di lettura
Apprendimento automatico September 4, 2026

Una guida completa a SegFormer: perché un trasformatore senza codifica posizionale funziona per la segmentazione

Questo articolo analizza SegFormer, introdotto da NVIDIA, dall'Università di Hong Kong e da altri collaboratori al NeurIPS 2021, basandosi sul documento originale. Esaminiamo il codificatore MiT gerarchico senza codifica posizionale, il decodificatore All-MLP efficiente in termini di parametri, il campo recettivo effettivo, il mIoU misurato, il numero di parametri e calcoliamo da B0 a B5 con le equazioni.

Fundamentals · 10 min di lettura
Apprendimento automatico September 4, 2026

YOLO11 spiegato in dettaglio: cosa hanno cambiato C3k2 e C2PSA rispetto a YOLOv8?

Analizza Ultralytics YOLO11 utilizzando la documentazione ufficiale e fonti primarie: C3k2, C2PSA, rilevamento senza ancoraggio, perdite DFL/CIoU e benchmark misurati per n/s/m/l/x.

Fundamentals · 12 min di lettura
Apprendimento automatico September 4, 2026

Introduzione all'apprendimento automatico: i fondamenti delle reti neurali

Le reti neurali combinano trasformazioni affini e attivazioni non lineari, quindi riducono la perdita tramite retropropagazione e ottimizzazione basata sul gradiente.

Fundamentals · 6 min di lettura
Apprendimento automatico September 4, 2026

Introduzione all'apprendimento automatico: stima della posa

La stima della posa deduce i punti chiave di una persona o di un oggetto e la posa 6D dalle immagini. Questa introduzione tratta le coordinate, le perdite, l'occlusione, la valutazione e la sicurezza.

Fundamentals · 5 min di lettura
Apprendimento per rinforzo September 4, 2026

Introduzione all'apprendimento per rinforzo multi-agente: ottimizzazione in un mondo in cui anche l'altra parte sta imparando.

Quando più agenti apprendono contemporaneamente, un MDP a singolo agente non è più valido. Questo articolo organizza, con equazioni e diagrammi, i concetti di non stazionarietà, contesti cooperativi/competitivi/misti, CTDE, il problema dell'assegnazione del credito, MADDPG e QMIX.

Fundamentals · 9 min di lettura
Apprendimento per rinforzo September 4, 2026

π0 spiegato: come la corrispondenza del flusso ha cambiato la generazione delle azioni VLA

Una guida tecnica basata sul codice sorgente per π0 dell'Intelligenza Fisica: il VLM PaliGemma e l'Action Expert dedicato, la generazione continua di azioni con corrispondenza del flusso condizionale, l'addestramento cross-incarnazione su sette tipi di robot e la differenza rispetto ai modelli VLA autoregressivi come RT-2 e OpenVLA.

Fundamentals · 12 min di lettura
Apprendimento per rinforzo September 4, 2026

Guida introduttiva alla progettazione delle ricompense: perché "cosa massimizzare" è la parte più difficile dell'apprendimento per rinforzo.

Nelle implementazioni dell'apprendimento per rinforzo, la progettazione della funzione di ricompensa determina più spesso il risultato rispetto all'algoritmo. Questo articolo analizza la differenza tra ricompensa sparsa e densa, l'invarianza di policy della modellazione della ricompensa basata sul potenziale, casi reali di manipolazione della ricompensa, l'apprendimento per rinforzo inverso e l'apprendimento per rinforzo vincolato.

Fundamentals · 9 min di lettura
Apprendimento per rinforzo September 3, 2026

Introduzione all'apprendimento per rinforzo: apprendimento per imitazione e apprendimento per rinforzo inverso

Il Behavior Cloning, DAgger e l'apprendimento per rinforzo inverso utilizzano dimostrazioni quando è difficile definire le ricompense. Questa introduzione tratta lo spostamento delle covariate, l'inferenza delle ricompense, le connessioni VLA, la valutazione, la sicurezza e la provenienza dei dati.

Fundamentals · 6 min di lettura
Apprendimento per rinforzo September 3, 2026

Nozioni di base sull'apprendimento per rinforzo: MDP, equazioni di Bellman ed esplorazione per i robot

L'apprendimento per rinforzo è un ciclo chiuso in cui un agente sceglie le azioni in base alle osservazioni e massimizza le ricompense ritardate. Questa introduzione spiega i processi decisionali di Markov (MDP), le funzioni di valore, le politiche, le equazioni di Bellman, la differenza tra esplorazione e sfruttamento, la progettazione delle ricompense e il percorso dalla simulazione a un robot reale.

Fundamentals · 7 min di lettura
Apprendimento per rinforzo September 3, 2026

Apprendimento per rinforzo basato su modelli e Sim-to-Real

Modelli globali, errore di predizione, MPC, randomizzazione del dominio, identificazione del sistema e monitoraggio della sicurezza per macchine reali.

Fundamentals · 5 min di lettura
Apprendimento per rinforzo September 3, 2026

Gradienti di policy, PPO e SAC: controllo continuo stabile per robot

I gradienti di policy aggiornano direttamente una policy in modo che sterzo, spinta e coppia articolare possano rimanere continui. Questo articolo collega Actor-Critic, PPO e SAC, quindi tratta il clipping, la regolarizzazione dell'entropia, la valutazione e il confine di sicurezza per il trasferimento Sim-Real.

Fundamentals · 6 min di lettura
Apprendimento per rinforzo September 3, 2026

Q-Learning e DQN: dalla tabella Q all'apprendimento per rinforzo profondo.

L'apprendimento Q aggiorna i valori delle azioni con l'obiettivo di ottimalità di Bellman. Questa introduzione illustra il percorso da una tabella Q tabellare a una rete Q profonda, spiegando la riproduzione dell'esperienza, le reti target, la sovrastima e il posizionamento sicuro in una pila di robot.

Fundamentals · 6 min di lettura