Un video da telefono, nessun sensore: cosa c'è nella scena, dove sta, come si muove l'oggetto, e un robot che ripete il gesto in simulazione.
Una persona sposta un oggetto sul tavolo, ripresa da un telefono. Nessun sensore, nessun marcatore: solo il video.
Basta dire a parole cosa cercare, oggetto, mano, persona, tavolo, e il sistema ritaglia ogni sagoma fotogramma per fotogramma, con il suo grado di confidenza.
La stanza e il tavolo dalla scansione 3D fatta col telefono: geometria in metri, l'oggetto al suo posto di partenza. Trascina per ruotare, rotella per lo zoom.
| Elemento | Misura | Da dove |
|---|---|---|
| Oggetto | 9,1 × 8,4 × 9,7 cm | scansione 3D, sagoma nel video |
| Tavolo | 1,67 × 1,46 m, piano a 0,74 m | scansione 3D |
| Mano, persona | nel video | sagome per fotogramma |
Gli elementi della scena diventano una lista con misure: la distinta base della postazione.
Il percorso reale dell'oggetto: sul tavolo dall'immagine, in aria dalla mano ricostruita in 3D. Soste A, B, C, D. Apri a schermo intero.
Un braccio robotico in simulazione segue la traiettoria nella stanza ricostruita: presa, trasporto, rilascio. Cinematica inversa fotogramma per fotogramma.