Proposte di tesi
16 proposte · 7 triennali · 9 magistrali
Proponiamo tesi triennali e magistrali sui temi di ricerca del gruppo Co-AI: assistenti indossabili, comprensione di video in prima persona, memoria e procedure. Ogni proposta è progettuale o sperimentale e ha una durata indicativa. Per informazioni scrivimi indicando il tuo corso di laurea.
16 proposte

Rilevamento in tempo reale degli errori procedurali su dispositivo edge tramite grafi procedurali
Costruire una demo dal vivo che osserva una persona mentre svolge una procedura e la avvisa subito se salta un passo o lo fa nell'ordine sbagliato.

Streaming video a bassa latenza tra visore e server per assistenti indossabili
Realizzare il collegamento in tempo reale tra un visore e un server che esegue un modello di IA, e misurarne la velocità.

Valutazione di modelli multimodali locali nel riconoscimento dei passi di un'attività
Mettere alla prova un modello multimodale eseguibile sul proprio computer nel riconoscere i passi di un'attività in un video, confrontandolo con un modello specializzato.

Previsione in tempo reale del movimento delle mani su occhiali smart e dispositivo edge
Costruire una demo che, dal video degli occhiali smart, segue le mani dell'utente e prevede dove si stanno dirigendo, in tempo reale su un piccolo computer.

Verifica a posteriori dei passi di una procedura da video con modelli visione-linguaggio
A fine lavoro, verificare dal video quali passi di una procedura sono stati davvero eseguiti e conservare l'immagine che lo dimostra.

Porting e ottimizzazione di un sistema di memoria visiva su dispositivi edge NVIDIA
Far funzionare un assistente con memoria visiva su piccoli computer NVIDIA, veloce, a basso consumo e senza cloud.

Scenario di manutenzione in laboratorio e raccolta di un dataset video in prima persona
Progettare un'attività di manutenzione da riprodurre in laboratorio e registrare i primi video in prima persona per insegnare a un assistente a guidarla.

Conoscenza procedurale per assistenti esperti mediante modelli video-linguaggio
Dare a un assistente video-linguaggio la conoscenza di come si svolge una procedura, per rispondere come farebbe un esperto a chi la sta imparando.

Stima del livello di abilità e rilevamento degli errori dallo sguardo in video in prima persona
Analizzare dove guarda chi indossa gli occhiali smart per stimarne il livello di abilità in un'attività e riconoscere i momenti in cui qualcosa va storto.

Certificazione online dei passi di una procedura tra affidabilità e ritardo
Decidere in tempo reale se un passo di una procedura è stato eseguito, scegliendo il momento giusto per esserne sicuri e conservando la prova.

Apprendimento della selezione dei sensori per il riconoscimento di azioni a basso consumo su dispositivi indossabili
Insegnare a un dispositivo indossabile a scegliere da solo, istante per istante, quali sensori usare per capire cosa fa l'utente consumando il meno possibile.

Memoria degli oggetti per assistenti indossabili: ritrovare dove e quando si è visto un oggetto
Un assistente indossabile che tiene memoria degli oggetti visti durante la giornata e sa dirti dove li hai lasciati.

Riconoscimento online dei passi di attività nuove a partire da pochi esempi
Riconoscere in tempo reale, dal video degli occhiali, a che passo di un'attività si trova l'utente, anche per attività viste con pochissimi esempi.

Memoria compatta per modelli video-linguaggio su video lunghi in prima persona
Far ricordare a un modello di IA ore di video in prima persona usando poca memoria, per rispondere a domande sul passato.

Tracciamento online dello stato di una procedura dal video in prima persona
Seguire in tempo reale una procedura dal video degli occhiali, sapendo quali passi sono già fatti e cosa si può fare dopo.

Previsione del movimento delle mani per anticipare le interazioni con gli oggetti
Sviluppare un modello che prevede dove andranno le mani nel prossimo secondo per anticipare con quale oggetto interagirà l'utente.
Nessuna proposta corrisponde a questi filtri.