A multimodal deep learning approach for food tray recognition. 
13 de setembre de 2020
Joan Peracaula Prat

---

El codi que es proporciona en aquestes carpetes consisteix en:
 - Els models implementats i explicats en el treball, en la carpeta "codi models".
 - La branca utilitzada de la llibreria Multimodal Keras Wrapper per a la implementacio dels models, en la carpeta "multimodal_keras_wrapper-joanp_branch".
 - Scripts utilitzats durant el desenvolupament del treball en la carpeta "scripts". Entre d'altres hi ha l'script "yolo_data_generation.py" que fa l'adaptació de les primers prediccions de YOLO per poder ser utilitzades pels models i genera també el ground truth per poder entrenar i testejar els models. La resta són scripts principalment secundaris que han servit per fer comprovacions i generar les bounding boxes visuals pels resultats del treball.
 - Dos scripts: un per generar les prediccions candidates de YOLO i l'altra per avaluar el Baseline model. Aquests es troben dins la carpeta "YOLO scripts".

Què no es proporciona:
 - Model base YOLO pre-entrenat amb el propi dataset
 - Dataset utilitzat

ja que no són de la meva autoria i són propietat de LogMeal. En cas que es vulguin consultar, podria demanar-los-hi i suposo que no hi hauria problema.

Joan Peracaula Prat