Il paper deve essere uno studio pilota di fattibilità per capire se è possibile realizzare un Dataset Parallelo di TS automaticamente.
Si parte da questo paper dove ci sono i vari approcci per la costruzione (semi-automatici e manuali) e si confrontano con il nuovo metodo proposto automatico.
Quindi si presenta nello stato dell’arte questo paper, si presenta il nuovo metodo e si valutano inizialmente le performance, e poi si fa una analisi di come vengono spostate le feature tra originale e semplificato e si confrontano con quelle del paper. Citare paper molisani.
Fare il KDE aanche dei valori di read-it sulle fixed-length sentences.
Si usano le varie coppie originale-simpl1, originale-simpl2 per fare più analisi e guardare quali feature rimangono costanti durante le varie “run”, in modo da avere dei dati più solidi rispetto a quali feature vengono impattate.
Dopo questo studio si valuta l’effetto della lunghezza su tutte le semplificazioni e si guarda cosa varia in quel caso.
Confronto su admin-it e simpitiki tra semplificate manuali e automatiche. Sì. e fare correlazsione spearman tra i ranking delle features vedere se cambiano le stesse ecc.