dbr
Advanced Member >PLATINUM PLUS<
Ciao Maurizio, grazie per il dettaglio — la Fase B e C sono fatte davvero bene: il dado virtuale vero al posto del rimescolamento risolve esattamente il problema di cui parlavamo (ora l'affidabilità può assumere valori intermedi, non solo 0 o 100%). Complimenti, si vede il lavoro fatto.
Una domanda sulla Fase A, quella che genera il numero P che poi alimenta tutto il resto: quel P (65,1% nel tuo esempio) viene calcolato sull'intero archivio storico, oppure solo sulla parte di dati che avevi già prima di scegliere quella formazione? Te lo chiedo perché se P viene dall'intero archivio — compreso magari il periodo più recente che ha reso quella formazione "buona" — allora le 1000 simulazioni, per quanto tecnicamente impeccabili, partono comunque da un tasso che potrebbe essere già un po' gonfiato. È un po' lo stesso discorso di prima sul rendiconto: la simulazione sofisticata non basta se il numero di partenza non è stato validato fuori campione.
Un modo semplice per controllarlo: calcoli P due volte, una su tutto l'archivio e una solo sulla metà più vecchia (o sulle finestre più vecchie), poi verifichi se il tasso si mantiene anche nella parte più recente mai usata per calcolarlo la prima volta. Se i due numeri sono vicini, l'affidabilità del 94% significa molto di più che se P fosse gonfiato solo dal periodo recente. Fammi sapere come lo calcoli, sono curioso.
Una domanda sulla Fase A, quella che genera il numero P che poi alimenta tutto il resto: quel P (65,1% nel tuo esempio) viene calcolato sull'intero archivio storico, oppure solo sulla parte di dati che avevi già prima di scegliere quella formazione? Te lo chiedo perché se P viene dall'intero archivio — compreso magari il periodo più recente che ha reso quella formazione "buona" — allora le 1000 simulazioni, per quanto tecnicamente impeccabili, partono comunque da un tasso che potrebbe essere già un po' gonfiato. È un po' lo stesso discorso di prima sul rendiconto: la simulazione sofisticata non basta se il numero di partenza non è stato validato fuori campione.
Un modo semplice per controllarlo: calcoli P due volte, una su tutto l'archivio e una solo sulla metà più vecchia (o sulle finestre più vecchie), poi verifichi se il tasso si mantiene anche nella parte più recente mai usata per calcolarlo la prima volta. Se i due numeri sono vicini, l'affidabilità del 94% significa molto di più che se P fosse gonfiato solo dal periodo recente. Fammi sapere come lo calcoli, sono curioso.