Scaricare la presentazione
La presentazione è in caricamento. Aspetta per favore
PubblicatoCroccifixio Valentino Modificato 10 anni fa
1
Metodi Quantitativi per Economia, Finanza e Management Lezione n°5
2
Tipologie di dati Qualitativi dati espressi in forma verbale, solitamente classificati in categorie Quantitativi dati espressi in forma numerica. si distinguono in: discreti dati caratterizzati da una quantità finita o infinita numerabile di classi di misura continui risposta numerica derivamte da un processo di misurazione che fornisce indicazioni puntuali all’interno di un continuum Territoriali Date
3
Tipologie di dati qualitativi
Nominale usato per dati qualitativi, che vengono così classificati in categorie distinte senza alcun ordine implicito (es. professione del cliente) Ordinale le categorie presentano un ordine implicito; consente di stabilire una relazione d’ordine tra le diverse categorie, ma nessuna asserzione numerica, ovvero si può dire che un determinato valore è più grande di un altro, ma non di quanto
4
Tipologie di dati quantitativi
Scala di rapporti con questa tipologia si può dire di quanto una categoria è maggiore di un’altra; è fissato un valore “0” della scala. es. Le variabili spesa media e tempo impiegato sono misurate a livello di rapporto,ovvero rientrano in una scala di valutazione comparativa Scala di intervalli presenta le stesse caratteristiche della precedente, ma non possiede un valore “0” fissato. es. In una indagine sui clienti di un supermercato, il loro livello di soddisfazione può essere adeguatamente rappresentato mediante una scala di valutazione compresa tra 1 e 9, ciò che posso asserire è che la differenza tra 2 e 3 è la medesima di quella tra 8 e 9, ma non che 8 sia il doppio di 4.
5
L’analisi statistica dei dati
Statistica descrittiva insieme dei metodi che riguardano la rappresentazione e sintesi di un insieme di dati al fine di evidenziarne le caratteristiche principali Statistica inferenziale insieme dei metodi che permettono la stima di una caratteristica di una popolazione basandosi sull’analisi di un campione Totalità degli elementi presi in esame dalla indagine Misura riassuntiva, calcolata sui dati campionari, utile per descrivere una caratteristica non nota della popolazione La parte di popolazione selezionata per l’analisi
6
Statistica descrittiva univariata
Nella statistica descrittiva univariata possiamo trovare due principali metodologie usate per rappresentare i dati analizzati: Distribuzioni di frequenza Misure di sintesi: Misure di tendenza centrale e non centrale; Misure di dispersione; Misure della forma della distribuzione
7
Le distribuzioni di frequenza
Frequenza assoluta: è un primo livello di sintesi dei dati- consiste nell’associare a ciascuna categoria, o modalità, il numero di volte in cui compare nei dati Distribuzione di frequenza: insieme delle modalità e delle loro frequenze Frequenza relativa: rapporto tra la frequenza assoluta ed il numero complessivo delle osservazioni effettuate. I due tipi di frequenze vengono usati con dati quantitativi, qualitativi ordinali, quantitativi discreti. p= n/ N
8
Le distribuzioni di frequenza
Rappresentazione grafica var.qualitative: Diagr. a barre: nell’asse delle ascisse ci sono le categorie, senza un ordine preciso; in quello delle ordinate le frequenze assolute/relative corrispondenti alle diverse modalità Diagr. a torta: la circonferenza è divisa proporzionalmente alle frequenze Diagramma a torta
9
Le distribuzioni di frequenza
Rappresentazione grafica var.quantitative discrete: Diagr. delle frequenze: nell’asse delle ascisse ci sono i valori assunti dalla var. discreta (quindi ha un significato quantitativo); l’altezza delle barre è proporzionale alle frequenze relative o assolute del valore stesso Istogramma: nell’asse delle ascisse ci sono le classi degli intervalli considerati; l’asse delle ordinate rappresenta la densità di frequenza; l’area del rettangolo corrisponde alla frequenza della classe stessa.
10
Misure di sintesi Misure di tendenza centrale: Media aritmetica
Mediana Moda Misure di tendenza non centrale: Quantili Percentili Misure di dispersione: Campo di variazione Differenza interquantile Varianza Scarto quadratico medio Coefficiente di variazione Misure di forma della distribuzione: Skewness Kurtosis
11
Misure di Tendenza Centrale
Media Mediana Moda Media Aritmetica Valore centrale delle osservazioni ordinate Valore più frequente
12
Media Aritmetica Media = 3 Media = 4
La misura di tendenza centrale più comune Media = somma dei valori diviso il numero di valori Influenzata da valori estremi (outlier) Media = 3 Media = 4
13
Mediana Mediana = 3 Mediana = 3
In una lista ordinata, la mediana è il valore “centrale” (50% sopra, 50% sotto) Non influenzata da valori estremi Mediana = 3 Mediana = 3
14
Moda No Moda Moda = 9 Valore che occorre più frequentemente
Non influenzata da valori estremi Usata sia per dati numerici che categorici Può non esserci una moda Ci può essere più di una moda No Moda Moda = 9
15
Misure di Tendenza Non Centrale
I Quartili dividono la sequenza ordinata dei dati in 4 segmenti contenenti lo stesso numero di valori 25% 25% 25% 25% Q1 Q2 Q3 Il primo quartile, Q1, è il valore per il quale 25% delle osservazioni sono minori e 75% sono maggiori di esso Q2 coincide con la mediana (50% sono minori, 50% sono maggiori) Solo 25% delle osservazioni sono maggiori del terzo quartile
16
Differenza Interquartile
Box Plot Mediana (Q2) X X Q1 Q3 massimo minimo 25% % % % Differenza Interquartile 57 – 30 = 27 OUTLIERS: Q1 - 1,5 * Differenza interquartile Q3 + 1,5 * Differenza interquartile
17
Misure di Variabilità Variabilità
Campo di Variazione Differenza Interquartile Varianza Scarto Quadratico Medio Coefficiente di Variazione Le misure di variabilità forniscono informazioni sulla dispersione o variabilità dei valori. Stesso centro, diversa variabilità
18
Campo di variazione = Xmassimo – Xminimo
La più semplice misura di variabilità Differenza tra il massimo e il minimo dei valori osservati: Campo di variazione = Xmassimo – Xminimo Esempio: Campo di Variazione = = 13
19
Campo di Variazione Ignora il modo in cui i dati sono distribuiti Sensibile agli outlier Campo di Var. = = 5 Campo di Var. = = 5 1,1,1,1,1,1,1,1,1,1,1,2,2,2,2,2,2,2,2,3,3,3,3,4,5 Campo di Var. = = 4 1,1,1,1,1,1,1,1,1,1,1,2,2,2,2,2,2,2,2,3,3,3,3,4,120 Campo di Var = = 119
20
Differenza Interquartile
Possiamo eliminare il problema degli outlier usando la differenza interquartile Elimina i valori osservati più alti e più bassi e calcola il campo di variazione del 50% centrale dei dati Differenza Interquartile = 3o quartile – 1o quartile IQR = Q3 – Q1
21
Varianza Media dei quadrati delle differenze fra ciascuna osservazione e la media Varianza della Popolazione: dove = media della popolazione N = dimensione della popolazione xi = iimo valore della variabile X
22
Scarto Quadratico Medio
Misura di variabilità comunemente usata Mostra la variabilità rispetto alla media Ha la stessa unità di misura dei dati originali Scarto Quadratico Medio della Popolazione:
23
Scarto Quadratico Medio
Scarto quadratico medio piccolo Scarto quadratico medio grande
24
Scarto Quadratico Medio
Dati A Media = 15.5 s = 3.338 Dati B Media = 15.5 s = 0.926 Dati C Media = 15.5 s = 4.570
25
Scarto Quadratico Medio
Viene calcolato usando tutti i valori nel set di dati Valori lontani dalla media hanno più peso (poichè si usa il quadrato delle deviazioni dalla media) Le stesse considerazioni valgono anche per il calcolo della Varianza
26
Coefficiente di Variazione
Misura la variabilità relativa Sempre in percentuale (%) Mostra la variabilità relativa rispetto alla media Può essere usato per confrontare due o più set di dati misurati con unità di misura diversa
27
Coefficiente di Variazione
Azione A: Prezzo medio scorso anno = $50 Scarto Quadratico Medio = $5 Azione B: Prezzo medio scorso anno = $100 Entrambe le azioni hanno lo stesso scarto quadratico medio, ma l’azione B è meno variabile rispetto al suo prezzo
28
Forma della Distribuzione
La forma della distribuzione si dice simmetrica se le osservazioni sono bilanciate, o distribuite in modo approssimativamente regolare attorno al centro.
29
Forma della Distribuzione
La forma della distribuzione è detta asimmetrica se le osservazioni non sono distribuite in modo simmetrico rispetto al centro. Una distribuzione con asimmetria positiva (obliqua a destra) ha una coda che si estende a destra, nella direzione dei valori positivi. Una distribuzione con asimmetria negativa (obliqua a sinistra) ha una coda che si estende a sinistra, nella direzione dei valori negativi.
30
Misure di Forma della Distribuzione
Descrive come i dati sono distribuiti Misure della forma Simmetrica o asimmetrica Obliqua a sinistra Simmetrica Obliqua a destra Media < Mediana Media = Mediana Mediana < Media Asimmetria negativa Simmetria Asimmetria positiva
31
Misure di Forma della Distribuzione
Skewness: indice che informa circa il grado di simmetria o asimmetria di una distribuzione. γ=0 ditribuzione simmetrica; γ<0 asimmetria negativa (mediana>media); γ>0 asimmetria positiva (mediana<media). Kurtosis: indice che permette di verificare se i dati seguono una distribuzione di tipo Normale (simmetrica). β=3 se la distribuzione è “Normale”; β<3 se la distribuzione è iponormale (rispetto alla distribuzione di una Normale ha densità di frequenza minore per valori molto distanti dalla media); β>3 se la distribuzione è ipernormale (rispetto alla distribuzione di una Normale ha densità di frequenza maggiore per i valori molto distanti dalla media).
32
IMPORTO NETTO UNITARIO
Basic Statistical Measures Location Variability Mean Std Deviation Median Variance 6563 Mode 0.0000 Range Interquartile Range
33
IMPORTO NETTO UNITARIO
34
IMPORTO NETTO UNITARIO
35
IMPORTO NETTO UNITARIO
Basic Statistical Measures Location Variability Mean Std Deviation Median Variance 4134 Mode Range Interquartile Range
36
Analisi di Concentrazione
Per caratteri quantitativi trasferibili Equidistribuzione: Max concentrazione: 1. Ordinare le osservazioni 2. Calcolare le quantità:
37
20% 50% 60% 90% Analisi di Concentrazione
CURVA DI CONCENTRAZIONE REDD. >=0 QI 0.0 0.1 0.2 0.3 0.4 0.5 0.6 0.7 0.8 0.9 1.0 FI 20% 50% 60% 90% 1
38
20% 40% Analisi di Concentrazione CURVA DI CONCENTRAZIONE REDD. < 0
QI 0.0 0.1 0.2 0.3 0.4 0.5 0.6 0.7 0.8 0.9 1.0 FI 20% 40% 1
39
Statistica descrittiva bivariata
Indaga la relazione tra due variabili misurate. Si distingue rispetto alla tipologia delle variabili indagate: var. qualitative/quantitative discrete: tavole di contingenza (o a doppia entrata) var. quantitative: analisi di correlazione lineare una var. qualitativa e una quantitativa: confronto tra le medie
40
Tavole di contingenza Sono tabelle a doppia entrata; i valori riportati all’interno della tabella sono le frequenze congiunte assolute, e la loro somma è pari al totale dei casi osservati. Dalla tabella si possono ricavare inoltre le distribuzioni marginali, sommando per riga e per colonna le frequenze congiunte; le frequenze relative congiunte, pari al rapporto tra le frequenze assolute congiunte e il totale dei casi osservati.
41
Tavole di contingenza Dalle tabelle di contingenza si possono ricavare ulteriori distribuzioni unidimensionali : Frequenze subordinate ovvero la frequenza di osservare il carattere x dato il carattere y e viceversa. Formalmente: P y|x (xi,yj) = P (xi,yj) / P x(xi) P x|y (xi,yj) = P (xi,yj) / P y(yj) Indipendenza statistica se al variare di X le distribuzioni subordinate (Y|X)= xi sono tutte uguali tra loro,si può concludere che la distribuzione del carattere Y non dipende da X. Nel caso di indipendenza statistica, la frequenza relativa congiunta è pari al prodotto delle marginali corrispondenti P(xi,yj)=Px (xi)Py(yj) L’indipendenza stat. è un concetto simmetrico: se vale per X, vale anche per Y. Se si verifica, vuol dire che l’analisi bivariata di X (Y) non dà informazioni aggiuntive rispetto all’analisi univariata.
Presentazioni simili
© 2024 SlidePlayer.it Inc.
All rights reserved.