4. Esercizio 4 (8 punti)
Un campione di 25 sigarette di una certa marca è stato sottoposto ad analisi per misurare il contenuto di nicotina. La media campionaria risulta pari a 1,000 mg e la varianza campionaria a 0,12 mg2. Assumiamo che il contenuto di nicotina nelle sigarette della marca considerata abbia distribuzione normale ed indichiamo con μ il valor medio incognito di tale distribuzione.
Sulla base dei valori stimati, se scegliamo a caso una sigaretta della marca considerata, qual è la probabilità che abbia un contenuto di nicotina superiore a 1.1 mg?
Sempre sulla base dei valori stimati, se selezioniamo un altro campione di 25 sigarette della marca considerata, qual è la probabilità che il contenuto medio di nicotina sia superiore a 1.1 mg?
Costruire un intervallo di confidenza al livello C = 1 - α = 0.95 per la media μ del contenuto di nicotina delle sigarette della marca considerata.
Che cosa concludiamo nel confronto tra le due ipotesi H0: μ = 0.9 e H1: μ ≠ 0.9 al livello di significatività α = 0.05?
Con riferimento al quesito precedente, che conclusione avremmo raggiunto se il livello di significatività fosse stato α = 0.1?
5. Esercizio 5 (6 punti)
Nella seguente tabella è riportata la distribuzione secondo il genere e l’ammontare di pagamenti effettuati tramite carta di credito (in euro) in uno specifico mese, riferita ad un campione casuale di mille individui.
| Pagamenti (in euro) | Genere | ||
|---|---|---|---|
| Maschio | Femmina | Totale | |
| 0–1000 | 340 | 260 | 600 |
| 1000–5000 | 360 | 40 | 400 |
| Totale | 700 | 300 | 1000 |
Qual è, tra i casi in cui l’ammontare dei pagamenti è pari almeno a 1000 euro, la frequenza relativa degli uomini?
I dati del campione vengono utilizzati per effettuare un’analisi volta a stabilire se nella popolazione di riferimento sia presente una qualche forma di legame tra i due caratteri. A tal fine vengono poste a confronto le due ipotesi:
- H0: Non c’è alcuna relazione tra le due variabili, cioè le due variabili sono indipendenti.
- H1: Tra le due variabili esiste una qualche forma di dipendenza.
Calcolare il valore di un’opportuna statistica per effettuare il test relativo al punto precedente.
Individuare il p-value corrispondente al valore della statistica test calcolata al punto precedente.
Alla luce delle informazioni disponibili e fissato il livello di significatività all’1%, possiamo concludere che nella popolazione da cui è stato estratto il campione non vi sia relazione tra i due caratteri?