R e RStudio
Fazer uma análise estatística completa usando RStudio pode ser um processo complexo e abrangente. A análise estatística é um campo vasto, com muitas técnicas e métodos diferentes disponíveis.
A escolha das técnicas corretas dependerá do seu conjunto de dados, das perguntas de pesquisa e dos objetivos da análise. Consultar a documentação dos pacotes e recursos adicionais de estatística pode ser útil para aprofundar-se em análises mais avançadas. Na parte II, observaremos alguns testes estatísticos.
Importando dados
Para este estudo, utilizaremos os conjuntos de dados mtcars, meusdados que será criado utilizando números e letras aleatórios, butterfat e ToothGrowth, conforme indicado abaixo.
Testes pré-requisitos
Avaliar a normalidade e a homogeneidade dos dados é fundamental antes de realizar análises estatísticas, pois esses critérios influenciam diretamente na validade e interpretação dos resultados estatísticos. Abaixo, observe como realizar estes testes no R.
Normalidade – Shapiro-Wilk
O teste de Shapiro-Wilk, realizado com a função shapiro.test() no R, é usado para verificar se uma variável segue uma distribuição normal (gaussiana). Isso é importante pois a normalidade é um pre-requisito de certos testes estatístico. como a análise de variância (ANOVA) ou o teste t.
A interpretação do resultado do teste de Shapiro-Wilk envolve a análise do valor-p. Aqui está como interpretar o teste de Shapiro-Wilk:
Hipótese Nula (H0): A hipótese nula afirma que os dados seguem uma distribuição normal.
Hipótese Alternativa (H1): A hipótese alternativa sugere que os dados não seguem uma distribuição normal.
A interpretação do resultado baseia-se no valor-p associado ao teste:
Se o valor-p for maior que o nível de significância (geralmente definido em 0,05 ou 0,01), você não rejeita a hipótese nula (H0). Se o valor-p for menor que o nível de significância escolhido, você rejeita a hipótese nula (H0).Ou seja nos testes de normalidade, consideramos que os dados seguem distribuição normal quando p é maior que 0.05.
Em resumo, o teste de Shapiro-Wilk é usado para verificar a normalidade dos dados. Se o valor-p for baixo, você pode concluir que os dados não são normalmente distribuídos, o que pode afetar a escolha do método estatístico apropriado para a análise. Se o valor-p for alto, você pode continuar com a suposição de que os dados são aproximadamente normais para fins de análise paramétrica.
Visualização:
Homogeneidade de variâncias – Levene (pacote car)
Pacote:
O teste de Levene é uma técnica estatística usada para verificar a homogeneidade das variâncias entre grupos em uma análise de variância (ANOVA) ou em outras análises estatísticas. Ele é utilizado para avaliar se as variâncias das diferentes amostras ou grupos são estatisticamente iguais ou diferentes. A hipótese nula (H0) do teste de Levene afirma que todas as amostras têm variâncias iguais, enquanto a hipótese alternativa (H1) sugere que pelo menos uma amostra tem uma variância diferente das outras.
Aqui está como interpretar o resultado do teste de Levene:
Hipótese Nula (H0): A hipótese nula assume que todas as amostras têm variâncias iguais.
Hipótese Alternativa (H1): A hipótese alternativa sugere que pelo menos uma amostra tem uma variância diferente das outras.
A interpretação do resultado do teste de Levene envolve a análise do valor-p:
Valor-p (p-value): O valor-p é a probabilidade de obter uma estatística de teste F tão extrema quanto a observada, sob a suposição de que todas as amostras têm a mesma variância (hipótese nula). Quanto menor o valor-p, mais forte é a evidência contra a hipótese nula.
Se o valor-p for maior que o nível de significância escolhido (geralmente definido em 0,05 ou 0,01), você não rejeita a hipótese nula (H0). Isso sugere que não há evidências estatisticamente significativas para concluir que as variâncias são diferentes entre as amostras. Você pode assumir que a homogeneidade de variâncias é atendida.
Se o valor-p for menor que o nível de significância, você rejeita a hipótese nula e conclui que há evidências estatisticamente significativas de que pelo menos uma amostra tem uma variância diferente das outras. Nesse caso, você deve considerar métodos estatísticos alternativos que levem em conta essa falta de homogeneidade de variância.
Em resumo, o teste de Levene é usado para verificar a homogeneidade de variâncias entre grupos. A interpretação do valor-p ajuda a determinar se essa suposição foi atendida ou não, o que é importante em análises estatísticas, para garantir que os resultados sejam confiáveis.
A seguir, vamos discutir alguns testes estatísticos que necessitam que os dados (ou resíduos) sigam uma distribuição normal e/ou homogeneidade das variâncias como um pré-requisito.
Modelo teste t para uma amostra
O teste t para uma amostra é uma análise estatística usada para determinar se a média de uma única amostra é estatisticamente diferente de um valor de referência conhecido ou hipotético. Ele avalia se existe evidência estatística para afirmar que a média da amostra é significativamente diferente do valor esperado. Isso é feito comparando a média da amostra com um valor de referência e levando em consideração o tamanho da amostra e o desvio padrão da população.
t – Estatística t (t-statistic):(t = -0.0564) A estatística t é calculada dividindo a diferença média (mean of the differences) pela estimativa do erro padrão das diferenças. Ela quantifica a magnitude da diferença entre as duas amostras em termos de desvios padrão. Quanto maior for a estatística t, maior será a diferença relativa entre as amostras.
df – Graus de Liberdade (degrees of freedom): (df = 149) Os graus de liberdade são usados para calcular o valor-p e indicam quantos graus de liberdade estão disponíveis para o teste estatístico. No caso de um teste t pareado, os graus de liberdade são determinados pelo número de pares de observações menos 1.
p-value – Valor-p: (p-valor = 0.9551)O valor-p é a probabilidade de obter um resultado tão extremo ou mais extremo do que o observado, sob a hipótese nula de que não há diferença real entre as duas amostras. É uma medida que nos ajuda a determinar a significância estatística do resultado.
Se o valor-p for menor que o nível de significância pré-definido (geralmente 0,05 ou 0,01), rejeitamos a hipótese nula (H0) e concluímos que existe uma diferença estatisticamente significativa entre as amostras. Em outras palavras, há evidências de que a mudança observada é estatisticamente significativa.
Se o valor-p for maior que o nível de significância, não temos evidências estatísticas para rejeitar a hipótese nula, o que sugere que não há diferença estatisticamente significativa entre as amostras.
conf.int – é o intervalo de confiança da média a 95% (conf.int = [9.51422, 10.45882]),
sample estimates é o valor médio da amostra (média = 9.986519).
Teste-t independente
O teste t independente, também conhecido como teste t de Student para amostras independentes, é uma técnica estatística usada para comparar as médias de duas amostras independentes e determinar se existe uma diferença estatisticamente significativa entre elas. Esse teste é apropriado quando você deseja comparar duas amostras diferentes, como dois grupos de pessoas, dois grupos de produtos ou duas populações independentes, e verificar se a diferença nas médias é devida ao acaso ou se é estatisticamente significativa.
Uma variável dependente (resposta) continua e uma variável independente (explanatória) categórica com dois grupos/níveis com unidades amostrais independentes (indivíduos diferentes em cada grupo/nível).
Normalidade por grupo
Visualização normalidade:
Teste:
Visualização:
Teste-t pareado
Aqui estão os principais conceitos e etapas envolvidos na realização e interpretação de um teste t pareado:
Hipótese Nula (H0): A hipótese nula assume que não há diferença significativa entre as médias das duas amostras relacionadas. Em outras palavras, as médias são iguais.
Hipótese Alternativa (H1): A hipótese alternativa sugere que há uma diferença significativa entre as médias das duas amostras relacionadas. Em outras palavras, as médias são diferentes.
Diferenças (differences): No teste t pareado, você calcula as diferenças entre as observações emparelhadas (por exemplo, as diferenças entre as observações antes e depois de uma intervenção). Essas diferenças representam a mudança observada em cada par de observações.
Estatística t (t-statistic): A estatística t é calculada a partir das diferenças, do desvio padrão das diferenças e do número de pares de observações. Ela quantifica a magnitude da diferença média entre as duas amostras em termos de desvios padrão. Quanto maior for a estatística t, maior será a diferença relativa entre as médias.
Graus de Liberdade (degrees of freedom): Os graus de liberdade são usados para calcular o valor-p e indicam quantos graus de liberdade estão disponíveis para o teste estatístico. No teste t pareado, os graus de liberdade são determinados pelo número de pares de observações menos 1.
Valor-p (p-value): O valor-p é a probabilidade de obter um resultado tão extremo ou mais extremo do que o observado, sob a hipótese nula de que não há diferença real entre as duas amostras relacionadas. Quanto menor o valor-p, mais forte é a evidência contra a hipótese nula.
Se o valor-p for menor que o nível de significância escolhido (geralmente definido em 0,05 ou 0,01), você rejeita a hipótese nula (H0) e conclui que existe uma diferença estatisticamente significativa entre as médias das duas amostras relacionadas. Ou seja as médias são diferentes.
Se o valor-p for maior que o nível de significância, você não rejeita a hipótese nula e não tem evidências estatísticas para concluir que as médias são diferentes.
Normalidade:
Teste:
Visualização:
ANOVA
A análise de variância (ANOVA) é uma técnica estatística usada para avaliar se existem diferenças significativas entre as médias de dois ou mais grupos ou populações. A ANOVA compara as variações entre os grupos com as variações dentro dos grupos, permitindo determinar se as diferenças observadas nas médias são provavelmente devidas a fatores reais ou se podem ser atribuídas à aleatoriedade. Existem vários tipos de ANOVA, cada um adequado para diferentes cenários e objetivos de pesquisa. Aqui estão os principais tipos de ANOVA:
- ANOVA de Um Fator (One-Way ANOVA): Também conhecida como ANOVA de um fator, é usada quando você está comparando as médias de três ou mais grupos independentes. Por exemplo, você pode usar a ANOVA de um fator para comparar as médias de desempenho de estudantes de três escolas diferentes.
- ANOVA de Dois Fatores (Two-Way ANOVA): A ANOVA de dois fatores é usada quando você tem duas variáveis independentes (fatores) e deseja avaliar como esses fatores afetam uma variável dependente. Por exemplo, você pode usar a ANOVA de dois fatores para analisar como a dose de um medicamento e o sexo dos pacientes afetam a resposta a um tratamento.
Outros tipos são: ANOVA de Medidas Repetidas (Repeated Measures ANOVA), ANOVA de Variáveis de Bloco (ANCOVA – Analysis of Covariance) e ANOVA Multivariada (MANOVA – Multivariate Analysis of Variance). A interpretação dos resultados da ANOVA envolve a análise do valor-p associado ao teste estatístico. Um valor-p menor que o nível de significância (geralmente definido em 0,05) indica que existe uma diferença estatisticamente significativa entre os grupos (ou condições), permitindo rejeitar a hipótese nula. A escolha do tipo de ANOVA depende da natureza dos seus dados e das suas perguntas de pesquisa. Cada tipo de ANOVA aborda situações específicas e é importante selecionar o método correto para obter resultados confiáveis e interpretáveis.
Abaixo exemplificaremos os testes mais usados de ANOVA (ANOVA de uma via e ANOVA de duas vias).
ANOVA 1 via independente
Uma variável dependente numérica e uma variável categórica com 2 ou mais níveis/grupos.
Normalidade:
Homogeneidade das variâncias:
Teste e visualização dos resíduos
Análise post-hoc (pacote DescTools)
As funções PostHocTest() com diferentes métodos são usadas para realizar testes de comparações múltiplas após a realização de uma Análise de Variância (ANOVA) para identificar quais grupos específicos diferem entre si. Cada método tem suas próprias características e níveis de correção para controlar o erro tipo I (falso positivo) nas comparações múltiplas. Abaixo estão destacadas as características de cada método.
PostHocTest(modeloAOV, method = “duncan”):
O método “Duncan” é usado para realizar testes de comparações múltiplas após uma ANOVA.
Ele realiza todas as comparações possíveis entre os grupos, calculando diferenças significativas entre as médias.
Este método não aplica correção para múltiplas comparações, o que significa que pode ser mais liberal em identificar diferenças, mas também aumenta o risco de falso positivo. Portanto, é importante usá-lo com cautela e interpretar os resultados com cuidado.
PostHocTest(modeloAOV, method = “hsd”):
O método “HSD” (LSD, sigla em inglês para Least Significant Difference) é outro método para comparações múltiplas após uma ANOVA.
Ele realiza comparações entre todas as combinações de grupos e aplica correção de Tukey para controlar o erro tipo I nas comparações múltiplas.
O teste HSD é mais conservador do que o método de Duncan, o que significa que ele pode ser menos propenso a identificar diferenças significativas, mas é mais rigoroso na correção de múltiplas comparações.
PostHocTest(modeloAOV, method = “bonf”):
O método “Bonferroni” é outro método de correção para comparações múltiplas após uma ANOVA.
Ele ajusta o nível de significância (valor-p) para cada comparação com base no número total de comparações que estão sendo realizadas.
O método Bonferroni é bastante conservador e tende a ser mais restritivo na identificação de diferenças significativas, o que ajuda a controlar o erro tipo I.
A escolha entre esses métodos depende do seu objetivo de pesquisa, do número de comparações que você está realizando e da importância de controlar o erro tipo I. O método Bonferroni é geralmente recomendado quando se deseja um controle rigoroso do erro tipo I, enquanto o método de Duncan pode ser usado quando se deseja explorar diferenças sem fazer correções para múltiplas comparações. O método HSD é um compromisso entre os dois, oferecendo uma correção eficaz para múltiplas comparações sem ser tão conservador quanto o Bonferroni.
Visualização:
ANOVA 2 vias independente
Uma variavel dependente numérica e duas varáveis independentes categóricas.
Pacotes:
Normalidade:
Homogeneidade das variâncias
Modelo e visualização da normalidade dos resíduos:
Resultado ANOVA
Para avaliar se o modelo está adequado podem ser utilizados gráficos de diagnóstico Saiba mais.
PostHoc
Supp:
Dose:
Pacote DescTools: Opções: “hsd”, “bonferroni”, “lsd”, “scheffe”, “newmankeuls”, “duncan”
Visualização:
Existem outros testes estatísticos que não foram abordados, mas serão adicionados nos conteúdos extras em breve.
Exercícios
A- Crie um conjunto de dados com uma variável numérica e pelo menos duas variáveis categóricas com mais de um nível cada.
B- Teste a normalidade e homogeneidade da variância dos seus dados.
C- Realize uma anova de 2 vias com seus conjunto de dados.
d- Represente graficamente sua análise.