Mostrar el registro sencillo del ítem
A new class of discrete models for the analysis of zero-modified count data
dc.contributor.author | Silva, Wesley Bertoli da | |
dc.date.accessioned | 2020-09-18T10:15:24Z | |
dc.date.available | 2020-09-18T10:15:24Z | |
dc.date.issued | 2020-04-03 | |
dc.identifier.citation | SILVA, Wesley Bertoli da. A new class of discrete models for the analysis of zero-modified count data. 2020. Tese (Doutorado em Estatística) – Universidade Federal de São Carlos, São Carlos, 2020. Disponível em: https://repositorio.ufscar.br/handle/ufscar/13249. | * |
dc.identifier.uri | https://repositorio.ufscar.br/handle/ufscar/13249 | |
dc.description.abstract | In this work, a new class of discrete models for the analysis of zero-modified count data has been introduced. The proposed class is composed of hurdle versions of the Poisson-Lindley, Poisson-Shanker, and Poisson-Sujatha baseline distributions, which are uniparametric Poisson mixtures that can accommodate different levels of overdispersion. Unlike the traditional formulation of zero-modified distributions, the primary assumption under hurdle models is that the positive observations are entirely represented by zero-truncated distributions. In the sense of extending the applicability of the theoretical models, it has also been developed a fixed-effects regression framework, in which the probability of zero-valued observations being generated as well as the average number of positive observations per individual could be modeled in the presence of covariates. Besides, an even more flexible structure allowing the inclusion of both fixed and random-effects in the linear predictors of the hurdle models has also been developed. In the derived mixed-effects structure, it has been considered the use of scalar random-effects to quantify the within-subjects heterogeneity arising from clustering or repeated measurements. In this work, all inferential procedures were conducted under a fully Bayesian perspective. Different prior distributions have been considered (e.g., Jeffreys' and g-prior), and the task of generating pseudo-random values from a posterior distribution without closed-form has been performed by one out of the three following algorithms (depending on the structure of each model): Rejection Sampling, Random-walk Metropolis, and Adaptive Metropolis. Intensive Monte Carlo simulation studies were performed in order to evaluate the performance of the adopted Bayesian methodologies. The usefulness of the proposed zero-modified models was illustrated by using several real datasets presenting different structures and sources of variation. Beyond parameter estimation, it has been performed sensitivity analyses to identify influent points, and, in order to evaluate the fitted models, it has been computed the Bayesian p-values, the randomized quantile residuals, among other measures. Finally, when compared with well-established distributions for the analysis of count data, the competitiveness of the proposed models has been proved in all provided examples. | eng |
dc.description.sponsorship | Fundação Araucária de Apoio ao Desenvolvimento Científico e Tecnológico do Paraná (FAADCT/PR) | por |
dc.language.iso | eng | eng |
dc.publisher | Universidade Federal de São Carlos | por |
dc.rights | Attribution-NonCommercial-NoDerivs 3.0 Brazil | * |
dc.rights.uri | http://creativecommons.org/licenses/by-nc-nd/3.0/br/ | * |
dc.subject | Bayesian Methods | eng |
dc.subject | Mixed-effects Hurdle Models | eng |
dc.subject | Overdispersion | eng |
dc.subject | Poisson Mixture Distributions | eng |
dc.subject | Zero-modified Data | eng |
dc.subject | Dados Zero Modificados | Por |
dc.subject | Distribuições de Mistura de Poisson | por |
dc.subject | Métodos Bayesianos | por |
dc.subject | Modelo Hurdle com Efeitos Mistos | por |
dc.subject | Sobredispersão | por |
dc.title | A new class of discrete models for the analysis of zero-modified count data | eng |
dc.title.alternative | Uma nova classe de modelos discretos para a análise de dados de contagem zero-modificados | por |
dc.type | Tese | por |
dc.contributor.advisor1 | Louzada Neto, Francisco | |
dc.contributor.advisor1Lattes | http://lattes.cnpq.br/0994050156415890 | por |
dc.description.resumo | Neste trabalho, uma nova classe de modelos discretos para a análise de contagens zero modificados foi introduzida. A classe proposta é composta pelas versões hurdle das distribuições de Poisson-Lindley, Poisson-Shanker e Poisson-Sujatha, que são misturas uniparamétricas de Poisson, capazes de acomodar diferentes níveis de sobredispersão. Diferentemente da formulação tradicional das distribuições zero modificadas, a principal suposição acerca de um modelo hurdle é que as observações positivas são inteiramente representadas por distribuições zero-truncadas. No sentido de estender a aplicabilidade dos modelos teóricos, também foi desenvolvida uma estrutura de regressão com efeitos fixos, na qual tanto a probabilidade de se observar o valor zero, quanto o número médio de observações positivas por indivíduo, puderam ser modelados na presença de covariáveis. Além disso, também foi desenvolvida uma estrutura ainda mais flexível, permitindo a inclusão simultânea de efeitos fixos e aleatórios nos preditores lineares do modelo hurdle. Na estrutura de efeitos mistos derivada, considerou-se o uso de efeitos aleatórios escalares para quantificar a heterogeneidade entre as observações de um mesmo indivíduo, que decorre de agrupamentos ou medidas repetidas. Neste trabalho, todos os procedimentos inferenciais foram conduzidos sob uma perspectiva totalmente Bayesiana. Diferentes distribuições a priori foram consideradas (por exemplo, Jeffreys' e g-prior), e a tarefa de gerar valores pseudo- aleatórios de uma distribuição a posteriori sem forma fechada foi realizada por um dos três algoritmos a seguir (dependendo da estrutura de cada modelo): Amostragem por Rejeição, Random-walk Metropolis, e Metropolis Adaptativo. Estudos intensivos de simulação de Monte Carlo foram realizados como forma de avaliar o desempenho das metodologias Bayesianas adotadas. A utilidade dos modelos zero modificados propostos foi ilustrada usando vários conjuntos de dados reais que apresentavam diferentes estruturas e fontes de variação. Além de estimar os parâmetros, foram realizadas análises de sensibilidade para identificar pontos influentes e, para avaliar os modelos ajustados, foram computados os p-valores Bayesianos, os resíduos quantílicos aleatorizados, entre outras medidas. Por fim, quando comparados com distribuições bem estabelecidas que são úteis para a análise de dados de contagem, a competitividade dos modelos propostos foi comprovada em todos os exemplos fornecidos. | por |
dc.publisher.initials | UFSCar | por |
dc.publisher.program | Programa Interinstitucional de Pós-Graduação em Estatística - PIPGEs | por |
dc.subject.cnpq | CIENCIAS EXATAS E DA TERRA::PROBABILIDADE E ESTATISTICA | por |
dc.subject.cnpq | CIENCIAS EXATAS E DA TERRA::PROBABILIDADE E ESTATISTICA::ESTATISTICA::INFERENCIA PARAMETRICA | por |
dc.subject.cnpq | CIENCIAS EXATAS E DA TERRA::PROBABILIDADE E ESTATISTICA::ESTATISTICA::REGRESSAO E CORRELACAO | por |
dc.description.sponsorshipId | FAADCT/PR: CP 18/2015 | por |
dc.publisher.address | Câmpus São Carlos | por |
dc.contributor.authorlattes | http://lattes.cnpq.br/7852733762870256 | por |