O número invisível que dita o que é verdade na ciência moderna
por Newsoba · 19 de setembro de 2026 · 7 min de leitura

Na década de 1920, um agrônomo e estatístico britânico chamado Ronald Fisher estava tentando resolver um problema aparentemente trivial nas fazendas da Inglaterra: como saber se um novo fertilizante realmente funcionava ou se a colheita melhor fora apenas um fruto do acaso. Entre equações e planilhas manuais, Fisher sugeriu um patamar arbitrário. Se a chance de um resultado acontecer por mera sorte fosse menor que 5%, poderíamos considerar a descoberta digna de atenção. Para representar essa probabilidade, usou uma única letra minúscula: a letra p.
Fisher jamais imaginou que essa convenção informal se transformaria no árbitro supremo da verdade científica global. Quase um século depois, o chamado valor-p tornou-se a métrica mais poderosa, controversa e influente do mundo acadêmico. Ele decide quais remédios chegam às prateleiras das farmácias, quais teorias de psicologia estampam as capas de revistas e quais pesquisadores mantêm seus empregos.
Contudo, nos últimos anos, essa métrica passou do status de ferramenta essencial para o centro de uma crise silenciosa. O fascínio por um único número acabou distorcendo a forma como produzimos conhecimento, gerando um debate acalorado entre cientistas, estatísticos e editores do mundo inteiro.
O número que dividiu a verdade da ilusão
Para entender por que uma simples letra carrega tanto peso, precisamos olhar para como o método científico valida suas descobertas. Quando cientistas testam uma nova hipótese — como a eficácia de um tratamento médico —, eles começam assumindo o oposto do que querem provar: que o tratamento não tem efeito algum. Essa premissa zerada é conhecida como a hipótese nula.
É aqui que entra o valor-p. Ele mede exatamente a probabilidade de obtermos os dados observados, ou algo mais extremo, caso a hipótese nula seja verdadeira. Em termos simples: qual é a chance de estarmos vendo um padrão que na verdade é apenas ruído aleatório?
Quando o cálculo resulta em um valor menor que 0,05, os pesquisadores declaram o achado como estatisticamente significativo. É o carimbo verde que autoriza a publicação. Se o valor for 0,06, por outro lado, o estudo é frequentemente engavetado e considerado um fracasso.
Essa fronteira rígida criou uma divisão binária no pensamento científico. Um lado representa a descoberta confirmada; o outro, o esquecimento. E foi justamente essa obsessão pelo corte de 5% que acendeu o sinal de alerta nas últimas décadas.
Como uma única letra passou a governar os laboratórios
O problema não reside na matemática do cálculo em si, mas na forma como a comunidade científica passou a utilizá-la. Ao longo da segunda metade do século XX, o valor-p deixou de ser um guia diagnóstico para se tornar o objetivo final da pesquisa.
A pressão do ecossistema acadêmico desempenhou um papel central nessa transformação. Universidades e agências de fomento priorizam pesquisadores com longo histórico de publicações. Revistas de prestígio, por sua vez, preferem publicar descobertas surpreendentes e positivas em vez de estudos que mostram que nada mudou.
E é aí que a engrenagem começa a ranger. Quando toda a carreira de um profissional depende de alcançar um resultado abaixo de 0,05, a tentação consciente ou inconsciente de ajustar o processo torna-se gigantesca.
A ilusão da certeza absoluta
Existe um equívoco muito comum entre o público leigo e até mesmo entre estudantes de graduação: a ideia de que um valor-p baixo significa que a hipótese testada é verdadeira. Não é bem assim.
O valor-p não mede a probabilidade de uma teoria estar certa, nem mede o tamanho do efeito de uma descoberta. Um remédio pode ter um valor-p extremamente pequeno simplesmente porque foi testado em dezenas de milhares de pessoas, embora o benefício real para a saúde seja insignificante no dia a dia.
Confundir significância estatística com relevância prática é uma das armadilhas mais frequentes da modernidade. Criou-se uma falsa sensação de certeza onde na verdade existe apenas uma estimativa de ruído.
O incentivo perverso da publicação
Esse cenário gerou o que os historiadores da ciência chamam de viés de publicação. Se cem laboratórios realizam o mesmo experimento e noventa e nove não encontram nenhum resultado relevante, esses noventa e nove estudos dificilmente serão publicados.
Mas o centésimo laboratório, por puro acaso estatístico, encontra um valor-p abaixo do limite. Esse único estudo ganha destaque na imprensa, vira livro e molda políticas públicas. O público nunca fica sabendo das noventa e nove tentativas que falharam.
A arte perigosa do p-hacking
À medida que a competição por verbas e espaço editorial se intensificou, surgiu uma prática conhecida no meio acadêmico como p-hacking — ou tortura de dados. Trata-se de manipular o processo de análise até que o gráfico entregue o número mágico desejado.
Existem muitas maneiras sutis de fazer isso sem necessariamente cometer uma fraude direta. Um pesquisador pode testar dezenas de variáveis diferentes e relatar apenas a única que apresentou resultado estatisticamente significativo.
Outro método comum envolve decidir quando parar a coleta de dados. Se os números estão quase atingindo a marca de 0,05, o cientista coleta mais algumas amostras até que a barra seja ultrapassada. Se já atingiu o valor, a coleta é interrompida imediatamente.
- Testar múltiplos subgrupos de pacientes até encontrar um onde o remédio funcione.
- Remover pontos fora da curva sem um critério metodológico claro definido previamente.
- Transformar variáveis contínuas em categorias arbitrárias para forçar correlações.
- Mudar a pergunta da pesquisa depois de olhar para os resultados já coletados.
Essas manobras minam a integridade do conhecimento acumulado. O resultado inevitável desse processo foi o estouro da chamada crise de replicabilidade, quando cientistas tentaram refazer experimentos clássicos e descobriram que a maioria não se sustentava.
O impacto invisível no seu dia a dia
Você provavelmente já leu manchetes contraditórias em sites de notícias: em uma semana o café faz bem ao coração; na semana seguinte, aumenta o risco de doenças cardíacas. Chocolate emagrece, depois engorda. Determinado hábito garante longevidade, até que outro estudo diz o oposto.
Essa volatilidade de informações que confunde o consumidor é filha direta do uso inadequado do valor-p. Grande parte dos estudos observacionais de nutrição e comportamento baseia-se em varreduras de enormes bancos de dados em busca de correlações com p menor que 0,05.
Quando um achado desse tipo é publicado, os veículos de comunicação raramente explicam o contexto ou as limitações do cálculo. O resultado é traduzido como uma regra absoluta, gerando ansiedade e perda de confiança da sociedade na própria ciência.
Mas o impacto vai muito além da nutrição. Na medicina, tratamentos ineficazes ou com efeitos colaterais subestimados podem avançar em fases de testes devido a flutuações estatísticas mascaradas por análises seletivas.
O fim da era da métrica única
Diante do acúmulo de evidências de que o sistema atual precisava de correções, as principais associações de estatística do mundo começaram a se posicionar. O recado é claro: nenhuma decisão médica, econômica ou política deve ser tomada com base apenas no fato de um valor-p ter ultrapassado uma linha arbitrária.
A comunidade internacional está gradualmente migrando para abordagens mais transparentes e holísticas. Uma das frentes mais promissoras é o pré-registro de pesquisas. Nesse modelo, os cientistas precisam detalhar publicamente sua metodologia, suas hipóteses e seu plano de análise estatística antes de coletar qualquer dado.
Isso impede o p-hacking posterior, pois qualquer desvio do plano original fica explicitamente exposto para os revisores.
Além disso, há um movimento crescente para priorizar o tamanho do efeito e os intervalos de confiança. Em vez de perguntar apenas "existe um efeito?", a ciência moderna quer saber "qual é o tamanho desse efeito e qual a nossa margem de incerteza sobre ele?".
Outras correntes defendem o uso mais amplo da estatística Bayesiana, que permite incorporar conhecimentos e probabilidades prévias à análise de novos dados, evitando conclusões precipitadas com base em um único evento.
O valor-p não vai desaparecer dos laboratórios, e nem deveria. Ele continua sendo uma ferramenta matemática útil quando bem interpretada e combinada com rigor metodológico.
O que está chegando ao fim é o reinado absoluto de uma métrica isolada sobre a definição do que é real. A ciência está redescobrindo que a busca pela verdade é um processo contínuo, complexo e gradual — um caminho que jamais caberá dentro de uma única letra.

Comentários
Carregando…