NewsobaNewsoba
Ciência

O número invisível que dita o que é verdade na ciência moderna

por Newsoba · 19 de setembro de 2026 · 7 min de leitura

Na década de 1920, um agrônomo e estatístico britânico chamado Ronald Fisher estava tentando resolver um problema aparentemente trivial nas fazendas da Inglaterra: como saber se um novo fertilizante realmente funcionava ou se a colheita melhor fora apenas um fruto do acaso. Entre equações e planilhas manuais, Fisher sugeriu um patamar arbitrário. Se a chance de um resultado acontecer por mera sorte fosse menor que 5%, poderíamos considerar a descoberta digna de atenção. Para representar essa probabilidade, usou uma única letra minúscula: a letra p.

Fisher jamais imaginou que essa convenção informal se transformaria no árbitro supremo da verdade científica global. Quase um século depois, o chamado valor-p tornou-se a métrica mais poderosa, controversa e influente do mundo acadêmico. Ele decide quais remédios chegam às prateleiras das farmácias, quais teorias de psicologia estampam as capas de revistas e quais pesquisadores mantêm seus empregos.

Contudo, nos últimos anos, essa métrica passou do status de ferramenta essencial para o centro de uma crise silenciosa. O fascínio por um único número acabou distorcendo a forma como produzimos conhecimento, gerando um debate acalorado entre cientistas, estatísticos e editores do mundo inteiro.

O número que dividiu a verdade da ilusão

Para entender por que uma simples letra carrega tanto peso, precisamos olhar para como o método científico valida suas descobertas. Quando cientistas testam uma nova hipótese — como a eficácia de um tratamento médico —, eles começam assumindo o oposto do que querem provar: que o tratamento não tem efeito algum. Essa premissa zerada é conhecida como a hipótese nula.

É aqui que entra o valor-p. Ele mede exatamente a probabilidade de obtermos os dados observados, ou algo mais extremo, caso a hipótese nula seja verdadeira. Em termos simples: qual é a chance de estarmos vendo um padrão que na verdade é apenas ruído aleatório?

Quando o cálculo resulta em um valor menor que 0,05, os pesquisadores declaram o achado como estatisticamente significativo. É o carimbo verde que autoriza a publicação. Se o valor for 0,06, por outro lado, o estudo é frequentemente engavetado e considerado um fracasso.

Essa fronteira rígida criou uma divisão binária no pensamento científico. Um lado representa a descoberta confirmada; o outro, o esquecimento. E foi justamente essa obsessão pelo corte de 5% que acendeu o sinal de alerta nas últimas décadas.

Como uma única letra passou a governar os laboratórios

O problema não reside na matemática do cálculo em si, mas na forma como a comunidade científica passou a utilizá-la. Ao longo da segunda metade do século XX, o valor-p deixou de ser um guia diagnóstico para se tornar o objetivo final da pesquisa.

A pressão do ecossistema acadêmico desempenhou um papel central nessa transformação. Universidades e agências de fomento priorizam pesquisadores com longo histórico de publicações. Revistas de prestígio, por sua vez, preferem publicar descobertas surpreendentes e positivas em vez de estudos que mostram que nada mudou.

E é aí que a engrenagem começa a ranger. Quando toda a carreira de um profissional depende de alcançar um resultado abaixo de 0,05, a tentação consciente ou inconsciente de ajustar o processo torna-se gigantesca.

A ilusão da certeza absoluta

Existe um equívoco muito comum entre o público leigo e até mesmo entre estudantes de graduação: a ideia de que um valor-p baixo significa que a hipótese testada é verdadeira. Não é bem assim.

O valor-p não mede a probabilidade de uma teoria estar certa, nem mede o tamanho do efeito de uma descoberta. Um remédio pode ter um valor-p extremamente pequeno simplesmente porque foi testado em dezenas de milhares de pessoas, embora o benefício real para a saúde seja insignificante no dia a dia.

Confundir significância estatística com relevância prática é uma das armadilhas mais frequentes da modernidade. Criou-se uma falsa sensação de certeza onde na verdade existe apenas uma estimativa de ruído.

O incentivo perverso da publicação

Esse cenário gerou o que os historiadores da ciência chamam de viés de publicação. Se cem laboratórios realizam o mesmo experimento e noventa e nove não encontram nenhum resultado relevante, esses noventa e nove estudos dificilmente serão publicados.

Mas o centésimo laboratório, por puro acaso estatístico, encontra um valor-p abaixo do limite. Esse único estudo ganha destaque na imprensa, vira livro e molda políticas públicas. O público nunca fica sabendo das noventa e nove tentativas que falharam.

A arte perigosa do p-hacking

À medida que a competição por verbas e espaço editorial se intensificou, surgiu uma prática conhecida no meio acadêmico como p-hacking — ou tortura de dados. Trata-se de manipular o processo de análise até que o gráfico entregue o número mágico desejado.

Existem muitas maneiras sutis de fazer isso sem necessariamente cometer uma fraude direta. Um pesquisador pode testar dezenas de variáveis diferentes e relatar apenas a única que apresentou resultado estatisticamente significativo.

Outro método comum envolve decidir quando parar a coleta de dados. Se os números estão quase atingindo a marca de 0,05, o cientista coleta mais algumas amostras até que a barra seja ultrapassada. Se já atingiu o valor, a coleta é interrompida imediatamente.

  • Testar múltiplos subgrupos de pacientes até encontrar um onde o remédio funcione.
  • Remover pontos fora da curva sem um critério metodológico claro definido previamente.
  • Transformar variáveis contínuas em categorias arbitrárias para forçar correlações.
  • Mudar a pergunta da pesquisa depois de olhar para os resultados já coletados.

Essas manobras minam a integridade do conhecimento acumulado. O resultado inevitável desse processo foi o estouro da chamada crise de replicabilidade, quando cientistas tentaram refazer experimentos clássicos e descobriram que a maioria não se sustentava.

O impacto invisível no seu dia a dia

Você provavelmente já leu manchetes contraditórias em sites de notícias: em uma semana o café faz bem ao coração; na semana seguinte, aumenta o risco de doenças cardíacas. Chocolate emagrece, depois engorda. Determinado hábito garante longevidade, até que outro estudo diz o oposto.

Essa volatilidade de informações que confunde o consumidor é filha direta do uso inadequado do valor-p. Grande parte dos estudos observacionais de nutrição e comportamento baseia-se em varreduras de enormes bancos de dados em busca de correlações com p menor que 0,05.

Quando um achado desse tipo é publicado, os veículos de comunicação raramente explicam o contexto ou as limitações do cálculo. O resultado é traduzido como uma regra absoluta, gerando ansiedade e perda de confiança da sociedade na própria ciência.

Mas o impacto vai muito além da nutrição. Na medicina, tratamentos ineficazes ou com efeitos colaterais subestimados podem avançar em fases de testes devido a flutuações estatísticas mascaradas por análises seletivas.

O fim da era da métrica única

Diante do acúmulo de evidências de que o sistema atual precisava de correções, as principais associações de estatística do mundo começaram a se posicionar. O recado é claro: nenhuma decisão médica, econômica ou política deve ser tomada com base apenas no fato de um valor-p ter ultrapassado uma linha arbitrária.

A comunidade internacional está gradualmente migrando para abordagens mais transparentes e holísticas. Uma das frentes mais promissoras é o pré-registro de pesquisas. Nesse modelo, os cientistas precisam detalhar publicamente sua metodologia, suas hipóteses e seu plano de análise estatística antes de coletar qualquer dado.

Isso impede o p-hacking posterior, pois qualquer desvio do plano original fica explicitamente exposto para os revisores.

Além disso, há um movimento crescente para priorizar o tamanho do efeito e os intervalos de confiança. Em vez de perguntar apenas "existe um efeito?", a ciência moderna quer saber "qual é o tamanho desse efeito e qual a nossa margem de incerteza sobre ele?".

Outras correntes defendem o uso mais amplo da estatística Bayesiana, que permite incorporar conhecimentos e probabilidades prévias à análise de novos dados, evitando conclusões precipitadas com base em um único evento.

O valor-p não vai desaparecer dos laboratórios, e nem deveria. Ele continua sendo uma ferramenta matemática útil quando bem interpretada e combinada com rigor metodológico.

O que está chegando ao fim é o reinado absoluto de uma métrica isolada sobre a definição do que é real. A ciência está redescobrindo que a busca pela verdade é um processo contínuo, complexo e gradual — um caminho que jamais caberá dentro de uma única letra.

Compartilhar
NewsobaEditor de EditoriaVer perfil

Comentários

Carregando…