Resumo executivo
A pesquisa de clima anual não mede o ano. Ela mede o que a pessoa lembra do ano, e memória de experiência não funciona como gravador.
A ciência é bem estabelecida e tem nome: regra do pico-fim. A avaliação retrospectiva de um período é prevista quase inteiramente por dois pontos, o momento de maior intensidade emocional e como aquilo terminou. O meio é dissolvido. Um levantamento anual, portanto, não devolve a média de doze meses. Devolve o pior dia e as últimas semanas.
Isso não invalida a pesquisa anual. Invalida usá-la sozinha, e sobretudo tratá-la como retrato fiel do período.
Este texto explica o que cada instrumento realmente mede, por que somar os dois produz conclusão falsa, e como decidir a frequência sem cair na armadilha de achar que mais pesquisa é mais escuta.
O que a pesquisa anual realmente mede
Em 1993, Daniel Kahneman, Barbara Fredrickson, Charles Schreiber e Donald Redelmeier publicaram o estudo que ficou conhecido como a origem da regra do pico-fim. O achado se repetiu em contextos diferentes, incluindo o experimento com pacientes de colonoscopia de Kahneman e Redelmeier em 1996.
A conclusão desconfortável: quando alguém avalia um período de forma retrospectiva, o julgamento é dominado pelo pico de intensidade e pelo final. A duração quase não pesa, fenômeno batizado de negligência da duração.
Uma meta-análise publicada em 2022 no Organizational Behavior and Human Decision Processes testou o efeito contra várias condições de contorno e o encontrou grande e robusto, com força comparável à do próprio escore médio do período e maior que a da tendência ou da variabilidade.
Kahneman resumiu a implicação separando dois sujeitos que convivem na mesma pessoa: o eu que experimenta, que vive os dias, e o eu que lembra, que faz o balanço e decide. Quem responde à sua pesquisa é o segundo.
Traduzindo para o RH: se uma área passou dez meses estáveis, teve uma reestruturação traumática em março e voltou ao normal, a pesquisa de novembro vai registrar quase nada daquilo. Se a mesma área teve dez meses difíceis e três semanas boas antes do envio, o resultado vem melhor do que o ano foi.
Os números se movem mais rápido do que uma foto por ano
O relatório State of the Global Workplace do Gallup, que ouve cerca de 250 mil trabalhadores em 160 países, registrou queda do engajamento global de 23% para 21% em um ano, a primeira queda anual desde o período de 2019 a 2020. O custo estimado foi de US$ 48 bilhões em produtividade perdida.
Mas o número agregado esconde o essencial.
Engajamento, variação no período
Gestores 30% -> 27% ███████▼ -3 pontos
Contribuidores ind. 18% -> 18% ████████ estável
Média global 23% -> 21% ███████▼ -2 pontos
A queda inteira veio da liderança. O engajamento de gestores caiu de 30% para 27%, enquanto o de contribuidores individuais ficou parado em 18%. Entre gestores com menos de 35 anos a queda foi de 5 pontos, e entre gestoras, de 7 pontos.
Uma pesquisa anual reportando a média da empresa teria produzido a manchete "engajamento caiu 2 pontos" e uma discussão sobre benefícios, quando o problema estava concentrado em quem lidera. A ação correta e a ação sugerida pelo número agregado são diferentes.
A média esconde quem se moveu
O caso acima não é exceção, é regra. Duas configurações completamente distintas produzem a mesma média:
| Cenário | Média | O que está acontecendo | Ação correta |
|---|---|---|---|
| Consenso morno | 6,0 | quase todo mundo indiferente | melhoria incremental |
| Time dividido | 6,0 | metade em 9, metade em 3 | investigar a clivagem |
São situações opostas e pedem decisões opostas, e o painel que mostra só a média as apresenta como idênticas. Por isso distribuição não é enfeite: é o que distingue um problema difuso de uma fratura.
O mesmo vale para recortes. Quando você fatia por área, cada fatia carrega margem de erro maior que a do total, e uma área com poucos respondentes produz número que serve para levantar hipótese, nunca para virar veredito. Tratamos disso em detalhe no guia de NR-1 e riscos psicossociais, onde o recorte por fator e área é exigência da norma.
Fadiga de pesquisa não é sobre frequência
Aqui mora o maior mal-entendido do tema.
A explicação usual para adesão baixa é que as pessoas estão cansadas de responder. A evidência aponta para outra coisa: elas não cansam de ser perguntadas, cansam de ser perguntadas e não ver nada mudar.
A prova é a assimetria. Um questionário de seis perguntas por semana, sem nenhuma ação visível, destrói a taxa de resposta mais rápido do que uma pesquisa anual destruiria. Frequência alta com consequência visível sustenta adesão; frequência baixa sem consequência também a destrói, só que mais devagar.
Existe um limiar prático que vale ter na cabeça: adesão abaixo de 50% é sinal, não detalhe operacional. As causas costumam ser três, e nenhuma se resolve encurtando o formulário: cansaço de processo sem retorno, desconfiança do anonimato, ou a percepção acumulada de que a resposta não tem destino.
Isso tem implicação direta para quem precisa cumprir a NR-1, porque a norma exige comunicar de volta aos trabalhadores o inventário consolidado e as medidas adotadas. O ciclo fechado deixou de ser boa prática e virou item de conformidade.
O erro oposto: pulso sem base
Corrigir o excesso de foto anual trocando tudo por pulso semanal produz outro problema.
Quem roda apenas o anual sabe o que aconteceu há seis meses. Quem roda apenas pulso tem sinal contínuo e nenhuma linha de base comparável, nenhum inventário completo e nenhuma referência de setor.
Os dois instrumentos medem coisas diferentes, e é justamente por isso que se complementam:
| Pesquisa aprofundada | Escuta contínua | |
|---|---|---|
| Regime de memória | retrospectiva de meses | experiência recente |
| O que captura bem | estrutura, benefícios, percepção consolidada | variação, agravo, sinal precoce |
| O que captura mal | o que aconteceu no meio do período | visão completa e comparável |
| Unidade de decisão | ciclo de gestão | semana |
| Serve para | diagnóstico amplo | detecção e acompanhamento |
Por que não somar os dois
Este é o ponto técnico que mais gente erra, e o erro é silencioso.
Se você tem duas fontes de dados com regimes de memória diferentes, populações de respondentes diferentes e frequências diferentes, somá-las numa média única não produz um número melhor. Produz um número que se move por motivo errado.
O nome do fenômeno é paradoxo de Simpson: a média combinada pode subir enquanto todos os grupos que a compõem caem, bastando que a proporção entre eles mude. E a proporção entre um instrumento semanal e outro trimestral muda o tempo todo, por construção.
Na prática, a regra é simples: placares separados. Cada instrumento com seu próprio número, sua própria série e sua própria margem de erro. Comparar é legítimo. Fundir não é.
Há um segundo cuidado, menos conhecido, sobre comparar ciclos entre si. Toda vez que o instrumento muda, seja pergunta nova, ordem diferente ou peso alterado, a série ganha uma descontinuidade. Comparar dois ciclos medidos com réguas diferentes produz conclusão falsa com aparência de tendência. Por isso registrar a versão do instrumento junto de cada número não é burocracia: é o que permite dizer com segurança o que é comparável.
A ordem das perguntas também mede
Um detalhe que quase nenhum material comercial menciona: a posição de uma pergunta altera a resposta dela.
O efeito parte-todo é bem documentado. Quando você pergunta sobre itens específicos (carga, liderança, salário) e só então faz a pergunta geral (o quanto você recomendaria trabalhar aqui), a pergunta geral chega contaminada pelos itens que acabaram de ser evocados. A pessoa não responde mais sobre a experiência inteira: responde sobre o que ficou fresco.
A consequência prática é que eNPS no fim do questionário é a pior posição possível, e é exatamente onde a maioria das ferramentas o coloca. Tratamos disso em eNPS: como calcular, interpretar e onde ele falha.
Há ainda o viés de aquiescência, a tendência de concordar com afirmações independentemente do conteúdo, que infla resultado em escalas de concordância mal construídas.
Nada disso é curiosidade acadêmica. São efeitos de tamanho suficiente para explicar variação que a empresa vai atribuir a uma mudança de gestão.
Como decidir a frequência
Sem receita universal, mas com um critério que funciona: a frequência deve acompanhar a velocidade da decisão que o dado vai informar.
| Se a decisão é... | A frequência útil é... |
|---|---|
| revisão de política de benefícios | anual ou semestral |
| acompanhamento de plano de ação | mensal |
| detecção de agravo e risco ocupacional | semanal |
| resposta a incidente específico | sob demanda |
Medir mais rápido do que a organização consegue agir não gera valor, gera fadiga. E medir mais devagar do que o risco se desenvolve significa descobrir tarde, que é o problema que a NR-1 tenta resolver.
Checklist
- Cada instrumento com placar próprio, sem fundir médias de fontes diferentes
- Distribuição sempre ao lado da média, para distinguir consenso morno de time dividido
- Adesão reportada junto de todo índice, e tratada como achado quando cai
- Recorte pequeno rotulado como hipótese, nunca como veredito
- Versão do instrumento registrada, para saber quais ciclos são comparáveis
- Pergunta geral antes das específicas, para não contaminar por efeito parte-todo
- Frequência definida pela velocidade da decisão, não pela ansiedade do painel
- Devolutiva ao respondente a cada ciclo, porque é ela que sustenta a adesão seguinte
Conclusão
A pergunta "anual ou contínua" está mal formulada. Os dois instrumentos medem construtos diferentes, e a escolha errada não é preferir um deles: é fingir que são o mesmo e somá-los.
O que a evidência sustenta com clareza é mais modesto e mais útil: uma foto anual descreve o pico e o fim, não o ano. Se a sua organização precisa detectar agravo antes que ele vire afastamento, ou demonstrar gestão contínua de risco como a NR-1 passou a exigir, um instrumento que só olha para trás uma vez por ano não é suficiente, por melhor que ele seja.
Para continuar: o guia de NR-1 e riscos psicossociais trata da exigência de gestão contínua e do que sustenta um inventário quando ele é examinado. Por que conversas superam formulários trata do instrumento de coleta. E o custo real do turnover mostra o que a detecção tardia custa.
Perguntas frequentes
Referências
- Gallup: State of the Global Workplace (dados globais e por recorte)
- Kahneman, Fredrickson, Schreiber e Redelmeier (1993): When More Pain Is Preferred to Less
- Meta-análise do efeito pico-fim e da negligência da duração (Organizational Behavior and Human Decision Processes, 2022)
- The Decision Lab: Peak-End Rule
- Estudo sobre viés de memória pico-fim em ansiedade (PMC / NIH)
- Ministério do Trabalho e Emprego: Manual sobre o GRO e o PGR da NR-1
Quer ouvir o que sua equipe não diz em formulários?
Converse com a Laura e veja a escuta contínua por IA funcionando na prática.
Falar com a Laura