Por Ludmila Praslova, Ph.D., SHRM-SCP, Âû
Quando Pontuações Altas Preveem Baixo Desempenho
A Zia obteve uma pontuação de 95% nas avaliações de seleção da sua empresa. Rápida no teste de capacidade cognitiva, perfil de personalidade desejável e entrevista em vídeo irrepreensível. O sistema de seleção automatizado sinalizou-a como uma “candidata de topo” para a função de analista de cibersegurança. Entretanto, Marcus mal atingiu o limite: mais lento em testes cronometrados, desajeitado em entrevistas em vídeo e sinalizado por “padrões de comunicação invulgares”.
Seis meses depois, as avaliações de desempenho contaram uma história diferente.
Zia não tinha detectado várias vulnerabilidades críticas de segurança. Marcus detetou mais no seu primeiro mês do que os seus colegas mais experientes. O sistema de avaliação tinha previsto exatamente o oposto do desempenho real.
Isto não é hipotético. Está a acontecer em todo o lado – as tecnologias de contratação supostamente sofisticadas não passam no teste principal de validade: prever quem se destacará na função.
O Problema da Dupla Validade
Problema 1: Medir as coisas erradas
A maioria das falhas na contratação decorre de erros fundamentais de validade da seleção, como a medição de características que não preveem a performance no trabalho. Antes de qualquer avaliação ser válida, as organizações precisam compreender o que a vaga/função realmente exige através de uma análise sistemática do cargo. Mas, em vez disso, muitas utilizam métodos de seleção tradicionais que frequentemente enfatizam o carisma e as respostas rápidas, mesmo quando estas são irrelevantes para o desempenho no trabalho.
Por exemplo, a atenção aos detalhes é essencial para as funções relacionadas com a cibersegurança. E, no entanto, no exemplo de Zia e Marcus, isto não foi tão proeminente nas avaliações utilizadas como as características irrelevantes de personalidade e comunicação e a velocidade de processamento. Não admira que um candidato melhor tenha passado por pouco – e é provável que muitos candidatos mais qualificados do que Zia tenham sido rejeitados.
Eis alguns outros exemplos de avaliações irrelevantes que podem influenciar os resultados da contratação em situações semelhantes à de Zia a superar Marcus:
- Entrevistas em vídeo que avaliam o contacto visual para funções de cibersegurança em que a interação social não é crítica para o trabalho.
- Testes cognitivos cronometrados que recompensam a velocidade em detrimento da precisão quando o trabalho exige a resolução completa dos problemas e a atenção aos detalhes.
- Avaliação da personalidade que prevê uma “personalidade ideal” genérica, definida como extroversão ou “carisma”, em vez de medir capacidades de trabalho específicas.
O padrão do problema é claro: avaliar exaustivamente as características gerais, ignorando as funções essenciais e as competências profissionais específicas. A solução também é clara: seja específico. Se a conversa informal não faz parte do trabalho, não a meça. Se a verificação de factos for essencial, teste-a diretamente.
Problema 2: Instrumentos de medição que não funcionam para todas as populações
Para além da medição das características irrelevantes, existe um problema adicional: nem todos os instrumentos de medição são válidos para todas as populações – devem ser avaliados quanto à validade para grupos específicos. Atualmente, no entanto, os instrumentos são frequentemente concebidos e validados com base na população neurotípica, que pode ser muito diferente dos candidatos neurodivergentes.
Mesmo as avaliações relevantes para o cargo podem reprovar os candidatos neurodivergentes por:
- Viés de formato que contamina medidas que, de outra forma, seriam válidas;
- Fatores ambientais (distrações sensoriais, ansiedade em testes);
- Variações no estilo de comunicação que influenciam a interpretação das instruções.
Por exemplo, importa COMO a inteligência é medida. As pesquisas mostram que as crianças autistas obtiveram, em média, mais 30 pontos percentuais nos testes de QI de Raven do que nos de Wechsler, com alguns casos a apresentarem diferenças superiores a 70 pontos percentuais. O teste de Raven mede a inteligência com foco na compreensão de padrões visuais, enquanto o de Wechsler se baseia fortemente no raciocínio verbal sob pressão de tempo.
Isto significa que uma avaliação de contratação pode ser perfeitamente válida para medir as capacidades analíticas dos candidatos neurotípicos, mas ignorar completamente os pontos fortes dos candidatos neurodivergentes, que podem processar a informação de forma diferente. Isto exige a validação de avaliações para autistas, PHDA, disléxicos e outras populações neurodivergentes. Os inquéritos do setor encontraram diferenças insignificantes nas pontuações entre indivíduos neurotípicos e neurodivergentes em avaliações cognitivas adequadamente elaboradas, desafiando as suposições negativas sobre as capacidades neurodivergentes. Pesquisas com a Specialisterne – que aloca funcionários no Canadá – mostram também que a seleção e o apoio cuidado resultam em empregos bem-sucedidos para pessoas com autismo.
A Estrutura da Solução
Passo 1: comece com a análise do trabalho
Documente as tarefas críticas, as competências essenciais e os padrões de desempenho antes de elaborar as avaliações de seleção. Ter um registo claro dos principais conhecimentos, competências, capacidades e outras características relevantes para o cargo fornece a base para uma seleção válida. Concentre-se em competências demonstráveis em vez de indicadores de personalidade. O candidato consegue executar as tarefas exigidas de acordo com os padrões exigidos?
Passo 2: Auditar as ferramentas atuais
· Comparar as avaliações com os resultados da análise de cargos
· Identificar componentes que medem características irrelevantes
· Analisar se os estudos de validação incluíram participantes neurodivergentes. Caso contrário, procurar ferramentas que tenham sido validadas junto de populações neurodivergentes.
· Testar o desempenho diferencial entre populações
Passo 3: Priorizar a avaliação relevante para o trabalho
Amostras de Trabalho como Padrão Ouro: A maior validade advém dos candidatos que realizam tarefas reais. Os engenheiros de software devem programar, os professores devem demonstrar competências de ensino, os investigadores devem avaliar as fontes e os representantes do serviço de apoio ao cliente devem demonstrar como se envolveriam com os clientes.
Entrevistas Estruturadas: Por vezes, a demonstração de competências é tudo o que é necessário. Mas se precisar de utilizar entrevistas, utilize-as, tendo em conta que os humanos podem processar a informação de diferentes formas, mas ainda assim serem igualmente capazes de realizar o trabalho. Concentre-se em exemplos de desempenho passado relevantes para funções essenciais do trabalho, em vez de cenários hipotéticos, e evite perguntas vagas ou intencionalmente capciosas, a menos que lidar com “caprichos” faça parte da descrição do cargo.
Elimine os critérios não relacionados com o trabalho: por exemplo, remova as avaliações de extroversão para funções de análise e fabrico de precisão, tarefas cronometradas para trabalhos que exijam atenção aos detalhes e medidas de adequação cultural que se correlacionem com padrões de comunicação neurotípicos.
Passo 4: Continue a validar o seu sistema de seleção entre as várias populações
Mesmo as avaliações relevantes para o trabalho requerem validação específica para a população e para o contexto:
· Verifique a validade preditiva equivalente em todos os perfis neurológicos
· Teste para viés ambiental ou processual
· Ofereça formatos alternativos quando necessário e documente a eficácia da acomodação, como por exemplo fazer os testes em ambientes silenciosos e com instruções oferecidas em diferentes formatos
Continue a avaliar o desempenho, a retenção, a satisfação e outros resultados ao longo do tempo e esteja preparado para ajustar o sistema conforme necessário.
Siga em frente
A contratação inclusiva mais eficaz aborda simultaneamente ambos os desafios de validade – relevância geral e validade para grupos específicos. Isto levará a uma maior justiça e a resultados comerciais superiores através de:
- Maior Poder Preditivo: As avaliações relevantes para o cargo, validadas em diferentes populações, fornecem as previsões de contratação mais precisas.
- Produtividade: Quando as organizações se concentram no que realmente prevê o desempenho, em vez de indicadores irrelevantes, fazem melhores contratações, independentemente do perfil neurológico. Por outras palavras, as empresas têm muito mais probabilidade de contratar colaboradores com uma excelente adequação a cargos específicos e que se tornem profissionais de alto desempenho, como Marcus.
- Menor Risco Jurídico: As avaliações relevantes para o cargo e validadas em diferentes populações cumprem os mais elevados padrões de defesa legal.
A promessa da contratação “científica” só pode ser cumprida quando a própria ciência é inclusiva e válida. Uma avaliação válida não se trata de baixar padrões ou abrir exceções. Trata-se de medir o que realmente importa: os candidatos podem desempenhar a função? Quando as avaliações se centram em competências relevantes para o cargo e abrangem diferentes populações, todos beneficiam.
