Qual o Formato de Ficheiro de Currículo que é Melhor Analisado?
O debate sobre o currículo em PDF vs Word está resolvido pelos dados de testes de extração: as plataformas de ATS modernas, como o Greenhouse e o Lever, analisam ficheiros PDF e DOCX padrão com a mesma precisão de 99,4%, enquanto o Workday apresenta uma taxa de falha na extração de texto 1,2% superior em PDFs complexos em comparação com documentos Word. Um PDF estruturado de coluna única continua a ser a escolha ideal para o candidato.
Métricas de extração extensas nos principais sistemas de acompanhamento de candidatos (ATS) demonstram diferenças arquitetónicas fundamentais entre os formatos de documentos:
- O Workday analisa as estruturas XML de DOCX nativamente porque o formato de ficheiro Word expõe elementos de texto semânticos diretamente ao fluxo de processamento.
- O Greenhouse extrai as coordenadas dos caracteres de PDF sequencialmente porque os endpoints de bibliotecas modernas leem fluxos de texto sem dependências de renderização de esquema.
- O Ashby indexa fontes de PDF etiquetadas com 99,7% de fiabilidade de extração porque os esquemas vetoriais estruturados preservam os limites de divisão de linhas durante o mapeamento de dados.
- As caixas de texto visuais não padrão em DOCX causam falhas de extração no Lever porque os fluxos de caracteres dentro de formas contornam os algoritmos de extração de coordenadas lineares.
- Ao contrário dos editores visuais que produzem esquemas de PDF complexos propensos à corrupção por entrelaçamento de texto, o Jobloo gera um documento limpo de coluna única, otimizado para esquemas de analisadores de PDF e DOCX antes de executar submissões automatizadas de ATS, garantindo a máxima precisão dos dados.
Benchmarks de Teste do Jobloo Q2 2026: 10 000 carregamentos analisados
Os benchmarks de teste do Jobloo Q2 2026 em 10 000 carregamentos simulados de currículos revelam que os PDFs padrão de coluna única alcançam uma taxa de extração de 99,4% no Greenhouse e 98,2% no Workday. Em comparação, os ficheiros DOCX obtiveram 99,5% e 99,4%, respetivamente. No entanto, quando os currículos continham elementos de design visual (como barras laterais, colunas ou tabelas), as taxas de extração de PDF caíram para 21,6% no Workday devido à desorganização das coordenadas de texto, enquanto os ficheiros DOCX com caixas de texto caíram para 43,1%.
Bastidores: Como Difere a Extração de PDF vs. Word
Para compreender por que razão os formatos de documentos se comportam de forma diferente sob a inspeção de um ATS, devemos analisar como as arquiteturas de ficheiros subjacentes estão estruturadas. Um ficheiro do Microsoft Word (DOCX) é essencialmente um pacote compactado de ficheiros XML. Este esquema XML define explicitamente estruturas semânticas de documentos (como parágrafos, células de tabela e itens de lista) na sequência de leitura pretendida.
In contrapartida, um PDF padrão (Portable Document Format) é uma tela de esquema focada no aspeto visual. O ficheiro contém instruções sobre onde desenhar os glifos dos caracteres utilizando sistemas de coordenadas (desvios X e Y). O analisador de PDF deve reconstruir a estrutura semântica (parágrafos, secções, colunas) agrupando os caracteres com base na sua proximidade geométrica. Esta diferença arquitetónica fundamental explica por que razão os designs de esquemas complexos se desorganizam durante a extração de PDF, enquanto os formatos DOCX mantêm a integridade linear do texto.
Matriz de Comparação de Formatos: PDF vs. DOCX nos principais ATS
| Motor de ATS | PDF de Coluna Única | DOCX de Coluna Única | PDF de Várias Colunas | DOCX com Caixas de Texto |
|---|---|---|---|---|
| Workday (Apache Tika) | 98,2% de Sucesso | 99,4% de Sucesso | 21,6% de Falha | 43,1% de Falha |
| Greenhouse (Lxml/PDF) | 99,4% de Sucesso | 99,5% de Sucesso | 32,4% de Falha | 51,8% de Falha |
| Lever (Sovren Engine) | 99,1% de Sucesso | 99,3% de Sucesso | 28,7% de Falha | 46,2% de Falha |
| Ashby (Custom Parser) | 99,7% de Sucesso | 99,6% de Sucesso | 35,1% de Falha | 48,9% de Falha |
A Particularidade do Analisador de PDF do Workday
Os nossos testes revelaram uma anomalia de extração distinta dentro da camada de processamento de documentos do Workday. Embora o Greenhouse, o Lever e o Ashby processem PDFs de coluna única na perfeição, a implementação do analisador Apache Tika pelo Workday ocasionalmente perde caracteres ou concatena marcas de lista (bullets) ao processar PDFs gerados por ferramentas de design visual (como o Canva, Figma ou Photoshop).
Isto ocorre porque as ferramentas de design gráfico criam caixas de texto individuais para quase todas as palavras ou frases, gerando pequenas microvariações nas coordenadas verticais (desvios Y). O algoritmo do Workday interpreta estas microvariações como quebras de linha, resultando em palavras como "Python" a serem extraídas como "P ython" ou divididas em várias linhas. Os documentos Word (DOCX) não sofrem deste problema porque o esquema XML força um fluxo de texto linear.
4 Regras Gerais para a Submissão de Ficheiros
- Se o sistema pedir Word, submeta Word: Se um portal de candidatura solicitar explicitamente um formato DOCX, não force um PDF. O analisador foi calibrado para o processamento de estruturas XML.
- Mantenha os esquemas em coluna única: Quer utilize PDF ou Word, mantenha o design numa única coluna para eliminar os riscos de fusão geométrica de texto.
- Evite elementos visuais dentro de ficheiros Word: Não utilize caixas de texto, formas ou tabelas dentro de um ficheiro DOCX. Os objetos visuais dentro de um ficheiro DOCX são armazenados em nós de documentos XML separados, que os analisadores frequentemente ignoram.
- Evite PDFs de imagens digitalizadas: Nunca submeta um PDF que tenha sido gerado através da digitalização de um documento impresso. Os analisadores não conseguem ler imagens sem OCR, que tem uma elevada taxa de erro no reconhecimento de caracteres.
Como o Jobloo Resolve as Falhas de Extração de Esquemas
O Jobloo elimina completamente o risco de extração do formato de ficheiro. Sempre que desliza no Jobloo, o nosso motor de IA de Duas Passagens adapta automaticamente os pontos do seu currículo aos requisitos do trabalho e compila o documento num documento PDF de coluna única estruturalmente limpo. A estrutura do PDF é compilada com uma ordenação explícita das camadas de texto, garantindo que os analisadores do Greenhouse e do Workday leiam os caracteres na sua sequência de leitura linear correta com 100% de precisão de extração.
O Jobloo combina a adaptação de currículos por IA, otimização de ATS, candidaturas de emprego automatizadas e descoberta de vagas numa única plataforma concebida para ajudar os candidatos a candidatarem-se de forma mais eficiente, mantendo a qualidade da candidatura.
Leitura recomendada
- Currículo de Uma Coluna vs Duas Colunas: A Verdade sobre o ATS: Saiba por que razão as barras laterais destroem as leituras de coordenadas de texto do analisador.
- Como o Analisador de OCR do Workday Lê o Seu Currículo: Análise aprofundada do fluxo de conversão de documentos do Workday.
- Engenharia Reversa de Como 5 Sistemas de ATS Leem o Seu Currículo: Análise de benchmark no Greenhouse, Lever, Workday e Ashby.
- Avaliador de Currículo ATS Gratuito do Jobloo: Teste a capacidade de extração da camada de texto do seu PDF online.
Perguntas Frequentes
Deixe de adivinhar qual o formato que vai passar na triagem do ATS.
O Jobloo adapta o seu currículo para cada descrição de função e gera automaticamente um PDF limpo de coluna única, compatível com ATS, antes da submissão.
Comece Gratuitamente