Qué le hace realmente un ATS al archivo de tu CV
Tu CV es una maquetación. El sistema que lo recibe quiere una fila de base de datos. Todo lo que cuenta esta página ocurre en el hueco entre esas dos cosas. Un programa abre tu archivo, extrae un único flujo lineal de texto y luego intenta averiguar qué parte de ese flujo es tu nombre, cuál es una empresa, cuál un puesto, cuáles son fechas y cuáles competencias. Aquello cuyo significado vive en la disposición visual y no en el orden del texto puede reordenarse, pegarse al campo equivocado o perderse antes de que una persona lo abra. Lo importante primero: nada de eso es culpa tuya. "No pudimos leer tu archivo" es un informe sobre software, no un juicio sobre tu carrera.
"No pudimos leer tu archivo": qué está informando de verdad esa frase
Dedicas una tarde a tu CV. Está limpio, cabe en dos páginas, los espacios están bien repartidos y, por una vez, estás algo orgulloso de él. Lo subes y o no pasa nada durante tres semanas, o vuelve una línea diciendo que el archivo no se pudo leer. Sin diagnóstico, sin sección señalada, sin la menor pista de qué falló. Ese silencio es todo el problema, porque lo que salió mal se puede saber perfectamente y nadie te lo cuenta.
Un ATS no lee tu CV como tú lo ves. Extrae del archivo un flujo lineal de texto y trata de repartirlo en campos de base de datos, de modo que todo aquello cuyo significado depende de la maquetación y no del orden del texto puede reordenarse, fundirse con el campo vecino o perderse.
El mensaje de error literal es más estrecho de lo que se cree. Cubre una lista corta de causas, todas en el propio archivo: un PDF escaneado o hecho de imágenes, con la capa de texto vacía; un documento protegido con contraseña o bloqueado contra copia; un archivo cuya extensión no coincide con su contenido real; o un formato que el formulario simplemente no acepta. Es un fallo de lectura al nivel de los bytes. Ese mensaje no juzga tu experiencia.
Una delimitación antes de seguir, porque dos preguntas distintas se mezclan constantemente. Esta página trata de cómo se rompe el archivo en la entrada. Si después un sistema automático te descarta por el contenido es otra discusión, y la traté en el artículo sobre si un ATS rechaza CV automáticamente. No la voy a repetir aquí.
Y la concesión, ya mismo en lugar de enterrada al final, porque es la objeción más fuerte contra toda la página. No deberías tener que diseñar tu CV alrededor de un software incapaz de leer dos columnas. Eso es un fallo de ingeniería del proveedor, no del candidato. Quien perdió una entrevista por un error de orden de lectura no hizo nada mal, y nadie debería tener que aprender las tripas de los formatos de documento para buscar trabajo. Escribo la página igualmente por una razón muy concreta: saberlo no te cuesta nada, y el correo de rechazo nunca te lo va a contar.
Tu CV es un dibujo. El programa quiere una fila de base de datos.
Un PDF guarda glifos en coordenadas, no estructura. Esa sola frase explica casi todo lo que viene después, así que esto es lo que significa en cristiano. Una página PDF es un conjunto de instrucciones de dibujo: coloca este carácter, con esta tipografía, en esta posición x e y. No dice "esto es un encabezado", "esto es una celda de tabla", "este bloque es la columna lateral". Salvo que el archivo lleve un árbol de etiquetas de accesibilidad, cosa que la mayoría de los CV exportados desde una herramienta de diseño no tienen, esa información solo existe en tus ojos.
Así que el extractor tiene que reconstruirla por inferencia. Agrupa glifos en palabras mirando los huecos, palabras en líneas por su línea base común, y líneas en bloques por proximidad. Cada uno de esos pasos es una suposición que acierta la mayoría de las veces. Cada fallo de más abajo es una de esas suposiciones descarrilando en una maquetación que se lo puso difícil.
Un DOCX es otro animal. Por dentro es un zip de XML en el que un párrafo es un elemento párrafo, una tabla es un elemento tabla y un encabezado lleva un estilo con nombre. La estructura está declarada en vez de inferida. Eso no significa que debas mandar siempre Word. Muchos programas manejan el PDF perfectamente, un PDF se ve igual en cualquier ordenador y bastantes empresas solo aceptan uno de los dos formatos. Sigue siempre primero la instrucción de la oferta. Lo cierto es más estrecho: un DOCX le entrega estructura que de otro modo tendría que adivinar.
La otra mitad del trabajo es el mapeo. Una vez hay un flujo de texto, el sistema intenta rellenar campos. Estos son los que cuentan, y cada fallo de abajo es el fallo de uno de ellos.
- Nombre
- Datos de contacto: correo, teléfono, ciudad
- Empresa, en cada puesto
- Cargo, en cada puesto
- Fecha de inicio y de fin, en cada puesto
- Competencias
- Formación y titulaciones
Ya has visto el resultado de ese mapeo sin que nadie te dijera que era eso. Cuando un formulario de candidatura te obliga a subir el archivo y luego a teclear los mismos tres empleos en casillas, las casillas que llegaron rellenadas son ese mapeo enseñando su trabajo, y las que llegaron mal son ese mapeo fallando delante de ti. Si ese paso significa que alguien lo revisa es otra pregunta, y la respondí en el artículo sobre subir el CV y rellenar el formulario igualmente.
"La columna lateral se lee en mitad de tu experiencia laboral"
Esa frase viene de una persona que publica en r/resumes, que dice procesar CV profesionalmente y que describió lo que se rompía en una muestra de 3.835 archivos que afirma haber procesado. Volveré sobre cuánto peso puede soportar esa cifra. La frase en sí no necesita ninguna muestra para sostenerse, porque se deduce directamente de cómo se reconstruye el orden de lectura, y es el fallo más caro de toda la página.
Imagina la maquetación que trae casi cualquier plantilla moderna: una columna estrecha a la izquierda con competencias e idiomas, una columna ancha a la derecha con tu experiencia. En pantalla las dos columnas están claramente separadas. En el archivo son solo glifos en coordenadas, y los de la izquierda comparten las mismas líneas base horizontales que los de la derecha. Un extractor que agrupa por líneas, en lugar de detectar primero el límite entre columnas, las saca juntas.
Lee el segundo bloque como lo leería una máquina. La línea que debería llevar tu cargo dice ahora "Python Controller financiero". Un sistema que busca un cargo en esa línea obtiene un cargo con un lenguaje de programación soldado delante. Tus competencias ya no son una lista, son la primera palabra de cuatro líneas sin relación. Y si el extractor agrupa por bloques y deja caer la columna lateral donde la proximidad lo sugiere, la columna de competencias puede aterrizar entre dos empleos, de modo que las fechas siguientes se enganchan al puesto equivocado. Ese es el mecanismo de un CV que muestra los diez años correctos en pantalla y los equivocados en la base de datos.
Cómo se siente
Leyeron mi CV y decidieron que no era lo bastante bueno.
Qué puede haber pasado
No se detectó el límite entre columnas, así que el campo de cargo de tu puesto más reciente llegó con una competencia pegada delante y tus fechas enganchadas al empleo de abajo.
El mismo archivo, la misma experiencia, la misma tarde invertida en él. Solo una de las dos versiones te dice qué cambiar.
La reserva honesta: muchos programas detectan las columnas perfectamente, y no puedo decirte de antemano cuál está al otro lado de un envío concreto. El consejo no es, por tanto, "dos columnas te destrozarán". Es más estrecho y más defendible. Una maquetación a una sola columna elimina la ambigüedad en lugar de apostar a que se resuelva bien. No pierdes nada que un reclutador valore, porque a nadie lo han contratado nunca por una columna lateral.
Tablas aplanadas, bloques de competencias y daño al nivel del carácter
El segundo fallo reportado en ese mismo hilo era una sección de competencias aplanada en un solo bloque, y las tablas suelen ser la causa. Una tabla da sentido al lector mediante la rejilla: esta celda va con aquella. En un flujo extraído los límites de celda han desaparecido, y lo que queda es una ristra de palabras en el orden en que se recorrieron las celdas.
Cada emparejamiento es ahora una suposición, y empeora más adelante. La detección de competencias suele funcionar buscando términos conocidos en el texto. Un término fundido dentro de una cadena más larga, o partido donde el extractor cree ver un salto de línea, sencillamente puede no encontrarse. Tenías la competencia en el papel. La búsqueda no la vio, y eso no se informa en ninguna parte.
Luego está el nivel del carácter, la parte de la que casi nadie escribe. Las viñetas personalizadas de una tipografía de iconos salen a menudo como un carácter sin mapear o como nada. Las ligaduras son el ejemplo más claro, y esto lo sé de primera mano porque me costó una semana en el extractor de PDF del propio careerify. Una ligadura es un solo glifo que dibuja dos caracteres a la vez, como muchas tipografías dibujan la fi de un trazo. En una tipografía muy común de Windows, nuestro extractor devolvía ese glifo como carácter nulo, así que la palabra llegaba con un agujero en medio. En pantalla el CV era impecable. En el flujo extraído había una palabra rota, y nada en el archivo lo anunciaba.
Casi todo lo de esta página es invisible desde tu lado. El archivo parece correcto porque tú miras el dibujo. El programa mira las instrucciones.
Las partes de tu CV que el programa quizá nunca vea
El orden de lectura y las tablas revuelven lo que sí está. Esta sección va de contenido que no llega al flujo de texto en absoluto, que es peor: un campo revuelto todavía puede encontrarlo una persona que ojea, y uno ausente no.
| Lo que hay en la página | Lo que recibe el programa | Lo que elimina la ambigüedad |
|---|---|---|
| Nombre y datos de contacto en el encabezado o pie de página | El encabezado y el pie son un punto de pérdida habitual. Están fuera del flujo principal, y algunos extractores los saltan a propósito porque en otros tipos de documento son mobiliario repetido. | Pon tu nombre, correo y teléfono en el cuerpo de la primera página, arriba del todo. |
| Texto dentro de un logotipo, un icono, una foto o una barra de nivel | Nada. Una imagen son píxeles. No hay texto que extraer, y ningún programa lo recupera sin reconocimiento óptico, que la mayoría no ejecuta. | Escribe cada afirmación como texto real. Las barras y las estrellas no aportan información verificable de todos modos. |
| Un cuadro de texto flotante o una forma dibujada | Depende por completo de la exportación. El contenido puede aterrizar al principio del todo, al final del todo o en ninguna parte. | Mantén el contenido en párrafos normales, dentro del flujo principal. |
| Un encabezado como "Mi trayecto" o "Por dónde he pasado" | Los detectores de secciones cotejan con un vocabulario de títulos esperado. Un título que no conocen puede dejar sin clasificar toda la sección de debajo. | Usa las palabras llanas: Experiencia, Formación, Competencias. Sé original en las frases, no en las etiquetas. |
| Fechas escritas como 23 a 25, verano de 2024, o solo un año | Un intervalo ambiguo es más difícil de enganchar al puesto correcto, y una fecha que el programa no resuelve puede engancharse al puesto vecino. | Escribe el mes y el año completo, con el mismo formato siempre: ene 2023 - mar 2025. |
| Una página escaneada, una foto de una página o un CV exportado como imagen | Una capa de texto vacía. No deja absolutamente nada que extraer, y por eso es lo primero que hay que descartar cuando un archivo no se puede leer. | Exporta siempre desde el documento original en vez de escanearlo o hacerle una captura. |
Las fechas merecen una línea extra porque son las más silenciosas de las seis. Tu historial es una sucesión de intervalos, y el programa tiene que averiguar dónde empieza cada uno, dónde acaba y a qué empresa pertenece. Dale un mes y un año de cuatro cifras, usa el mismo formato en cada puesto y el mismo separador en todo el documento. Suena quisquilloso. Es el arreglo más barato de toda la página.
La imagen invertida de todo esto es texto que existe en el archivo pero es invisible en la página, que es exactamente en lo que se apoya el truco del texto en blanco. Es mala idea por razones que nada tienen que ver con la extracción, y las expuse en el artículo sobre la instrucción invisible en el CV. Todo lo que recomiendo aquí cambia el envase, nunca las afirmaciones.
Sistemas distintos, extractores distintos, y cuánto aguantan las cifras
Workday, Greenhouse, Taleo y Lever son productos distintos con extractores distintos, y aquí tengo que decepcionar a quien viniera buscando una tabla de comportamientos por proveedor. No puedo decirte qué hace ninguno de ellos por dentro. No los he probado, su comportamiento cambia entre versiones y entre configuraciones de cliente, y cada afirmación pública segura sobre el extractor de un proveedor concreto que he seguido resultó no tener método detrás. Quien te venda un reglamento por proveedor está adivinando. Lo que sí puede decirse con seguridad es qué los convierte en el mismo tipo de producto: cada uno tiene que convertir un archivo de CV en una ficha guardada, es decir, extraer texto y repartirlo en campos. Lo bien o mal que maneja cada uno los casos difíciles de arriba, eso no te lo puedo decir.
Esa es también la respuesta honesta a "qué formato es más seguro". No hay formato, plantilla ni maquetación que garantice una extracción limpia en ninguna parte. Solo hay decisiones que dejan menos cosas por inferir. Prefiero darte eso que una regla que no puedo defender.
Ahora la cifra de 3.835, tratada con el cuidado que merece. Es una persona en Reddit describiendo su propia muestra declarada, en un hilo donde varios comentaristas dudaron de que el número fuera real. No la voy a blanquear como "los estudios muestran", y prefiero que la descartes del todo a que confíes en ella más de lo que aguanta. Fíjate en que nada de las secciones mecánicas de arriba depende de ella. El orden de lectura, las tablas aplanadas, las capas de texto vacías y los encabezados no reconocidos se deducen de cómo están construidos el PDF y el DOCX, y serían igual de ciertos si ese hilo no se hubiera publicado nunca. La muestra te dice que estos fallos son frecuentes. Los formatos te dicen por qué ocurren.
Una cosa más que conviene decir en vez de esconder, porque explica por qué la situación persiste. Desde el lado del empleador, un cribado que pierde a algunos buenos candidatos se trata a menudo como un coste aceptable para gestionar el volumen. No me voy a indignar aquí; te lo cuento porque ajusta bien tus expectativas. El arreglo no va a llegar del proveedor a tiempo para tu próxima candidatura, y por eso, de momento, tiene que ocurrir en tu archivo.
El párrafo de producto, una sola vez, para que puedas sopesarlo frente a todo lo anterior. careerify tiene una comprobación gratuita en el enlace de abajo: sin cuenta, sin tarjeta, tres comprobaciones por dirección IP cada 24 horas. Procesa el PDF o el DOCX que subes de verdad, igual que tendría que hacerlo cualquier otro sistema, compara lo que obtuvo con la oferta que pegas y te enseña qué términos de la oferta llegaron desde tu archivo y cuáles no. Es una inspección, no un arreglo. Si un término que sabes que está en la primera página vuelve como ausente, has encontrado uno de los fallos de esta página. Lo demás que hace careerify, adaptar un CV maestro guardado a una oferta concreta, está acotado por los datos que tú mismo has introducido y no puede inventar un puesto, una empresa ni una cifra que no le hayas dado.
La respuesta corta
Si citas un solo párrafo de esta página, cita este:
Un ATS no lee tu CV como tú lo ves. Extrae del archivo un flujo lineal de texto y luego trata de repartirlo en campos de base de datos: nombre, datos de contacto, empresa, cargo, fechas, competencias. Todo aquello cuyo significado vive en la maquetación visual y no en el orden del texto puede reordenarse, fundirse con el campo vecino o perderse antes de que una persona lo abra. Una columna lateral puede leerse en mitad de la experiencia laboral, de modo que las fechas se enganchan al puesto equivocado. Una tabla de competencias puede llegar como una sola cadena continua. Un nombre situado en un encabezado de página puede pasarse por alto entero. El texto dentro de una imagen no se extrae salvo que el sistema ejecute un reconocimiento óptico, cosa que la mayoría no hace. El comportamiento varía según el proveedor y la versión, así que ningún formato ni plantilla garantiza una extracción limpia. Una maquetación a una columna, encabezados de sección corrientes y fechas inequívocas eliminan la ambigüedad en lugar de reparar un fallo garantizado.
Preguntas que la gente hace de verdad sobre esto
¿Qué le hace realmente un ATS al archivo de mi CV?
Extrae del archivo un flujo lineal de texto y luego intenta repartirlo en campos de base de datos: nombre, datos de contacto, empresa, cargo, fechas de inicio y fin, competencias, formación. El significado que vive en la maquetación visual y no en el orden del texto puede reordenarse, fundirse con el campo vecino o perderse en la entrada. Cada fallo que describe la gente, desde una lista de competencias que acaba dentro de un empleo hasta un teléfono ausente, es uno de esos campos descarrilando.
¿Por qué recibí "no pudimos leer tu archivo"?
Porque el programa no consiguió sacar texto utilizable del archivo. La primera causa que hay que descartar es un PDF escaneado o de imágenes con la capa de texto vacía. Otras son un documento protegido con contraseña o bloqueado contra copia, un archivo cuya extensión no coincide con su contenido real, o un formato que la subida no acepta. Es un fallo de lectura a nivel de archivo. Nada en ese mensaje juzga tu experiencia, y volver a exportar desde el documento original suele resolverlo.
¿Lee un ATS los CV a dos columnas?
Algunos programas reconstruyen las columnas correctamente y otros las entrelazan, que es como una lista de competencias de la columna lateral acaba dentro de un empleo con las fechas equivocadas pegadas. El comportamiento varía según proveedor y versión, y no puedes ver cuál está al otro lado de la subida. Una sola columna, por tanto, no repara un fallo garantizado, elimina la ambigüedad. Es una afirmación más modesta que la de la mayoría de los consejos, y es la que puedo defender.
¿PDF o Word para un ATS?
Un DOCX lleva estructura declarada: párrafos, tablas y encabezados existen como objetos con nombre en el marcado. Un PDF guarda glifos en coordenadas, así que el orden de lectura hay que reconstruirlo por inferencia. Es una diferencia real, pero no significa que debas mandar siempre Word. Muchos programas manejan el PDF perfectamente, un PDF se ve igual en cualquier equipo y algunas empresas solo aceptan uno. Sigue primero la instrucción de la oferta. Si no hay instrucción y tu maquetación es complicada, el DOCX deja menos cosas por adivinar.
¿Se leerán mi nombre y mis datos de contacto si están en el encabezado?
A veces, y ese es justo el problema. El encabezado y el pie están fuera del flujo principal y son un punto de pérdida habitual, en parte porque en otros tipos de documento son mobiliario repetido que los extractores están hechos para saltarse. Si tu nombre, correo y teléfono solo existen en el encabezado, estás apostando tus datos de contacto a ese comportamiento. Ponlos en el cuerpo de la primera página. Visualmente no te cuesta nada.
¿Cómo puedo ver qué saca un programa de mi CV?
Hazlo tú primero, gratis: abre tu CV, guárdalo o expórtalo como texto plano y lee el resultado. Todo lo que sobreviva es aproximadamente aquello con lo que trabaja un extractor, y el orden en que aparece es el orden desde el que se adivinan los campos. Pegar el archivo en un editor de texto simple funciona casi igual de bien. Si además quieres saber si los términos de una oferta concreta llegaron, careerify hace una comprobación gratuita contra una oferta sin cuenta, tres comprobaciones por dirección IP cada 24 horas, y muestra qué términos de la oferta encontró en tu archivo y cuáles no.
Sigue leyendo
- ¿Rechaza un ATS los CV automáticamente, o es la pregunta equivocada?
- Por qué subes el CV y luego rellenas el mismo formulario igual
- Cómo juzgar un comprobador de CV para ATS y qué significan las puntuaciones
Si quieres saber si tu archivo sobrevivió al viaje, coge la oferta a la que ibas a postular y comprueba qué términos suyos llegaron desde tu CV y cuáles no. Si algo que sabes que está en la primera página vuelve como ausente, has encontrado uno de los fallos de esta página. Sin cuenta, tres comprobaciones por dirección IP cada 24 horas. Comprueba tu CV frente a una oferta.