Cómo resumir libros y PDFs largos con IA para que te sirvan

Un resumen genérico no sirve para nada. Cómo pedirle a la IA que resuma un PDF largo para que puedas usarlo dentro de seis meses.

Tengo una carpeta con PDFs que me he bajado con toda la ilusión del mundo y no he vuelto a abrir. Informes de sector, manuales de herramientas, libros en PDF, transcripciones de charlas. Doscientas páginas cada uno y cero minutos de lectura.

Durante un tiempo la solución fue obvia: le paso el PDF a una IA, le digo "resúmemelo" y listo. Y funcionó fatal. O sea, funcionó en el sentido de que me devolvía un texto. Pero ese texto era inútil.

Un resumen que dice "el autor argumenta que la disciplina supera a la motivación" no me sirve de nada. Eso ya lo sabía sin leer el libro. Lo que necesitaba era algo que dentro de seis meses, cuando no me acuerde ni del título, me devuelva lo que ese documento tenía de aprovechable.

¿Por qué el resumen que te da la IA por defecto no vale nada?

Porque le estás pidiendo lo equivocado.

Cuando escribes "resume este PDF", la IA hace lo que le pides: comprime. Coge doscientas páginas y las convierte en quince párrafos que cubren todo por encima. Es un resumen honesto y equilibrado. Le da el mismo peso al capítulo que te cambia la forma de trabajar que al capítulo de relleno que el autor metió para llegar a las trescientas páginas.

Y ahí está el problema. Un resumen equilibrado es un resumen sin criterio. Tú no quieres saber "de qué va" el documento. Eso lo sabes por la portada. Quieres saber qué hay dentro que puedas usar.

La diferencia entre un resumen inútil y uno bueno no está en el modelo que uses. Está en que le digas para qué lo quieres.

El cambio de chip: no pidas resumen, pide extracción

Deja de usar la palabra "resume". En serio. Cámbiala por verbos que obliguen a la IA a filtrar.

Extrae. Lista. Contrasta. Convierte. Señala.

"Extrae las siete afirmaciones del documento que un lector podría discutir." Eso ya no es un resumen. Es un filtro con criterio.

"Lista todas las decisiones concretas que el autor recomienda tomar, con la página donde aparece cada una." Eso lo puedes ejecutar mañana.

"Convierte el capítulo tres en una lista de comprobación de cosas que revisar antes de lanzar algo." Eso es lo que de verdad querías cuando te bajaste el PDF.

La IA no sabe qué te interesa. Y por defecto asume que te interesa todo por igual, que es lo mismo que asumir que no te interesa nada.

¿Cómo resumo un documento largo con IA sin que se deje la mitad?

Hay dos rutas y llevan a sitios distintos. Yo uso las dos según lo que tenga delante.

Ruta 1: NotebookLM. Subes el PDF a NotebookLM, y a partir de ahí solo responde con lo que hay en ese documento. No te inventa contexto de fuera. Si le preguntas algo que el libro no cubre, te dice que el libro no lo cubre. Para documentos de referencia (un manual, una normativa, un informe con datos) es lo mejor que hay, y te lo cuento paso a paso en cómo estudiar con NotebookLM.

Ruta 2: Claude Code con el archivo en una carpeta. Metes el PDF (o su texto) en una carpeta de tu ordenador, abres Claude Code ahí dentro y le pides que lea el archivo y escriba la extracción en otro archivo. La ventaja es que el resultado se queda en tu disco duro, en texto plano, y puedes volver a él sin depender de ninguna cuenta.

La regla que yo sigo: si voy a consultarlo muchas veces y me da igual que viva en la nube, NotebookLM. Si quiero que el resultado entre en mi sistema de notas y se mezcle con el resto de mis cosas, Claude Code.

Los cuatro bloques que yo pido siempre

Con el tiempo he acabado pidiendo casi lo mismo para todo. Estos cuatro bloques son lo que hace que un resumen siga sirviendo medio año después.

Bloque 1. La tesis en una frase. Literalmente una. "Resume la tesis central del documento en una sola frase, sin adjetivos y sin usar la palabra importante." La restricción es la que hace el trabajo: si la IA puede escribir tres párrafos, escribe tres párrafos vagos. Si solo puede escribir una frase, tiene que elegir.

Bloque 2. Lo accionable. "Lista las acciones concretas que se derivan del texto. Solo cosas que alguien pueda hacer esta semana. Si algo es una idea abstracta y no una acción, no la incluyas."

Bloque 3. Lo que contradice lo que ya se cree. "Señala las tres afirmaciones del documento que van en contra de lo que se suele dar por sentado en este tema." Este bloque es oro. Es donde está el valor real de casi cualquier libro, y es justo lo que un resumen equilibrado aplasta.

Bloque 4. Las citas literales. "Extrae entre cinco y diez frases textuales del documento, tal cual, con la página." Porque dentro de seis meses vas a querer la frase exacta, no la paráfrasis de la IA. Y porque si citas algo públicamente, te toca haberlo leído en el original.

Con esos cuatro bloques, el archivo que te queda ocupa dos folios y contiene más valor que el resumen de quince párrafos.

¿Y si el PDF es enorme y no entra entero?

Pasa. Un libro de cuatrocientas páginas puede no caber de una sentada según la herramienta.

Lo que hago es partirlo por capítulos y procesar cada uno por separado con los mismos cuatro bloques. Luego junto todas las extracciones en un solo archivo y le pido a la IA una última pasada: "aquí tienes las extracciones de los doce capítulos, dime qué ideas se repiten en varios y cuáles aparecen solo una vez".

Ese último paso es el que más me sorprendió. Las ideas que se repiten suelen ser el argumento de verdad del libro. Las que aparecen una sola vez suelen ser el relleno. Y a veces al revés, y ahí es donde encuentras la joya que el propio autor no supo que tenía.

Lo que se te va a atascar

Los PDFs escaneados. Si el PDF es una foto de páginas y no texto seleccionable, la IA no lee nada o lee fatal. Pruébalo: intenta seleccionar una palabra con el ratón. Si no puedes, necesitas pasarle un reconocimiento de texto antes. Muchos lectores de PDF lo hacen en dos clics.

Los números. La IA se equivoca con las cifras más de lo que a nadie le gustaría admitir. Cualquier dato numérico que vayas a usar en algo público, lo verificas en el original. Sin excepciones. Yo esto lo aprendí por las malas.

El resumen que suena perfecto. Cuando un resumen te suena redondo y bien escrito, desconfía. Suele significar que la IA ha suavizado las aristas del texto original, y las aristas eran lo interesante. Un buen resumen de un libro incómodo debería seguir siendo incómodo.

Pedirlo todo de golpe. Si le pides los cuatro bloques en un solo mensaje, te va a dar cuatro bloques mediocres. Uno por mensaje. Tarda dos minutos más y sale el triple de bien.

¿Y ahora qué haces con esas extracciones?

Aquí está la parte que casi todo el mundo se salta.

Un archivo de extracción que se queda solo en una carpeta perdida es exactamente igual de inútil que el PDF sin leer. Solo que más corto.

Lo que a mí me cambió el asunto fue meter esas extracciones dentro de un sistema donde puedo buscarlas y donde la IA puede leerlas cuando le pregunto por un tema. Escribí sobre cómo montar un sistema de notas que sí vas a usar, porque el problema nunca fue guardar. Guardar es fácil. El problema es encontrar.

Yo pongo cada extracción en un archivo con el título del libro, el autor y la fecha en que lo procesé. Y encima, una línea con "por qué me lo bajé". Esa línea es la que me salva cuando lo abro medio año después y no tengo ni idea de qué buscaba.

El resto de las cosas que me ahorran horas cada semana con IA las voy contando en la guía de IA para el día a día. Nada espectacular, nada de flujos de trabajo de veinte pasos. Cosas pequeñas que hacen que la carpeta de PDFs sin leer deje de crecer.

Porque al final el objetivo no era leer más. Era dejar de bajarme documentos que no voy a abrir nunca y quedarme con lo que de verdad iba a usar.

Si quieres saber por dónde empezar a meter IA en tu día a día sin liarte, tengo un test que te dice en qué punto estás y qué te conviene probar primero.

Hacer el test de IA

Relacionado

Sigue leyendo