En este artículo
- ¿Qué es book-to-skill?
- ¿Por qué convertir libros en skills?
- Requisitos previos
- Instalación paso a paso
- Tu primera conversión: de libro a skill
- ¿Qué genera exactamente?
- El problema de tokens que resuelve
- Los 3 modos de uso
- Cómo consultar una skill generada
- Más allá de libros: carpetas, papers y docs internos
- Fold-in: añadir contenido a una skill existente
- Formatos soportados y extractores
- ¿Por qué esto y no un RAG?
- ¿Cuánto cuesta en tokens?
- 3 ejemplos reales
- 9 consejos para mejores resultados
- Limitaciones
- ¿Dónde consigo libros gratuitos?
- Cómo detectar repos que no debes usar
- ¿Y si no uso Claude Code?
Tienes libros técnicos que releíste tres veces y sigues sin recordar el framework exacto cuando lo necesitas. O peor: sabes que la respuesta está en algún capítulo de ese PDF de 400 páginas, pero no vas a buscarlo en mitad del trabajo.
¿Y si Claude Code pudiera hacerlo por ti? No un resumen genérico, sino una skill estructurada que extrae los frameworks, principios y técnicas del libro, y que el agente consulta bajo demanda mientras trabajas. Pides "aplica el principio de reciprocidad de Cialdini a mi landing page" y Claude sabe exactamente qué hacer, porque tiene el contenido del libro indexado.
Eso es book-to-skill: una skill open-source que convierte cualquier libro (PDF, EPUB, DOCX, Markdown y más) en una skill reutilizable para Claude Code. En este tutorial te enseño a instalarla, usarla y sacarle partido de verdad.
¿Para quién es esta guía?
Cualquiera que use Claude Code y lea libros técnicos, de negocio, productividad o desarrollo. No necesitas saber programar: la instalación es un comando y el uso es conversacional. Si sabes usar la terminal, estás listo.
¿Qué es book-to-skill?
Book-to-skill es una skill creada por Virgilio Jr. que hace una cosa brillante: toma un libro o documento, lo procesa con un script Python, y genera una colección de archivos Markdown que Claude Code puede consultar como si fueran su propia base de conocimiento.
No es un resumen. No es copiar y pegar el libro. Es una extracción estructurada que convierte 300 páginas en:
- Un SKILL.md maestro con los frameworks más importantes del autor
- Un archivo por capítulo con conceptos clave, modelos mentales y anti-patrones
- Un glosario de términos
- Un catálogo de patrones y técnicas
- Una cheatsheet de referencia rápida
Y lo mejor: Claude carga los archivos bajo demanda. No gasta tokens leyendo todo el libro cada vez. Solo carga el capítulo relevante cuando lo necesitas.
¿Por qué convertir libros en skills?
Yo tengo estanterías llenas de libros que leí, subrayé, y cuyos frameworks olvidé en dos semanas. El conocimiento estaba ahí, pero no era accesible en el momento que lo necesitaba. Convertirlos en skills cambia eso por completo.
Conocimiento accesible
En vez de buscar en 400 páginas, le dices a Claude "¿qué dice el capítulo 7 sobre pricing?" y te lo explica al instante.
Frameworks aplicados
"Aplica el Value Proposition Canvas a mi producto." Claude conoce el framework porque lo tiene indexado del libro de Osterwalder.
Reutilizable para siempre
Una vez generada, la skill está disponible en todas tus sesiones futuras de Claude Code. No pagas tokens por regenerarla.
Compartible
La skill generada son archivos Markdown. Puedes compartirla con tu equipo, subirla a un repo, o usarla en otros agentes compatibles.
Requisitos previos
Antes de instalar, necesitas tener esto:
| Requisito | ¿Lo tienes? | Cómo verificar |
|---|---|---|
| Claude Code | Instalado y funcionando | claude --version |
| Python 3.8+ | Necesario para el extractor | python3 --version |
| Git | Para clonar el repo | git --version |
| Un libro | PDF, EPUB, DOCX o similar | Tenerlo en tu disco |
Dependencias opcionales (el script te avisa si las necesitas):
- pdftotext (poppler-utils): mejor extractor de PDF.
brew install poppleren macOS. - ebooklib + beautifulsoup4: para EPUB con formato.
pip install ebooklib beautifulsoup4 - python-docx: para DOCX con estructura.
pip install python-docx - Calibre: para MOBI/AZW (Kindle). Instalar desde calibre-ebook.com
- Docling: para PDF técnicos con tablas y código.
pip install docling
No te preocupes si no tienes todas: el script tiene fallbacks para cada formato y te pregunta antes de instalar nada.
Instalación paso a paso
Clona el repositorio en la carpeta de skills
Un solo comando. Esto descarga la skill y la coloca donde Claude Code la encuentra automáticamente.
git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill
Eso es todo para la instalación. En serio, un comando.
Verifica que Claude Code la detecta
Abre Claude Code y comprueba que la skill aparece disponible. Debería aparecer como book-to-skill en la lista de skills.
# Verifica que los archivos están en su sitio
ls ~/.claude/skills/book-to-skill/
# Deberías ver: SKILL.md scripts/
(Opcional) Instala dependencias para tu formato
Si vas a procesar PDFs, instala poppler para mejor calidad de extracción. Para otros formatos, el script te preguntará la primera vez.
# Para PDFs (recomendado)
brew install poppler
# Para EPUB
pip install ebooklib beautifulsoup4
# Para DOCX
pip install python-docx
# Para PDF técnicos con tablas y código
pip install docling
sudo apt install poppler-utils
pip install ebooklib beautifulsoup4 python-docx
¿Ya está?
Sí. La skill es un directorio con dos archivos: SKILL.md (las instrucciones para Claude) y scripts/extract.py (el extractor de texto). No hay build, ni compilación, ni configuración. Claude Code lee el SKILL.md y sabe qué hacer.
Tu primera conversión: de libro a skill
Vamos a convertir un libro real. Abre Claude Code y escribe:
/book-to-skill ~/Libros/influence-cialdini.pdf
Claude arranca el workflow de 10 pasos. Lo primero que hace es preguntarte qué tipo de libro es:
¿Qué tipo de contenido tiene este libro?
1. Technical: tiene bloques de código, tablas, fórmulas, diagramas
2. Text-heavy: mayoritariamente prosa, pocos elementos técnicos
3. Not sure: usaré el método rápido
2
Claude extrae el texto, analiza la estructura y te muestra una estimación de coste antes de generar nada:
Fuente detectada: influence-cialdini.pdf (PDF)
Páginas: ~320 | Palabras: ~95.000 | Tokens fuente: ~127K
Coste estimado (conversión completa):
Input: ~165K tokens | Output: ~22K tokens | Total: ~187K tokens
Claude Sonnet 4.6: ~$0.83 USD
Tiempo estimado: ~8 minutos
¿Proceder con la conversión completa? (o escribe "analyze only" para ver primero)
Si dices que sí, Claude procesa cada capítulo, extrae frameworks, genera los archivos, y al final te da un resumen:
Skill creada: ~/.claude/skills/cialdini-influence/
Libro: Influence — Robert B. Cialdini
Páginas: ~320 | Capítulos: 9
Archivos generados: SKILL.md + 9 capítulos + glossary + patterns + cheatsheet
Tamaño total de la skill: ~18K tokens (cargados bajo demanda)
A partir de ahora, en cualquier sesión futura de Claude Code, puedes pedir cosas como "aplica el principio de escasez de Cialdini a mi copy" y Claude sabe exactamente qué hacer.
¿Qué genera exactamente?
Después de la conversión, la skill tiene esta estructura:
¿Qué hay dentro de cada archivo de capítulo?
Cada capítulo sigue una estructura fija que Claude puede navegar rápido:
- Core Idea: la idea central del capítulo en 1-2 frases
- Frameworks Introduced: frameworks con nombre exacto del autor, cuándo usarlos y cómo
- Key Concepts: 5-10 términos definidos con precisión
- Mental Models: herramientas de pensamiento en formato "Usa X cuando Y"
- Anti-patterns: qué evitar y por qué falla
- Code Examples: solo en libros técnicos (código real del libro)
- Key Takeaways: 3-7 insights accionables
- Connects To: relaciones con otros capítulos y conceptos externos
La clave es que no son resúmenes narrativos. Son herramientas de pensamiento que Claude puede aplicar directamente a tu trabajo.
El problema de tokens que resuelve
Cuando intentas que un agente trabaje con un libro, hay tres enfoques habituales. Los tres tienen problemas serios.
Opción 1: volcar el libro entero en contexto. Un libro de 300 páginas son 120.000-180.000 tokens. Cada vez que haces una pregunta, pagas esa factura completa. Con un libro de ingeniería de software son fácilmente 250K tokens por consulta. A $3 por millón de tokens de entrada, la cuenta sube rápido.
Opción 2: buscar trozo a trozo. Le dices a Claude "busca en el libro la parte sobre testing" y el agente va abriendo secciones, leyendo, descartando, probando otra. Este enfoque "de descubrimiento" gasta entre 12.000 y 78.000 tokens por consulta dependiendo de lo rápido que encuentre lo que buscas. Mejor que volcar todo, pero sigue siendo caro y lento.
Opción 3: no usar el libro. La más común. Tienes el libro, sabes que tiene la respuesta, pero el coste o la fricción te frena. El conocimiento se queda en la estantería.
Book-to-skill introduce una cuarta vía: compilar el conocimiento una sola vez. La skill generada tiene un SKILL.md de ~4.000 tokens que siempre está cargado, más capítulos individuales de ~1.000-1.800 tokens que se cargan solo cuando hacen falta. Resultado: cada consulta consume unos 5.000-6.000 tokens en vez de 120.000+.
Para ponerlo en perspectiva con números reales:
| Enfoque | Tokens por consulta | Comparación |
|---|---|---|
| Volcar libro completo | 120K-250K | Referencia (1x) |
| Búsqueda iterativa | 12K-78K | 3-20x más eficiente |
| Skill compilada | ~5K | 24-50x más eficiente |
Y esa ventaja escala con el tamaño del libro. Cuanto más grande y denso es el libro, mayor es la diferencia. Con un manual técnico de 600 páginas, la skill puede ser 50 veces más eficiente que el volcado directo. Es la diferencia entre rebuscar en un cajón sin orden y consultar un archivo con pestañas bien puestas.
Los 3 modos de uso
| Modo | Comando | ¿Qué hace? | Cuándo usarlo |
|---|---|---|---|
| Full Conversión | /book-to-skill libro.pdf |
Extrae, analiza, genera toda la skill | Cuando quieres la skill completa de un tirón |
| Analyze Only | /book-to-skill libro.pdf → "analyze only" |
Extrae y muestra un informe de lo encontrado, sin generar archivos | Cuando quieres revisar qué va a extraer antes de gastar tokens |
| Generate from Analysis | Proporciona un análisis previo a Claude | Salta la extracción, genera la skill desde notas existentes | Cuando ya hiciste "analyze only" y quieres generar, o tienes tus propias notas |
Mi recomendación: para libros que ya conoces, usa Full Conversión directamente. Para libros nuevos o muy largos (500+ páginas), haz primero "analyze only" para ver si la estructura se detecta bien, y luego genera.
Cómo consultar una skill generada
Una vez generada, la skill está disponible en todas tus sesiones de Claude Code. No necesitas activarla ni importarla. Simplemente habla con Claude y referencia el contenido:
Estoy escribiendo la landing page de mi SaaS. ¿Qué principio de Cialdini aplicarías al CTA principal?
(carga ch07-scarcity.md y ch02-reciprocation.md)
Dos principios encajan aquí. Escasez: limita las plazas o pon un contador de tiempo en la oferta. Cialdini lo llama el "principio de escasez", y funciona porque valoramos más lo que percibimos como limitado. Reciprocidad: ofrece algo gratis antes del CTA (un template, una auditoría, un capítulo). El usuario siente obligación de devolver el favor. Mi recomendación: combina ambos. Ofrece un recurso gratis y pon un deadline a la oferta. Empieza gratis con los 3 primeros módulos.
Formas de consultar
- Por tema: "¿Qué dice el libro sobre social proof?"
- Por capítulo: "Resúmeme el capítulo 5"
- Aplicado a tu trabajo: "Aplica el framework de autoridad a mi perfil de LinkedIn"
- Referencia cruzada: "¿Qué técnicas del libro aplican a email marketing?"
- Exploración: "¿Qué capítulos tiene la skill de Cialdini?"
Claude carga solo el capítulo relevante, no toda la skill. Por eso el coste por consulta es mínimo.
Más allá de libros: carpetas, papers y docs internos
Book-to-skill no se limita a un solo archivo. Puedes pasarle carpetas enteras, patrones glob, o múltiples documentos que se fusionan en una skill unificada.
# Convierte 40 archivos Markdown de tu wiki en una skill consultable
/book-to-skill ~/workspace/docs/ knowledge-base
# Fusiona varios PDFs académicos en una skill con glosario compartido
/book-to-skill "~/papers/*.pdf" research-llm
Esto abre casos de uso que van más allá de los libros:
- Documentación interna dispersa: ADRs, guías de estilo, runbooks, postmortems. 40 archivos Markdown que nadie recuerda dónde están, unificados en una skill con índice navegable.
- Papers de investigación: 10 papers sobre fine-tuning fusionados con glosario cruzado y referencias entre ellos.
- Specs y estándares: RFCs, guías de accesibilidad, normativa RGPD. Documentos que consultas fragmentariamente pero nunca enteros.
- Manuales técnicos: la documentación oficial de un framework que usas a diario y medio recuerdas.
Cuando le pasas una carpeta, el script procesa cada archivo por separado y fusiona los resultados en un único SKILL.md con glosario, patrones y cheatsheet compartidos.
Fold-in: añadir contenido a una skill existente
¿Ya tienes una skill generada y quieres añadirle un documento nuevo sin regenerar todo? El modo fold-in hace exactamente eso.
# Añade un nuevo documento a la skill research-llm que ya existe
/book-to-skill ~/papers/nuevo-paper.pdf ~/.claude/skills/research-llm
El proceso es inteligente: lee el SKILL.md existente, detecta la numeración actual de capítulos, y añade los nuevos sin romper los anteriores. El glosario, patrones y cheatsheet se fusionan alfabéticamente.
Esto convierte la skill en una base de conocimiento viva. Cada vez que lees un paper nuevo, un ADR reciente, o una guía actualizada, lo incorporas a la skill existente con un solo comando. Con el tiempo, acumulas una biblioteca personal que Claude puede consultar al instante.
Formatos soportados y extractores
| Formato | Extractor principal | Fallback | Notas |
|---|---|---|---|
| PDF (texto) | pdftotext (poppler) | PyPDF2 → pdfminer | El más común. Instala poppler para mejor resultado. |
| PDF (técnico) | Docling | pdftotext | Preserva tablas, código y fórmulas como Markdown. |
| EPUB | ebooklib + BS4 | zipfile + html.parser | La mayoría de ebooks. Funciona con fallback stdlib. |
| DOCX | python-docx | zipfile + XML parser | Documentos Word. Fallback stdlib decente. |
| Markdown | Lectura directa | — | Sin dependencias. Perfecto para docs técnicos. |
| Texto plano | Lectura directa | — | Sin dependencias. |
| HTML | BeautifulSoup4 | html.parser stdlib | Para libros en formato web. |
| RTF | striprtf | Regex básico | Formato legacy, funciona razonablemente. |
| MOBI/AZW | Calibre ebook-convert | — | Requiere Calibre instalado. Sin fallback. |
Si un extractor no está instalado, el script te pregunta: "Missing package detected. Do you want to install? y=install, n=fallback". Puedes elegir instalar o usar el fallback stdlib que viene incluido.
Elegir bien el modo de extracción importa mucho
Un PDF técnico procesado como prosa pierde todas las tablas de comparación, los bloques de código y las fórmulas. La skill resultante suena razonable pero está vacía de contenido útil. Si el libro tiene tablas o código, siempre elige "Technical" aunque tarde más (Docling necesita unos 90-180 segundos para 100 páginas, pero preserva la estructura que da valor al libro).
¿Por qué esto y no un RAG?
Si conoces RAG (Retrieval Augmented Generation), te estarás preguntando: ¿no es esto lo mismo? No. Son enfoques fundamentalmente distintos.
| Aspecto | RAG tradicional | Book-to-skill |
|---|---|---|
| ¿Cuándo analiza? | En cada consulta | Una vez al compilar |
| ¿Qué devuelve? | Fragmentos de texto por similitud semántica | Frameworks con nombre, reglas de decisión, anti-patrones |
| Infraestructura | Base de datos vectorial, embeddings, pipeline | Archivos Markdown en una carpeta |
| Coste recurrente | Tokens por cada consulta (embedding + retrieval + generación) | Ninguno después de compilar |
| Navegación | Similitud semántica (a veces imprecisa) | Índice explícito de temas y capítulos |
| Calidad de respuesta | Depende de qué fragmentos recupere | Frameworks ya sintetizados y estructurados |
RAG tiene sentido cuando trabajas con datos que cambian constantemente (logs, tickets, conversaciones). Pero para un libro o documentación estable, compilar una vez y consultar gratis es objetivamente mejor. No necesitas montar Qdrant, generar embeddings, ni mantener un pipeline. Solo archivos Markdown que cualquier agente sabe leer.
Además, RAG devuelve trozos de texto. Book-to-skill devuelve conocimiento procesado: "usa X cuando Y" en vez de "en la página 147 el autor menciona que...". Eso marca la diferencia cuando quieres que Claude aplique un framework a tu trabajo en vez de simplemente citarte un párrafo.
¿Cuánto cuesta en tokens?
Book-to-skill es gratis y open-source. El coste real es el consumo de tokens de Claude al procesar el libro. Aquí van números reales:
| Tamaño del libro | Tokens entrada | Tokens salida | Coste Sonnet 4.6 | Tiempo |
|---|---|---|---|---|
| 100 páginas (~35K palabras) | ~60K | ~12K | ~$0.35 | ~4 min |
| 200 páginas (~70K palabras) | ~120K | ~20K | ~$0.65 | ~7 min |
| 400 páginas (~140K palabras) | ~230K | ~35K | ~$1.20 | ~12 min |
| 600 páginas (~210K palabras) | ~350K | ~50K | ~$1.80 | ~18 min |
Para libros largos (500+ páginas), la skill usa un enfoque inteligente: en vez de leer el libro entero en memoria, hace consultas quirúrgicas con grep y sed para cargar solo el capítulo que está procesando. Esto mantiene el coste proporcional al output, no al tamaño del libro.
La inversión merece la pena
Gastar $1 en convertir un libro que costó $30 y que vas a consultar durante meses es probablemente el mejor ROI que puedes sacar de tus tokens de Claude.
3 ejemplos reales
Ejemplo 1: libro de marketing
/book-to-skill ~/Libros/building-a-storybrand-miller.epub storybrand
Genera una skill con los 7 pasos del framework StoryBrand. Después puedes pedir: "Aplica el framework StoryBrand a la página de inicio de mi proyecto." Claude estructura tu copy siguiendo los 7 pasos del libro.
Ejemplo 2: libro técnico de programación
/book-to-skill ~/Libros/designing-data-intensive-apps.pdf
Al preguntar por tipo de libro, elige "Technical". Docling preserva las tablas de comparación (LSM-Tree vs B-Tree), los diagramas de arquitectura en texto, y los fragmentos de código. Consulta: "¿Qué patrón de replicación recomienda Kleppmann para mi caso de uso con Postgres?"
Ejemplo 3: libro de productividad
/book-to-skill ~/Libros/deep-work-cal-newport.pdf newport-deep-work
Extrae las 4 reglas de Deep Work, las estrategias de scheduling, y los anti-patrones de distracción. Consulta: "Diseña mi rutina diaria aplicando las reglas de Deep Work de Newport."
9 consejos para mejores resultados
- Usa PDFs de buena calidad. Los PDFs escaneados (imágenes sin OCR) dan mal resultado. Si tu PDF es un escaneo, pásalo primero por un OCR como Adobe Acrobat u OCRmyPDF.
- Para libros técnicos, elige siempre "Technical". Docling tarda más (1.5 segundos por página), pero preserva tablas y código que pdftotext destruye. Un libro técnico sin sus tablas es una skill que suena bien pero no sirve.
- Haz "analyze only" primero con libros nuevos. Te muestra los frameworks detectados antes de gastar tokens en la generación completa. Si la estructura del libro es irregular, puedes ajustar.
- Nombra las skills con el formato autor-concepto.
cialdini-influence,newport-deep-work,kleppmann-data-intensive. Es más fácil de recordar y referenciar que un slug genérico. - Un libro por skill, pero usa fold-in para documentos relacionados. Un libro grande merece su propia skill. Pero papers o artículos sobre el mismo tema pueden ir juntos con fold-in.
- Revisa siempre el SKILL.md generado. Claude a veces confunde nombres de frameworks, mezcla conceptos similares, u omite secciones importantes. Cinco minutos de revisión manual mejoran mucho la calidad de las consultas futuras. Compara con el índice del libro original.
- Combina skills. Lo potente es tener varias skills activas. "Aplica reciprocidad de Cialdini usando el framework StoryBrand para mi onboarding." Claude cruza ambas skills sin que le digas dónde buscar.
- Los libros con frameworks con nombre dan mejores skills. "Las 5 fuerzas de Porter", "el principio de Pareto", "la regla de los 2 minutos". Cuanto más estructurado y nombrado está el contenido del autor, mejor es la extracción. Libros tipo ensayo narrativo sin frameworks explícitos producen skills mediocres.
- No olvides la documentación interna. Las mejores skills que he generado no son de libros famosos, sino de documentación interna: ADRs, guías de arquitectura, runbooks de producción. Conocimiento que ya existía pero que nadie consultaba porque estaba disperso en 30 archivos.
Limitaciones
Siendo honestos sobre lo que no hace bien:
- No procesa imágenes ni diagramas. Si el valor del libro está en gráficos y diagramas, la skill no los captura. Solo texto.
- PDFs escaneados sin OCR: texto ilegible o vacío. Necesitas OCR previo.
- Libros con estructura irregular: si el libro no tiene capítulos claros (algunos libros de ensayo, poesía), la detección de estructura falla. Funciona mejor con libros bien organizados.
- Libros muy largos (800+ páginas): funcionan, pero el coste en tokens sube y el tiempo de procesamiento puede superar los 20 minutos.
- Contenido con copyright: la skill extrae y sintetiza, no copia texto literal. Pero ten en cuenta las implicaciones legales de procesar contenido protegido para uso personal vs. distribución.
- Calidad variable por formato: PDF con tablas complejas o layouts de dos columnas pueden perder estructura. EPUB y Markdown dan los mejores resultados consistentes.
¿Y si no uso Claude Code?
Book-to-skill también funciona con otros agentes:
- Amp: clona en
~/.config/agents/skills/book-to-skill - GitHub Copilot CLI: clona en
~/.copilot/skills/book-to-skill - Cualquier agente compatible: clona en
~/.agents/skills/book-to-skill
La skill generada son archivos Markdown estándar. Si tu herramienta soporta leer archivos Markdown como contexto, puedes usarla. No hay dependencia de ningún agente específico.
¿Dónde consigo libros gratuitos para convertir en skills?
Book-to-skill funciona con cualquier PDF, EPUB o DOCX que tengas. Pero si estás empezando y no sabes por dónde buscar material legal y gratuito, aquí va un framework de búsqueda que he destilado investigando a fondo los recursos disponibles en GitHub y fuera de él.
Aviso legal importante
Que un libro esté en un repositorio público de GitHub no significa que sea legal redistribuirlo ni que tengas derecho a usarlo como quieras. GitHub aplica copyright por defecto a los repositorios sin licencia: nadie obtiene automáticamente derecho de reproducción, distribución o creación de obras derivadas. Solo el fork dentro de GitHub está permitido por los términos del servicio.
Antes de convertir cualquier libro en skill, verifica: (1) que existe una licencia explícita (Creative Commons, MIT, Apache, etc.), (2) que la licencia permite el uso que le vas a dar, y (3) que el material procede del autor o de una fuente autorizada. Un PDF en un repo de un tercero no es prueba de que sea libre.
Este framework es informativo y educativo. No sustituye asesoramiento jurídico. La responsabilidad de verificar los derechos de cada obra es tuya.
El framework: 3 niveles de confianza
No todos los "libros gratuitos" tienen el mismo nivel de seguridad jurídica. He organizado las fuentes en tres niveles para que sepas exactamente dónde pisas:
| Nivel | Descripción | Ejemplo | ¿Puedo convertirlo en skill? |
|---|---|---|---|
| A: Fuente oficial | El autor o proyecto pública la obra con licencia clara e inequívoca | Pro Git (CC BY-NC-SA 3.0), repositorios universitarios con CC BY-SA | Sí, respetando los términos de la licencia (atribución, no comercial si aplica, etc.) |
| B: Índice curado | Un catálogo mantenido enlaza obras externas. El índice tiene licencia propia, pero cada libro enlazado tiene la suya | Free Programming Books (CC BY 4.0 para el índice) | Depende de cada libro. El índice es seguro, la obra enlazada requiere verificación individual |
| C: Copia de tercero | Alguien sube PDFs de otros autores a su repositorio, a veces etiquetados como "distribución libre" | Repos con carpetas llenas de PDFs sin licencia verificable | No sin verificar. Busca siempre la fuente original del autor o editorial |
Regla de oro: empieza por el índice curado (nivel B), localiza la obra que te interesa, y termina la verificación en la fuente del autor (nivel A). Nunca uses un repo de tercero como fuente primaria sin comprobar la licencia original.
Paso 1: tu punto de partida
El mejor catálogo de libros técnicos gratuitos que existe se llama Free Programming Books, mantenido por la Free Ebook Foundation. Tiene cerca de 395.000 estrellas en GitHub, contribuciones activas en 2026, y su índice está bajo CC BY 4.0. Incluye una sección en español con libros de IA, Git, JavaScript, Python, sistemas operativos y desarrollo web.
# Catálogo general (multiidioma)
https://github.com/EbookFoundation/free-programming-books
# Sección en español (programación)
https://github.com/EbookFoundation/free-programming-books/blob/main/books/free-programming-books-es.md
# Ciencia (mayoritariamente inglés)
https://github.com/EbookFoundation/free-science-books
Pero recuerda: la licencia CC BY 4.0 cubre el catálogo, no cada libro enlazado. Cada obra tiene su propia licencia que debes comprobar antes de usarla.
Paso 2: libros verificados listos para convertir
Estos son libros que he verificado personalmente: fuente oficial, licencia explícita, formatos disponibles y estado actual confirmado. Puedes descargarlos y pasarlos por book-to-skill con tranquilidad, siempre respetando las condiciones de cada licencia.
Programación y desarrollo
| Libro | Tema | Licencia | Formatos | Idioma | Ideal para skill de... |
|---|---|---|---|---|---|
| Pro Git, 2.ª ed. Scott Chacon, Ben Straub |
Git completo | CC BY-NC-SA 3.0 | PDF, EPUB, HTML, MOBI | Español | Workflows Git, branching, colaboración |
| Eloquent JavaScript, 4.ª ed. Marijn Haverbeke (trad. Midudev) |
JavaScript moderno | CC BY-NC 3.0 (texto), MIT (código) | PDF (445 pág.), EPUB, MOBI, HTML | Español | Patrones JS, DOM, Node.js, proyectos |
| El modo JavaScript Baptiste Pesquet |
JavaScript desde cero | CC BY-NC-SA 4.0 | PDF, texto fuente | Español | Intro JS, DOM, APIs, primer proyecto |
Ciencia de datos y estadística
| Libro | Tema | Licencia | Formatos | Idioma | Ideal para skill de... |
|---|---|---|---|---|---|
| Intro. Ciencia de Datos Rafael A. Irizarry (trad. Alex Nones) |
R, estadística, ML | CC BY-NC-SA 4.0 | HTML/web, fuentes R Markdown | Español | Probabilidad, regresión, ggplot2, dplyr |
| Respondiendo preguntas con datos Crump, Navarro, Suzuki, Cabana |
Estadística introductoria | CC BY-SA 4.0 | HTML/web, Quarto reproducible | Español | Conceptos estadísticos, diseño experimental |
Ciencia abierta y metodología
| Libro | Tema | Licencia | Formatos | Idioma | Ideal para skill de... |
|---|---|---|---|---|---|
| Open Science Training Handbook | Ciencia abierta, OER | CC0 1.0 Universal | Markdown/GitHub | Español | Datos abiertos, licencias, reproducibilidad |
Paso 3: convertir a skill
Una vez que tienes el libro descargado y su licencia verificada, el proceso es directo:
# 1. Descarga Pro Git en español (PDF oficial)
curl -LO https://github.com/progit/progit2-es/releases/download/2.1.23/progit.pdf
# 2. Conviértelo en skill
/book-to-skill ~/Downloads/progit.pdf progit-es
# 3. Úsalo
# "¿Cómo funciona el rebase interactivo en Git?"
# Claude carga el capítulo relevante y te explica con el contexto del libro
Paso 4: verificar licencias (checklist rápido)
Antes de convertir cualquier libro, pasa por esta checklist:
- ¿Quién lo pública? Busca el repositorio del autor o proyecto original, no una copia de terceros.
- ¿Hay archivo LICENSE o licencia en el README? Si no hay ninguno, el copyright aplica por defecto. No puedes asumir que es libre.
- ¿Qué licencia exacta es? CC BY permite casi todo con atribución. CC BY-NC prohíbe uso comercial. CC BY-SA obliga a compartir igual. Sin versión especificada, desconfía.
- ¿Es la fuente o una copia? Un PDF en el repo de otra persona no hereda la licencia de ese repo. Busca siempre la edición original.
- ¿Tu uso es personal o vas a distribuir? Para uso personal con libros que compraste, el riesgo es mínimo. Para redistribuir la skill generada, necesitas que la licencia lo permita explícitamente.
Sobre libros que compraste
Si compraste un libro (papel o digital), convertirlo en skill para tu uso personal es análogo a tomar notas estructuradas. Book-to-skill no copia texto literal: sintetiza, extrae frameworks y genera contenido derivado. Dicho esto, redistribuir esa skill a terceros entra en terreno diferente y depende de la legislación de tu país y de los términos de la licencia del libro. En caso de duda, consulta con un profesional legal.
Paso 5: catálogos curados por tema
Más allá de Free Programming Books, hay catálogos especializados que funcionan como semillas de búsqueda. Todos son índices que enlazan a fuentes externas, así que la licencia de cada libro sigue requiriendo verificación individual.
IA y Machine Learning
| Catálogo | Cobertura | Licencia del índice | Uso recomendado |
|---|---|---|---|
| awesome-free-ai-books MarcosSete | Deep Learning, RL, NLP/LLM, ML, CV, AI Safety | Enlaces solo a fuentes oficiales | Mejor índice curado de IA. Punto de partida para skills de ML/DL. |
| awesome-machine-learning (books.md) josephmisiti | ML, Data Mining, Statistics | Lista curada, enlaces externos | Discovery amplio. Verificar cada título. |
| ml-books brpy | ML, Data Science, Statistics | Repo MIT; obras externas varían | Punto de partida complementario. |
Ciberseguridad
| Catálogo | Cobertura | Licencia del índice | Uso recomendado |
|---|---|---|---|
| misp-training MISP Project (oficial) | Threat Intelligence, OSINT, MISP | AGPLv3+ / CC BY-SA 4.0 | Material oficial con licencia clara. Ingesta permitida. |
| Malware (curso) RPISEC | Malware Analysis, Reverse Engineering | Material docente propio | Curso universitario completo. Revisar licencia concreta. |
| malware-study albertzsigovits | Malware, RE | Enlaces a recursos externos | Índice de referencia para malware analysis. |
Paso 6: libros oficiales de autores (las joyas)
Los mejores candidatos para skills son libros que los propios autores o sus editoriales publican gratuitamente. Aquí no hay ambigüedad de licencia: el autor decidió que quiere que los leas gratis. He recopilado los más relevantes por dominio.
IA y Machine Learning
- Dive into Deep Learning (D2L): libro interactivo oficial con código, matemáticas y múltiples formatos. Uno de los mejores recursos de DL que existen. Perfecto para una skill de arquitecturas y técnicas de deep learning.
- Deep Learning Book (Goodfellow, Bengio, Courville): el clásico. Lectura gratuita oficial online. Ideal para una skill de fundamentos teóricos de DL.
- Understanding Deep Learning (Simon J. D. Prince): publicado oficialmente por el autor. Enfoque más moderno y visual que el de Goodfellow.
- The Little Book of Deep Learning (François Fleuret): edición actualizada por el autor. Compacto y denso. Perfecto para una skill de referencia rápida.
- An Introduction to Statistical Learning (ISLR): disponible oficialmente por los autores. El punto de entrada estándar a ML estadístico.
- Elements of Statistical Learning (ESL): disponible oficialmente desde Stanford. Más avanzado que ISLR.
- Speech and Language Processing, 3.ª ed. (borrador): borrador oficial de Jurafsky y Martin. La referencia en NLP.
- Mathematics for Machine Learning: versión oficial gratuita. Cubre el álgebra lineal, cálculo y probabilidad que necesitas para ML.
Ciberseguridad y Reverse Engineering
- Security Engineering, 3.ª ed. (Ross Anderson): disponible oficialmente en la web del autor. Enciclopédico. Perfecto para una skill de principios de seguridad.
- Reverse Engineering for Beginners (Dennis Yurichev): libro gratuito oficial. El punto de entrada estándar a RE.
- OWASP Web Security Testing Guide: documentación/libro abierto oficial de OWASP. Imprescindible para una skill de pentest web.
- OWASP API Security Top 10: publicación oficial. Compacto y directo.
- MISP Book / MISP Training: material oficial de threat intelligence e intercambio de IOCs.
- The Threat Intelligence Handbook (Recorded Future): distribuido gratuitamente desde su sitio oficial.
Todos estos libros tienen en común que el autor o la institución los pública activamente de forma gratuita. Son candidatos ideales para book-to-skill: contenido de calidad, licencia clara, y formatos descargables.
Cómo detectar repos que no debes usar
En GitHub vas a encontrar repositorios que parecen bibliotecas gratuitas pero en realidad alojan copias no autorizadas de libros comerciales. Estas son las señales de alarma:
- El archivo LICENSE solo cubre el código o el README, pero el repo está lleno de PDFs de editoriales (O'Reilly, Packt, Wiley, No Starch, Pearson, Manning).
- El README dice "collected from the Internet", "for educational purposes only", o "contact me for removal". Esas frases son un reconocimiento implícito de que no tienen derechos.
- Enlaces a Google Drive, Mega, o servicios similares con colecciones de PDFs. Las editoriales legítimas no distribuyen así.
- Decenas o cientos de PDFs de libros comerciales en una sola carpeta. Ningún autor pública así su propia obra.
- Nombres de archivo con ISBN o edición comercial sin licencia acompañante.
- Repo con licencia MIT/Apache que no puede aplicarse al contenido editorial de terceros. La licencia del repo cubre el código del repo, no los PDFs que alguien subió dentro.
Si ves alguna de estas señales, no uses ese contenido. Busca el título que te interesa en la web del autor o la editorial. Muchos libros técnicos tienen versiones gratuitas oficiales que los propios autores distribuyen.
Recursos universitarios en inglés (fallback de calidad)
Si no encuentras lo que buscas en español, OpenStax (Rice University) ofrece manuales universitarios completos y gratuitos en inglés, con licencia Creative Commons. Cubren cálculo, estadística, física, biología y más. Claude trabaja igual de bien con skills en inglés y puede responderte en español.
Artículos relacionados en IAcademy
Tu especialización desde 19 EUR
19 itinerarios prácticos. Founding Members: acceso sin caducidad al contenido adquirido + canal directo con el creador. Solo 50 plazas.
Ver Founding MembersFounding Members: todo por 99 EUR
614 módulos, 23 especializaciones, acceso sin caducidad al contenido adquirido. Precio normal: 199 EUR. Reembolso según Términos.
Aprende más en el curso
Este artículo complementa el Módulo M06: Agentes IA y automatización. Incluye vídeo, quiz, flashcards con repaso espaciado y proyecto práctico.