Book to Skill: convierte cualquier libro en una skill de Claude Code

Por David Moya · · 45 min lectura · Actualizado mensualmente

En este artículo

  1. ¿Qué es book-to-skill?
  2. ¿Por qué convertir libros en skills?
  3. Requisitos previos
  4. Instalación paso a paso
  5. Tu primera conversión: de libro a skill
  6. ¿Qué genera exactamente?
  7. El problema de tokens que resuelve
  8. Los 3 modos de uso
  9. Cómo consultar una skill generada
  10. Más allá de libros: carpetas, papers y docs internos
  11. Fold-in: añadir contenido a una skill existente
  12. Formatos soportados y extractores
  13. ¿Por qué esto y no un RAG?
  14. ¿Cuánto cuesta en tokens?
  15. 3 ejemplos reales
  16. 9 consejos para mejores resultados
  17. Limitaciones
  18. ¿Dónde consigo libros gratuitos?
  19. Cómo detectar repos que no debes usar
  20. ¿Y si no uso Claude Code?

Tienes libros técnicos que releíste tres veces y sigues sin recordar el framework exacto cuando lo necesitas. O peor: sabes que la respuesta está en algún capítulo de ese PDF de 400 páginas, pero no vas a buscarlo en mitad del trabajo.

¿Y si Claude Code pudiera hacerlo por ti? No un resumen genérico, sino una skill estructurada que extrae los frameworks, principios y técnicas del libro, y que el agente consulta bajo demanda mientras trabajas. Pides "aplica el principio de reciprocidad de Cialdini a mi landing page" y Claude sabe exactamente qué hacer, porque tiene el contenido del libro indexado.

Eso es book-to-skill: una skill open-source que convierte cualquier libro (PDF, EPUB, DOCX, Markdown y más) en una skill reutilizable para Claude Code. En este tutorial te enseño a instalarla, usarla y sacarle partido de verdad.

¿Para quién es esta guía?

Cualquiera que use Claude Code y lea libros técnicos, de negocio, productividad o desarrollo. No necesitas saber programar: la instalación es un comando y el uso es conversacional. Si sabes usar la terminal, estás listo.

¿Qué es book-to-skill?

Book-to-skill es una skill creada por Virgilio Jr. que hace una cosa brillante: toma un libro o documento, lo procesa con un script Python, y genera una colección de archivos Markdown que Claude Code puede consultar como si fueran su propia base de conocimiento.

No es un resumen. No es copiar y pegar el libro. Es una extracción estructurada que convierte 300 páginas en:

Y lo mejor: Claude carga los archivos bajo demanda. No gasta tokens leyendo todo el libro cada vez. Solo carga el capítulo relevante cuando lo necesitas.

¿Por qué convertir libros en skills?

Yo tengo estanterías llenas de libros que leí, subrayé, y cuyos frameworks olvidé en dos semanas. El conocimiento estaba ahí, pero no era accesible en el momento que lo necesitaba. Convertirlos en skills cambia eso por completo.

Conocimiento accesible

En vez de buscar en 400 páginas, le dices a Claude "¿qué dice el capítulo 7 sobre pricing?" y te lo explica al instante.

Frameworks aplicados

"Aplica el Value Proposition Canvas a mi producto." Claude conoce el framework porque lo tiene indexado del libro de Osterwalder.

Reutilizable para siempre

Una vez generada, la skill está disponible en todas tus sesiones futuras de Claude Code. No pagas tokens por regenerarla.

Compartible

La skill generada son archivos Markdown. Puedes compartirla con tu equipo, subirla a un repo, o usarla en otros agentes compatibles.

Requisitos previos

Antes de instalar, necesitas tener esto:

Requisito¿Lo tienes?Cómo verificar
Claude CodeInstalado y funcionandoclaude --version
Python 3.8+Necesario para el extractorpython3 --version
GitPara clonar el repogit --version
Un libroPDF, EPUB, DOCX o similarTenerlo en tu disco

Dependencias opcionales (el script te avisa si las necesitas):

No te preocupes si no tienes todas: el script tiene fallbacks para cada formato y te pregunta antes de instalar nada.

Instalación paso a paso

1

Clona el repositorio en la carpeta de skills

Un solo comando. Esto descarga la skill y la coloca donde Claude Code la encuentra automáticamente.

Terminal git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill

Eso es todo para la instalación. En serio, un comando.

2

Verifica que Claude Code la detecta

Abre Claude Code y comprueba que la skill aparece disponible. Debería aparecer como book-to-skill en la lista de skills.

Terminal # Verifica que los archivos están en su sitio ls ~/.claude/skills/book-to-skill/ # Deberías ver: SKILL.md scripts/
3

(Opcional) Instala dependencias para tu formato

Si vas a procesar PDFs, instala poppler para mejor calidad de extracción. Para otros formatos, el script te preguntará la primera vez.

macOS # Para PDFs (recomendado) brew install poppler # Para EPUB pip install ebooklib beautifulsoup4 # Para DOCX pip install python-docx # Para PDF técnicos con tablas y código pip install docling
Linux (Ubuntu/Debian) sudo apt install poppler-utils pip install ebooklib beautifulsoup4 python-docx

¿Ya está?

Sí. La skill es un directorio con dos archivos: SKILL.md (las instrucciones para Claude) y scripts/extract.py (el extractor de texto). No hay build, ni compilación, ni configuración. Claude Code lee el SKILL.md y sabe qué hacer.

Tu primera conversión: de libro a skill

Vamos a convertir un libro real. Abre Claude Code y escribe:

Claude Code /book-to-skill ~/Libros/influence-cialdini.pdf

Claude arranca el workflow de 10 pasos. Lo primero que hace es preguntarte qué tipo de libro es:

Claude:

¿Qué tipo de contenido tiene este libro?

1. Technical: tiene bloques de código, tablas, fórmulas, diagramas

2. Text-heavy: mayoritariamente prosa, pocos elementos técnicos

3. Not sure: usaré el método rápido

Tú:

2

Claude extrae el texto, analiza la estructura y te muestra una estimación de coste antes de generar nada:

Claude:

Fuente detectada: influence-cialdini.pdf (PDF)

Páginas: ~320 | Palabras: ~95.000 | Tokens fuente: ~127K

Coste estimado (conversión completa):

  Input: ~165K tokens | Output: ~22K tokens | Total: ~187K tokens

  Claude Sonnet 4.6: ~$0.83 USD

  Tiempo estimado: ~8 minutos

¿Proceder con la conversión completa? (o escribe "analyze only" para ver primero)

Si dices que sí, Claude procesa cada capítulo, extrae frameworks, genera los archivos, y al final te da un resumen:

Claude:

Skill creada: ~/.claude/skills/cialdini-influence/

Libro: Influence — Robert B. Cialdini

Páginas: ~320 | Capítulos: 9

Archivos generados: SKILL.md + 9 capítulos + glossary + patterns + cheatsheet

Tamaño total de la skill: ~18K tokens (cargados bajo demanda)

A partir de ahora, en cualquier sesión futura de Claude Code, puedes pedir cosas como "aplica el principio de escasez de Cialdini a mi copy" y Claude sabe exactamente qué hacer.

¿Qué genera exactamente?

Después de la conversión, la skill tiene esta estructura:

~/.claude/skills/cialdini-influence/ ├── SKILL.md — Archivo maestro: frameworks + índice (~4K tokens) ├── chapters/ │ ├── ch01-weapons.md — Resumen cap. 1 (~1K tokens) │ ├── ch02-reciprocation.md │ ├── ch03-commitment.md │ ├── ch04-social-proof.md │ ├── ch05-liking.md │ ├── ch06-authority.md │ ├── ch07-scarcity.md │ ├── ch08-unity.md │ └── ch09-instant-influence.md ├── glossary.md — Todos los términos clave (~1.5K tokens) ├── patterns.md — Técnicas y patrones aplicables (~2K tokens) └── cheatsheet.md — Referencia rápida (~1K tokens)

¿Qué hay dentro de cada archivo de capítulo?

Cada capítulo sigue una estructura fija que Claude puede navegar rápido:

La clave es que no son resúmenes narrativos. Son herramientas de pensamiento que Claude puede aplicar directamente a tu trabajo.

El problema de tokens que resuelve

Cuando intentas que un agente trabaje con un libro, hay tres enfoques habituales. Los tres tienen problemas serios.

Opción 1: volcar el libro entero en contexto. Un libro de 300 páginas son 120.000-180.000 tokens. Cada vez que haces una pregunta, pagas esa factura completa. Con un libro de ingeniería de software son fácilmente 250K tokens por consulta. A $3 por millón de tokens de entrada, la cuenta sube rápido.

Opción 2: buscar trozo a trozo. Le dices a Claude "busca en el libro la parte sobre testing" y el agente va abriendo secciones, leyendo, descartando, probando otra. Este enfoque "de descubrimiento" gasta entre 12.000 y 78.000 tokens por consulta dependiendo de lo rápido que encuentre lo que buscas. Mejor que volcar todo, pero sigue siendo caro y lento.

Opción 3: no usar el libro. La más común. Tienes el libro, sabes que tiene la respuesta, pero el coste o la fricción te frena. El conocimiento se queda en la estantería.

Book-to-skill introduce una cuarta vía: compilar el conocimiento una sola vez. La skill generada tiene un SKILL.md de ~4.000 tokens que siempre está cargado, más capítulos individuales de ~1.000-1.800 tokens que se cargan solo cuando hacen falta. Resultado: cada consulta consume unos 5.000-6.000 tokens en vez de 120.000+.

Para ponerlo en perspectiva con números reales:

EnfoqueTokens por consultaComparación
Volcar libro completo120K-250KReferencia (1x)
Búsqueda iterativa12K-78K3-20x más eficiente
Skill compilada~5K24-50x más eficiente

Y esa ventaja escala con el tamaño del libro. Cuanto más grande y denso es el libro, mayor es la diferencia. Con un manual técnico de 600 páginas, la skill puede ser 50 veces más eficiente que el volcado directo. Es la diferencia entre rebuscar en un cajón sin orden y consultar un archivo con pestañas bien puestas.

Los 3 modos de uso

ModoComando¿Qué hace?Cuándo usarlo
Full Conversión /book-to-skill libro.pdf Extrae, analiza, genera toda la skill Cuando quieres la skill completa de un tirón
Analyze Only /book-to-skill libro.pdf → "analyze only" Extrae y muestra un informe de lo encontrado, sin generar archivos Cuando quieres revisar qué va a extraer antes de gastar tokens
Generate from Analysis Proporciona un análisis previo a Claude Salta la extracción, genera la skill desde notas existentes Cuando ya hiciste "analyze only" y quieres generar, o tienes tus propias notas

Mi recomendación: para libros que ya conoces, usa Full Conversión directamente. Para libros nuevos o muy largos (500+ páginas), haz primero "analyze only" para ver si la estructura se detecta bien, y luego genera.

Cómo consultar una skill generada

Una vez generada, la skill está disponible en todas tus sesiones de Claude Code. No necesitas activarla ni importarla. Simplemente habla con Claude y referencia el contenido:

Tú:

Estoy escribiendo la landing page de mi SaaS. ¿Qué principio de Cialdini aplicarías al CTA principal?

Claude:

(carga ch07-scarcity.md y ch02-reciprocation.md)

Dos principios encajan aquí. Escasez: limita las plazas o pon un contador de tiempo en la oferta. Cialdini lo llama el "principio de escasez", y funciona porque valoramos más lo que percibimos como limitado. Reciprocidad: ofrece algo gratis antes del CTA (un template, una auditoría, un capítulo). El usuario siente obligación de devolver el favor. Mi recomendación: combina ambos. Ofrece un recurso gratis y pon un deadline a la oferta. Empieza gratis con los 3 primeros módulos.

Formas de consultar

Claude carga solo el capítulo relevante, no toda la skill. Por eso el coste por consulta es mínimo.

Más allá de libros: carpetas, papers y docs internos

Book-to-skill no se limita a un solo archivo. Puedes pasarle carpetas enteras, patrones glob, o múltiples documentos que se fusionan en una skill unificada.

Carpeta de documentación interna # Convierte 40 archivos Markdown de tu wiki en una skill consultable /book-to-skill ~/workspace/docs/ knowledge-base
Papers de investigación # Fusiona varios PDFs académicos en una skill con glosario compartido /book-to-skill "~/papers/*.pdf" research-llm

Esto abre casos de uso que van más allá de los libros:

Cuando le pasas una carpeta, el script procesa cada archivo por separado y fusiona los resultados en un único SKILL.md con glosario, patrones y cheatsheet compartidos.

Fold-in: añadir contenido a una skill existente

¿Ya tienes una skill generada y quieres añadirle un documento nuevo sin regenerar todo? El modo fold-in hace exactamente eso.

Añadir un artículo a una skill existente # Añade un nuevo documento a la skill research-llm que ya existe /book-to-skill ~/papers/nuevo-paper.pdf ~/.claude/skills/research-llm

El proceso es inteligente: lee el SKILL.md existente, detecta la numeración actual de capítulos, y añade los nuevos sin romper los anteriores. El glosario, patrones y cheatsheet se fusionan alfabéticamente.

Esto convierte la skill en una base de conocimiento viva. Cada vez que lees un paper nuevo, un ADR reciente, o una guía actualizada, lo incorporas a la skill existente con un solo comando. Con el tiempo, acumulas una biblioteca personal que Claude puede consultar al instante.

Formatos soportados y extractores

FormatoExtractor principalFallbackNotas
PDF (texto)pdftotext (poppler)PyPDF2 → pdfminerEl más común. Instala poppler para mejor resultado.
PDF (técnico)DoclingpdftotextPreserva tablas, código y fórmulas como Markdown.
EPUBebooklib + BS4zipfile + html.parserLa mayoría de ebooks. Funciona con fallback stdlib.
DOCXpython-docxzipfile + XML parserDocumentos Word. Fallback stdlib decente.
MarkdownLectura directa—Sin dependencias. Perfecto para docs técnicos.
Texto planoLectura directa—Sin dependencias.
HTMLBeautifulSoup4html.parser stdlibPara libros en formato web.
RTFstriprtfRegex básicoFormato legacy, funciona razonablemente.
MOBI/AZWCalibre ebook-convert—Requiere Calibre instalado. Sin fallback.

Si un extractor no está instalado, el script te pregunta: "Missing package detected. Do you want to install? y=install, n=fallback". Puedes elegir instalar o usar el fallback stdlib que viene incluido.

Elegir bien el modo de extracción importa mucho

Un PDF técnico procesado como prosa pierde todas las tablas de comparación, los bloques de código y las fórmulas. La skill resultante suena razonable pero está vacía de contenido útil. Si el libro tiene tablas o código, siempre elige "Technical" aunque tarde más (Docling necesita unos 90-180 segundos para 100 páginas, pero preserva la estructura que da valor al libro).

¿Por qué esto y no un RAG?

Si conoces RAG (Retrieval Augmented Generation), te estarás preguntando: ¿no es esto lo mismo? No. Son enfoques fundamentalmente distintos.

AspectoRAG tradicionalBook-to-skill
¿Cuándo analiza?En cada consultaUna vez al compilar
¿Qué devuelve?Fragmentos de texto por similitud semánticaFrameworks con nombre, reglas de decisión, anti-patrones
InfraestructuraBase de datos vectorial, embeddings, pipelineArchivos Markdown en una carpeta
Coste recurrenteTokens por cada consulta (embedding + retrieval + generación)Ninguno después de compilar
NavegaciónSimilitud semántica (a veces imprecisa)Índice explícito de temas y capítulos
Calidad de respuestaDepende de qué fragmentos recupereFrameworks ya sintetizados y estructurados

RAG tiene sentido cuando trabajas con datos que cambian constantemente (logs, tickets, conversaciones). Pero para un libro o documentación estable, compilar una vez y consultar gratis es objetivamente mejor. No necesitas montar Qdrant, generar embeddings, ni mantener un pipeline. Solo archivos Markdown que cualquier agente sabe leer.

Además, RAG devuelve trozos de texto. Book-to-skill devuelve conocimiento procesado: "usa X cuando Y" en vez de "en la página 147 el autor menciona que...". Eso marca la diferencia cuando quieres que Claude aplique un framework a tu trabajo en vez de simplemente citarte un párrafo.

¿Cuánto cuesta en tokens?

Book-to-skill es gratis y open-source. El coste real es el consumo de tokens de Claude al procesar el libro. Aquí van números reales:

Tamaño del libroTokens entradaTokens salidaCoste Sonnet 4.6Tiempo
100 páginas (~35K palabras)~60K~12K~$0.35~4 min
200 páginas (~70K palabras)~120K~20K~$0.65~7 min
400 páginas (~140K palabras)~230K~35K~$1.20~12 min
600 páginas (~210K palabras)~350K~50K~$1.80~18 min

Para libros largos (500+ páginas), la skill usa un enfoque inteligente: en vez de leer el libro entero en memoria, hace consultas quirúrgicas con grep y sed para cargar solo el capítulo que está procesando. Esto mantiene el coste proporcional al output, no al tamaño del libro.

La inversión merece la pena

Gastar $1 en convertir un libro que costó $30 y que vas a consultar durante meses es probablemente el mejor ROI que puedes sacar de tus tokens de Claude.

3 ejemplos reales

Ejemplo 1: libro de marketing

/book-to-skill ~/Libros/building-a-storybrand-miller.epub storybrand

Genera una skill con los 7 pasos del framework StoryBrand. Después puedes pedir: "Aplica el framework StoryBrand a la página de inicio de mi proyecto." Claude estructura tu copy siguiendo los 7 pasos del libro.

Ejemplo 2: libro técnico de programación

/book-to-skill ~/Libros/designing-data-intensive-apps.pdf

Al preguntar por tipo de libro, elige "Technical". Docling preserva las tablas de comparación (LSM-Tree vs B-Tree), los diagramas de arquitectura en texto, y los fragmentos de código. Consulta: "¿Qué patrón de replicación recomienda Kleppmann para mi caso de uso con Postgres?"

Ejemplo 3: libro de productividad

/book-to-skill ~/Libros/deep-work-cal-newport.pdf newport-deep-work

Extrae las 4 reglas de Deep Work, las estrategias de scheduling, y los anti-patrones de distracción. Consulta: "Diseña mi rutina diaria aplicando las reglas de Deep Work de Newport."

9 consejos para mejores resultados

  1. Usa PDFs de buena calidad. Los PDFs escaneados (imágenes sin OCR) dan mal resultado. Si tu PDF es un escaneo, pásalo primero por un OCR como Adobe Acrobat u OCRmyPDF.
  2. Para libros técnicos, elige siempre "Technical". Docling tarda más (1.5 segundos por página), pero preserva tablas y código que pdftotext destruye. Un libro técnico sin sus tablas es una skill que suena bien pero no sirve.
  3. Haz "analyze only" primero con libros nuevos. Te muestra los frameworks detectados antes de gastar tokens en la generación completa. Si la estructura del libro es irregular, puedes ajustar.
  4. Nombra las skills con el formato autor-concepto. cialdini-influence, newport-deep-work, kleppmann-data-intensive. Es más fácil de recordar y referenciar que un slug genérico.
  5. Un libro por skill, pero usa fold-in para documentos relacionados. Un libro grande merece su propia skill. Pero papers o artículos sobre el mismo tema pueden ir juntos con fold-in.
  6. Revisa siempre el SKILL.md generado. Claude a veces confunde nombres de frameworks, mezcla conceptos similares, u omite secciones importantes. Cinco minutos de revisión manual mejoran mucho la calidad de las consultas futuras. Compara con el índice del libro original.
  7. Combina skills. Lo potente es tener varias skills activas. "Aplica reciprocidad de Cialdini usando el framework StoryBrand para mi onboarding." Claude cruza ambas skills sin que le digas dónde buscar.
  8. Los libros con frameworks con nombre dan mejores skills. "Las 5 fuerzas de Porter", "el principio de Pareto", "la regla de los 2 minutos". Cuanto más estructurado y nombrado está el contenido del autor, mejor es la extracción. Libros tipo ensayo narrativo sin frameworks explícitos producen skills mediocres.
  9. No olvides la documentación interna. Las mejores skills que he generado no son de libros famosos, sino de documentación interna: ADRs, guías de arquitectura, runbooks de producción. Conocimiento que ya existía pero que nadie consultaba porque estaba disperso en 30 archivos.

Limitaciones

Siendo honestos sobre lo que no hace bien:

¿Y si no uso Claude Code?

Book-to-skill también funciona con otros agentes:

La skill generada son archivos Markdown estándar. Si tu herramienta soporta leer archivos Markdown como contexto, puedes usarla. No hay dependencia de ningún agente específico.

¿Dónde consigo libros gratuitos para convertir en skills?

Book-to-skill funciona con cualquier PDF, EPUB o DOCX que tengas. Pero si estás empezando y no sabes por dónde buscar material legal y gratuito, aquí va un framework de búsqueda que he destilado investigando a fondo los recursos disponibles en GitHub y fuera de él.

Aviso legal importante

Que un libro esté en un repositorio público de GitHub no significa que sea legal redistribuirlo ni que tengas derecho a usarlo como quieras. GitHub aplica copyright por defecto a los repositorios sin licencia: nadie obtiene automáticamente derecho de reproducción, distribución o creación de obras derivadas. Solo el fork dentro de GitHub está permitido por los términos del servicio.

Antes de convertir cualquier libro en skill, verifica: (1) que existe una licencia explícita (Creative Commons, MIT, Apache, etc.), (2) que la licencia permite el uso que le vas a dar, y (3) que el material procede del autor o de una fuente autorizada. Un PDF en un repo de un tercero no es prueba de que sea libre.

Este framework es informativo y educativo. No sustituye asesoramiento jurídico. La responsabilidad de verificar los derechos de cada obra es tuya.

El framework: 3 niveles de confianza

No todos los "libros gratuitos" tienen el mismo nivel de seguridad jurídica. He organizado las fuentes en tres niveles para que sepas exactamente dónde pisas:

NivelDescripciónEjemplo¿Puedo convertirlo en skill?
A: Fuente oficial El autor o proyecto pública la obra con licencia clara e inequívoca Pro Git (CC BY-NC-SA 3.0), repositorios universitarios con CC BY-SA Sí, respetando los términos de la licencia (atribución, no comercial si aplica, etc.)
B: Índice curado Un catálogo mantenido enlaza obras externas. El índice tiene licencia propia, pero cada libro enlazado tiene la suya Free Programming Books (CC BY 4.0 para el índice) Depende de cada libro. El índice es seguro, la obra enlazada requiere verificación individual
C: Copia de tercero Alguien sube PDFs de otros autores a su repositorio, a veces etiquetados como "distribución libre" Repos con carpetas llenas de PDFs sin licencia verificable No sin verificar. Busca siempre la fuente original del autor o editorial

Regla de oro: empieza por el índice curado (nivel B), localiza la obra que te interesa, y termina la verificación en la fuente del autor (nivel A). Nunca uses un repo de tercero como fuente primaria sin comprobar la licencia original.

Paso 1: tu punto de partida

El mejor catálogo de libros técnicos gratuitos que existe se llama Free Programming Books, mantenido por la Free Ebook Foundation. Tiene cerca de 395.000 estrellas en GitHub, contribuciones activas en 2026, y su índice está bajo CC BY 4.0. Incluye una sección en español con libros de IA, Git, JavaScript, Python, sistemas operativos y desarrollo web.

Enlaces de entrada # Catálogo general (multiidioma) https://github.com/EbookFoundation/free-programming-books # Sección en español (programación) https://github.com/EbookFoundation/free-programming-books/blob/main/books/free-programming-books-es.md # Ciencia (mayoritariamente inglés) https://github.com/EbookFoundation/free-science-books

Pero recuerda: la licencia CC BY 4.0 cubre el catálogo, no cada libro enlazado. Cada obra tiene su propia licencia que debes comprobar antes de usarla.

Paso 2: libros verificados listos para convertir

Estos son libros que he verificado personalmente: fuente oficial, licencia explícita, formatos disponibles y estado actual confirmado. Puedes descargarlos y pasarlos por book-to-skill con tranquilidad, siempre respetando las condiciones de cada licencia.

Programación y desarrollo

LibroTemaLicenciaFormatosIdiomaIdeal para skill de...
Pro Git, 2.ª ed.
Scott Chacon, Ben Straub
Git completo CC BY-NC-SA 3.0 PDF, EPUB, HTML, MOBI Español Workflows Git, branching, colaboración
Eloquent JavaScript, 4.ª ed.
Marijn Haverbeke (trad. Midudev)
JavaScript moderno CC BY-NC 3.0 (texto), MIT (código) PDF (445 pág.), EPUB, MOBI, HTML Español Patrones JS, DOM, Node.js, proyectos
El modo JavaScript
Baptiste Pesquet
JavaScript desde cero CC BY-NC-SA 4.0 PDF, texto fuente Español Intro JS, DOM, APIs, primer proyecto

Ciencia de datos y estadística

LibroTemaLicenciaFormatosIdiomaIdeal para skill de...
Intro. Ciencia de Datos
Rafael A. Irizarry (trad. Alex Nones)
R, estadística, ML CC BY-NC-SA 4.0 HTML/web, fuentes R Markdown Español Probabilidad, regresión, ggplot2, dplyr
Respondiendo preguntas con datos
Crump, Navarro, Suzuki, Cabana
Estadística introductoria CC BY-SA 4.0 HTML/web, Quarto reproducible Español Conceptos estadísticos, diseño experimental

Ciencia abierta y metodología

LibroTemaLicenciaFormatosIdiomaIdeal para skill de...
Open Science Training Handbook Ciencia abierta, OER CC0 1.0 Universal Markdown/GitHub Español Datos abiertos, licencias, reproducibilidad

Paso 3: convertir a skill

Una vez que tienes el libro descargado y su licencia verificada, el proceso es directo:

Ejemplo completo # 1. Descarga Pro Git en español (PDF oficial) curl -LO https://github.com/progit/progit2-es/releases/download/2.1.23/progit.pdf # 2. Conviértelo en skill /book-to-skill ~/Downloads/progit.pdf progit-es # 3. Úsalo # "¿Cómo funciona el rebase interactivo en Git?" # Claude carga el capítulo relevante y te explica con el contexto del libro

Paso 4: verificar licencias (checklist rápido)

Antes de convertir cualquier libro, pasa por esta checklist:

  1. ¿Quién lo pública? Busca el repositorio del autor o proyecto original, no una copia de terceros.
  2. ¿Hay archivo LICENSE o licencia en el README? Si no hay ninguno, el copyright aplica por defecto. No puedes asumir que es libre.
  3. ¿Qué licencia exacta es? CC BY permite casi todo con atribución. CC BY-NC prohíbe uso comercial. CC BY-SA obliga a compartir igual. Sin versión especificada, desconfía.
  4. ¿Es la fuente o una copia? Un PDF en el repo de otra persona no hereda la licencia de ese repo. Busca siempre la edición original.
  5. ¿Tu uso es personal o vas a distribuir? Para uso personal con libros que compraste, el riesgo es mínimo. Para redistribuir la skill generada, necesitas que la licencia lo permita explícitamente.

Sobre libros que compraste

Si compraste un libro (papel o digital), convertirlo en skill para tu uso personal es análogo a tomar notas estructuradas. Book-to-skill no copia texto literal: sintetiza, extrae frameworks y genera contenido derivado. Dicho esto, redistribuir esa skill a terceros entra en terreno diferente y depende de la legislación de tu país y de los términos de la licencia del libro. En caso de duda, consulta con un profesional legal.

Paso 5: catálogos curados por tema

Más allá de Free Programming Books, hay catálogos especializados que funcionan como semillas de búsqueda. Todos son índices que enlazan a fuentes externas, así que la licencia de cada libro sigue requiriendo verificación individual.

IA y Machine Learning

CatálogoCoberturaLicencia del índiceUso recomendado
awesome-free-ai-books
MarcosSete
Deep Learning, RL, NLP/LLM, ML, CV, AI SafetyEnlaces solo a fuentes oficialesMejor índice curado de IA. Punto de partida para skills de ML/DL.
awesome-machine-learning (books.md)
josephmisiti
ML, Data Mining, StatisticsLista curada, enlaces externosDiscovery amplio. Verificar cada título.
ml-books
brpy
ML, Data Science, StatisticsRepo MIT; obras externas varíanPunto de partida complementario.

Ciberseguridad

CatálogoCoberturaLicencia del índiceUso recomendado
misp-training
MISP Project (oficial)
Threat Intelligence, OSINT, MISPAGPLv3+ / CC BY-SA 4.0Material oficial con licencia clara. Ingesta permitida.
Malware (curso)
RPISEC
Malware Analysis, Reverse EngineeringMaterial docente propioCurso universitario completo. Revisar licencia concreta.
malware-study
albertzsigovits
Malware, REEnlaces a recursos externosÍndice de referencia para malware analysis.

Paso 6: libros oficiales de autores (las joyas)

Los mejores candidatos para skills son libros que los propios autores o sus editoriales publican gratuitamente. Aquí no hay ambigüedad de licencia: el autor decidió que quiere que los leas gratis. He recopilado los más relevantes por dominio.

IA y Machine Learning

Ciberseguridad y Reverse Engineering

Todos estos libros tienen en común que el autor o la institución los pública activamente de forma gratuita. Son candidatos ideales para book-to-skill: contenido de calidad, licencia clara, y formatos descargables.

Cómo detectar repos que no debes usar

En GitHub vas a encontrar repositorios que parecen bibliotecas gratuitas pero en realidad alojan copias no autorizadas de libros comerciales. Estas son las señales de alarma:

  1. El archivo LICENSE solo cubre el código o el README, pero el repo está lleno de PDFs de editoriales (O'Reilly, Packt, Wiley, No Starch, Pearson, Manning).
  2. El README dice "collected from the Internet", "for educational purposes only", o "contact me for removal". Esas frases son un reconocimiento implícito de que no tienen derechos.
  3. Enlaces a Google Drive, Mega, o servicios similares con colecciones de PDFs. Las editoriales legítimas no distribuyen así.
  4. Decenas o cientos de PDFs de libros comerciales en una sola carpeta. Ningún autor pública así su propia obra.
  5. Nombres de archivo con ISBN o edición comercial sin licencia acompañante.
  6. Repo con licencia MIT/Apache que no puede aplicarse al contenido editorial de terceros. La licencia del repo cubre el código del repo, no los PDFs que alguien subió dentro.

Si ves alguna de estas señales, no uses ese contenido. Busca el título que te interesa en la web del autor o la editorial. Muchos libros técnicos tienen versiones gratuitas oficiales que los propios autores distribuyen.

Recursos universitarios en inglés (fallback de calidad)

Si no encuentras lo que buscas en español, OpenStax (Rice University) ofrece manuales universitarios completos y gratuitos en inglés, con licencia Creative Commons. Cubren cálculo, estadística, física, biología y más. Claude trabaja igual de bien con skills en inglés y puede responderte en español.

Artículos relacionados en IAcademy

Tu especialización desde 19 EUR

19 itinerarios prácticos. Founding Members: acceso sin caducidad al contenido adquirido + canal directo con el creador. Solo 50 plazas.

Ver Founding Members

Founding Members: todo por 99 EUR

614 módulos, 23 especializaciones, acceso sin caducidad al contenido adquirido. Precio normal: 199 EUR. Reembolso según Términos.

Ser Founding Member — 99 EUR Ver todos los planes

Aprende más en el curso

Este artículo complementa el Módulo M06: Agentes IA y automatización. Incluye vídeo, quiz, flashcards con repaso espaciado y proyecto práctico.

Ir al módulo M06 Repasar con FSRS