Qué es un LLM
LLM = programa que predice la siguiente palabra más probable tras leer miles de millones de textos. No piensa, no razona, no busca en BD.
Consecuencias directas
- Sin memoria real: cada conversación empieza de cero (salvo memoria persistente, M03).
- No verifica datos: puede inventar cifras, URLs, citas (alucinaciones).
- Basura entra, basura sale: prompt vago = respuesta vaga.
- No ejecuta código: genera texto que parece código (excepciones: Claude Code, Code Interpreter).
Regla de oro: Trátalo como un junior muy rápido, no como un senior infalible. Verifica datos críticos y testea el código.
Qué puede y qué no puede hacer
Puede hacer bien
- Redactar textos, emails, documentos estructurados
- Analizar documentos largos y extraer información clave
- Generar código funcional (con revisión humana)
- Traducir con calidad profesional
- Resumir, clasificar, organizar información
- Brainstorming y generación de ideas
- Explicar conceptos complejos de forma simple
No puede hacer (o hace mal)
- Verificar si un dato es verdadero o falso
- Recordar conversaciones anteriores sin configuración
- Acceder a internet en tiempo real (excepto Gemini y Perplexity)
- Garantizar que el código funciona sin testear
- Tomar decisiones éticas o legales por ti
- Contar con precisión (palabras, caracteres, elementos)
- Matemáticas complejas sin herramientas externas
Anti-alucinaciones: Añade al prompt: "Si no estás seguro de un dato, dilo explícitamente. No inventes." Pide fuentes y verifica datos críticos.
Elegir modelo: comparativa real
ChatGPT (GPT-4o)
- Mejor para: redacción creativa, brainstorming, marketing, imágenes DALL-E.
- Debilidad: pierde contexto en documentos largos, verboso, a veces ignora restricciones.
- Contexto: 128K tokens (~90 páginas).
Claude (Opus 4 / Sonnet 4)
- Mejor para: análisis de documentos largos, instrucciones complejas, código profesional, tareas con restricciones.
- Debilidad: conservador en temas sensibles, demasiado cauteloso.
- Contexto: hasta 1M tokens (~700 páginas). El mayor del mercado.
Gemini (Google)
- Mejor para: acceso a internet en tiempo real, integración con ecosistema Google.
- Debilidad: menor precisión en tareas muy técnicas comparado con Claude.
DeepSeek
- Mejor para: tareas de razonamiento y código con coste reducido.
- Debilidad: menos pulido en creatividad y seguimiento de instrucciones complejas.
Claves finales
- No uses la misma IA para todo: elige según la tarea (documentos largos → Claude; creatividad → ChatGPT; datos en tiempo real → Gemini).
- Prompt profesional: sé específico, da contexto, define formato y restricciones.
- Diferencia entre modelos: contexto, capacidad de ejecución, acceso a internet y estilo de respuesta.
- Ejercicio práctico: prueba el mismo prompt en 2 modelos distintos y compara resultados.