Los modelos de lenguaje de gran escala —LLM, por sus siglas en inglés— son tan recientes que a veces olvidamos que su historia empezó hace más de dos décadas, y que su funcionamiento no tiene nada que ver con cómo piensa un ser humano o un animal. Su origen puede rastrearse a los primeros modelos estadísticos de lenguaje de los años 2000, pero el salto decisivo llegó en 2017, cuando Google publicó el artículo Attention Is All You Need y presentó la arquitectura transformer, el esqueleto matemático que hoy sostiene a GPT, Claude, Gemini, Llama y todos los sistemas actuales. Aquella arquitectura no nació para “pensar”, sino para predecir texto, una tarea aparentemente simple que acabó convirtiéndose en el motor de la IA moderna.
Cuando apareció una inteligencia no biológica: cómo nacieron los LLM y por qué piensan distinto a los seres vivos
8 de diciembre de 2025



