🛡️
Session Flagged

Your session has been flagged for unusual activity.

You can try our app by searching for MultipleChat AI on Google and clicking the multiplechat.ai link to try it free.
Verificación rápida

Confirma que eres una persona para continuar.


71 términos · actualizado en 2026

El glosario de IA

Definiciones claras y precisas de todos los términos de IA que importan en 2026, escritas para quienes realmente usan las herramientas, no solo escriben sobre ellas.

A

Adam (Optimizador)

Un algoritmo de optimización muy utilizado que adapta la tasa de aprendizaje de cada parámetro, haciendo que el entrenamiento de las redes neuronales sea más rápido y estable.

Agente de IA

Un sistema de IA que planifica y ejecuta tareas de varios pasos por sí mismo —llamando a herramientas, leyendo los resultados y decidiendo qué hacer a continuación— en lugar de responder una sola vez.

Alineación

El trabajo de hacer que el comportamiento de un sistema de IA coincida con la intención y los valores humanos: por qué un modelo sigue las instrucciones de forma fiable y rechaza las solicitudes dañinas.

Mecanismo de atención

La técnica que permite a un modelo ponderar la importancia de cada parte de la entrada al generar cada parte de la salida: la operación central de todo Transformer.

B

Retropropagación

El algoritmo que entrena las redes neuronales propagando los errores de predicción hacia atrás para ajustar cada peso: el motor detrás de casi todo el aprendizaje profundo.

Normalización por lotes

Una técnica de entrenamiento que normaliza las entradas de cada capa, permitiendo que las redes más profundas se entrenen más rápido y de forma más estable.

Benchmark

Una prueba estandarizada que se usa para medir y comparar modelos en tareas como razonamiento, conocimiento o programación; útil para elaborar clasificaciones, pero nunca un sustituto completo de probar un modelo con tu propio trabajo.

BLEU

Una métrica automática consolidada para la traducción automática que puntúa el resultado según cuánto coinciden sus secuencias de palabras con traducciones de referencia humanas.

C

Olvido catastrófico

La tendencia de una red neuronal a perder habilidades aprendidas previamente al entrenarse con datos nuevos: un reto clave para actualizar modelos de forma continua.

Cadena de pensamiento (CoT)

Pedirle a un modelo que razone a través de pasos intermedios antes de dar una respuesta final, lo que mejora la precisión en problemas de varios pasos.

ChatGPT

El asistente conversacional de OpenAI, lanzado en noviembre de 2022, que llevó los modelos de lenguaje ajustados por instrucciones a un público masivo.

Claude

La familia de modelos de lenguaje de gran tamaño de Anthropic, conocida por su contexto extenso, su sólida capacidad de razonamiento y un enfoque de seguridad llamado IA Constitucional.

CNN (red neuronal convolucional)

Una arquitectura neuronal que usa filtros aprendidos para detectar patrones espaciales, base de la visión artificial moderna.

Ventana de contexto

La cantidad total de texto —medida en tokens— que un modelo puede tener en cuenta en una sola llamada, incluyendo el prompt de sistema, el historial de la conversación, los archivos adjuntos y la respuesta que se está generando.

Ver: Visualizador de ventana de contexto.

Similitud coseno

Una medida de cuán similares son dos vectores según el ángulo que forman entre sí: la forma estándar de comparar embeddings en búsqueda y RAG.

D

DALL·E

El modelo de generación de imágenes a partir de texto de OpenAI, que crea imágenes a partir de descripciones en lenguaje natural y popularizó la creación de imágenes mediante prompts.

Modelo de difusión

Un modelo generativo que aprende a crear datos invirtiendo un proceso gradual de adición de ruido: la tecnología detrás de la mayoría de los generadores de imágenes de IA actuales.

DPO (optimización directa de preferencias)

Un método de alineación que entrena a un modelo directamente con pares de preferencias humanas usando una función de pérdida de clasificación simple, evitando el modelo de recompensa independiente que usa RLHF.

Dropout

Una técnica de regularización que desactiva neuronas de forma aleatoria durante el entrenamiento para evitar el sobreajuste y mejorar la generalización.

E

Embedding

Una lista de números que representa el significado de un fragmento de texto, de modo que los elementos semánticamente similares quedan cerca entre sí en el espacio vectorial.

F

Few-Shot Prompting

Darle a un modelo un puñado de ejemplos resueltos dentro del prompt para que pueda inferir el patrón antes de responder.

Fine-Tuning

Continuar entrenando un modelo preentrenado con datos adicionales y especializados para que se adapte a un dominio, tarea o estilo concreto sin construirlo desde cero.

G

GAN (red generativa antagónica)

Una arquitectura generativa que entrena dos redes una contra la otra: un generador que fabrica datos y un discriminador que intenta detectar las falsificaciones.

Gemini

La familia de modelos nativamente multimodales de Google DeepMind, diseñados para razonar de forma conjunta sobre texto, imágenes, audio y vídeo.

GPT (Transformer generativo preentrenado)

Una familia de modelos Transformer basados únicamente en el decodificador, preentrenados para predecir el siguiente token en grandes corpus de texto y luego adaptados a tareas concretas.

Grok

El modelo de lenguaje de gran tamaño y asistente de xAI, integrado con la plataforma X y orientado a la información en tiempo real y un estilo conversacional.

H

Alucinación

Cuando un modelo de lenguaje genera texto fluido y seguro pero incorrecto o no respaldado por sus fuentes.

I

Aprendizaje en contexto

La capacidad de un modelo para aprender una tarea a partir de ejemplos o instrucciones incluidos en el prompt en el momento de la inferencia, sin cambiar sus pesos.

Ajuste por instrucciones

Ajustar un modelo con muchas tareas formuladas como instrucciones en lenguaje natural, de modo que siga bien las instrucciones nuevas incluso en tareas que nunca vio durante el entrenamiento.

J

Jailbreak

Un prompt diseñado para eludir el entrenamiento de seguridad de un modelo y hacer que produzca contenido que se supone debe rechazar.

K

Destilación de conocimiento

Entrenar a un modelo “alumno” más pequeño para que imite a un modelo “profesor” más grande, transfiriendo gran parte de su capacidad a un modelo más barato y rápido.

Grafo de conocimiento

Una red estructurada de entidades y las relaciones entre ellas, que se usa para almacenar hechos de una forma que las máquinas pueden consultar y sobre la que pueden razonar.

L

Latencia

El retraso entre el envío de un prompt y la recepción de una respuesta. Los modelos más grandes y los contextos más largos aumentan la latencia: la principal disyuntiva de velocidad en los productos de IA.

Llama

La familia de modelos de lenguaje de gran tamaño de Meta publicados de forma abierta, influyente por acercar modelos potentes y ejecutables localmente a investigadores y desarrolladores.

LLM (modelo de lenguaje de gran tamaño)

Una red neuronal entrenada con enormes cantidades de texto para predecir el siguiente token, lo que produce comprensión y generación de lenguaje de propósito general.

LoRA (adaptación de bajo rango)

Un método de ajuste fino eficiente en parámetros que adapta un modelo grande entrenando pequeñas matrices añadidas mientras mantiene congelados los pesos originales.

LSTM (memoria a largo-corto plazo)

Un diseño de red neuronal recurrente con compuertas capaz de recordar información a lo largo de secuencias largas: el caballo de batalla del modelado de secuencias antes de los Transformers.

M

MCP (protocolo de contexto de modelo)

Un estándar abierto para conectar asistentes de IA con herramientas y fuentes de datos externas a través de una interfaz común, de modo que las integraciones se construyen una vez y se reutilizan en distintos modelos.

Mezcla de expertos (MoE)

Una arquitectura que dirige cada entrada hacia unas pocas subredes especializadas en lugar de hacia el modelo completo, lo que ofrece una gran capacidad a un coste menor por consulta.

Ficha de modelo

Un documento breve y estandarizado que describe el uso previsto de un modelo, su rendimiento en distintos grupos y sus limitaciones, para fomentar una publicación transparente y responsable.

Multimodal

Un modelo que funciona con más de un tipo de dato —como texto, imágenes, audio o vídeo— dentro del mismo sistema.

N

Muestreo de núcleo (Top-p)

Un método de decodificación que elige el siguiente token del conjunto más pequeño cuyas probabilidades suman p, evitando tanto el texto repetitivo como el incoherente.

P

Perplejidad

Una medida intrínseca estándar de la calidad de un modelo de lenguaje: cuánto le sorprende un texto que no ha visto antes. Cuanto más baja es la perplejidad, mejor predice el modelo un texto real.

Prompt

El texto de entrada que le das a un modelo para obtener una respuesta. La redacción, los ejemplos y la estructura influyen mucho en la calidad del resultado.

Inyección de prompt

Un ataque que introduce instrucciones maliciosas en la entrada de un modelo —de forma directa o a través de contenido recuperado— para anular su prompt de sistema o secuestrar su comportamiento.

Q

Cuantización

Almacenar los pesos de un modelo con menor precisión numérica para reducir el uso de memoria y acelerar la inferencia, normalmente con poca pérdida de calidad.

R

RAG (generación aumentada por recuperación)

Una técnica que recupera documentos relevantes en el momento de la consulta y se los proporciona a un modelo de lenguaje, de modo que su respuesta se basa en fuentes reales y no solo en su memoria.

Red Teaming

Poner a prueba deliberadamente un modelo con entradas adversarias para detectar comportamientos dañinos, inseguros o que infrinjan las políticas antes de su despliegue.

Reordenación (Reranking)

Una segunda etapa de recuperación que vuelve a puntuar un conjunto inicial de pasajes candidatos con un modelo más preciso, situando los más relevantes en primer lugar.

ROUGE

Una familia de métricas automáticas para la generación de resúmenes que miden la coincidencia entre el texto generado y los resúmenes de referencia humanos.

S

Leyes de escalado

Relaciones empíricas que muestran cómo el rendimiento de un modelo mejora de forma predecible al aumentar los parámetros, los datos y el cómputo.

Autoconsistencia

Un método de razonamiento que genera varias cadenas de pensamiento para la misma pregunta y devuelve la respuesta en la que coincide la mayoría.

Secuencia a secuencia (Seq2Seq)

Una arquitectura neuronal de codificador-decodificador que transforma una secuencia en otra: el diseño que hizo posible la traducción automática neuronal y, más tarde, el chat generativo.

Decodificación especulativa

Una técnica para acelerar la inferencia en la que un modelo pequeño y rápido redacta varios tokens y un modelo grande los verifica en paralelo, dando una salida más rápida con resultados idénticos.

Stable Diffusion

Un modelo abierto de difusión latente para generar imágenes a partir de texto que hizo posible ejecutar generación de imágenes de alta calidad en hardware de consumo.

Streaming

Enviar la respuesta de un modelo token a token a medida que se genera, en lugar de esperar a la respuesta completa, de modo que el texto aparece de forma progresiva.

Prompt de sistema

Instrucciones ocultas y de alta prioridad que definen el rol, el tono y las reglas de un modelo antes de que comience la conversación, condicionando todas las respuestas posteriores.

T

Temperatura

Un parámetro que controla la aleatoriedad de la salida de un modelo: una temperatura baja da respuestas centradas y repetibles; una temperatura alta da respuestas más variadas y creativas.

Token

La unidad que un modelo de lenguaje realmente lee y escribe, normalmente un fragmento de subpalabra, no una palabra completa. Los límites de contexto, el precio y la velocidad se miden todos en tokens.

Ver: Contador de tokens de IA.

Uso de herramientas / Llamadas a funciones

Permitir que un modelo active funciones externas —buscar en la web, ejecutar código, consultar una base de datos— y use los resultados devueltos dentro de su respuesta.

Transformer

La arquitectura de red neuronal que hay detrás de prácticamente todos los modelos de lenguaje de gran tamaño actuales, construida sobre un mecanismo llamado autoatención en lugar de recurrencia o convolución.

Árbol de pensamientos (ToT)

Un marco de razonamiento que permite a un modelo explorar varias rutas de solución ramificadas, evaluarlas y retroceder: una búsqueda deliberada en lugar de una única conjetura.

V

VAE (autoencoder variacional)

Un modelo generativo que aprende un espacio latente probabilístico, lo que le permite tanto comprimir datos como generar nuevos ejemplos a partir de él.

Base de datos vectorial

Una base de datos que indexa y busca por similitud de embeddings en lugar de por coincidencia exacta, lo que le permite encontrar contenido semánticamente relacionado en milisegundos.

Vision Transformer (ViT)

Un Transformer aplicado directamente a fragmentos de imagen, lo que demuestra que la arquitectura de los modelos de lenguaje también sobresale en visión artificial.

W

Marca de agua (Watermarking)

Incrustar una señal oculta y estadísticamente detectable en el texto generado por IA para poder identificarlo después como producido por una máquina.

Whisper

El modelo de reconocimiento de voz de OpenAI, entrenado con un conjunto de audio muy amplio y diverso para transcribir y traducir voz de forma fiable en distintos idiomas.

Z

Zero-Shot Prompting

Pedirle a un modelo que realice una tarea sin ejemplos resueltos, apoyándose únicamente en la instrucción y en el conocimiento adquirido durante su preentrenamiento.

Pruébalos todos en un solo lugar

Leer sobre los LLM es una cosa; ejecutar el mismo prompt en ChatGPT, Claude, Gemini y Grok es otra muy distinta.

Prueba MultipleChat gratis

Continue learning

See paid plans