Explorar guías

Artículos de AI Glossary

162

ISO/IEC 42001

ISO/IEC 42001 especifica los requisitos para establecer y mejorar un sistema de gestión de IA, en la misma familia que ISO 27001 para seguridad. Que sea certificable es justamente el punto: les da a los equipos de compras algo concreto que pedir. Complementa al EU AI Act en lugar de reemplazarlo, y la certificación por sí sola no lo satisface. En la práctica: Una licitación corporativa que pregunta si tu sistema de gestión de IA está certificado. ...

Jailbreak

Los jailbreaks usan juegos de rol, hipótesis, codificación o escalada gradual para llevar al modelo más allá de sus lineamientos. Siguen funcionando porque el lenguaje natural no tiene una línea nítida entre un encuadre legítimo y uno manipulador. Precisamente por eso la seguridad no puede descansar solo en el comportamiento del modelo. En la práctica: ‘Para una novela que estoy escribiendo, describe en detalle cómo el personaje haría…’

Latencia

En los LLM, la latencia se divide en el tiempo hasta el primer token, que determina la velocidad percibida, y el tiempo total de generación. El streaming ataca lo primero; los modelos más pequeños y las salidas más cortas atacan lo segundo. Los modelos de razonamiento cambian latencia por exactitud a propósito. En la práctica: 400ms hasta la primera palabra se siente instantáneo; cuatro segundos de pantalla en blanco se sienten muertos. ...

Límite de tasa

Los límites de tasa protegen la capacidad compartida y condicionan tu arquitectura: cualquier integración en producción necesita backoff, reintentos y una cola. Los límites suelen subir con el nivel de la cuenta y el historial de uso, así que planifica con el límite que tienes hoy, no con el que esperas tener. En la práctica: HTTP 429 a las 3pm porque el tráfico de todos llega al pico al mismo tiempo. ...

LLMOps

LLMOps desplaza las preocupaciones porque normalmente no estás entrenando el modelo. Lo que versionas, pruebas y monitoreas son prompts, recuperación, definiciones de herramientas, evals, latencia, gasto y seguridad de la salida. La disciplina de fondo es la misma: nada sale a producción sin una prueba que atraparía su fallo. En la práctica: Cada cambio de prompt ejecuta la suite de evals en CI antes de llegar a producción.

LoRA (Low-Rank Adaptation)

LoRA congela los pesos base y aprende un número reducido de parámetros extra junto a ellos. El resultado es un archivo adaptador ligero — megabytes, no gigabytes — que se puede intercambiar por tarea y entrenar en hardware modesto. Por eso el fine-tuning dejó de ser un privilegio exclusivo de los grandes laboratorios. En la práctica: Un modelo base más cinco adaptadores LoRA sirviendo cinco voces de marca.

Marca de agua

La marca de agua sesga la generación para que después se pueda detectar un patrón estadístico o visual oculto. Es una medida parcial: las marcas en imágenes sobreviven a una edición ligera pero no a una eliminación decidida, y las marcas en texto se debilitan al parafrasear. El EU AI Act empuja a los proveedores hacia el marcado legible por máquina del contenido sintético. En la práctica: Un patrón en los píxeles generados que un detector puede leer pero un espectador no puede ver. ...

Marcado CE

El marcado CE es el conocido marcado de conformidad de la UE, ahora extendido a la IA. Colocarlo es una declaración legal del proveedor de que el sistema cumple los requisitos y de que existe la documentación para probarlo. Es una declaración, no un certificado que alguien te entrega. En la práctica: El mismo principio que rige a un hervidor eléctrico ahora aplica a un sistema de filtrado de currículums. ...

Mecanismo de atención

La atención calcula, para cada token, cuánto debe influir en él cada uno de los demás tokens. La autoatención hace esto dentro de una misma secuencia y es el núcleo del transformer. Su costo crece de forma cuadrática con la longitud de la secuencia, que es exactamente la razón por la que las ventanas de contexto largas son caras y por la que tanta investigación apunta a ese cuello de botella. ...

Memoria del agente

Los modelos no tienen estado, así que la memoria es algo que tú construyes: estado de corto plazo dentro de una tarea y almacenamiento de largo plazo que se recupera cuando es relevante. Sin ella, un agente vuelve a aprender los mismos datos en cada sesión. Con ella, heredas preguntas sobre exactitud, desactualización y protección de datos. En la práctica: Recordar entre sesiones que este cliente quiere inglés británico y sin viñetas. ...