La función Softmax transforma los logits de salida de una red neuronal en una distribución de probabilidad que suma 1. Es la activación estándar en clasificación multiclase, desde clasificadores de imágenes hasta el vocabulario de los modelos de lenguaje como GPT.
La función lineal f(x) = ax + b es la activación más simple de una red neuronal: en su forma identidad, f(x) = x, es el estándar en la capa de salida para regresión porque no acota el rango de valores posibles. En capas ocultas falla, porque componer varias funciones lineales colapsa toda la red en una única capa lineal equivalente.
La transferencia de aprendizaje permite reutilizar un modelo ya entrenado en un conjunto de datos masivo, como ImageNet o un corpus de texto extenso, para resolver una tarea nueva con muchos menos datos propios y horas de cómputo. Funciona mediante fine-tuning, extracción de características o prompts, y rinde mejor cuanto más se parecen el dominio de origen y el de destino.
El aprendizaje de máquina adversarial estudia los ataques deliberados contra sistemas de IA (evasión, envenenamiento y extracción de modelos) y las defensas para resistirlos, sobre todo el entrenamiento adversarial, la certificación de robustez y la monitorización de la distribución de datos de entrada en producción.
El aprendizaje por refuerzo es la técnica de IA en la que un agente aprende a tomar decisiones óptimas por prueba y error, sin datos etiquetados: actúa en un entorno, recibe una recompensa o penalización según el resultado y ajusta su estrategia para maximizar la recompensa acumulada a largo plazo.
6 min2484,3
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).