DINOv2 es el modelo de visión por computadora de Meta AI entrenado con autoaprendizaje sobre 142 millones de imágenes sin etiquetas humanas. Con una simple capa lineal sobre el codificador congelado iguala o supera a modelos supervisados en clasificación ImageNet, segmentación semántica y estimación de profundidad monocular.
La función escalón o de Heaviside es la función de activación más simple de una red neuronal: convierte cualquier entrada en una salida binaria, 0 o 1, según supere o no un umbral fijo. Fue el mecanismo central del perceptrón de Rosenblatt en 1958, pero su derivada es nula en casi todo punto, por lo que hoy se sustituye por la sigmoide o la ReLU.
El aprendizaje federado entrena modelos de IA de forma colaborativa entre varios dispositivos u organizaciones sin mover los datos originales: cada participante entrena en local y solo envía gradientes al servidor central. Formalizado por Google en 2016, no garantiza privacidad por sí solo: necesita privacidad diferencial o agregación segura para evitar fugas de información en esos gradientes.
La visión computarizada es la rama de la inteligencia artificial que permite a las máquinas interpretar imágenes digitales: detectar objetos, segmentar regiones y reconocer patrones mediante redes neuronales convolucionales. Desde 2012, cuando AlexNet redujo el error de clasificación en ImageNet al 15,3%, se aplica en fabricación, medicina, transporte y agricultura de precisión.
6 min2524,7
Usamos cookies propias y de terceros para analizar el tráfico del sitio. Puedes aceptarlas, rechazarlas o configurar tu elección.
Más información sobre las cookies
Preferencias de cookies
NecesariasImprescindibles para el funcionamiento del sitio. Siempre activas.
AnalíticasNos ayudan a entender cómo se usa el sitio (Google Analytics).