IA para Científicos Sociales

Sesión 1.1: ¿Qué es la Inteligencia Artificial?

Danilo Freire

Department of Data and Decision Sciences
Emory University

¡Bienvenidos! 🥳

Agenda de la sesión

¿Qué veremos hoy?

  1. Bienvenida y presentaciones
    • Quiénes somos, materiales del curso, filosofía de trabajo
  2. ¿Qué es la IA?
    • Definición, tipos (estrecha, general, superinteligente), mitos comunes, taxonomía
  3. Historia de la IA
    • De Turing y Dartmouth a ChatGPT
  4. Tipos de aprendizaje automático
    • Supervisado, no supervisado, por refuerzo
  5. Ética de la IA
    • Sesgos, alucinaciones

Materiales del curso

Enlaces importantes

Sitio web del curso: https://danilofreire.github.io/introduccion-ia-ucu

Repositorio del curso: https://github.com/danilofreire/introduccion-ia-ucu

Todos los materiales del curso (diapositivas, código, laboratorios y lecturas) están disponibles en nuestro sitio web y repositorio de GitHub

Las diapositivas ya están publicadas, así que pueden leerlas antes de cada sesión o repasarlas después 😉

Nota

Si algo cambia durante la semana, será un ajuste menor: revisen el repositorio para tener siempre la última versión

Sobre el docente

Un poco sobre mí

Profesor asistente visitante en el Department of Data and Decision Sciences, Emory University

MA del Graduate Institute Geneva, PhD de King’s College London, Postdoc en Brown University, Senior Lecturer en la University of Lincoln, UK

Investigación: ciencias sociales computacionales, métodos experimentales, evaluación de políticas públicas, violencia política

Sobre ustedes

  • ¡Ahora les toca a ustedes! 😊

  • Por favor, preséntense

  • Cuéntennos su nombre, su área de trabajo y qué les gustaría aprender en este curso

  • Por favor, sean breves: unos 30 segundos por persona para que nos dé tiempo de escuchar a todos 😉

Estructura del curso

Cinco días, 20 horas

Día Tema Sesiones Laboratorios
1 Fundamentos de IA y ML ¿Qué es la IA? + Flujo de ML tidymodels + comparación de modelos
2 Aprendizaje supervisado Clasificación + Predicción clasificación + regresión
3 No supervisado y texto Clustering/PCA + Texto clustering + análisis de texto
4 LLMs y aplicaciones Transformers + APIs ellmer + aplicaciones avanzadas
5 Modelos locales y ética Modelos locales + Sesgo/regulación Ollama + auditoría de sesgo

Objetivos de aprendizaje

Al finalizar este curso, serán capaces de:

  • Explicar cómo funcionan los sistemas de IA actuales
  • Identificar fallos comunes y problemas de datos
  • Evaluar afirmaciones sobre IA en noticias y políticas públicas
  • Diseñar un plan realista para una aplicación de IA
  • Reflexionar sobre las cuestiones éticas y sociales de la IA

¿Qué es la Inteligencia Artificial? 🤖

Definición de IA

  • Una definición sencilla: la Inteligencia Artificial (IA) es una rama de la informática centrada en crear sistemas capaces de realizar tareas que normalmente requieren inteligencia humana
  • Estas tareas incluyen aprender, razonar, resolver problemas, entender el lenguaje, etc

Tres categorías principales

  • La IA estrecha (narrow) resuelve tareas específicas, como asistentes virtuales o recomendaciones
  • La IA general alcanzaría, en teoría, la inteligencia humana en muchas tareas
  • La IA superinteligente la superaría en todo (no existe ni sabemos si será posible)

Técnicas comunes

  • Aprendizaje automático (ML)
  • Aprendizaje profundo (DL), un subconjunto de ML basado en redes neuronales
  • Procesamiento del lenguaje natural (NLP), un área de aplicación

¿Qué NO es la IA?

Mitos y concepciones erróneas

Mitos comunes:

  • La IA “piensa” como los humanos
    • No. Procesa patrones estadísticos, no tiene conciencia ni comprensión real
  • La IA es objetiva e imparcial
    • No. Refleja los sesgos de los datos con los que fue entrenada
  • La IA va a reemplazar todos los trabajos
    • Parcialmente. Transforma trabajos más de lo que los elimina por completo
  • La IA es infalible
    • No. Comete errores, a veces con mucha confianza

Fortalezas y limitaciones de la IA

Lo que la IA hace bien:

  • Procesar grandes cantidades de datos rápidamente
  • Identificar patrones complejos que los humanos podrían pasar por alto
  • Realizar tareas repetitivas o peligrosas sin fatiga
  • Generar contenido creativo (texto, imágenes, música) a partir de ejemplos

Lo que la IA no hace bien:

  • Razonamiento causal: no entiende relaciones causa-efecto, solo correlaciones
  • Contexto amplio: no puede entender situaciones complejas que requieren conocimiento del mundo o sentido común
  • Adaptación a situaciones nuevas: no generaliza bien fuera de los datos con los que fue entrenada

Taxonomía de la IA

Fuente: McKinsey & Company (2024)

Benchmarks de IA y desempeño humano

Fuente: Artificial Intelligence Index Report (2025)

Breve historia de la IA

Mitos antiguos y calculadoras mecánicas

  • Los seres humanos siempre han soñado con crear vida artificial
  • Mitos antiguos con seres mecánicos:
    • Talos (griego): gigante de bronce que protegía Creta
    • Golem (folclore judío): figura de arcilla que cobra vida
    • Frankenstein (1818): la novela de Mary Shelley
  • Calculadoras mecánicas:
  • El cálculo podía separarse de la mente humana

Talos

Fuente: Wikipedia - Talos

Alan Turing y los fundamentos

  • 1936: Alan Turing publica “On Computable Numbers”, donde introduce el concepto de máquina universal
  • 1950: publica “Computing Machinery and Intelligence” en la revista Mind
    • Propone el famoso Test de Turing: ¿puede una máquina engañar a un humano haciéndole creer que es humana?
    • Pregunta: “¿Pueden pensar las máquinas?” y la reformula como una pregunta práctica
  • Las ideas de Turing sentaron las bases teóricas tanto de la computación como de la IA
  • Sugirió que las máquinas podían aprender, no solo seguir reglas fijas

La versión estándar del Test de Turing

Fuente: Wikipedia - Test de Turing

La Conferencia de Dartmouth (1956)

“Todo aspecto del aprendizaje o cualquier otra característica de la inteligencia puede, en principio, describirse con tal precisión que una máquina puede simularla.”

  • El optimismo era alto: muchos creían que la IA a nivel humano estaba a pocas décadas

Los participantes del taller de Dartmouth

Fuente: IEEE Spectrum

IA simbólica y sistemas expertos

IA simbólica, 1956-1980s

  • Inteligencia = manipular símbolos según reglas (la “IA clásica”)
  • Programar las reglas formales del comportamiento inteligente
  • Primeros éxitos: ELIZA (terapeuta), SHRDLU (mundo de bloques)
  • Prueben ELIZA: https://anthay.github.io/eliza.html
  • Predicciones audaces pero excesivamente optimistas

Sistemas expertos, 1970s-1980s

  • Cambio hacia dominios especializados con conocimiento experto
  • Codificar la experiencia humana como reglas si-entonces (if x then y else z)
  • Ejemplos: MYCIN (infecciones), DENDRAL (análisis químico)
  • Ambos enfoques dependían del conocimiento codificado a mano, no del aprendizaje a partir de datos
  • Ninguno podía aprender o mejorar automáticamente

Los inviernos de la IA

Primer invierno (1974-1980)

  • Explosión combinatoria, poco poder de cómputo, fragilidad
  • Colapso del financiamiento; éxodo de investigadores
  • Lección: la IA era más difícil de lo que pensaban

Segundo invierno (1987-1993)

  • Mantenimiento costoso, no aprendían, poca escalabilidad
  • Las PCs hicieron obsoleto el hardware especializado
  • “IA” se convirtió en una mala palabra

El patrón

  1. Promesas atraen financiamiento
  2. Éxitos iniciales generan entusiasmo
  3. Las limitaciones se hacen evidentes a escala
  4. El financiamiento se seca y los investigadores se van
  5. La investigación silenciosa continúa, preparando el terreno


¿Les resulta familiar este patrón?

¿Será que esta vez es diferente?

El renacer: datos + GPUs + algoritmos

  • 2009: Halevy, Norvig y Pereira publican “The Unreasonable Effectiveness of Data
  • Modelos simples con muchos datos superan a modelos complejos con pocos datos
  • 2012: AlexNet (Krizhevsky, Sutskever y Hinton) gana ImageNet por un margen enorme
    • Tasa de error top-5: 15,3% (el siguiente mejor: 26,2%)
    • Usó redes neuronales profundas entrenadas en GPUs
  • Datos, poder computacional y mejores algoritmos convergieron al mismo tiempo
  • Ninguno de ellos solo era suficiente, pero los tres juntos cambiaron el campo

Más datos superan mejores algoritmos

Fuente: Google Research

Transformers (vista de alto nivel)

  • 2017: investigadores de Google publican “Attention Is All You Need” (Vaswani et al.)
  • Introducen el mecanismo de autoatención
  • En lugar de procesar secuencialmente:
    • Cada palabra puede “mirar” todas las demás palabras directamente
    • Calcula puntuaciones de relevancia entre todos los pares
    • Procesamiento en paralelo: mucho más rápido de entrenar
  • Esta arquitectura alimenta GPT, BERT y prácticamente toda la IA moderna
  • Veremos los transformers en detalle en el Día 4

El paper que lo cambió todo

Fuente: Vaswani et al. (2017)

De GPT a ChatGPT

Modelo Año Parámetros Referencia
GPT-1 2018 117M Radford et al. (2018)
BERT 2018 340M Devlin et al. (2018)
GPT-2 2019 1,5B Radford et al. (2019)
GPT-3 2020 175B Brown et al. (2020)
GPT-4 2023 No divulgado OpenAI (2023)

El crecimiento explosivo de ChatGPT

Fuente: Backlinko

Tipos de aprendizaje automático

Aprendizaje supervisado

  • El modelo aprende de ejemplos etiquetados
  • Tenemos datos de entrada (features) y la respuesta correcta (label)
  • Dos tipos principales:
  • Clasificación: predecir una categoría
    • ¿Este correo es spam o no?
    • ¿Este tumor es benigno o maligno?
  • Regresión: predecir un número continuo
    • ¿Cuál será el precio de esta vivienda?
    • ¿Cuántos productos venderemos el próximo mes?
  • Es el tipo de aprendizaje más usado en la práctica
  • Lo veremos en detalle en el Día 2

Ejemplo: clasificación de spam

Entrada: "¡Ganaste un premio! Haz clic aquí"
Etiqueta: SPAM ❌

Entrada: "Reunión de equipo mañana a las 10"
Etiqueta: NO SPAM ✅

El modelo aprende patrones:
  - palabras como "premio", "gratis" → spam
  - palabras como "reunión", "equipo" → no spam


Ejemplo: regresión

Entrada: casa con 3 habitaciones, 120 m²
Salida: USD 250.000

El modelo aprende la relación entre
características y precio

Aprendizaje no supervisado

  • El modelo busca patrones sin etiquetas
  • No hay respuestas “correctas”: el modelo descubre la estructura por sí mismo
  • Técnicas principales:
  • Clustering: agrupar elementos similares
    • Segmentación de clientes
    • Agrupación de noticias por tema
  • Reducción de dimensionalidad (PCA): simplificar datos con muchas variables
    • Visualizar datos de alta dimensión en 2D/3D
    • Identificar las variables más informativas
  • Útil cuando no sabemos qué estamos buscando
  • Lo veremos en el Día 3

Ejemplo: segmentación de clientes

El modelo recibe datos de compras
de miles de clientes y descubre
grupos por sí mismo:

Grupo A: compras frecuentes, bajo valor
Grupo B: compras ocasionales, alto valor
Grupo C: nuevos clientes, sin patrón claro

Nadie le dijo que estos grupos existían; ¡el algoritmo los encontró solo!

Aprendizaje por refuerzo

  • El modelo aprende por ensayo y error
  • Un agente interactúa con un entorno y recibe recompensas o penalizaciones
  • El objetivo: maximizar la recompensa acumulada a lo largo del tiempo
  • Ejemplos:
    • AlphaGo (DeepMind): venció al campeón mundial de Go en 2016
    • Robots que aprenden a caminar cayéndose miles de veces
    • RLHF en ChatGPT: humanos califican respuestas, el modelo aprende qué es “útil”
  • No necesita ejemplos etiquetados: aprende de la experiencia
  • Seremos más específicos sobre RLHF en el Día 4

El ciclo del aprendizaje por refuerzo

Ciclo de aprendizaje por refuerzo

El agente aprende qué acciones llevan a mejores resultados

Ética básica de la IA

Sesgo algorítmico

  • Los modelos de IA pueden amplificar los sesgos presentes en los datos de entrenamiento
  • Ejemplo real (Buolamwini y Gebru, 2018):
    • Tasas de error en reconocimiento facial comercial:
    • Hombres de piel clara: 0,8% de error
    • Mujeres de piel oscura: 34,7% de error
    • Un rendimiento 43 veces peor para un grupo
  • El modelo “funciona” en general, pero falla para poblaciones específicas
  • Incluso eliminando variables sensibles (raza, género), los sesgos persisten porque se correlacionan con otras variables
  • Siempre evaluar los modelos por subgrupos, no solo en promedio

Disparidades en el rendimiento por subgrupos

Fuente: Joy Buolamwini / Medium

Alucinaciones

  • Alucinación: la IA genera contenido fluido pero factualmente incorrecto o inventado
  • Formas comunes:
    • Citas fabricadas: inventar papers que no existen
    • Estadísticas falsas: “el 73% de los científicos coinciden…”
    • Datos biográficos incorrectos: fechas, eventos, logros equivocados
  • ¿Por qué ocurre? Porque los modelos están entrenados para predecir texto probable, no texto verdadero:

\[P(\text{siguiente palabra} | \text{contexto}) \neq P(\text{afirmación verdadera})\]

Preguntas para la discusión:

¿Cómo verificarían si la respuesta de una IA es correcta?

  • ¿Consultar fuentes primarias?
  • ¿Preguntarle a otra IA?
  • ¿Confiar en la intuición?
  • ¿Confiar en la reputación de la empresa?


¡La IA es una herramienta, no un oráculo! 😅

Siempre mantengan el pensamiento crítico 😉

Actividad: verdadero o falso

Verdadero o falso

  • Un modelo de contratación puede seguir discriminando por raza aunque eliminemos la variable “raza” de los datos
    • Verdadero. Otras variables se correlacionan con la raza y actúan como proxy, así que el sesgo persiste
  • Un modelo muy sofisticado con pocos datos suele superar a un modelo simple con muchos datos
    • Falso. Es al revés, según “The Unreasonable Effectiveness of Data”
  • Una IA puede inventar una cita que no existe aunque haya sido entrenada solo con textos verídicos
    • Verdadero. No copia hechos, predice la palabra más probable. Datos verídicos no garantizan afirmaciones verídicas
  • Un modelo con 99% de accuracy siempre es mejor que uno con 80%
    • Falso. Con clases desbalanceadas, predecir siempre la clase mayoritaria da 99% sin aprender nada

Resumen de la sesión

  • IA: sistemas que realizan tareas que requieren inteligencia humana
  • Tipos de IA: estrecha, general, superinteligente
  • Fortalezas: procesar grandes datos, identificar patrones, tareas repetitivas, generar contenido
  • Limitaciones: razonamiento causal, contexto amplio, adaptación a situaciones
  • Historia: ciclos de entusiasmo y decepción, cada uno con avances reales
  • Tres tipos de ML: supervisado, no supervisado y por refuerzo
  • Problemas reales: sesgo y alucinaciones

Próximo: Fundamentos de Machine Learning

  • En la próxima sesión, vamos a profundizar en los fundamentos del aprendizaje automático
  • Veremos:
    • El flujo de trabajo completo de ML
    • División train/test y validación cruzada
    • Sobreajuste y el compromiso sesgo-varianza
    • Métricas de evaluación (precisión, recall, matrices de confusión)
  • Y cerraremos con un laboratorio práctico en R con tidymodels

¡Nos vemos en la próxima sesión! 🤓