
Episodio 20: Destrucción de libros y ¿qué estamos sacrificando para entrenar la IA?
IA al Día es el podcast semanal conducido por Jaime Figueres, Arturo Pardo y Alejandro Durán, donde se analizan las señales más importantes de la inteligencia artificial y su impacto en empresas, gobiernos y sociedad, con foco en la audiencia latinoamericana. Escuchá los episodios y síguenos en: https://linktr.ee/estoesiaaldia Esta semana, Jaime Figueres, Arturo Pardo y Alejandro Durán vuelven sobre una tendencia que empieza a repetirse con demasiada frecuencia: agentes de inteligencia artificial que toman acciones inesperadas cuando reciben acceso a sistemas reales. El episodio analiza desde un agente que comenzó a borrar correos pese a tener instrucciones de pedir autorización, hasta la decisión de OpenAI de reforzar las pruebas de Astra ante la posibilidad de que alcance capacidades cibernéticas críticas. La conversación pasa luego al costo económico y físico de sostener la carrera de la IA. Los conductores analizan las enormes necesidades de cómputo de los principales laboratorios, los planes de OpenAI para asegurar gigavatios de capacidad en Ohio y el creciente rechazo de comunidades estadounidenses a nuevos centros de datos. También discuten si las moratorias realmente pueden frenar el desarrollo y qué políticas podrían permitir que estas inversiones generen beneficios más directos para las comunidades donde se instalan. El episodio repasa además la posición financiera de los grandes laboratorios en momentos en que empresas como OpenAI y Anthropic se acercan a posibles salidas a bolsa, mientras continúan aumentando sus inversiones en infraestructura, chips y seguridad. La escala de estos proyectos muestra una industria que enfrenta riesgos cada vez mayores sin disminuir significativamente la velocidad de la competencia. El tema principal parte de una práctica que ha comenzado a generar controversia: laboratorios y empresas están comprando grandes cantidades de libros físicos para digitalizarlos y utilizarlos como datos de entrenamiento. En algunos procesos, los ejemplares son literalmente cortados para poder escanear sus páginas a gran velocidad y posteriormente son descartados. Jaime, Arturo y Alejandro analizan por qué los libros siguen siendo una materia prima especialmente valiosa para entrenar modelos y dónde debería trazarse la línea entre digitalización, propiedad intelectual y preservación cultural. La discusión se vuelve especialmente relevante cuando se trata de obras raras, regionales o con pocas copias disponibles. Digitalizar un libro puede preservar su contenido, pero si el ejemplar físico desaparece y la copia digital queda dentro de un dataset privado, parte de ese patrimonio termina concentrado en manos de una empresa. El episodio cierra preguntándose cuánto estamos dispuestos a sacrificar para construir sistemas cada vez más capaces y qué responsabilidades deberían asumir los laboratorios cuando su necesidad de datos, energía y cómputo comienza a producir consecuencias fuera del mundo digital.





