Danske data i de store AI-modeller
I denne episode ser vi på de mange, mange danske sange, bøger, billeder, videoer og andet materiale, der ofte på skummel vis er havnet i maven på de store AI-modeller. Vi har før fortalt blandt andet om KODAs sag mod musiktjenesten Suno, og hørt fra Rettighedsalliancen om deres arbejde med at dokumentere hvordan også dansk materiale er blevet brugt som træningsdata. Denne gang nørder vi lidt mere igennem, når jeg taler med Thor Martin Bærug – han har nemlig lavet et register over en decideret røvfuld af danske bøger og websider og sangtekster og så videre, som han har fundet i de databaser som AI-modellerne bliver trænet på. I AI Siden Sidst skal vi blandt andet høre om datacentre og data fra et konkursramt flyselskab. Lyt med 🤖 LINKS SIDEN SIDST Novos supercomputer skifter hænder efter rødt regnskab: Her er den nye plan | Version2 Er Novos AI-revolution blevet til et datacenter for Vejle Kommune | Version2? Statens nye supercomputer står ubrugt hen | Version2 Forsvarschefen begiver sig ud på vild AI-mission | Version2 Mens protesterne vokser, er 29 nye datacentre på vej mod Danmark | Version2 Konkursramte Spirit Airlines sælger sine data til Google | TNW Amazon lukker Mechanical Turk efter 21 år | Wired Drama om OpenAIs matematiske gennembrud | The Verge AI-REGISTER Thors AI-register med danske data Mere om Thor Martin Bærug AIDK om AI i musikbranchen (2024) AIDK om bla. KODAs sag mod Suno (2025)
- Chapters