Danske data i de store AI-modeller
transcript
show notes
I denne episode ser vi på de mange, mange danske sange, bøger, billeder, videoer og andet materiale, der ofte på skummel vis er havnet i maven på de store AI-modeller.
Vi har før fortalt blandt andet om KODAs sag mod musiktjenesten Suno, og hørt fra Rettighedsalliancen om deres arbejde med at dokumentere hvordan også dansk materiale er blevet brugt som træningsdata.
Denne gang nørder vi lidt mere igennem, når jeg taler med Thor Martin Bærug – han har nemlig lavet et register over en decideret røvfuld af danske bøger og websider og sangtekster og så videre, som han har fundet i de databaser som AI-modellerne bliver trænet på.
I AI Siden Sidst skal vi blandt andet høre om datacentre og data fra et konkursramt flyselskab.
Lyt med 🤖
LINKS
SIDEN SIDST
- Novos supercomputer skifter hænder efter rødt regnskab: Her er den nye plan | Version2
- Er Novos AI-revolution blevet til et datacenter for Vejle Kommune | Version2?
- Statens nye supercomputer står ubrugt hen | Version2
- Forsvarschefen begiver sig ud på vild AI-mission | Version2
- Mens protesterne vokser, er 29 nye datacentre på vej mod Danmark | Version2
- Konkursramte Spirit Airlines sælger sine data til Google | TNW
- Amazon lukker Mechanical Turk efter 21 år | Wired
- Drama om OpenAIs matematiske gennembrud | The Verge
AI-REGISTER
- Novos supercomputer skifter hænder efter rødt regnskab: Her er den nye plan | Version2version2.dk
- Er Novos AI-revolution blevet til et datacenter for Vejle Kommune | Version2?version2.dk
- Statens nye supercomputer står ubrugt hen | Version2version2.dk
- Forsvarschefen begiver sig ud på vild AI-mission | Version2version2.dk