Meer dan 2 miljoen van de oudste berichten op internet zijn openbaar gemaakt

Tientallen jaren vóór Twitter-threads, Reddit-forums of Facebook-groepen was er Usenet: een vroeg internetsysteem

discussies waar men zou kunnen beginnen enneem deel aan discussies, op dezelfde manier waarop berichten met opmerkingen tegenwoordig werken. Usenet, gelanceerd in 1980, was het geesteskind van twee studenten van Duke University die wilden communiceren tussen gedecentraliseerde lokale servers – en het project is nog steeds actief.

Op Usenet praten mensen over van alles, van nanotechnologietot soapseries, wijn en UFO's. Josef Jaroszczak, een systeemarchitect uit Ontario, maakte voor het eerst kennis met Usenet in 2000 toen hij via een vacature daar een fulltime baan vond in Canada.

Deze week heeft Yaroszczak een aantal van deoudste Usenet-berichten die beschikbaar zijn op internet. Ongeveer 2,1 miljoen berichten uit het UTZOO NetNews-archief van Henry Spencer voor de periode van februari 1981 tot juni 1991 zijn verzameld in het Usenet-archief en zijn voor iedereen beschikbaar.

De Usenet Archive-site maakt deel uit van een ander waareen groter project gelanceerd door Joseph Yaroschak. Het wordt ook gebruikt om berichten op te slaan voor moderne onafhankelijke internetprojecten die niet zijn gelieerd aan bedrijven zoals Google. Het kan potentieel ongeveer een miljard records opslaan. Het archiveert momenteel 317 miljoen berichten in 10.000 unieke Usenet-nieuwsgroepen - en Yaroshchak schat dat het uiteindelijk ongeveer 1 miljard berichten zal opslaan.

Een gesprek over cyberpunkliteratuur, 1987

© usenetarchives.com

Henry Spencer van de Universiteit van Toronto, faculteitzoölogie, opgeslagen groepsarchieven op 141 magneetbanden. “De UTZOO-Wseman Usenet-feeds zijn in wezen de vroegst beschikbare discussies die op internet worden geplaatst door mensen die aan verschillende universiteiten werken en al verbonden zijn met internet”, legde Jaroszczak uit in een interview met Vice.

Spencer en verschillende collega's wisten over te stappende gegevens van de tape naar .TAR (Tape ARchive) -formaat, en Yaroshchak, die jarenlang als Usenet-archiveringsprogramma werkte, zette deze banden om in een doorzoekbare PostgreSQL-database, die hij vervolgens uploadde naar de Usenet-archieven. Onderweg creëerde hij, naast parsers voor het Utzoo-tape-archief, converters in PHP, JavaScript, Java en Python en maakte deze beschikbaar op Github als open source-bronnen die iedereen zou kunnen gebruiken.

Van Utzoo-groepen heeft hij bijna 26.300.000 berichten gedownload en er komen er steeds meer bij.

“Deze schat aan oude berichten zou dat wel moeten zijnbeschikbaar voor toekomstige generaties ”, besluit Yaroshchak. “Deze honderden miljoenen posts zijn misschien leuk om te lezen, maar wat nog belangrijker is, ze werpen licht op het denkproces van de internetgemeenschap in de begintijd van internet zelf. Dit is een enorme hoeveelheid belangrijke historische en onderzoeksinhoud. Het zou een minachting zijn van mijn kant en van de kant van andere archivarissen als ik de kans zou missen om deze oude Usenet-tekstgroepen uit de archieven terug te brengen naar het publieke domein. "

Lees ook

Er kunnen universums zijn in zwarte gaten. We vertellen je over de nieuwe ontdekking

Op dag 3 van de ziekte verliezen de meeste COVID-19-patiënten hun reukvermogen en hebben ze vaak een loopneus

Wetenschappers hebben ontdekt waarom kinderen de gevaarlijkste dragers van COVID-19 zijn