Per la prima volta, quasi tutte le proteine ​​conosciute sono state raccolte in un unico database, ce ne sono 200 milioni.

Nel 2021, Alphabet DeepMind ha rilasciato un database open source contenente strutture 3D

centinaia di migliaia di proteine. In particolare, sono 20mila le proteine ​​conosciute che si trovano nel corpo umano. 

Ora questo database è stato ampliato a 200 milioni e include quasi tutte le proteine ​​note alla scienza.

Oggi gli scienziati hanno ancora difficoltà a calcolarlil'esatta struttura di una proteina in base agli aminoacidi di cui è composta. In genere, ciò richiede un'enorme quantità di potenza di calcolo e tempo. Questo è stato chiamato il problema del ripiegamento delle proteine. Pertanto, i progressi in questo settore sono relativamente lenti. 

Ora Alphabet ha addestrato una potente IAmente profonda. È stato addestrato su 100.000 strutture proteiche conosciute. Un tale sistema, secondo gli sviluppatori, può prevedere le strutture di milioni di altre proteine. Ognuno ha impiegato minuti o secondi per determinare, non mesi o anni.

Ora DeepMind ha rilasciato un nuovo enormeaggiornamento del database. Ora comprende circa 214 milioni di strutture di un milione di specie. Queste sono quasi tutte proteine ​​attualmente note alla scienza. Si noti che il database aiuterà a condurre ricerche nel campo del trattamento delle malattie, la creazione di vaccini e aiuterà anche a risolvere il problema della resistenza agli antibiotici.

L'intero database, composto da 25 terabyte di dati, può essere scaricato da Google Cloud.

Leggi di più:

Gli scienziati hanno filmato una strana creatura con tentacoli, che hanno scambiato per un fiore

L'aereo supersonico volerà a una velocità di 2.000 km/he attraverserà l'oceano in 3,5 ore

Ha creato un computer quantistico che "è andato oltre il sistema binario"