Por primera vez, casi todas las proteínas conocidas se recopilaron en una sola base de datos, hay 200 millones de ellas.

En 2021, Alphabet DeepMind lanzó una base de datos de código abierto que contiene estructuras 3D.

cientos de miles de proteínas. En particular, 20 mil proteínas conocidas que se encuentran en el cuerpo humano. 

Ahora esta base de datos se ha ampliado a 200 millones e incluye casi todas las proteínas conocidas por la ciencia.

Hoy en día, a los científicos todavía les resulta difícil calcularla estructura exacta de una proteína basada en los aminoácidos que la componen. Normalmente, esto requiere gastar una gran cantidad de tiempo y potencia informática. A esto se le llamó el problema del plegamiento de proteínas. Por tanto, los avances en este ámbito son relativamente lentos. 

Ahora Alphabet ha entrenado una poderosa IAmente profunda. Ha sido entrenado en 100.000 estructuras proteicas conocidas. Tal sistema, según los desarrolladores, puede predecir las estructuras de millones de otras proteínas. Cada uno tomó minutos o segundos para determinar, no meses o años.

Ahora DeepMind ha lanzado una nueva y masivaactualización de base de datos. Ahora incluye alrededor de 214 millones de estructuras de un millón de especies. Estas son casi todas las proteínas actualmente conocidas por la ciencia. Se señala que la base de datos ayudará a realizar investigaciones en el campo del tratamiento de enfermedades, la creación de vacunas y también ayudará a resolver el problema de la resistencia a los antibióticos.

La base de datos completa, que consta de 25 terabytes de datos, se puede descargar desde Google Cloud.

Lee mas:

Científicos filmaron a una extraña criatura con tentáculos, que confundieron con una flor

El avión supersónico volará a una velocidad de 2.000 km/h y cruzará el océano en 3,5 horas

Creó una computadora cuántica que "fue más allá del sistema binario"