За първи път почти всички известни протеини бяха събрани в една база данни, има 200 милиона от тях.

През 2021 г. Alphabet DeepMind пусна база данни с отворен код, съдържаща 3D структури

стотици хиляди протеини. По-специално, 20 хиляди известни протеини, които се намират в човешкото тяло. 

Сега тази база данни е разширена до 200 млн. Тя включва почти всички протеини, известни на науката.

Днес учените все още смятат, че е трудно да изчислятточната структура на протеин въз основа на аминокиселините, от които е изграден. Обикновено това изисква изразходване на огромно количество изчислителна мощност и време. Това се нарича проблем със сгъването на протеина. Следователно напредъкът в тази област е относително бавен. 

Сега Alphabet е обучил мощен AIдълбок ум. Той е обучен на 100 000 известни протеинови структури. Такава система, според разработчиците, може да предвиди структурите на милиони други протеини. Определянето на всеки от тях отне минути или секунди, а не месеци или години.

Сега DeepMind пусна нов масивактуализация на база данни. Сега тя включва около 214 милиона структури от милион вида. Това са почти всички протеини, известни в момента на науката. Отбелязва се, че базата данни ще помогне за провеждането на изследвания в областта на лечението на заболявания, създаването на ваксини, а също така ще помогне за решаването на проблема с антибиотичната резистентност.

Цялата база данни, която се състои от 25 терабайта данни, може да бъде изтеглена от Google Cloud.

Прочетете още:

Учени заснеха странно създание с пипала, което сбъркаха с цвете

Свръхзвуковият самолет ще лети със скорост 2000 км/ч и ще пресича океана за 3,5 часа

Създадоха квантов компютър, който „излезе отвъд двоичната система“