Το AI μπορεί να αναδημιουργήσει μόνο τρισδιάστατες σκηνές από φωτογραφίες

Οι ερευνητές της Google αποκάλυψαν λεπτομερείς τρισδιάστατες σκηνές διάσημων ορόσημων σε όλο τον κόσμο. Αυτοί

Χρησιμοποιήσαμε φωτογραφίες που κατεβάσαμε από το Διαδίκτυο και τις επεξεργαστήκαμε χρησιμοποιώντας μηχανική εκμάθηση.

Στη σελίδα GitHub του έργου, ερευνητέςμοιράστηκαν τρισδιάστατες σκηνές της Πύλης του Βρανδεμβούργου στο Βερολίνο, της Βασιλικής του Sacre Coeur στο Παρίσι και της Φοντάνα ντι Τρέβι στη Ρώμη. Η μηχανική εκμάθηση έχει δημιουργήσει λεπτομερή απόδοση 3D από αυτό το υλικό, στην οποία μπορείτε να μετακινήσετε την προβολή και η εξωτερική σκηνή αλλάζει με εφέ φωτισμού.

Οι ερευνητές εξήγησαν ότι ο αλγόριθμός τους μπορείαντιμετωπίζετε δυσκολίες κατά τη χρήση εικόνων με "ασυνήθιστες παραμέτρους". Η επεξεργασία των φωτογραφιών δεν γίνεται σωστά με χαμηλό φωτισμό, εσφαλμένη έκθεση ή μετά την επεξεργασία. Επιπλέον, οι εικόνες από το Διαδίκτυο συχνά περιέχουν κινούμενα αντικείμενα - για παράδειγμα, άτομα ή αυτοκίνητα. Μπορούν επίσης να επηρεάσουν τον αλγόριθμο.

«Δύο φωτογράφοι μπορούν να σταθούν σε ένα μέρος καιτραβήξτε μια εικόνα με το ίδιο βλέμμα, αλλά ο αλγόριθμος θα επεξεργαστεί σωστά ένα πλαίσιο και θα χαλάσει το δεύτερο. Πρέπει να βελτιώσουμε το AI ώστε να λειτουργεί σωστά », σημείωσαν οι ερευνητές.

Το μοντέλο που προκύπτει μπορεί να περιέχει δυσλειτουργίες ή άλλα σφάλματα. Οι ερευνητές αναπτύσσουν ειδικές επεκτάσεις που μαλακώνουν την επεξεργασία με AI, γεγονός που οδηγεί σε καλύτερα αποτελέσματα.

Δείτε επίσης:

- Το τελευταίο πάγο στον Καναδά κατέρρευσε στον ωκεανό. Έχασε το 40% σε δύο ημέρες

- Δείτε τι μπορεί να δει ο διάδοχος του Χαμπλ στο διάστημα. Επισκόπηση του τηλεσκοπίου Webb

- Η Ρωσία έχει ανοίξει αεροπορικές συνδέσεις με διάφορες χώρες. Πόσο ασφαλές είναι να πετάξετε εκεί;