Η DeepMind AI της Google μπορεί να δημιουργήσει 3D μοντέλο από μια 2D φωτογραφία

Μια από τις δυσκολίες κατά την ανάπτυξη ενός συστήματος οπτικής αναγνώρισης για την AI είναι το να λειτουργεί όπως ο εγκέφαλός μας, αναγνωρίζοντας αυτόματα το τι βλέπουμε μπαίνοντας σε ένα χώρο. Επάνω σε ένα τέτοιο νευρωνικό δίκτυο εργάζεται η ομάδα DeepMind της Google, το οποίο θα προγραμματίζεται για να λειτουργεί όπως ο ανθρώπινος εγκέφαλος.

Η δυσκολία στην ανάπτυξη ενός τέτοιου μοντέλου έχει να κάνει με την “εκπαίδευση” της τεχνητής νοημοσύνης έτσι ώστε να οδηγείται σε τέτοιου είδους συμπεράσματα, με τους ερευνητές να καταβάλλουν τεράστιες προσπάθειες για την ενσωμάτωση τεράστιας ποσότητας δεδομένων. Τα νευρωνικά δίκτυα παρουσιάζουν πρόβλημα στο να “μαθαίνουν” να εναλλάσσονται από σκηνή σε σκηνή και να προσαρμόζονται καταλλήλως για να μπορούν να “αντιλαμβάνονται” τον περιβάλλοντα χώρο.

Η DeepMind αναπτύσσει το νευρωνικό δίκτυο General Query Network το οποίο διαφέρει από τα άλλα στο ότι προγραμματίζεται για να παρατηρεί τον περιβάλλοντα χώρο και να μαθαίνει από αυτόν και όχι από τα δεδομένα τα οποία θα καταχωρούν οι ερευνητές. Σαν αποτέλεσμα, το δίκτυο αυτό θα μπορεί να “αντιλαμβάνεται” τον κόσμο και να παρατηρεί μόνο του κάθε νέα σκηνή που του εμφανίζεται.

Μετά από δοκιμές σε ελεγχόμενο περιβάλλον, οι ερευνητές κατάφεραν να τροποποιήσουν αυτό το νευρωνικό δίκτυο έτσι ώστε να μπορεί να “φαντάζεται” το περιβάλλον γύρω του από διαφορετικές οπτικές γωνίες και να δημιουργεί μια τρισδιάστατη απεικόνιση από μια δισδιάστατη φωτογραφία. Επιπλέον, μπόρεσε να αναγνωρίσει και να κατηγοριοποιήσει αντικέιμενα τα οποία δεν έχουν καταχωρηθεί προηγουμένως από τους ερευνητές αλλά και να καταλήξουν σε συμπεράσματα βάσει του τι “βλέπει”.

Το όλο εγχείρημα βρίσκεται ακόμα σε πολύ αρχικό στάδιο και οι δοκιμές πραγματοποιήθηκαν σε κατασκευασμένες σκηνές και όχι σε πραγματικό περιβάλλον, με τους ερευνητές να δηλώνουν πως βρίσκονται ένα βήμα πιο κοντά στο να καταφέρουν να κάνουν ένα νευρωνικό δίκτυο να αναγνωρίζει πλήρως το περιβάλλον του από μόνο του χωρίς άλλη παρέμβαση.

deepmind ai google δημιουργία 3d μοντέλο 2d φωτογραφία, Η DeepMind AI της Google μπορεί να δημιουργήσει 3D μοντέλο από μια 2D φωτογραφία

Πηγή

Λάτρης της τεχνολογίας τα τελευταία 20 χρόνια και παιδί της πληροφορικής με σπουδές στην Αγγλία. Fan της Apple και δεν το κρύβει αλλά καταφέρνει και αντιμετωπίζει την τεχνολογία με αντικειμενικότητα, παρακολουθώντας τα τεχνολογικά δρώμενα σε καθημερινή βάση.

ΣΥΖΗΤΗΣΗ

Παρακολουθήστε τα σχόλια
Να ειδοποιηθώ όταν
guest

0 Σχόλια
Inline Feedbacks
View all comments

ΔΙΑΒΑΣΤΕ ΕΠΙΣΗΣ

Smartphones featured Google Google Pixel

Google Pixel 8a: Ολοκληρωτική αποκάλυψη σε hands-on βίντεο

Το Google Pixel 8a συνεχίζει να διαρρέει σαν τρελό και σήμερα έχουμε νέο leak από κατάστημα πώλησης κινητών τηλεφώνων στην Καζαμπλάνκα.

Software Android Google

Gemini για Android: Θα σας επιτρέπει να ανεβάσετε αρχεία PDF

Η εφαρμογή Gemini στο Android λαμβάνει συνεχώς βελτιώσεις από όταν κυκλοφόρησε στις αρχές του έτους, αποκτώντας νέες δυνατότητες.

Software Android featured Google

Android 15 Beta 1.1: Διορθώνει προβλήματα με τις ανέπαφες πληρωμές NFC και Google Wallet

Η Google κυκλοφόρησε μια μικρή ενημέρωση κώδικα για το τρέχον πρόγραμμα Android 15 Beta, η οποία αντιμετωπίζει ορισμένα ζητήματα.

Smartphones Google Pixel Pixel 7

Google Pixel 7 & Pixel 8: Δεύτερη ενημέρωση Απριλίου επιλύει προβλήματα δικτύου

Μετά την εγκατάσταση της μηνιαίας ενημέρωσης Μαρτίου 2024, χρήστες συσκευών Pixel 7 και Pixel 8 αντιμετώπισαν διάφορα προβλήματα δικτύου.