Google, το software που περιγράφει ολόκληρες εικόνες με φράσεις

Σήμερα έχουμε ήδη την τεχνολογία η οποία μπορεί να εντοπίζει αντικείμενα σε εικόνες αλλά αυτό που δεν μπορεί να καταφέρει να κάνει καλά είναι η περιγραφή των αντικειμένων αυτών. Το εμπόδιο όμως φαίνεται να ξεπεράστηκε από ερευνητές της Google σε συνεργασία με επιστήμονες από το Stanford University.

Το σύστημά τους συνδυάζει δυο νευρωνικά δίκτυα (neural networks), το ένα είναι για την αναγνώριση εικόνων και το άλλο για την επεξεργασία φυσικής γλώσσας προκειμένου να περιγράψει μια ολόκληρη σκηνή χρησιμοποιώντας φράσεις. Ακόμη, χρειάζονται να γίνουν πολλές βελτιώσεις και να εκπαιδευτεί για την αναγνώριση και περιγραφή περισσότερων εικόνων, όμως έχει την ικανότητα να κάνει αρκετά καλές περιγραφές. Για παράδειγμα στην παρακάτω φωτογραφία δεν αναγνωρίζει απλά έναν άνθρωπο και μια μηχανή, αλλά μπορεί να περιγράψει έναν άνθρωπο πάνω σε μια μηχανή σε χωματόδρομο.

image-recognition-software-01-570

Το νέο software είναι δυο φορές πιο ακριβές στις περιγραφές του όταν συγκριθεί με προηγούμενους αλγόριθμους. Ακόμη έχει κάποια προβλήματα καθώς δεν δίνει πάντα ακριβείς περιγραφές, όπως συμβαίνει στα παρακάτω παραδείγματα. Ακόμη είναι στην αρχή και λογικά όσο περνάει ο καιρός θα μαθαίνει περισσότερα.

Η νέα τεχνολογία θα μπορούσε να χρησιμοποιηθεί σε διάφορους τομείς από την τεχνητή νοημοσύνη μέχρι και την έρευνα. Για παράδειγμα μελλοντικά θα μπορούσε να βοηθήσει άτομα με προβλήματα όρασης και ρομπότ να κινηθούν καλύτερα στο φυσικό τους περιβάλλον. Επίσης, ένα ρομπότ θα μπορούσε να σου πει τι βλέπει ακριβώς χωρίς να χρειάζεται να κοιτάξεις εσύ την κάμερα ενώ θα μπορούσε να γίνει search για εικόνες χρησιμοποιώντας καθημερινές φράσεις και στα αποτελέσματα να βγουν μόνο αυτές που θέλεις.

Ακόμα πρέπει να περάσει καιρός μέχρι να δούμε τη νέα τεχνολογία να εφαρμόζεται στην καθημερινή ζωή, αλλά στο μέλλον έχουμε να δούμε σημαντικές αλλαγές.

Για παράδειγμα, τα τελευταία 15 χρόνια βλέπουμε να έχουν τοποθετηθεί σε δημόσιους και ιδιωτικούς χώρους κάμερες παρακολούθησης. Στο μέλλον οι κάμερες αυτές δεν θα μπορούν απλά να αντιλαμβάνονται το άτομο που καταγράφουν, μέσω της τεχνολογίας αναγνώρισης προσώπου, αλλά θα είναι ικανές να εντοπίζουν συγκεκριμένες συμπεριφορές οι οποίες όταν θεωρηθούν ύποπτες θα ειδοποιούν αυτόματα τις αρχές.

image-recognition-software-04-570

Πηγή: 1,2

ΣΥΖΗΤΗΣΗ

Παρακολουθήστε τα σχόλια
Να ειδοποιηθώ όταν
guest
1 Σχόλιο
παλαιότερο
νεώτερο
Inline Feedbacks
View all comments
Τομ

Μου λεγε ενας φιλος προσφατα για τα νευρωνικα δικτυα. Advanced shit..

ΔΙΑΒΑΣΤΕ ΕΠΙΣΗΣ

Software

Αποκτήστε δημοφιλές λογισμικό Windows 10 Pro με €7.31 και Office 2016 Pro με €17

Συνεχίστε δυνατά τη χρονιά με νέο λογισμικό και τσιμπήστε τα καλύτερα deals σε κλειδιά για Windows και Office, λογισμικό Anti-Virus και άλλα Security apps με εκπτώσεις 44.1% και 37.9%.

Software iPhone App Store

Τι είναι το Clubhouse και γιατί όλοι ασχολούνται μαζί του;

Το Clubhouse δίνει μία νέα, ηχητική διάσταση στα social media, έχοντας ήδη κερδίσει μεγάλο μέρος του διαδικτυακού ενδιαφέροντος.

Software Apple iOS

Γιατί πρέπει να εγκαταστήσεις το iOS 14.5 αμέσως, εάν έχεις iPhone;

Με γνώμονα την ασφάλεια, οι κάτοχοι iPhone θα πρέπει να αναβαθμίσουν το λειτουργικό τους σε iOS 14.5, μόλις γίνει αυτό διαθέσιμο.

Software Microsoft Microsoft Office

H Microsoft θα προσφέρει μία offline έκδοση Office μέσα στο 2021

Με αγορά άδειας, θα μπορούν οι κάτοχοι υπολογιστών με Windows και MacOS να αποκτήσουν το Office στον υπολογιστή τους.