AI καταφέρνει και κερδίζει παιχνίδια που παίζαμε στις κονσόλες του 1980!

Επιστήμονες ανέπτυξαν ένα πρόγραμμα υπολογιστή που μπορεί να κερδίζει μια σειρά παιχνιδιών πλατφόρμας/ εξερεύνησης της δεκαετίας του 1980, ανοίγοντας έτσι των δρόμο για πιο αυτόνομα ρομπότ.

Όπως γράφει το BBC, οι ερευνητές δημιούργησαν μια «οικογένεια» αλγορίθμων ικανών να κερδίζουν κλασικά παιχνίδια στο Atari, όπως το Pitfall. Στο παρελθόν αυτά τα παιχνίδια ήταν δύσκολο να κερδηθούν μέσω τεχνητής νοημοσύνης (ΑΙ).

Οι αλγόριθμοι αυτοί θα μπορούσαν να βοηθήσουν ρομπότ να πλοηγούνται καλύτερα σε περιβάλλοντα πραγματικού κόσμου- κάτι που συνεχίζει να αποτελεί σημαντική πρόκληση στους τομείς της ρομποτικής και της τεχνητής νοημοσύνης. Τα επίμαχα περιβάλλοντα περιλαμβάνουν περιοχές που έχουν πληγεί από καταστροφές, όπου τα ρομπότ θα μπορούσαν να αποστέλλονται προς αναζήτηση επιζώντων, ή ακόμα και το μέσο σπίτι.

Η συγκεκριμένη έρευνα εντάσσεται στο ευρύτερο πλαίσιο της έρευνας τεχνητής νοημοσύνης που είναι γνωστή ως reinforcement learning. Κάποια από τα παιχνίδια που χρησιμοποιήθηκαν στην έρευνα θέλουν ο παίκτης να εξερευνά λαβυρίνθους που περιέχουν ανταμοιβές, εμπόδια και κινδύνους. Η οικογένεια των αλγορίθμων, που είναι γνωστή συλλογικά ως Go-Explore, έχει δώσει σημαντικές βελτιώσεις σε σχέση με προηγούμενες προσπάθειες για να κερδίζονται τέτοια παιχνίδια- όπως πχ τα Montezuma’s Revenge, Freeway και Pitfall.

Μεταξύ άλλων, οι ερευνητές ανέπτυξαν αλγορίθμους που μπορούσαν να δημιουργούν αρχεία περιοχών που είχαν ήδη επισκεφθεί. «Η μέθοδός μας είναι όντως πολύ απλή και άμεση, αν και αυτό ισχύει συχνά με τα επιστημονικά επιτεύγματα» δήλωσαν στο BBC οι ερευνητές Αντριέν Εκοφέτ, Τζουστ Χουϊζίνγκα και Τζεφ Κλουν. «Ο λόγος που η προσέγγισή μας δεν είχε εξεταστεί στο παρελθόν είναι πως διαφέρει πολύ από την κυρίαρχη προσέγγιση που παραδοσιακά χρησιμοποιείτο για την αντιμετώπιση αυτών των προβλημάτων στην κοινότητα του reinforcement learning, το αποκαλούμενο “intrinsic motivation”. Σε αυτό, αντί να διαχωρίζεται η εξερεύνηση στην επιστροφή και τη διερεύνηση όπως κάνουμε εμείς, ο δρων απλά ανταμείβεται για την ανακάλυψη νέων περιοχών».

Ένα πρόβλημα με την προσέγγιση του intrinsic motivation είναι πως, ενώ αναζητείται λύση, ο αλγόριθμος μπορεί να «ξεχνά» τις πολλά υποσχόμενες περιοχές που πρέπει ακόμα να εξερευνώνται. Αυτό είναι γνωστό ως «detachment». Οι ερευνητές βρήκαν τρόπο να το προσπερνούν αυτό: Δημιουργώντας αρχείο με τις περιοχές που έχει επισκεφθεί, ο αλγόριθμος μπορεί να επιστρέψει σε ένα υποσχόμενο ενδιάμεσο στάδιο του παιχνιδιού, ως ένα σημείο από όπου μπορεί να εξερευνά περαιτέρω.

Ωστόσο υπήρχε και ένα άλλο πρόβλημα με τις προηγούμενες προσεγγίσεις σε αυτά τα παιχνίδια: «Βασίζονται σε τυχαίες ενέργειες που μπορεί να ληφθούν σε οποιοδήποτε σημείο στον χρόνο, μεταξύ των οποίων και ενώ ο δρων πηγαίνει ακόμα προς την περιοχή που πρέπει να εξερευνηθεί» είπαν στο BBC News οι επιστήμονες. «Αν έχεις ένα περιβάλλον όπου οι ενέργειές σου πρέπει να είναι ακριβείς, όπως ένα παιχνίδι με πολλούς κινδύνους που μπορούν να σε σκοτώσουν άμεσα, τέτοιες τυχαίες ενέργειες μπορούν να σε εμποδίσουν από το να φτάσεις στην περιοχή που θες στα αλήθεια να εξερευνήσεις» (ο τεχνικός όρος για αυτό είναι derailment, εκτροχιασμός).

Η νέα μέθοδος, που περιγράφεται στο Nature, επιλύει το πρόβλημα του εκτροχιασμού διαχωρίζοντας τη διαδικασία της επιστροφής σε προηγούμενες περιοχές από τη διαδικασία της εξερεύνησης νέων- και το επιλύει με διαφορετικούς τρόπους.

 

[signoff]

 

Πηγή

ΣΧΕΤΙΚΑ ΑΡΘΡΑ

Leave a reply

εισάγετε το σχόλιό σας!
παρακαλώ εισάγετε το όνομά σας εδώ

ΠΡΟΣΦΑΤΑ ΑΡΘΡΑ

H “Απόλυτη αισθητική” ΑΝΑΒΑΘΜΙΣΗ του Χώρου σου είναι ΕΔΩ… με Led RGBIC, Govee Glide Hexa (VIDEO)

Έλα να την απολαύσεις την αλλαγή του backround στον πάγκο μου Για εσένα που θέλεις το "καλύτερο" και ειδικά όταν αυτό είναι για να καλύψει...

iPhone 18 Pro και iPhone Ultra: Όλα τα χρώματα

Η Apple αναμένεται να παρουσιάσει τα νέα iPhone στις αρχές του Σεπτεμβρίου και σε αυτό το άρθρο θα δούμε όλα τα χρώματα. Αν δεν το γνωρίζετε, η εταιρία...

Galaxy S27 Ultra: Διαρροή αποκαλύπτει το τελικό design με κάμερα στυλ iPhone!

Αν και απέχουμε αρκετούς μήνες από την επίσημη παρουσίασή του, ο γνωστός leaker Ice Universe έφερε στο φως το τελικό σχέδιο (CAD sketch) του Galaxy S27 Ultra,...

Poco F9 Ultra: Ραντεβού με τα κορυφαία flagship της χρονιάς

Ένα νέο μοντέλο Xiaomi πέρασε από τη βάση δεδομένων του Geekbench, δίνοντας τα πρώτα επίσημα στοιχεία επίδοσης για το αναμενόμενο Poco F9 Ultra. Η...

Android Auto: Η νέα ενημέρωση φέρνει τέλος στα προβλήματα σύνδεσης

Το Android Auto έχει βελτιωθεί αρκετά τον τελευταίο καιρό, όμως μαζί με τις μεγάλες αναβαθμίσεις έχουν έρθει και ορισμένα προβλήματα. Καθώς πρόκειται για μια...

ΤΕΛΕΥΤΑΙΕΣ ΠΡΟΣΦΟΡΕΣ

H “Απόλυτη αισθητική” ΑΝΑΒΑΘΜΙΣΗ του Χώρου σου είναι ΕΔΩ… με Led RGBIC, Govee Glide Hexa (VIDEO)

Έλα να την απολαύσεις την αλλαγή του backround στον πάγκο μου Για εσένα που θέλεις το "καλύτερο" και ειδικά όταν αυτό είναι για να καλύψει...

2026 New Pandorra Box 3D. Η Best Seller Super Arcade Κονσόλα τα “Σπάει” με 36800+ παιχνίδια. ΤΩΡΑ στα 92€ ΚΟΜΠΛΕ (Βίντεο)

Ενημέρωση 23/08/26 00:30 Τα πρώτα κουπόνι στα 88€ τα εξαφανίσατε (κάποιοι ξέρουν το "Χτύπα Χθες" που λέω στο βίντεο) Ενημέρωσα νέο κουπόνι και πλέον η τιμή...

Η Πιο “Ολοκληρωμένη” Smart Κλειδαριά με Φυσικό Κλειδί και με 5 Τρόπους Ξεκλειδώματος!!! Στα 159€ Κομπλέ Welock U71

Υπάρχουν πάρα πολλά στυλ με διαφορετικές δυνατότητες το καθένα, ώστε να βρούμε ΤΗΝ ΚΑΤΑΛΗΛΗ ΓΙΑ ΤΙΣ ΔΙΚΕΣ ΜΑΣ ΠΡΟΣΩΠΙΚΕΣ ΑΝΑΓΚΕΣ... Η U71 θεωρώ πως...

Λειτουργικό Μοτέρ “Ferrari”? Με Κιβώτιο ταχυτήτων και 2800 κομμάτια… Μεγάλο κι Απίστευτο! Στα 109€ ΚΟΜΠΛΕ… (Βίντεο)

Είναι από τα πιο ιδιαίτερα πράγματα που έχω φέρει στο κανάλι... Αφορά μια "Ειδική" κατηγορία από εσάς εκεί έξω. Για ένα όμως πράγμα είμαι σίγουρος! Αν...

Σου “ΒΑΖΩ τα ΓΥΑΛΙΑ”!!! DT NO.1 Smart Bluetooth Γυαλιά Ηλίου… Στα 15€ ΚΟΜΠΕ!? (βίντεο & Giveaway)

Σε αυτήν την τιμή δεν αγοράζεις ούτε ηλίου... από "πλανόδιο" και με τόσα που κάνουν... ΧΤΥΠΑ ΤΑ αλύπητα!!! Δοκιμασμένα... είναι πραγματικά εκπληκτικό τι αγοράζεις σε...