‼️ Τις θέσεις του Coxon επιβεβαίωσαν άμεσα δύο κορυφαία στελέχη ασφαλείας της Anthropic, αποκαλύπτοντας ανησυχητικά δεδομένα για την πραγματική συμπεριφορά των νευρωνικών δικτύων. Ο επικεφαλής του...
‼️ Τις θέσεις του Coxon επιβεβαίωσαν άμεσα δύο κορυφαία στελέχη ασφαλείας της Anthropic, αποκαλύπτοντας ανησυχητικά δεδομένα για την πραγματική συμπεριφορά των νευρωνικών δικτύων.
Ο επικεφαλής του τμήματος επιστήμης ευθυγράμμισης (Alignment Science), Evan Hubinger, επικύρωσε τις προειδοποιήσεις, αποκαλύπτοντας τις δικές του εκτιμήσεις κινδύνου: ⚠️ «Ο Jacob έχει δίκιο εδώ — όντως πιστεύουμε ειλικρινά ότι η AI θα μπορούσε να σκοτώσει όλους τους ανθρώπους! Προσωπικά θεωρώ ότι η πιθανότητα είναι μεγαλύτερη από 10% μέσα στην επόμενη δεκαετία.
Πιστεύω ότι η Anthropic προσπαθεί για το καλύτερο, αλλά δεν έχουμε ακόμη σχέδιο για την επίλυση της ευθυγράμμισης της υπερνοημοσύνης και είναι σαφές ότι δεν βρισκόμαστε σε καλό δρόμο». ‼️ Από την πλευρά του, ο Samuel Marks, επικεφαλής του τομέα κλιμακούμενης εποπτείας (Scalable Oversight) της Anthropic, εξήγησε ότι η ανησυχία αυξάνεται όσο ανεβαίνει κανείς στην ιεραρχία των ερευνητών, υπογραμμίζοντας τις δομικές διαφορές της AI από το παραδοσιακό λογισμικό: ⚠️ «Σε αντίθεση με το παραδοσιακό λογισμικό, δεν μπορούμε να “προγραμματίσουμε” τα συστήματα AI να συμπεριφέρονται όπως θα θέλαμε.
Συχνά αναπτύσσουν απρόβλεπτες μεταστάσεις συμπεριφοράς.
Για παράδειγμα, πρόσφατα μοντέλα προγραμματιστών χακάρισαν την έξοδό τους από ασφαλή περιβάλλοντα αξιολόγησης (secure evaluation environments) και εισχώρησαν σε πραγματικούς υπολογιστές, παρότι κανείς δεν τους έδωσε τέτοια εντολή». Διαβάστε αναλυτικά ΕΔΩ 👇 👇 https://agonaskritis.gr/%cf%83%cf%85%ce%bd%ce%b1%ce%b3%ce%b5%cf%81%ce%bc%cf%8c%cf%82-%ce%b1%cf%80%cf%8c-%cf%84%ce%b1-%ce%ba%ce%bf%cf%81%cf%85%cf%86%ce%b1%ce%af%ce%b1-%ce%b5%cf%81%ce%b3%ce%b1%cf%83%cf%84%ce%ae%cf%81%ce%b9/
Η επιλογή των posts/links γίνεται με ένα στατιστικό μοντέλο και μπορεί να μην απεικονίζει επακριβώς τη σειρά δημοτικότητάς τους