Οι νέες θέσεις εργασίας, με αμοιβές που πλησιάζουν τα 300.000 δολάρια, καλύπτουν απειλές από πυρηνικά όπλα και εκρηκτικά έως κυβερνοεπιθέσεις, βιολογικούς κινδύνους και οικονομικές απάτες
  • Η Anthropic αναζητεί προσωπικό για 32 θέσεις που συνδέονται με την πρόληψη της κακόβουλης χρήσης της τεχνητής νοημοσύνης.
  • Οι ειδικότητες καλύπτουν πυρηνικές και ραδιολογικές απειλές, εκρηκτικά, κυβερνοέγκλημα, βιολογικούς κινδύνους και οικονομικές απάτες.
  • Οι ετήσιες αμοιβές για αρκετούς από τους συγκεκριμένους ρόλους κινούνται στα μεσαία και υψηλά επίπεδα των 200.000 δολαρίων.

Η Anthropic ενισχύει δραστικά τις ομάδες ασφαλείας της, αναζητώντας δεκάδες ειδικούς που θα επιχειρούν να προβλέψουν πώς θα μπορούσαν κακόβουλοι χρήστες να αξιοποιήσουν τα ισχυρά μοντέλα τεχνητής νοημοσύνης για να προκαλέσουν σοβαρή βλάβη στον πραγματικό κόσμο.

Η εταιρεία πίσω από το Claude διαθέτει 32 ανοικτές θέσεις εργασίας με αντικείμενο την αντιμετώπιση απειλών που εκτείνονται από την κατασκευή εκρηκτικών και την ανάπτυξη πυρηνικών ή ραδιολογικών όπλων μέχρι τις κυβερνοεπιθέσεις, τις οικονομικές απάτες και τη βιολογική τρομοκρατία.

Οι αγγελίες αποκαλύπτουν το εύρος των κινδύνων που θεωρούν πλέον πιθανό ή τουλάχιστον τεχνικά εφικτό οι μεγαλύτερες εταιρείες AI. Παράλληλα, αναδεικνύουν μια από τις βασικές αντιφάσεις του κλάδου: οι ίδιοι οργανισμοί που αναπτύσσουν ολοένα ισχυρότερα συστήματα επενδύουν σημαντικά ποσά για να εμποδίσουν τη μετατροπή τους σε εργαλεία επίθεσης.

Από τα εκρηκτικά έως τις πυρηνικές απειλές

Η Anthropic αναζητεί αναλυτές και ερευνητές με εξειδίκευση σε ιδιαίτερα ευαίσθητα πεδία.

Στην επίσημη σελίδα προσλήψεων της εταιρείας εμφανίζονται, μεταξύ άλλων, θέσεις για:

  • βιολογικές απειλές,
  • χημικά και εκρηκτικά,
  • πυρηνικές και ραδιολογικές βλάβες,
  • κυβερνοεπιθέσεις,
  • οικονομική απάτη,
  • βίαιο εξτρεμισμό,
  • παραβίαση λογαριασμών και κλοπή διαπιστευτηρίων,
  • προηγμένα όπλα και απειλές CBRN-E.

Η τελευταία κατηγορία περιλαμβάνει χημικές, βιολογικές, ραδιολογικές, πυρηνικές και εκρηκτικές απειλές. Στις διαθέσιμες θέσεις περιλαμβάνονται επίσης τεχνικοί ερευνητές απειλών, μηχανικοί red teaming και στελέχη συλλογής πληροφοριών ασφαλείας.

Σε μία από τις αγγελίες, η εταιρεία αναφέρει ότι ο ειδικός για τις πυρηνικές και ραδιολογικές απειλές θα έχει κρίσιμο ρόλο στην προστασία από την κατάχρηση συστημάτων AI για την πρόκληση αντίστοιχων βλαβών.

Να σκέφτονται όπως οι κακόβουλοι χρήστες

Το έργο των νέων εργαζομένων δεν περιορίζεται στην ανάπτυξη λογισμικού ή στη δημιουργία γενικών πολιτικών ασφαλείας.

Οι αναλυτές θα πρέπει να εξετάζουν τα συστήματα από τη σκοπιά ενός επιτιθέμενου: να επιχειρούν να παρακάμψουν τα φίλτρα ασφαλείας, να αποκρύψουν τις πραγματικές προθέσεις τους και να αποσπάσουν πληροφορίες που το μοντέλο κανονικά δεν θα έπρεπε να παρέχει.

Αυτή η διαδικασία είναι γνωστή ως red teaming. Οι ειδικοί δοκιμάζουν ένα σύστημα πριν από την κυκλοφορία του, αναζητώντας αδυναμίες τις οποίες θα μπορούσαν να εκμεταλλευτούν εγκληματίες, τρομοκρατικές οργανώσεις, κρατικοί φορείς ή μεμονωμένοι χρήστες.

Όπως ανέφερε εκπρόσωπος της Anthropic στο Axios, η διασφάλιση ότι τα μοντέλα δεν παρέχουν δυνητικά επιβλαβείς πληροφορίες αποτελεί κεντρικό στοιχείο της υπεύθυνης ανάπτυξής τους. Για τον λόγο αυτό, η εταιρεία προσλαμβάνει ειδικούς που κατανοούν τόσο τη φύση μιας απειλής όσο και τον τρόπο με τον οποίο η AI μπορεί να την ενισχύσει.