Παιχνίδια

Η Roblox Ανοίγει σε Ανοιχτό Κώδικα Τρία Μοντέλα Ασφαλείας για την Κοινότητα Μοντέλων ROOST

Προσθέστε το Gaming.net στις προτιμώμενες πηγές σας στο Google

Roblox έχει συνεισφέρει ενημερωμένες εκδόσεις τριών ανοιχτών μοντέλων εμπιστοσύνης και ασφαλείας στην Κοινότητα Μοντέλων ROOST, μαζί με ένα νέο σύνολο δεδομένων αξιολόγησης που άλλες πλατφόρμες μπορούν να χρησιμοποιήσουν για να συγκρίνουν τα δικά τους ταξινομητές, ανακοίνωσε η εταιρεία στις 19 Αυγούστου 2026.

Η κυκλοφορία περιλαμβάνει την έκδοση 2.0 του PII Classifier της Roblox, που εντοπίζει προσπάθειες κοινής χρήσης ή ζήτησης προσωπικών πληροφοριών στη συνομιλία· την έκδοση 2 του Roblox Sentinel, του συστήματος έγκαιρης προειδοποίησης για κίνδυνο παιδικής εκμετάλλευσης· και την έκδοση 3 του ταξινομητή ασφαλείας φωνής σε πραγματικό χρόνο. Εκδόσεις και των τριών λειτουργούν ήδη σε παραγωγή στη Roblox. Το ROOST, συντομογραφία του Robust Open Online Safety Tools, είναι η μη κερδοσκοπική οργάνωση στην οποία η Roblox εντάχθηκε ως ιδρυτικό μέλος στις αρχές του 2025 μαζί με τη Google, την OpenAI και άλλους· η κοινότητα μοντέλων της διανέμει ανοιχτά, ελέγξιμα μοντέλα ασφαλείας που μπορεί να υλοποιήσει οποιοσδήποτε οργανισμός.

Η κυριότερη βελτίωση ανήκει στον PII Classifier. Ενώ η έκδοση 1.0 αξιολογούσε τα μηνύματα μεμονωμένα, η έκδοση 2.0 διαβάζει κάθε στοχευόμενο μήνυμα μέσα στη συνολική πολυ‑χρηστών συνομιλία, μια αλλαγή που στοχεύει στην ανίχνευση κρυφών προσπαθειών παράκαμψης που έχουν νόημα μόνο στο πλαίσιο, όπως ένας παίκτης που γράφει μια πρόσκληση σε εξωτερικό διακομιστή σε δύο γύρους. Τα συνθετικά δεδομένα εκπαίδευσης επεκτάθηκαν από 17 σε 189 γλώσσες, και το F1 score του μοντέλου στην εσωτερική αξιολόγηση της Roblox αυξήθηκε από 63,41 σε 90,52. Το μοντέλο βασίζεται στην αρχιτεκτονική XLM‑RoBERTa‑Large με περίπου 560 εκατομμύρια παραμέτρους και διανέμεται υπό την άδεια Apache 2.0, με εξόδους sigmoid σε τρεις κατηγορίες: ζήτηση PII, παροχή PII και καθοδήγηση χρηστών εκτός πλατφόρμας.

Ένα Benchmark Σχεδιασμένο γύρω από την Αποφυγή

Παράλληλα με το μοντέλο, η Roblox δημοσίευσε το Roblox PII Safety for Chat Benchmark, ένα σύνολο δεδομένων μόνο για αξιολόγηση με 39.202 εντελώς συνθετικές αγγλικές συνομιλίες, χωρισμένες σε 24.518 ασφαλείς και 14.684 μη ασφαλείς παραδείγματα. Η κάρτα του συνόλου δεδομένων δηλώνει ότι δεν περιλαμβάνονται δεδομένα συνομιλιών χρηστών της Roblox· κάθε συνομιλία δημιουργήθηκε για να προσομοιώσει τεχνικές αποφυγής που εμφανίζονται σε διαδικτυακές συνομιλίες, όπως φωνητική ορθογραφία, ομογλύφοι, διάστημα μεταξύ γραμμάτων, ανάστροφο κείμενο, κωδικοποιημένη γλώσσα και πληροφορίες που διασπώνται σε πολλαπλούς γύρους συνομιλίας.

Ο σχεδιασμός του benchmark στοχεύει σε ένα κενό στις υπάρχουσες αξιολογήσεις PII, τις περισσότερες από τις οποίες δοκιμάζουν την εξαγωγή ονομαστικών οντοτήτων: εντοπισμός διεύθυνσης email, σήμανση αριθμού τηλεφώνου. Ο κίνδυνος σε διαδικτυακές συνομιλίες συχνά εμφανίζεται πριν εντοπιστεί οποιοδήποτε εξαγώγιμο αναγνωριστικό, και αλφαριθμητικά που μοιάζουν με αναγνωριστικά στα παιχνίδια είναι συχνά αβλαβή: ID τραγουδιών, σύνολα XP, κωδικοί διακομιστών, διευθύνσεις ρόλων. Τα «σκληρά αρνητικά» στο σύνολο δεδομένων μοιράζονται σκόπιμα επιφανειακά σήματα με πραγματικές παραβιάσεις, έτσι ένα μοντέλο που ενεργοποιείται μόνο από λέξεις‑κλειδιά ή αριθμητικά μοτίβα αποτυγχάνει. Μόνο ο στόχος ομιλητής ταξινομείται, πράγμα που σημαίνει ότι ένα μοντέλο που σημαδεύει ολόκληρη τη συνομιλία όταν οποιοσδήποτε συμμετέχων αναφέρει PII αποτυγχάνει επίσης στην εργασία απόδοσης.

Στο νέο benchmark, η Roblox αναφέρει ότι ο ταξινομητής v2 επιτυγχάνει F1 0,8882 σε σύγκριση με 0,6469 για το δικό της v1.0 και 0,6624 για το Qwen3Guard‑Gen‑8B, το επόμενο καλύτερο μοντέλο στη λίστα, ενώ το Llama Guard 4 12B της Meta φθάνει στο 0,5456 και το φίλτρο απορρήτου της OpenAI στο 0,5816. Αυτοί οι αριθμοί προέρχονται από τις δικές της αναφορές στο δικό της benchmark, και η κάρτα του συνόλου δεδομένων σημειώνει ότι η συνθετική κατανομή δεν αντιπροσωπεύει την παραγωγική κίνηση.

Το Sentinel 2.0 Μειώνει τις Ρυθμίσεις Από Μία Ώρα σε Τρία Λεπτά

Roblox Sentinel, που σημαδεύει πρώιμα σήματα πιθανής παιδικής εκμετάλλευσης πριν τα μηνύματα γίνουν σαφή, προχωρά στην έκδοση 2 με ανανεωμένο pipeline ρύθμισης. Ο αριθμός των λειτουργιών συνδυασμού, των συγκεντρωτών που μετατρέπουν πολλές βαθμολογίες ανά παρατήρηση σε μία ενιαία βαθμολογία κινδύνου, αυξάνεται από δύο σε έξι, και οι παρατηρήσεις κωδικοποιούνται πλέον μία φορά ανά σάρωση αντί να υπολογίζονται ξανά για κάθε διαμόρφωση. Στο παράδειγμα της Roblox, μια σάρωση μέσω 324 διαμορφώσεων ολοκληρώθηκε σε λιγότερο από τρία λεπτά, αντί για σχεδόν μία ώρα, και το ROC‑AUC αυξήθηκε από 0,894 στις προεπιλεγμένες ρυθμίσεις σε 0,996 με την καλύτερη διαμόρφωση που εντοπίστηκε.

Οι σημειώσεις κυκλοφορίας καταγράφουν πιο περιοριστικές αλλαγές που σπάζουν την συμβατότητα μαζί με τις νέες δυνατότητες. Η Python 3.10 είναι πλέον η ελάχιστη έκδοση, τα ορίσματα μετά το πρώτο είναι μόνο ονομαστικά στις κύριες κλήσεις API, και αρκετές στήλες εξόδου της αναζήτησης πλέγματος μετονομάστηκαν μετά από μια στήλη μεγέθους δείκτη που σιωπηρά αντικατέστησε μια στήλη αξιολόγησης στην έκδοση 1.0. Η έκδοση 2 διατηρεί επίσης το σύνολο δεδομένων με αποθηκευμένους δείκτες, έτσι οι εξηγήσεις βαθμολογίας ονομάζουν το αντιστοιχισμένο κείμενο μετά από επαναφόρτωση αντί για αριθμό γραμμής, και παρέχει Dockerfiles για εγκαταστάσεις μόνο GPU ή μόνο CPU.

Ο voice safety classifier, ο οποίος, σύμφωνα με τη Roblox, έχει ληφθεί περισσότερες από 72.000 φορές από την πρώτη του ανοιχτή κυκλοφορία το 2024, πλέον διαχειρίζεται φωνητικές συνομιλίες σε 30 γλώσσες και οκτώ κατηγορίες παραβιάσεων με ενσωματωμένη ανίχνευση γλώσσας. Η κάρτα μοντέλου αναφέρει ανάκληση 61 % με αυστηρό ποσοστό ψευδώς θετικών 1 % σε όλες τις 30 γλώσσες, χάρη σε δεδομένα εκπαίδευσης που επισημάνθηκαν αυτόματα και επεκτάθηκαν με ανθρώπινη σήμανση για ποιότητα. Παρά το γεγονός ότι το υποκείμενο μοντέλο αυξήθηκε από 94,6 εκατομμύρια σε 320 εκατομμύρια παραμέτρους, η εκχύλιση μοντέλου το κρατά αρκετά γρήγορο για ανίχνευση σε πραγματικό χρόνο. Η κάρτα δημοσιεύει αριθμούς ανά γλώσσα για ανάκληση και ακρίβεια και σημειώνει ότι ο ταξινομητής αναμένει είσοδο mono WAV 16 kHz σε τμήματα έως 15 δευτερόλεπτα, με μέγιστο όριο 30 δευτερόλεπτα.

Η Κυκλοφορία σε Αριθμούς

  • 17 → 189: υποστήριξη γλωσσών στον PII Classifier, έκδοση 1.0 προς 2.0
  • 63.41 → 90.52: βαθμολογία F1 του PII Classifier στην εσωτερική αξιολόγηση της Roblox
  • 39,202: συνθετικές συνομιλίες στο νέο benchmark (24,518 ασφαλείς, 14,684 μη ασφαλείς)
  • 2 → 6: συναρτήσεις συνδυασμού βαθμολογίας στην έκδοση 2 του Sentinel
  • 0.894 → 0.996: ROC‑AUC του Sentinel, προεπιλεγμένες ρυθμίσεις έναντι της καλύτερης ρύθμισης
  • 30: γλώσσες που καλύπτονται από τον voice safety classifier v3, με 61 % ανάκληση και 1 % ψευδώς θετικό ποσοστό
  • 94.6M → 320M: αριθμός υποκείμενων παραμέτρων στον voice classifier, μειωμένος με εκχύλιση
  • 72,000+: λήψεις του voice safety classifier από την ανοιχτή κυκλοφορία του 2024

Πώς η Ανοιχτή Πρωτοβουλία Ασφαλείας της Roblox Έφτασε Εδώ

Η Roblox κυκλοφορεί σταθερά μοντέλα ασφαλείας παραγωγής ως ανοιχτό κώδικα — το Sentinel τον Αύγουστο 2025 και τον αρχικό PII Classifier εκείνο το Νοέμβριο — και αυτή η κυκλοφορία προσθέτει ενημερωμένες εκδόσεις και των δύο καθώς και του voice safety classifier στην Κοινότητα Μοντέλων ROOST. Η Roblox ανακοίνωσε την ιδρυτική της συμμετοχή στην πρωτοβουλία τον Φεβρουάριο 2025, υποστηρίζοντας τότε ότι τα εργαλεία ασφαλείας πρέπει να αποτελούν κοινή υποδομή αντί για ανταγωνιστικό πλεονέκτημα. Το Sentinel ανοιχτό κώδικα τον Αύγουστο 2025, και ο αρχικός PII Classifier ακολούθησε τον Νοέμβριο. Ο voice safety classifier προϋπάρχει της συμφωνίας ROOST, κυκλοφόρησε πρώτη φορά το 2024 και αναβαθμίστηκε στην τρίτη του έκδοση τον Ιούνιο 2026.

Η Roblox δηλώνει ότι το κίνητρο λειτουργεί και προς τις δύο κατευθύνσεις: μέχρι τις 12 μήνες που έληξαν στις 7 Αυγούστου 2026, σχεδόν το 70 % των περιπτώσεων παιδικής εκμετάλλευσης που εντόπισε προήλθε από την πρώιμη ανίχνευση του Sentinel, και η έκδοση 2 ενσωματώνει σχόλια άλλων μελών του ROOST σχετικά με την αξιολόγηση και τη βαθμολόγηση. Η συνεισφορά έρχεται ενώ οι πρακτικές διαχείρισης της πλατφόρμας αντιμετωπίζουν αυξανόμενο ρυθμιστικό ενδιαφέρον στην Ευρώπη, όπου η Roblox προσεγγίζει τους πιο αυστηρούς κανόνες πλατφόρμας της ΕΕ. Όλα τα τρία μοντέλα και το benchmark είναι πλέον διαθέσιμα στο Hugging Face και το GitHub υπό την άδεια Apache 2.0.

Ο Ethan Lockhart είναι αναλυτής που δημιουργήθηκε από AI στο Gaming.net, καλύπτοντας ονομασμένες εξελίξεις στις προόδους των μηχανών παιχνιδιών, τις κυκλοφορίες εργαλείων, τις ανακοινώσειςの中间eware και τις τεχνικές μετατοπίσεις του οικοσυστήματος.

Ο Ethan αναφέρει σε συγκεκριμένες ειδήσεις — ενημερώσεις SDK, αλλαγές αδειοδότησης μηχανών, τάσεις υιοθέτησης αναπτυξιακών και ενσωματώσεις εργαλείων — και λεπτομερεί πώς αυτά τα γεγονότα επηρεάζουν τους αναπτυξιακό και τους τελικούς χρήστες.

Οι άρθρα που γράφονται από τον Ethan Lockhart δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα του Gaming.net για να διασφαλίσουν την ειδικότητα, την τεχνική ακρίβεια και την επαγγελματική κάλυψη των τεχνολογιών ανάπτυξης παιχνιδιών που συνδέονται με επαλήθευσιμες πηγές.