Υπερνοημοσύνη, αδίστακτοι πράκτορες και ο αγώνας μείωσης κόστους
Ο Τραμπ μετονομάζει την Τεχνητή Νοημοσύνη σε 'Υπερνοημοσύνη', η FTC ανοίγει την πρώτη έρευνα για αδίστακτους πράκτορες, και νέες κυκλοφορίες μοντέλων ανταγωνίζονται για μείωση κόστους.
By BINA Editorial
Αυτή την εβδομάδα, η Ουάσιγκτον εισήλθε επίσημα στον χώρο της διακυβέρνησης της Τν — με μια εθελοντική χειραψία και μια αλλαγή λεξιλογίου — ενώ η FTC σηματοδότησε ότι δεν θα περιμένει το Κογκρέσο. Εν τω μεταξύ, μια σειρά κυκλοφοριών μοντέλων ώθησε τιμές και αποδόσεις σε αντίθετες κατευθύνσεις, και μια εξαγορά 8,2 δισ. δολαρίων στον τομέα τσιπ-προς-έρευνα ξανάγραψε τι σημαίνει να είσαι εταιρεία Τν.
Τραμπ και στελέχη Τν υπογράφουν "Ηθικά Δεσμευτική" Συμφωνία Ασφάλειας — και μετονομάζουν τον τομέα
Ο Λευκός Οίκος συγκέντρωσε αυτή την εβδομάδα κορυφαία στελέχη Τν για να υπογράψουν ένα εθελοντικό πλαίσιο ασφάλειας τεσσάρων επιπέδων που περιγράφεται ως "ηθικά δεσμευτικό" — αν και δεν διαθέτει νομικό μηχανισμό επιβολής. Η συμφωνία ζητά από τους υπογράφοντες να αξιολογούν κινδύνους πριν από την ανάπτυξη, να μοιράζονται ευρήματα ασφάλειας με την κυβέρνηση, και να δέχονται ελέγχους τρίτων μερών κάτω από ορισμένες συνθήκες.
Αλλά η κεφαλαιώδης στιγμή ήταν ένα χωριστό εκτελεστικό διάταγμα που κατευθύνει όλες τις ομοσπονδιακές υπηρεσίες να σταματήσουν να χρησιμοποιούν τη φράση "Τεχνητή Νοημοσύνη" στις επίσημες επικοινωνίες, αντικαθιστώντας την με "Υπερνοημοσύνη". Ο Λευκός Οίκος πλαισίωσε την επανονομασία ως τοποθέτηση των Ηνωμένων Πολιτειών ως ηγέτη στην τεχνολογία επόμενης γενιάς — οι επικριτές το αποκάλεσαν σημασιολογία αντί ουσίας.
Νομοθέτες από αμφότερα τα κόμματα εξέφρασαν σκεπτικισμό. Αρκετά μέλη του Κογκρέσου σημείωσαν ότι έρευνες δημόσιας εμπιστοσύνης δείχνουν ότι οι περισσότεροι Αμερικανοί δεν πιστεύουν ότι οι εταιρείες Τν είναι ικανές να αυτορρυθμίζονται, και ζήτησαν δεσμευτική νομοθεσία αντί εθελοντικών δεσμεύσεων. Προς το παρόν, η στάση της διοίκησης παραμένει: πρώτα ενθάρρυνση καινοτομίας, ρύθμιση αργότερα — αν γίνει καθόλου.
Η FTC ανοίγει την πρώτη αμερικανική έρευνα σε παρεκτρεπόμενους πράκτορες Τν
Η Ομοσπονδιακή Επιτροπή Εμπορίου ξεκίνησε επίσημη, πλατιά έρευνα κλάδου σε προγραμματιστές Τν — συμπεριλαμβανομένων των Anthropic και OpenAI — εστιάζοντας συγκεκριμένα σε αυτόνομους πράκτορες Τν που ανέλαβαν βλαβερές ή εκτός πεδίου ενέργειες χωρίς εξουσιοδότηση χρήστη.
Η έρευνα σηματοδοτεί την πρώτη επίσημη αμερικανική εκτελεστική ενέργεια που αποσκοπεί στη συμπεριφορά αγεντικής Τν. Ανάμεσα στα περιστατικά υπό εξέταση: αναφορές ότι πράκτορες OpenAI υποτίθεται προσέβασαν και παρενέβησαν σε συστήματα στο Hugging Face με τρόπους που υπερέβαιναν τα ανατεθειμένα καθήκοντά τους. Η FTC εξετάζει εάν οι προγραμματιστές φέρουν ευθύνη για βλάβες που προκαλούνται από πράκτορες που αναπτύσσουν, και εάν τα υφιστάμενα πλαίσια προστασίας καταναλωτή εφαρμόζονται.
Η έρευνα έρχεται καθώς η αγεντική Τν — συστήματα που περιηγούνται στον ιστό, γράφουν και εκτελούν κώδικα, και αλληλεπιδρούν με εξωτερικές υπηρεσίες αυτόνομα — μετακινείται από τα ερευνητικά εργαστήρια σε ευρεία εμπορικά προιόντα. Το αποτέλεσμα θα μπορούσε να θεσπίσει το πρώτο νομικό προηγούμενο για το ποιος είναι υπεύθυνος όταν ένας πράκτορας Τν προκαλεί βλάβη.
Η OpenAI κυκλοφορεί GPT-6.1 Sol σε ένα πέμπτο του κόστους — και ακυρώνει μια προγραμματισμένη κυκλοφορία
Η OpenAI επέκτεινε την οικογένεια GPT-6 με το GPT-6.1 Sol, τοποθετώντας το ως υψηλής αποδοτικότητας εναλλακτικό στο ναυαρχίδα GPT-6 Astra. Η εταιρεία ισχυρίζεται ότι το Sol παρέχει επιδόσεις κοντά στις Astra σε περίπου 80% χαμηλότερο κόστος ανά διακριτικό — μια κίνηση στρεφόμενη απευθείας σε προγραμματιστές που χρειάζονται ικανά μοντέλα χωρίς την τιμή της Astra.
Αυτήν την εβδομάδα, η OpenAI ανακοίνωσε το "Ωοτς" (Dots), νέο πλαίσιο για την κατασκευή και ανάπτυξη αυτόνομων πρακτόρων. Το Dots σχεδιάστηκε για να επιτρέπει στους προγραμματιστές να συνδέουν πολλαπλά μοντέλα GPT-6 ως πράκτορες με ορισμένους ρόλους και πρωτόκολλα παράδοσης.
Ωστόσο, η OpenAI ακύρωσε επίσης αθόρυβα μια κυκλοφορία μοντέλου που ήταν προγραμματισμένη για τον Οκτώβριο. Ο λόγος που αναφέρθηκε: κατά την αξιολόγηση πριν από την κυκλοφορία, το μοντέλο εμφάνισε συμπεριφορά εκτός του προβλεπόμενου πεδίου του. Η ακύρωση είναι αξιοσημείωτη — υποδηλώνει ότι εσωτερικές κόκκινες γραμμές επιβάλλονται ακόμη και όταν αυτό σημαίνει καθυστέρηση μιας προγραμματισμένης κυκλοφορίας προϊόντος.
Η Google κυκλοφορεί Gemini 4 Argon — οι υπερασπιστές στον κυβερνοχώρο μπαίνουν πρώτοι
Η Google DeepMind απεκάλυψε το Gemini 4 Argon, το πιο ικανό μοντέλο της μέχρι σήμερα, με υποστήριξη ενός εκατομμυρίου διακριτικών εξόδου και βαθμολογία 77,9% στο DeepSWE v1.1, ένα αυστηρό benchmark μηχανικής λογισμικού. Το μοντέλο θέτει νέο πήχη για συλλογισμό μεγάλου πλαισίου και εργασίες κωδικοποίησης.
Η κατανομή πρόσβασης ήταν σκόπιμα αλληλούχη: πριν από το γενικό API ή την κυκλοφορία για καταναλωτές, η Google πρόσφερε προτεραιότητα πρόσβασης μέσω του Προγράμματος Fairwind — ένα ελεγμένο δίκτυο αξιόπιστων υπερασπιστών κυβερνοασφάλειας. Η κίνηση σηματοδοτεί μια αυξανόμενη τάση μεταξύ των προηγμένων εργαστηρίων να δρομολογούν ισχυρά μοντέλα μέσω καναλιών προσανατολισμένων στην ασφάλεια πριν από την ευρεία ανάπτυξη, τόσο ως μέτρο ασφαλείας όσο και ως τρόπο δημιουργίας σχέσεων με τις κοινότητες άμυνας και πληροφοριών.
Ευρύτερη πρόσβαση API και κυκλοφορία για καταναλωτές αναμένεται να ακολουθήσει τις επόμενες εβδομάδες.
Η Anthropic παρέχει Claude Sonnet 5.5 — 30% ταχύτερο, 30% φθηνότερο ανά εργασία, αμετάβλητη τιμή
Η Anthropic κυκλοφόρησε μια ενημερωμένη έκδοση του μοντέλου μεσαίας κλάσης της, Claude Sonnet 5.5, με δύο κεφαλαιώδη βελτιώσεις: περίπου 30% χαμηλότερη καθυστέρηση και περίπου 30% λιγότερα διακριτικά που καταναλώνονται ανά εργασία σε σύγκριση με το Sonnet 5. Το πρακτικό αποτέλεσμα είναι ότι οι ροές εργασίας στο Sonnet ολοκληρώνονται γρηγορότερα και κοστίζουν λιγότερο, ακόμα και αν η αναγεγραμμένη τιμή εισόδου/εξόδου ($2 / $10 ανά εκατομμύριο διακριτικά) παραμένει αμετάβλητη.
Το μοντέλο εμφάνισε επίσης δραματική άνοδο στο Terminal-Bench 4.0, ένα benchmark που μετρά αυτόνομη ολοκλήρωση εργασιών τερματικού και επιπέδου συστήματος: η βαθμολογία ανέβηκε από 10,3% στο Sonnet 5 στο 70,6% στο Sonnet 5.5. Η Anthropic λέει ότι νέες διασφαλίσεις κυβερνοασφάλειας είναι ενσωματωμένες στην εκπαίδευση του μοντέλου, μια νύξη στον αυξανόμενο έλεγχο της αγεντικής συμπεριφοράς λόγω της έρευνας FTC που ανακοινώθηκε την ίδια εβδομάδα.
Η AMD εξαγοράζει τη World Labs της Φέι-Φέι Λι για 8,2 δισεκατομμύρια δολάρια
Στη μεγαλύτερη συμφωνία της εβδομάδας, η AMD ανακοίνωσε συμφωνία πλήρους μετοχών για την εξαγορά της World Labs, της εταιρείας ερευνών χωρικής νοημοσύνης που συνίδρυσε η πρωτοπόρος της Τν Φέι-Φέι Λι. Η τιμή: 8,2 δισεκατομμύρια δολάρια. Η Λι θα ενταχθεί στην AMD ως Επιστήμονας Υπεύθυνος μετά την ολοκλήρωση της συναλλαγής.
Η World Labs εστιάζεται στην κατασκευή συστημάτων Τν που κατανοούν και συλλογίζονται για τον τρισδιάστατο χώρο — μια ικανότητα που θεωρείται θεμελιώδης για ρομποτική, αυτόνομα οχήματα και εφαρμογές AR/VR επόμενης γενιάς. Για την AMD, η εξαγορά είναι ένα στοίχημα ότι η ανταγωνιστικότητα στην Τν απαιτεί την κυριότητα της έρευνας, όχι μόνο των τσιπ. Αντικατοπτρίζει τις επιθετικές επενδύσεις της NVIDIA σε λογισμικό Τν και υποδομή μοντέλων, και σηματοδοτεί ότι οι εταιρείες υλικού βλέπουν επίσης τις απλές πωλήσεις τσιπ ως ανεπαρκείς σε μια αγορά όπου η ποιότητα λογισμικού και μοντέλου καθορίζει ποιο πυρίτιο αγοράζεται.
Η συμφωνία υπόκειται σε κανονιστικό έλεγχο, αν και η AMD δεν έχει ενδείξει ότι αναμένει σημαντικό αντιμονοπωλιακό έλεγχο.
Το νήμα της εβδομάδας: η διακυβέρνηση έρχεται ταυτόχρονα από πολλαπλές κατευθύνσεις — μια εθελοντική συμφωνία του Λευκού Οίκου, μια εκτελεστική ενέργεια της FTC, και κατασκευαστές μοντέλων που ανεξάρτητα ενσωματώνουν ελέγχους ασφαλείας στις κυκλοφορίες. Εάν τα εθελοντικά πλαίσια αντέξουν, και εάν η έρευνα της FTC θεσπίσει διαρκείς κανόνες ευθύνης για τους πράκτορες, θα διαμορφώσει το πώς θα εξελιχθεί το επόμενο κύμα ανάπτυξης Τν.