Μοντέλα και πλατφόρμες AI

Η OpenAI Αναφέρει ότι οι Πράκτορες Τώρα Καλύπτουν 3,1 Ημέρες Εργασίας ανά Ημέρα Εργασίας Ερευνητή

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Η ερευνητική οργάνωση της OpenAI εκτελεί πλέον 3,1 ημέρες εργασίας πρακτόρων για κάθε ημέρα εργασίας ανθρώπινου εργατικού δυναμικού, δήλωσε η εταιρεία σε ένα δοκίμιο της 8 Σεπτεμβρίου 2026 που περιγράφει πώς σκοπεύει να μετατρέψει την ικανότητα των πρωτοποριακών μοντέλων σε έσοδα. Ο αριθμός, μετρημένος σε σχέση με μια τυπική οκτάωρη εργάσιμη ημέρα από το μέσο του Αυγούστου 2026, στηρίζει ένα ευρύτερο επιχείρημα της οικονομικής διευθύντριας Sarah Friar ότι πιο ικανά μοντέλα, μια βάση χρηστών με πάνω από ένα δισεκατομμύριο ενεργούς εβδομαδιαίους χρήστες, και μια πλήρης στρατηγική υπολογιστικής υποδομής ενισχύουν το ένα το άλλο.

Το δοκίμιο, με τίτλο «Η Εργασία Τώρα Εντός Εμβέλειας», είναι το πιο πρόσφατο της Friar σε μια σειρά σχετικά με τις επιχειρηματικές και υπολογιστικές οικονομίες της OpenAI. Η OpenAI διόρισε τη Friar ως οικονομική διευθύντρια τον Ιούνιο 2024· προηγουμένως είχε υπηρετήσει ως διευθύνων σύμβουλος της Nextdoor και ως οικονομική διευθύντρια της Square.

Χρήση και Έσοδα

Η OpenAI δήλωσε ότι τα προϊόντα της φθάνουν σε πάνω από ένα δισεκατομμύριο εβδομαδιαίους ενεργούς χρήστες και 2,5 εκατομμύρια επιχειρήσεις, και ότι κάθε ερευνητική πρόοδος βελτιώνει το ChatGPT, το ChatGPT Work, το Codex και τις εφαρμογές που χτίζονται πάνω στο API της. Η εταιρεία ανέφερε ότι η δωρεάν πρόσβαση, υποστηριζόμενη από διαφημίσεις, βοηθά τους ανθρώπους να ανακαλύψουν πού είναι χρήσιμη η τεχνητή νοημοσύνη, ενώ οι συνδρομές και οι προσφορές βάσει χρήσης επιτρέπουν στους πελάτες να ξοδεύουν περισσότερα καθώς βρίσκουν μεγαλύτερη αξία.

Αναφέροντας τη μελέτη της για μεμονωμένα προγράμματα ChatGPT, η OpenAI ανέφερε ότι ο ημερήσιος όγκος μηνυμάτων ήταν περίπου 50 % υψηλότερος έξι μήνες μετά την εγγραφή σε σύγκριση με τον πρώτο μήνα, και ότι οι χρήστες είχαν δοκιμάσει περίπου διπλάσιο αριθμό διαφορετικών εργασιών. Η υποκείμενη ανάλυση βασίζεται σε δείγμα 0,1 % λογαριασμών που δημιουργήθηκαν μεταξύ 15 οκτωβρίου 2025 και 1 μηαίου 2026, με δραστηριότητα παρακολουθούμενη έως τις 31 μηαίου 2026· μετρά τα μηνύματα και το εύρος των εργασιών σε σχέση με τις πρώτες 28 ημέρες του κάθε χρήστη και ταξινομεί τα μηνύματα σε 53 κατηγορίες ικανοτήτων.

Το δοκίμιο αναφέρει επίσης πέντε υλοποιήσεις πελατών. Το Boston Children’s Hospital ανέφερε πάνω από 40 διαγνώσεις σε προηγουμένως ανεπίλυτες περιπτώσεις σπάνιων ασθενειών μέσω έρευνας με υποβοήθηση AI. Η Cars24 δήλωσε ότι οι πράκτορές της διαχειρίζονται πάνω από ένα εκατομμύριο λεπτά συνομιλιών το μήνα σε αγορές και πωλήσεις αυτοκινήτων. Η Circles ανέφερε 65 % αυτόματη επίλυση αλληλεπιδράσεων εξυπηρέτησης πελατών σε υποστηριζόμενες ροές εργασίας, και η Balyasny Asset Management δήλωσε ότι ο Αναλυτής Ομιλιών Κεντρικής Τράπεζας της μείωσε την ανάλυση μακροοικονομικών σεναρίων από δύο ημέρες σε περίπου 30 λεπτά. Η Replit προσφέρει μια Δωρεάν Λειτουργία που επιτρέπει στους χρήστες να σχεδιάζουν λογισμικό χωρίς να καταναλώνουν το όριο χρήσης τους. Κάθε αριθμός προέρχεται από τον λογαριασμό του πελάτη όπως παρουσιάστηκε από την OpenAI.

Πράκτορες Εντός της Ερευνητικής Οργάνωσης

Ο αριθμός των 3,1 ημερών εργασίας πρακτόρων προέρχεται από μια ενημέρωση έρευνας της OpenAI που δημοσιεύθηκε στις 6 Σεπτεμβρίου 2026, η οποία ανέφερε ότι πριν τον Ιούνιο 2026 το συνολικό χρόνο εκτέλεσης πρακτόρων σε όλη την ερευνητική οργάνωση ήταν ακόμη κάτω από το συνολικό ανθρώπινο εργατικό δυναμικό. Η ενημέρωση δήλωσε ότι ο μέσος ερευνητής χρησιμοποιούσε πάνω από 600 $ ημερησίως για inference στις τιμές του API μέχρι το μέσο του Αυγούστου, και ο χρήστης στο 90ο εκατοστημόριο περισσότερα από 7 000 $ σε tokens ανά ημέρα.

Η ίδια ενημέρωση ανέφερε ότι τα ποσοστά επιτυχίας των πρακτόρων κώδικα αυξήθηκαν από τον Ιανουάριο έως τον Ιούλιο 2026 σε διάφορες κατηγορίες δυσκολίας εργασιών, ενώ σημειώθηκε ότι οι μεγαλύτερες εργασίες εξακολουθούσαν να απαιτούν ανθρώπινη καθοδήγηση: τα τελευταία έξι μήνες, πάνω από το ήμισυ των επιτυχών εργασιών που εκτιμήθηκαν σε τέσσερις έως οκτώ ώρες ανθρώπινου χρόνου περιελάμβαναν τουλάχιστον μια παρέμβαση. Στο δοκίμιο, η OpenAI δήλωσε ότι οι άνθρωποι εξακολουθούν να θέτουν προτεραιότητες έρευνας και να αξιολογούν τα αποτελέσματα, και ότι οι ομάδες χρησιμοποιούν πράκτορες για την επίλυση προβλημάτων υποδομής που παλαιότερα απαιτούσαν εξειδικευμένη υποστήριξη.

Ικανότητα Μοντέλου και Κόστος Υπολογιστικής Ισχύος

Το δοκίμιο της Friar θέτει το GPT-6 Astra ως τον τρέχοντα κινητήρα ικανοτήτων, περιγράφοντάς το ως κορυφαίο στην χρήση υπολογιστών, περιήγηση, μηχανική λογισμικού, κυβερνοασφάλεια, επιστήμη και επαγγελματική εργασία. Στην ανακοίνωσή του, η OpenAI δήλωσε ότι το Astra καταγράφει 98 % στο FrontierMath Tier 4, 99,9 % στο ARC‑AGI‑3 και 100 % στο ExploitBench, και ότι πληροί το κρίσιμο όριο στην κυβερνοασφάλεια σύμφωνα με το Πλαίσιο Ετοιμότητας της εταιρείας. Αυτά είναι τα δικά της αναφερόμενα αποτελέσματα. Η εταιρεία ανακοίνωσε ότι το Astra άρχισε να διανέμεται σε περιορισμένο σύνολο οργανισμών στις 3 Σεπτεμβρίου 2026, με γενική διαθεσιμότητα σε όλα τα επί πληρωμή επίπεδα του ChatGPT, το API, το Microsoft Azure και το AWS Bedrock τις επόμενες ημέρες.

Σχετικά με την οικονομία παροχής υπηρεσιών, το δοκίμιο επαναλαμβάνει δύο αριθμούς από την ανάρτηση μηχανικής της OpenAI στις 29 Ιουλίου 2026 για το GPT‑5.6: βελτιώσεις λογισμικού παραγωγικής εξυπηρέτησης που μείωσαν το συνολικό κόστος εξυπηρέτησης κατά 20 % και εργασία υποθετικής αποκωδικοποίησης που αύξησε την αποδοτικότητα δημιουργίας tokens κατά περισσότερο από 15 %. Και οι δύο κερδισμένοι επιτεύχθηκαν με το GPT‑5.6 Sol που λειτουργεί μέσα στο Codex, συμπεριλαμβανομένης της αυτόνομης επανεγγραφής παραγωγικών πυρήνων, όπως ανέφερε η ανάρτηση μηχανικής.

Το δοκίμιο συνοψίζει επίσης τα πρώτα αποτελέσματα για το Jalapeño, το προσαρμοσμένο chip inference της OpenAI, που δημοσιεύθηκε για πρώτη φορά στις 25 Αυγούστου 2026. Στις δοκιμές InferenceX σε GPT‑OSS 120B, DeepSeek R1 και Kimi K2.5, η OpenAI δήλωσε ότι το chip παρείχε 1,5‑1,9 φορές μεγαλύτερη μέγιστη απόδοση token ανά watt σε σύγκριση με τα εμπορικά συστήματα που δοκιμάστηκαν, χρησιμοποιώντας την ονομαστική ισχύ του chip για κανονικοποίηση της σύγκρισης, με καθυστέρηση από άκρη σε άκρη 1,7‑3,6 φορές χαμηλότερη. Η OpenAI δήλωσε ότι σχεδιάζει να αρχίσει την ανάπτυξη του Jalapeño στην υπολογιστική υποδομή της μέχρι το τέλος του έτους, μαζί με επιταχυντές από NVIDIA, AMD και άλλους συνεργάτες, και ότι οι εκδόσεις δεύτερης και τρίτης γενιάς βρίσκονται σε ανάπτυξη.

Η Friar έγραψε ότι η OpenAI αξιολογεί κάθε επένδυση με βάση τη ζήτηση που μπορεί να εξυπηρετήσει, το πόσο γρήγορα γίνεται παραγωγική, και αν οι αποδόσεις δικαιολογούν το δεσμευμένο κεφάλαιο, και ότι τα έσοδα από την αυξανόμενη υιοθέτηση χρηματοδοτούν περαιτέρω έρευνα και υποδομή.

Ο Jonas Reeve είναι ένας αναλυτής που δημιουργείται από AI στη Unite.AI, με επίκεντρο την γνωστική AI, την τεχνητή γενική νοημοσύνη (AGI) και τις θεωρητικές βάσεις της μηχανικής νοημοσύνης. Το έργο του εξετάζει πώς η μάθηση, ο συλλογισμός, η μνήμη και η αφαίρεση εμφανίζονται και σε βιολογικά και τεχνητά συστήματα, δημιουργώντας συνδέσεις μεταξύ σύγχρονων αρχιτεκτονικών AI και μακροχρόνιων ερωτημάτων στις γνωστικές επιστήμες και τη φιλοσοφία του νου. Με μια концепτουαλιστική και αναστοχαστική προσέγγιση, ο Jonas εξετάζει πλαισιά όπως τα μοντέλα συλλογισμού, τα συστήματα agentic, η αναδυόμενη γνωστική και η θεωρία ευθυγράμμισης, με στόχο να αποσαφηνίσει τι σημαίνει πραγματικά η πρόοδος προς την AGI - και τι όχι. Αντί να κυνηγά χρονοδιαγράμματα ή υπεροπτικές εκφράσεις, τονίζει τις αρχές, τη концепτουαλιστική αυστηρότητα και τα όρια των τρεχόντων μοντέλων. Τα άρθρα που γράφονται από τον Jonas Reeve δημιουργούνται από AI και αναθεωρούνται από την редакτική ομάδα της Unite.AI για να διασφαλιστεί η ακρίβεια, η σαφήνεια και η υπεύθυνη συζήτηση για προηγμένα концеп AI.