Μετάβαση στο κύριο περιεχόμενο
Τεχνολογία & Επιστήμη06 / 16 · ιστορία ημέρας3 λεπτά · 580 λέξεις · 19 πηγές

Το ChatGPT Voice πλέον ακούει και μιλά ταυτόχρονα

Γράφτηκε από AIto brief AI · 9 Ιουλίου 2026, 18:30
Πώς γράφτηκε

Η νέα αρχιτεκτονική της OpenAI καταργεί τις παύσεις, μετατρέποντας τη φωνητική επικοινωνία σε μια αδιάκοπη, μαζική ροή δεδομένων.

Σύνθεση εικόνας · tobrief
το κείμενο · 3 λεπτά ανάγνωση

Μέχρι χθες, το να μιλάς με το ChatGPT με τη φωνή σου έμοιαζε με ασύρματο: εσύ μιλάς, σταματάς, περιμένεις, απαντάει. Στις 8 Ιουλίου 2026 η OpenAI άλλαξε αυτόν τον ρυθμό, λανσάροντας διεθνώς μια νέα γενιά φωνητικών μοντέλων, τα GPT-Live, που ακούν και μιλούν ταυτόχρονα. Η φαινομενικά μικρή αλλαγή είναι, στην ουσία, αλλαγή αρχιτεκτονικής (OpenAI).

Για να καταλάβουμε γιατί μετράει, αξίζει να δούμε πώς δούλευε ο παλιός φωνητικός βοηθός. Ήταν μια σειριακή αλυσίδα. Πρώτα μετέτρεπε τη φωνή σου σε κείμενο. Μετά το γλωσσικό μοντέλο σκεφτόταν την απάντηση. Και στο τέλος ένα τρίτο σύστημα την ξαναγύριζε σε ήχο (Cekura). Κάθε κρίκος περίμενε τον προηγούμενο. Αποτέλεσμα: τεχνητές παύσεις, και μια μηχανή που σε αγνοούσε αν προσπαθούσες να τη διακόψεις ή να διορθώσεις κάτι στη μέση.

Το full-duplex σπάει αυτή τη σειρά. Ο όρος έρχεται από τις τηλεπικοινωνίες και σημαίνει απλώς ότι και οι δύο πλευρές μπορούν να μιλούν και να ακούν την ίδια στιγμή (Evalgent). Η αναλογία που κάνει τη διαφορά κατανοητή: το παλιό μοντέλο ήταν σαν να αφήνεις φωνητικό μήνυμα και να περιμένεις. Το νέο είναι σαν κανονική τηλεφωνική συζήτηση, όπου μπαίνεις, κόβεις, ξεκαθαρίζεις και συγχρονίζεσαι ζωντανά. Στην πράξη, το σύστημα αποφασίζει πολλές φορές το δευτερόλεπτο αν πρέπει να συνεχίσει να μιλά, να σωπάσει ή να παραχωρήσει τη σειρά. Οι φωνητικοί βοηθοί αυτού του τύπου στοχεύουν σε χρόνους αντίδρασης της τάξης των 100-300 χιλιοστών του δευτερολέπτου, εκεί όπου διατηρείται η αίσθηση «σε ακούω τώρα» (Evalgent).

Ο συνομιλητής μπροστά, ο «ειδικός» πίσω

Το δεύτερο κομμάτι είναι το πιο έξυπνο κόλπο. Ένα μοντέλο φτιαγμένο για να κρατά ζωντανή τη φωνητική ροή δεν είναι απαραίτητα καλό στη βαριά σκέψη, στο να ψάξει στο web ή να λύσει ένα σύνθετο πρόβλημα. Η OpenAI λύνει το δίλημμα με ανάθεση: το GPT-Live κρατά τη συζήτηση, αλλά όταν χρειάζεται πραγματική έρευνα ή βαθύτερος συλλογισμός, πασάρει το δύσκολο κομμάτι σε ένα ισχυρότερο μοντέλο στο παρασκήνιο, στο λανσάρισμα το GPT-5.5, και φέρνει πίσω το αποτέλεσμα χωρίς να «παγώσει» η κουβέντα (OpenAI). Είναι σαν έναν τηλεφωνητή που σε κρατά στη γραμμή ενώ ρωτά τον ειδικό στο διπλανό γραφείο.

Αυτό είναι και το πραγματικό στοίχημα: το GPT-Live δεν είναι «νέος εγκέφαλος», είναι νέα διεπαφή. Οι πιο ρεαλιστικές χρήσεις είναι hands-free βοήθεια ενώ οδηγείς ή μαγειρεύεις, ζωντανή γλωσσική διαμεσολάβηση, και προσβασιμότητα για ανθρώπους που δυσκολεύονται με οθόνες και πληκτρολόγια (ChosunBiz). Το GPT-Live-1 γίνεται η προεπιλογή για συνδρομητές Go, Plus και Pro, ενώ το ελαφρύτερο GPT-Live-1 mini για τους δωρεάν χρήστες (SiliconANGLE). Η κυκλοφορία ήρθε λίγο πριν από την ευρύτερη διάθεση του GPT-5.6, το επόμενο κύμα ενός ανταγωνισμού που εξελίσσεται πλέον υπό το βλέμμα των ρυθμιστικών αρχών (To Brief).

Χρειάζεται όμως ψυχραιμία. Οι ισχυρισμοί ότι το GPT-Live είναι το «εξυπνότερο φωνητικό μοντέλο» και ότι προτιμήθηκε έναντι του παλιού Advanced Voice Mode προέρχονται από εσωτερικές αξιολογήσεις της OpenAI, όχι από ανεξάρτητη επιβεβαίωση (OpenAI). Και όσο πιο φυσική ακούγεται μια φωνή, τόσο πιο πειστικά ακούγονται και τα λάθη της. Στη ζωντανή μετάφραση, ακόμη και η ίδια η εταιρεία παραδέχεται μη φυσικές προφορές σε ορισμένες γλώσσες (MarkTechPost).

Μια πρακτική λεπτομέρεια γειώνει τον ενθουσιασμό: στο λανσάρισμα, το GPT-Live δεν υποστηρίζει ακόμη φωνή με βίντεο ή διαμοιρασμό οθόνης. Για αυτά, οι παλιές εκδόσεις φωνής παραμένουν σε λειτουργία (OpenAI). Η OpenAI βελτίωσε δραματικά το πώς μιλάμε με το AI. Το αν αυτό γίνει αξιόπιστος ψηφιακός βοηθός, και όχι απλώς πιο εντυπωσιακή φωνή, θα κριθεί στην πραγματική δουλειά, όχι στον ρυθμό της κουβέντας.

Πώς σου φάνηκε το άρθρο;

Βοήθησέ μας να γίνουμε καλύτεροι

Πώς γράφτηκε
Μοντέλο:
claude-opus-4-8
Δημιουργήθηκε:
7/9/2026, 6:25:04 PM
Εκτέλεση pipeline:
incremental_20260709_163006
Υδατόσημο:
SynthID (αόρατο υδατόσημο της Google)
Ανθρώπινη επιμέλεια:
Καμία πριν τη δημοσίευση
Μάθετε περισσότερα για τη μεθοδολογία μας