Τι συμβαίνει όταν πατάς Enter στο ChatGPT;
Κάθε φορά που πατάς Enter, μέσα σε λίγα δευτερόλεπτα συμβαίνουν εκατομμύρια μαθηματικές πράξεις, το μήνυμά σου ταξιδεύει σε servers, αναλύεται σε μικρότερα κομμάτια και ένα μοντέλο τεχνητής νοημοσύνης αρχίζει να προβλέπει την επόμενη λέξη της απάντησής του. Όλα αυτά γίνονται τόσο γρήγορα που μοιάζουν σχεδόν μαγικά.
Με λίγα λόγια
Όταν στέλνεις ένα μήνυμα στο ChatGPT, δεν "ψάχνει" μια έτοιμη απάντηση σε μια βάση δεδομένων ούτε διαβάζει το Internet εκείνη τη στιγμή (εκτός αν χρησιμοποιεί ειδικά εργαλεία).
Αντίθετα, παίρνει ολόκληρη τη συζήτηση μέχρι εκείνο το σημείο, τη μετατρέπει σε μια μορφή που μπορεί να καταλάβει ένας υπολογιστής και, χρησιμοποιώντας ένα τεράστιο νευρωνικό δίκτυο, προβλέπει ένα μικρό κομμάτι της απάντησης κάθε φορά.
Το αποτέλεσμα είναι αυτό που βλέπεις να "πληκτρολογείται" στην οθόνη σου.
Η διαδρομή του μηνύματός σου βήμα προς βήμα
1. Το μήνυμά σου φεύγει από τη συσκευή
Μόλις πατήσεις Enter, ο browser ή η εφαρμογή του ChatGPT δημιουργεί ένα αίτημα προς τους servers της OpenAI.
Η επικοινωνία γίνεται μέσω μιας κρυπτογραφημένης σύνδεσης HTTPS, όπως ακριβώς όταν συνδέεσαι στην τράπεζά σου ή κάνεις μια αγορά online.
Δεν αποστέλλεται μόνο η τελευταία πρόταση που έγραψες.
Στις περισσότερες περιπτώσεις αποστέλλεται και το απαραίτητο ιστορικό της συνομιλίας, ώστε το μοντέλο να γνωρίζει το πλαίσιο της συζήτησης.
Για παράδειγμα, αν γράψεις:
"Μπορείς να το εξηγήσεις πιο απλά;"
το AI πρέπει να ξέρει τι είναι αυτό το "το".
Χωρίς το προηγούμενο context, η πρόταση δεν έχει νόημα.
2. Οι λέξεις μετατρέπονται σε Tokens
Οι άνθρωποι διαβάζουμε λέξεις.
Οι υπολογιστές όχι.
Πριν το μοντέλο μπορέσει να επεξεργαστεί το μήνυμά σου, το κείμενο μετατρέπεται σε μικρότερα κομμάτια που ονομάζονται tokens.
Ένα token μπορεί να είναι:
- μια ολόκληρη λέξη,
- μέρος μιας λέξης,
- ένας αριθμός,
- ένα σύμβολο,
- ακόμη και ένα κενό.
Για παράδειγμα, η πρόταση:
Καλημέρα, τι κάνεις;
μπορεί να χωριστεί περίπου έτσι:
["Καλη", "μέρα", ",", " τι", " κάν", "εις", "?"]
Το πραγματικό tokenization είναι αρκετά πιο σύνθετο, αλλά η βασική ιδέα είναι ότι το AI δεν βλέπει το κείμενο όπως το βλέπουμε εμείς.
Βλέπει μια ακολουθία από tokens.
3. Το μοντέλο διαβάζει ολόκληρο το Context
Ένα από τα μεγαλύτερα πλεονεκτήματα των σύγχρονων AI μοντέλων είναι ότι μπορούν να λαμβάνουν υπόψη ολόκληρη τη συζήτηση.
Δεν διαβάζουν μόνο το τελευταίο μήνυμα.
Διαβάζουν:
- το ιστορικό της συνομιλίας,
- τις οδηγίες που έχουν δοθεί για το πώς πρέπει να απαντούν,
- τυχόν πληροφορίες που παρέχουν εργαλεία,
- και φυσικά το νέο μήνυμα που μόλις έστειλες.
Όλα αυτά αποτελούν το Context Window.
Μπορείς να το φανταστείς σαν το "βραχυπρόθεσμο μυαλό" του AI.
Όσο περισσότερο σχετικό context έχει, τόσο καλύτερες και πιο συνεπείς είναι συνήθως οι απαντήσεις του.
4. Δεν "σκέφτεται". Προβλέπει.
Αυτό είναι ίσως το πιο παρεξηγημένο σημείο.
Το ChatGPT δεν κάθεται να συλλογιστεί όπως ένας άνθρωπος.
Ούτε ψάχνει σε μια λίστα με σωστές απαντήσεις.
Αυτό που κάνει είναι να υπολογίζει:
Ποιο token είναι πιο πιθανό να ακολουθήσει;
Αν γράψεις:
Η πρωτεύουσα της Ελλάδας είναι...
το μοντέλο μπορεί να υπολογίσει κάτι σαν:
Αθήνα 99.9%
Θεσσαλονίκη 0.05%
Πάτρα 0.01%
...
Φυσικά, οι πραγματικοί υπολογισμοί αφορούν δεκάδες ή και εκατοντάδες χιλιάδες πιθανά tokens και είναι πολύ πιο περίπλοκοι.
Το σημαντικό είναι να καταλάβουμε ότι το AI δεν αποφασίζει μία ολόκληρη πρόταση.
Αποφασίζει μόνο το επόμενο token.
5. Και μετά το ξανακάνει...
Αφού επιλέξει το πρώτο token, αυτό προστίθεται στην απάντηση.
Έπειτα ολόκληρη η διαδικασία ξεκινά από την αρχή.
Το μοντέλο πλέον βλέπει:
την αρχική συζήτηση + το token που μόλις δημιούργησε
και προσπαθεί να προβλέψει το επόμενο.
Αυτό επαναλαμβάνεται ξανά και ξανά μέχρι να θεωρήσει ότι η απάντηση ολοκληρώθηκε.
Γι' αυτό πολλές φορές βλέπεις το ChatGPT να "σταματά" ακριβώς στο τέλος μιας λογικής πρότασης ή παραγράφου.
6. Γιατί η απάντηση εμφανίζεται σταδιακά;
Έχεις παρατηρήσει ότι το ChatGPT δεν εμφανίζει ολόκληρη την απάντηση αμέσως.
Αντίθετα, φαίνεται σαν να γράφει.
Αυτό συμβαίνει επειδή οι απαντήσεις αποστέλλονται σταδιακά (streaming).
Καθώς δημιουργούνται νέα tokens, αποστέλλονται αμέσως στη συσκευή σου.
Έτσι δεν χρειάζεται να περιμένεις μέχρι να ολοκληρωθεί ολόκληρη η απάντηση.
Η εφαρμογή απλώς εμφανίζει κάθε νέο κομμάτι μόλις το λάβει.
7. Ο browser μορφοποιεί το αποτέλεσμα
Το τελευταίο στάδιο δεν αφορά πλέον το AI αλλά την εφαρμογή που χρησιμοποιείς.
Το κείμενο που επιστρέφεται περιέχει μορφοποίηση (Markdown).
Ο browser το μετατρέπει σε αυτό που βλέπεις στην οθόνη:
- επικεφαλίδες,
- έντονα γράμματα,
- λίστες,
- πίνακες,
- blocks κώδικα,
- συνδέσμους.
Το AI παράγει το περιεχόμενο.
Η εφαρμογή αναλαμβάνει να το παρουσιάσει όμορφα.
Ένα παράδειγμα
Ας υποθέσουμε ότι γράφεις:
Γιατί είναι μπλε ο ουρανός;
Το ταξίδι του μηνύματος μοιάζει κάπως έτσι:

Μύθοι vs Πραγματικότητα
❌ «Το ChatGPT ψάχνει στο Internet κάθε φορά που ρωτάω κάτι.»
Όχι απαραίτητα. Το βασικό μοντέλο απαντά χρησιμοποιώντας όσα έχει μάθει κατά την εκπαίδευσή του. Μόνο όταν χρησιμοποιούνται ειδικά εργαλεία αναζήτησης ή περιήγησης μπορεί να ανακτήσει πληροφορίες από το Internet σε πραγματικό χρόνο.
❌ «Έχει όλες τις απαντήσεις αποθηκευμένες.»
Όχι. Δεν υπάρχει μια τεράστια λίστα από έτοιμες απαντήσεις. Κάθε απάντηση δημιουργείται εκείνη τη στιγμή, token προς token.
❌ «Καταλαβαίνει όπως ένας άνθρωπος.»
Το μοντέλο μπορεί να παράγει εξαιρετικά φυσικές απαντήσεις, αλλά ο τρόπος λειτουργίας του βασίζεται σε στατιστικά μοτίβα και μαθηματικούς υπολογισμούς, όχι σε ανθρώπινη συνείδηση ή κατανόηση.
✔️ Πρόβλεψη της επόμενης λέξης
Στην πραγματικότητα, η βασική λειτουργία ενός LLM (Large Language Model) είναι να προβλέπει ποια είναι η πιο πιθανή επόμενη λέξη (ή token) σε μια πρόταση, με βάση τα δεδομένα με τα οποία έχει εκπαιδευτεί.
✔️ Δεν έχει μνήμη (από μόνο του)
Κάθε φορά που στέλνεις ένα μήνυμα, το μοντέλο «διαβάζει» ξανά ολόκληρη τη συνομιλία από την αρχή για να σου απαντήσει. Δεν «θυμάται» με τον τρόπο που θυμάται ένας άνθρωπος, απλώς επεξεργάζεται το ιστορικό της συζήτησης σε κάθε σου prompt.
✔️ Το φαινόμενο των «ψευδαισθήσεων»
Επειδή ο στόχος του είναι να παράγει κείμενο με φυσική ροή και όχι απαραίτητα να επαληθεύει την ιστορική αλήθεια, μερικές φορές μπορεί να δημιουργήσει εντελώς λανθασμένες πληροφορίες με απόλυτα πειστικό ύφος.
Γιατί όλα αυτά συμβαίνουν τόσο γρήγορα;
Πίσω από το ChatGPT βρίσκονται εξειδικευμένοι servers εξοπλισμένοι με ισχυρές GPU (Graphics Processing Units).
Οι ίδιες κάρτες γραφικών που σχεδιάστηκαν αρχικά για παιχνίδια και τρισδιάστατα γραφικά αποδείχθηκαν ιδανικές και για την εκτέλεση τεράστιων νευρωνικών δικτύων, επειδή μπορούν να πραγματοποιούν εκατομμύρια παράλληλους υπολογισμούς.
Χάρη σε αυτή την υπολογιστική ισχύ, το μοντέλο μπορεί να δημιουργεί δεκάδες ή και εκατοντάδες tokens κάθε δευτερόλεπτο, δίνοντας την αίσθηση ότι "γράφει" σχεδόν σε πραγματικό χρόνο.
Συμπέρασμα
Το πάτημα ενός απλού Enter ξεκινά μια αλυσίδα γεγονότων που διαρκεί μόλις λίγα δευτερόλεπτα αλλά περιλαμβάνει δικτυακή επικοινωνία, μετατροπή του κειμένου σε tokens, ανάλυση ολόκληρης της συνομιλίας και χιλιάδες διαδοχικές προβλέψεις μέχρι να δημιουργηθεί η τελική απάντηση.
Ίσως αυτό είναι και το πιο εντυπωσιακό χαρακτηριστικό των σύγχρονων μοντέλων τεχνητής νοημοσύνης: πίσω από μια συνομιλία που μοιάζει ανθρώπινη, δεν υπάρχει κάποιος που πληκτρολογεί ούτε μια βάση δεδομένων με έτοιμες απαντήσεις. Υπάρχει ένα μοντέλο που προβλέπει, ξανά και ξανά, το επόμενο μικρό κομμάτι του κειμένου — τόσο γρήγορα ώστε η διαδικασία να μοιάζει σχεδόν αόρατη.