![]()
Η NVIDIA ετοιμάζεται να βάλει σε λειτουργία τα πρώτα server racks που βασίζονται στην τεχνολογία της Groq πριν από το τέλος του 2026. Η κίνηση ακολουθεί τη συμφωνία ύψους περίπου 20 δισ. δολαρίων για την τεχνολογία και τα περιουσιακά στοιχεία της εταιρείας και δείχνει πόσο σημαντική θεωρεί πλέον η NVIDIA την αγορά του AI inference.
Η NVIDIA κυριαρχεί στην αγορά των συστημάτων τεχνητής νοημοσύνης, όμως η επόμενη μεγάλη μάχη ίσως να μη δοθεί αποκλειστικά στην εκπαίδευση νέων μοντέλων. Όσο περισσότερες εταιρείες αναπτύσσουν και χρησιμοποιούν μεγάλα γλωσσικά μοντέλα, τόσο αυξάνεται η σημασία μιας διαφορετικής διαδικασίας: του inference, δηλαδή της εκτέλεσης ενός ήδη εκπαιδευμένου μοντέλου για να απαντήσει σε πραγματικά αιτήματα χρηστών.
Σε αυτό ακριβώς το πεδίο θέλει να ενισχυθεί η NVIDIA μέσω της Groq. Σύμφωνα με το CNBC, η εταιρεία σχεδιάζει να έχει τα πρώτα racks που αξιοποιούν την τεχνολογία της Groq online και διαθέσιμα για πελάτες πριν από το τέλος του 2026, αρκετούς μήνες μετά τη συμφωνία ύψους περίπου 20 δισ. δολαρίων. Η ταχύτητα με την οποία προχωρά η ανάπτυξη δείχνει ότι η NVIDIA δεν αντιμετωπίζει τη συμφωνία ως μια απλή εξαγορά τεχνολογίας για μελλοντική χρήση. Θέλει να τη μετατρέψει γρήγορα σε εμπορικό προϊόν.
Γιατί η NVIDIA ενδιαφέρεται τόσο πολύ για τη Groq;
Η Groq έγινε γνωστή επειδή ανέπτυξε μια διαφορετική προσέγγιση στα chips για την τεχνητή νοημοσύνη. Αντί να χρησιμοποιεί GPUs γενικής χρήσης, δημιούργησε επεξεργαστές ειδικά σχεδιασμένους για συγκεκριμένα AI workloads, ιδιαίτερα για την εκτέλεση μεγάλων γλωσσικών μοντέλων.
Η βασική ιδέα είναι σχετικά απλή: η εκπαίδευση ενός μοντέλου είναι μια τεράστια και εξαιρετικά απαιτητική διαδικασία που μπορεί να διαρκέσει εβδομάδες ή μήνες. Το inference είναι το στάδιο που ακολουθεί. Κάθε φορά που ένας χρήστης στέλνει μια ερώτηση σε ένα chatbot, ζητά από έναν AI agent να εκτελέσει μια εργασία ή χρησιμοποιεί μια εφαρμογή που βασίζεται σε ένα μοντέλο AI, το σύστημα πραγματοποιεί inference.
Αυτό σημαίνει ότι, καθώς η χρήση της AI εξαπλώνεται, το inference μπορεί να εξελιχθεί σε μια αγορά τεράστιας κλίμακας. Και σε αυτή την αγορά, η απόλυτη υπολογιστική ισχύς δεν είναι το μοναδικό ζητούμενο. Εξίσου σημαντικά είναι η χαμηλή καθυστέρηση, η κατανάλωση ενέργειας και το κόστος ανά αίτημα.
Η Groq είχε αναπτύξει την τεχνολογία της ακριβώς με στόχο αυτού του είδους τις εφαρμογές.
Η συμφωνία των 20 δισ. δολαρίων
Η συμφωνία της NVIDIA με τη Groq, που αποκαλύφθηκε τον Δεκέμβριο του 2025, είχε εκτιμώμενη αξία περίπου 20 δισ. δολαρίων. Η δομή της δεν ήταν μια απλή παραδοσιακή εξαγορά ολόκληρης της εταιρείας. Η NVIDIA απέκτησε περιουσιακά στοιχεία και εξασφάλισε μη αποκλειστική άδεια για την τεχνολογία inference της Groq, ενώ σημαντικά στελέχη, μεταξύ των οποίων και ο ιδρυτής Jonathan Ross, εντάχθηκαν στη NVIDIA. Η Groq συνέχισε να υπάρχει ως ανεξάρτητη εταιρεία και το cloud business της δεν αποτέλεσε μέρος της συμφωνίας.
Το μέγεθος του ποσού δείχνει ότι η NVIDIA δεν αγόρασε απλώς πατέντες. Απέκτησε πρόσβαση σε μια διαφορετική αρχιτεκτονική και σε μια ομάδα μηχανικών με εξειδίκευση σε έναν τομέα που μπορεί να γίνει εξίσου σημαντικός με την εκπαίδευση των μεγάλων μοντέλων.
Η Groq είχε ήδη καταφέρει να δημιουργήσει ισχυρή φήμη στον χώρο της AI inference, παρουσιάζοντας πολύ υψηλές ταχύτητες στην παραγωγή tokens. Το βασικό πλεονέκτημα της αρχιτεκτονικής της ήταν η δυνατότητα να προσφέρει εξαιρετικά γρήγορη απόκριση σε εφαρμογές όπου η καθυστέρηση είναι κρίσιμος παράγοντας.
Η Groq γίνεται μέρος της εποχής Vera Rubin
Η σημαντικότερη λεπτομέρεια της ανακοίνωσης είναι ότι η τεχνολογία της Groq δεν θα λειτουργεί απομονωμένα από την υπόλοιπη στρατηγική της NVIDIA. Η νέα Groq 3 LPX εντάσσεται στην ευρύτερη πλατφόρμα Vera Rubin, τη νέα γενιά υποδομών AI της εταιρείας, η οποία συνδυάζει τους επεξεργαστές Vera με τις GPUs Rubin.
Η NVIDIA θέλει να δημιουργήσει ένα πιο εξειδικευμένο σύστημα, όπου διαφορετικοί επεξεργαστές αναλαμβάνουν διαφορετικά στάδια των AI workloads. Οι Rubin GPUs μπορούν να αναλαμβάνουν την εκπαίδευση μοντέλων και γενικότερα ιδιαίτερα απαιτητικές εργασίες, ενώ η Groq 3 LPX στοχεύει κυρίως στο λεγόμενο decode phase του inference: το στάδιο κατά το οποίο ένα μεγάλο γλωσσικό μοντέλο παράγει τα tokens της απάντησής του.
Αυτό έχει ιδιαίτερη σημασία για εφαρμογές όπου η ταχύτητα απόκρισης είναι κρίσιμη. Ένα AI chatbot, ένας agent που εκτελεί ενέργειες σε πραγματικό χρόνο ή ένα σύστημα παραγωγής κώδικα δεν χρειάζεται μόνο μεγάλη υπολογιστική ισχύ. Χρειάζεται και όσο το δυνατόν μικρότερη καθυστέρηση ανάμεσα στο αίτημα του χρήστη και στην παραγωγή της απάντησης.
Σύμφωνα με τις διαθέσιμες πληροφορίες, κάθε Groq LPX rack θα συνδυάζει 256 Groq 3 LPX chips, ενώ τα πρώτα συστήματα θα αναπτυχθούν από τη Nebius μέσω της υπηρεσίας Nebius Token Factory. Εκεί θα λειτουργήσουν μαζί με Vera CPUs και Rubin GPUs, δείχνοντας στην πράξη πώς η NVIDIA σχεδιάζει να συνδυάζει διαφορετικές αρχιτεκτονικές μέσα στην ίδια AI υποδομή.
Με αυτή τη λογική, η συμφωνία των περίπου 20 δισ. δολαρίων με τη Groq αποκτά ακόμη μεγαλύτερη σημασία. Η NVIDIA δεν αγόρασε απλώς μια τεχνολογία inference για να προσθέσει έναν ακόμη accelerator στο χαρτοφυλάκιό της. Προσπαθεί να ενσωματώσει την εξειδικευμένη αρχιτεκτονική της Groq στη γενιά Vera Rubin, δημιουργώντας ένα σύστημα όπου η κατάλληλη μονάδα αναλαμβάνει το κατάλληλο μέρος του AI workload.
Αυτό ίσως είναι και το πραγματικό στοίχημα της επόμενης γενιάς AI data centers. Αντί για μια ενιαία αρχιτεκτονική που θα προσπαθεί να κάνει τα πάντα, οι υποδομές μπορεί να εξελιχθούν σε ένα σύνολο εξειδικευμένων επεξεργαστών: CPUs για ορισμένες εργασίες, GPUs για training και μεγάλα workloads και ειδικούς inference accelerators, όπως η Groq 3 LPX, για τα πιο ευαίσθητα στη χρονική καθυστέρηση στάδια.
Η NVIDIA, επομένως, δεν παρουσιάζει τη Groq ως αντικαταστάτη των GPUs της. Τη χρησιμοποιεί ως ακόμη ένα κομμάτι του παζλ Vera Rubin. Και αυτή η λεπτομέρεια ίσως είναι σημαντικότερη από την ίδια την είδηση ότι τα πρώτα Groq racks θα βρεθούν online μέσα στο 2026.
Η πραγματική δοκιμασία αρχίζει όταν μπουν οι πελάτες
Το γεγονός ότι τα πρώτα Groq racks θα βρεθούν online μέσα στο 2026 είναι σημαντικό, αλλά η πραγματική επιτυχία θα κριθεί αργότερα.
Η NVIDIA θα πρέπει να αποδείξει ότι η τεχνολογία μπορεί να ενσωματωθεί αποτελεσματικά στο τεράστιο οικοσύστημα που έχει ήδη δημιουργήσει γύρω από τις GPUs της. Ένα γρήγορο chip από μόνο του δεν αρκεί. Οι πελάτες χρειάζονται εργαλεία ανάπτυξης, λογισμικό, εύκολη διαχείριση και δυνατότητα να συνδυάζουν διαφορετικά είδη hardware μέσα στα ίδια data centers.
Εδώ η NVIDIA διαθέτει ένα τεράστιο πλεονέκτημα. Αν καταφέρει να ενσωματώσει την τεχνολογία της Groq στο υπάρχον λογισμικό και data center οικοσύστημά της, μπορεί να προσφέρει στους πελάτες μια ευρύτερη γκάμα επιλογών χωρίς να τους αναγκάζει να εγκαταλείψουν την υπόλοιπη υποδομή NVIDIA.
Μια συμφωνία που μπορεί να δείξει το μέλλον της αγοράς AI chips
Η εξέλιξη αυτή είναι σημαντική και για έναν ακόμη λόγο. Για χρόνια, η συζήτηση γύρω από την AI υποδομή επικεντρωνόταν κυρίως στο ποιος διαθέτει τις πιο ισχυρές GPUs για την εκπαίδευση μοντέλων.
Η επόμενη φάση, όμως, μπορεί να αφορά περισσότερο το ερώτημα: ποιος μπορεί να εκτελεί AI μοντέλα ταχύτερα, φθηνότερα και με χαμηλότερη κατανάλωση ενέργειας;
Η συμφωνία με τη Groq δείχνει ότι η NVIDIA θεωρεί αυτή τη μετάβαση αρκετά σημαντική ώστε να επενδύσει περίπου 20 δισ. δολάρια. Και το γεγονός ότι τα πρώτα racks αναμένεται να μπουν σε λειτουργία μέσα στο 2026 σημαίνει ότι η εταιρεία δεν θέλει να περιμένει χρόνια για να δει το αποτέλεσμα.
Η μεγάλη μάχη των AI chips δεν τελειώνει με την εκπαίδευση των μοντέλων. Αντίθετα, η επόμενη μάχη ίσως ξεκινά τη στιγμή που αυτά τα μοντέλα πρέπει να εξυπηρετήσουν εκατομμύρια πραγματικούς χρήστες. Και η NVIDIA θέλει η Groq να αποτελέσει ένα από τα σημαντικότερα όπλα της σε αυτή τη νέα εποχή του AI inference.








