ΑρχικήGoogleΗ Google αντεπιτίθεται στην OpenAI – Αυτό είναι το νέο Gemini 4...

Η Google αντεπιτίθεται στην OpenAI – Αυτό είναι το νέο Gemini 4 Argon

Loading

Σύνοψη

  • Η Google παρουσίασε το Gemini 4 Argon, το νέο κορυφαίο μοντέλο τεχνητής νοημοσύνης της.
  • Η εταιρεία το σχεδιάζει για σύνθετες εργασίες στον προγραμματισμό, την επιχειρηματική έρευνα, τα οικονομικά, τη νομική και την κυβερνοασφάλεια.
  • Μπορεί να παράγει έως 1 εκατομμύριο tokens, έναντι 64.000 στα προηγούμενα μοντέλα.
  • Η Google υποστηρίζει ότι βρίσκεται στην κορυφή σε αρκετά απαιτητικά benchmarks, αν και σε ορισμένες δοκιμές κώδικα οι ανταγωνιστές παραμένουν ισχυροί.
  • Το Argon έχει ήδη χρησιμοποιηθεί εσωτερικά από χιλιάδες εργαζομένους της Google για πραγματικές εργασίες.
  • Δεν είναι ακόμη διαθέσιμο για όλους. Η πρώτη πρόσβαση δίνεται σε επιλεγμένους ειδικούς κυβερνοασφάλειας.
  • Η Google ετοιμάζει σταδιακή διάθεση σε προγραμματιστές, επιχειρήσεις και καταναλωτές, ξεκινώντας από πελάτες API και συνδρομητές Google AI Ultra.

Η Google επιστρέφει δυναμικά στη μάχη των κορυφαίων μοντέλων τεχνητής νοημοσύνης με το Gemini 4 Argon, ένα σύστημα που δεν έχει σχεδιαστεί απλώς για να απαντά σε ερωτήσεις, αλλά για να αναλαμβάνει πολύπλοκες εργασίες που μπορούν να διαρκούν για μεγάλο χρονικό διάστημα.

Η νέα έκδοση αποτελεί την προσπάθεια της Google να ανταγωνιστεί τα πιο προηγμένα μοντέλα των OpenAI και Anthropic σε έναν αγώνα που πλέον δεν κρίνεται μόνο από το ποιος γράφει καλύτερα κείμενα. Το πραγματικό πεδίο μάχης είναι ο προγραμματισμός, η αυτόνομη εκτέλεση πολλών βημάτων, η ανάλυση επιχειρηματικών δεδομένων και η κυβερνοασφάλεια.

Το Gemini 4 Argon μπορεί να «σκέφτεται» για πολύ μεγαλύτερο διάστημα

Μία από τις σημαντικότερες αλλαγές βρίσκεται στο μέγεθος της απάντησης που μπορεί να δημιουργήσει το μοντέλο. Η Google αύξησε το όριο εξόδου στο 1 εκατομμύριο tokens, από μόλις 64.000 στα προηγούμενα μοντέλα.

Με απλά λόγια, αυτό επιτρέπει στο Argon να διαχειρίζεται πολύ μεγαλύτερες και πιο σύνθετες εργασίες χωρίς να χρειάζεται να σταματά συνεχώς και να περιμένει νέα εντολή. Ένα τέτοιο μοντέλο μπορεί να αναλύσει μεγάλο όγκο κώδικα, να σχεδιάσει μια λύση, να την ελέγξει, να εντοπίσει προβλήματα και να συνεχίσει με διορθώσεις μέσα στην ίδια διαδικασία.

Αυτό είναι ιδιαίτερα σημαντικό για τους λεγόμενους AI agents, δηλαδή συστήματα που δεν περιορίζονται στην παραγωγή μιας απάντησης αλλά μπορούν να εκτελούν μια σειρά ενεργειών για να ολοκληρώσουν έναν στόχο.

Η Google το χρησιμοποιεί ήδη για τον δικό της κώδικα

Η Google δεν παρουσιάζει το Argon μόνο μέσα από benchmarks. Αναφέρει ότι το μοντέλο χρησιμοποιείται ήδη από χιλιάδες εργαζομένους της σε πραγματικές εργασίες.

Ένα χαρακτηριστικό παράδειγμα αφορά τα data centers της εταιρείας. Σύμφωνα με τη Google, agents βασισμένοι στο Argon ανέλυσαν δεδομένα από ολόκληρο τον στόλο υποδομών της και εντόπισαν τρόπους βελτιστοποίησης της χρήσης μνήμης. Μετά την εφαρμογή των αλλαγών, η εταιρεία υπολογίζει ότι απελευθερώθηκαν περισσότερα από 300 TiB μνήμης, ενώ η συνολική εξοικονόμηση θα μπορούσε να φτάσει από 500 TiB έως 1 PiB.

Το δεύτερο μεγάλο παράδειγμα αφορά τον προγραμματισμό. Agents του Argon χρησιμοποιούνται για τη μεταφορά μεγάλων τμημάτων κώδικα από C/C++ σε Rust, μια γλώσσα προγραμματισμού που προσφέρει μεγαλύτερη έμφαση στην ασφάλεια της μνήμης. Η Google αναφέρει ότι η διαδικασία αφορά από δεκάδες χιλιάδες γραμμές κώδικα έως και περισσότερες από 800.000 γραμμές στον πυρήνα του λειτουργικού συστήματος Fuchsia.

Η κυβερνοασφάλεια είναι ίσως το πιο ενδιαφέρον κομμάτι

Εκεί όμως που η Google θέλει να διαφοροποιήσει πραγματικά το Argon είναι η κυβερνοασφάλεια.

Το μοντέλο έχει εκπαιδευτεί ώστε να μπορεί να εντοπίζει, να επιβεβαιώνει και να βοηθά στην επιδιόρθωση κρίσιμων ευπαθειών λογισμικού. Στις δοκιμές της Google, το Argon εντόπισε ευπάθειες σε σύνθετες βάσεις κώδικα που περιλάμβαναν 20 διαφορετικές γλώσσες προγραμματισμού.

Η εταιρεία υποστηρίζει επίσης ότι το μοντέλο μπορεί να αναλύει πραγματικά διαδικτυακά συστήματα χωρίς να έχει πρόσβαση στον πηγαίο κώδικά τους, αναζητώντας πιθανά σημεία επίθεσης και δημιουργώντας δοκιμές για την επιβεβαίωση των ευρημάτων.

Στο CWE-bench v1, μια δοκιμή που αξιολογεί την ικανότητα AI μοντέλων να διορθώνουν ευπάθειες, το Argon πέτυχε 68%. Η Google αναφέρει ότι η επίδοση αυτή το τοποθετεί στην κορυφή μαζί με άλλο προηγμένο μοντέλο της εταιρείας.

Τα benchmarks δείχνουν ισχυρό ανταγωνισμό

Η Google παρουσιάζει το Gemini 4 Argon ως μοντέλο κορυφαίου επιπέδου σε πολλές κατηγορίες. Στις δικές της αξιολογήσεις εμφανίζεται ιδιαίτερα ισχυρό σε σύνθετη λογική, μεγάλες εργασίες, πολυτροπική κατανόηση και κυβερνοασφάλεια.

Για παράδειγμα, στο LVBench, που εξετάζει την κατανόηση μεγάλων βίντεο, η Google αναφέρει επίδοση 91,7%. Στο GraphWalks, με περιβάλλοντα έως και 1 εκατομμύριο tokens, το Argon φτάνει το 84,2% στη δυσκολότερη δοκιμή μεγάλης διάρκειας.

Ωστόσο, χρειάζεται προσοχή όταν διαβάζουμε τέτοιες συγκρίσεις. Τα benchmarks επιλέγονται και εκτελούνται με συγκεκριμένες μεθοδολογίες, ενώ η ίδια η Google σημειώνει ότι το Argon δεν βρίσκεται στην κορυφή σε κάθε κατηγορία. Σε ορισμένες δοκιμές προγραμματισμού, για παράδειγμα, ανταγωνιστικά μοντέλα παρουσιάζουν καλύτερες επιδόσεις.

Το πραγματικό τεστ επομένως θα είναι η χρήση του μοντέλου σε πραγματικές εφαρμογές και όχι μόνο οι αριθμοί των benchmarks.

Και πάλι, η Google δεν το ανοίγει αμέσως σε όλους

Το πιο ενδιαφέρον στοιχείο της ανακοίνωσης είναι ίσως αυτό που δεν συνέβη.

Η Google δεν έκανε άμεση δημόσια κυκλοφορία του Gemini 4 Argon. Αρχικά το διαθέτει σε επιλεγμένους ειδικούς κυβερνοασφάλειας μέσω του Fairwind Program, ενώ παράλληλα χρησιμοποιεί το μοντέλο εσωτερικά.

Η επιλογή αυτή συνδέεται άμεσα με τις αυξημένες δυνατότητες του Argon. Ένα μοντέλο που μπορεί να εντοπίζει πραγματικές ευπάθειες και να εκτελεί σύνθετες εργασίες προγραμματισμού μπορεί να χρησιμοποιηθεί τόσο για άμυνα όσο και για κακόβουλες δραστηριότητες.

Η Google αναφέρει ότι ενισχύει τα συστήματα ασφαλείας πριν από την ευρύτερη κυκλοφορία, με ελέγχους για κακόβουλη χρήση, προστασία από επιθέσεις prompt injection, παρακολούθηση πιθανής απόκλισης της συμπεριφοράς του μοντέλου και αυστηρότερα απομονωμένα περιβάλλοντα για δοκιμές υψηλού κινδύνου.

Πόσο θα κοστίζει

Η Google επιχειρεί παράλληλα να κάνει το Argon ανταγωνιστικό και στο κόστος.

Η αρχική τιμή για το API είναι 2 δολάρια ανά εκατομμύριο tokens εισόδου και 10 δολάρια ανά εκατομμύριο tokens εξόδου, με σημαντική έκπτωση για tokens που βρίσκονται ήδη στην προσωρινή μνήμη. Μετά την introductory περίοδο, οι τιμές αυξάνονται στα 4 και 20 δολάρια αντίστοιχα.

Αυτό έχει ιδιαίτερη σημασία για επιχειρήσεις που θέλουν να χρησιμοποιούν AI agents σε μεγάλη κλίμακα. Όσο τα μοντέλα γίνονται ικανά να εκτελούν ολόκληρες εργασίες αντί για μεμονωμένες απαντήσεις, το κόστος ανά εργασία γίνεται σημαντικότερο από το απλό κόστος ανά ερώτηση.

Η μάχη Google, OpenAI και Anthropic περνά σε άλλη εποχή

Το Gemini 4 Argon δείχνει ότι η μάχη στην κορυφή της AI δεν αφορά πλέον αποκλειστικά την παραγωγή καλύτερου κειμένου ή τη δημιουργία εντυπωσιακών εικόνων.

Το επόμενο στάδιο είναι τα μοντέλα να μπορούν να αναλάβουν ολόκληρες αλυσίδες εργασιών: να κατανοούν ένα πρόβλημα, να γράφουν κώδικα, να τον ελέγχουν, να κάνουν έρευνα, να χρησιμοποιούν εργαλεία, να εντοπίζουν λάθη και να συνεχίζουν μέχρι να ολοκληρώσουν τον στόχο.

Αυτό είναι και το σημείο όπου το Gemini 4 Argon αποκτά ιδιαίτερη σημασία. Η Google δεν προσπαθεί απλώς να παρουσιάσει ένα ακόμη καλύτερο chatbot. Θέλει να δημιουργήσει ένα μοντέλο που μπορεί να λειτουργεί περισσότερο σαν ψηφιακός συνεργάτης, ειδικά για προγραμματιστές και επιχειρήσεις.

Το αν το Argon θα αποδειχθεί πράγματι το ισχυρότερο μοντέλο της αγοράς θα κριθεί τους επόμενους μήνες, όταν η πρόσβαση ανοίξει και θα υπάρχουν περισσότερες ανεξάρτητες δοκιμές. Αυτό που είναι ήδη ξεκάθαρο είναι ότι η Google ανεβάζει ξανά σημαντικά τον πήχη της AI και, αυτή τη φορά, το κάνει με ένα μοντέλο σχεδιασμένο όχι απλώς να απαντά, αλλά να δουλεύει.

How useful was this post?

Click on a star to rate it!

Average rating 0 / 5. Vote count: 0

No votes so far! Be the first to rate this post.

George S. Metallidis
George S. Metallidishttps://techlog.gr
Όλα ξεκίνησαν το 1988 όταν μπήκε στο σπίτι το πρώτο PC ένας 32bit 80386 με 4mb ram, CGA γραφικά σε 16colours monitor....και φυσικά λιώσιμο με το DOS game Grand Prix Circuit της Accolade
Σχετικά άρθρα

Η NVIDIA παγιδεύτηκε στη μέση του πολέμου ΗΠΑ–Κίνας για την AI

0
Η NVIDIA βρίσκεται ανάμεσα στις πιέσεις των ΗΠΑ για περιορισμό της πρόσβασης της Κίνας σε προηγμένα AI chips και στους περιορισμούς του Πεκίνου στις αμερικανικές τεχνολογίες.

ΑΦΗΣΤΕ ΜΙΑ ΑΠΑΝΤΗΣΗ

εισάγετε το σχόλιό σας!
παρακαλώ εισάγετε το όνομά σας εδώ

ΔΕΙΤΕ ΑΚΟΜΑ!