Η Google παρουσίασε το Gemma 4, τη νεότερη γενιά της οικογένειας μοντέλων ανοικτού βάρους, σε τέσσερα μεγέθη που έχουν σχεδιαστεί για να καλύπτουν τα πάντα, από την εκτέλεση στο smartphone έως τις αναπτύξεις επιπέδου workstation. Τα μοντέλα έχουν κατασκευαστεί με την ίδια έρευνα και τεχνολογία που υποστηρίζει το Gemini 3, το ιδιόκτητο μοντέλο αιχμής της Google και κυκλοφορούν υπό την άδεια Apache 2.0, έναν πιο επιτρεπτικό όρο από τις προηγούμενες γενιές Gemma, μια αλλαγή που ο συνιδρυτής του Hugging Face, Clément Delangue, περιέγραψε ως “ένα τεράστιο ορόσημο.”
Δείτε επίσης: Υποστήριξη Google Cast κυκλοφορεί στις τηλεοράσεις Samsung

Ο Διευθύνων Σύμβουλος της Google DeepMind, Demis Hassabis, χαρακτήρισε τα νέα μοντέλα “τα καλύτερα ανοικτά μοντέλα στον κόσμο για τα αντίστοιχα μεγέθη τους.” Οι τέσσερις παραλλαγές είναι τα μοντέλα Effective 2B (E2B) και Effective 4B (E4B), σχεδιασμένα να εκτελούνται σε συσκευές όπως τα τηλέφωνα, το Raspberry Pi και το Jetson Nano, που αναπτύχθηκαν σε συνεργασία με την ομάδα Pixel, την Qualcomm και τη MediaTek.
Τα μοντέλα 26B Mixture-of-Experts (MoE) και 31B Dense απευθύνονται σε offline χρήση σε hardware προγραμματιστών και καταναλωτικές GPUs. Το μοντέλο 31B Dense κατατάσσεται αυτή τη στιγμή τρίτο μεταξύ όλων των ανοικτών μοντέλων στον πίνακα κατάταξης κειμένου Arena AI, ενώ το 26B MoE βρίσκεται στην έκτη θέση.
Η Google ισχυρίζεται ότι και τα δύο μεγαλύτερα μοντέλα υπερτερούν μοντέλων έως και 20 φορές μεγαλύτερου μεγέθους σε αυτό το benchmark. Τα μη ποσοτικοποιημένα βάρη του 31B χωρούν σε μία μόνο GPU Nvidia H100 80GB, ενώ οι ποσοτικοποιημένες εκδόσεις εκτελούνται σε καταναλωτικό hardware. Και τα τέσσερα μοντέλα είναι πολυτροπικά, επεξεργάζονται εγγενώς βίντεο και εικόνες και έχουν εκπαιδευτεί σε περισσότερες από 140 γλώσσες.
Δείτε ακόμα: Google Home update: Καλύτερη κατανόηση εντολών από το Gemini

Τα μοντέλα E2B και E4B υποστηρίζουν επιπλέον εγγενή είσοδο ήχου για αναγνώριση ομιλίας. Τα παράθυρα περιεχομένου είναι 128K tokens για τα μοντέλα edge και 256K για τις δύο μεγαλύτερες παραλλαγές. Όσον αφορά τις δυνατότητες, η Google επισημαίνει βελτιώσεις στη λογική πολλαπλών βημάτων, εγγενή κλήση λειτουργιών και δομημένη έξοδο JSON για agentic workflows και offline δημιουργία κώδικα. Όσον αφορά την απόδοση, το Android Developers Blog σημειώνει ότι το μοντέλο E2B εκτελείται τρεις φορές πιο γρήγορα από το E4B, ενώ η οικογένεια edge συνολικά είναι έως και τέσσερις φορές πιο γρήγορη από τις προηγούμενες εκδόσεις Gemma και χρησιμοποιεί έως και 60% λιγότερη μπαταρία.
Τα μοντέλα E2B και E4B αποτελούν επίσης τη βάση για το Gemini Nano 4, το επόμενης γενιάς μοντέλο της Google για Android, το οποίο θα φτάσει στις καταναλωτικές συσκευές αργότερα φέτος. Το Gemma έχει συγκεντρώσει περισσότερες από 400 εκατομμύρια λήψεις και πάνω από 100.000 παραλλαγές που δημιουργήθηκαν από την κοινότητα από την πρώτη του κυκλοφορία, ένα στοιχείο που η Google επισημαίνει ως απόδειξη της υιοθέτησης από τους προγραμματιστές σε κλίμακα.
Δείτε επίσης: Google Drive: AI ανίχνευση ransomware για όλους τους συνδρομητές

Το Gemma 4 είναι άμεσα διαθέσιμο στο Hugging Face, το Kaggle και το Ollama, με τα μοντέλα 31B και 26B να είναι προσβάσιμα μέσω του Google AI Studio και τα μοντέλα edge μέσω της AI Edge Gallery. Η απόφαση για την άδεια Apache 2.0 είναι το πιο σημαντικό εμπορικό σήμα στην κυκλοφορία: αφαιρεί περιορισμούς που εμπόδιζαν ορισμένες επιχειρηματικές και εμπορικές αναπτύξεις υπό τους προηγούμενους όρους Gemma, ανοίγοντας το οικοσύστημα σε ένα ευρύτερο φάσμα περιπτώσεων παραγωγικής χρήσης.
