Η Alphabet αναπτύσσει έναν νέο, εξαιρετικά εξειδικευμένο επεξεργαστή με την εσωτερική κωδική ονομασία “Frozen v2”, σύμφωνα με πληροφορίες που διέρρευσαν από το The Information, Η ειδοποιός διαφορά του σε σχέση με τα γενικής χρήσης TPUs (Tensor Processing Units) της εταιρείας έγκειται στο γεγονός ότι το Frozen v2 θα «παγώνει» (embed) βασικά τμήματα της αρχιτεκτονικής του μοντέλου Gemini κατευθείαν πάνω στο πυρίτιο.
Αυτός ο σκληρός επανασχεδιασμός hardware και software εκμηδενίζει τις απαιτούμενες μαθηματικές πράξεις και τη μεταφορά δεδομένων, επιτρέποντας στους μηχανικούς της Google να υπολογίζουν μια αύξηση της αποδοτικότητας κατά 6 έως 10 φορές (μετρούμενη σε παραγόμενα tokens ανά μονάδα ενέργειας). Το τίμημα, ωστόσο, είναι η απώλεια ευελιξίας. Το τσιπ θα μπορεί να εξυπηρετεί μελλοντικές εκδόσεις του Gemini μόνο εφόσον η Google διατηρήσει την ίδια βασική αρχιτεκτονική.
Η εταιρεία, σε δήλωσή της, απέφυγε να επιβεβαιώσει ή να διαψεύσει ρητά το έργο, σύμφωνα με το techcrunch.com, σημειώνοντας: «Οι ομάδες μας ερευνούν και πειραματίζονται συνεχώς με νέες καινοτομίες για να προσφέρουν μέγιστη απόδοση. Ο συν-σχεδιασμός υλικού και λογισμικού από την αρχή διασφαλίζει ότι τα συστήματά μας είναι πλήρως βελτιστοποιημένα για πραγματικά φορτία εργασίας».
Η κούρσα των Custom Chips και το deal-σοκ με τη SpaceX
Η στροφή της Google στο custom silicon δεν είναι μεμονωμένο φαινόμενο, αλλά μέρος μιας γενικευμένης προσπάθειας των κολοσσών της τεχνολογίας να απεξαρτηθούν από την κυριαρχία της Nvidia και να τιθασεύσουν τα υπέρογκα λειτουργικά έξοδα. Μόλις τον περασμένο μήνα, η OpenAI ανακοίνωσε τον δικό της επεξεργαστή inference με την ονομασία Jalapeño, ενώ η Anthropic βρίσκεται σε προχωρημένες συζητήσεις με τη Samsung για μια νέα παραγωγική συμμαχία.
Για την Alphabet, η ανάγκη για υπολογιστική ισχύ είναι κάτι παραπάνω από πιεστική. Η εσωτερική έλλειψη compute έφτασε σε σημείο να απειλεί τις εμπορικές δεσμεύσεις του Google Cloud, αναγκάζοντας την εταιρεία να υπογράψει μια πρωτοφανή συμφωνία με τη SpaceX, καταβάλλοντας σχεδόν 1 δισεκατομμύριο δολάρια τον μήνα για την ενοικίαση υπολογιστικών υποδομών.
Με τις σχεδιαζόμενες κεφαλαιουχικές δαπάνες (CapEx) της εταιρείας να εκτοξεύονται στα 180 με 190 δισεκατομμύρια δολάρια, το Frozen v2 -με ορίζοντα εφαρμογής το 2028- λειτουργεί ως μια πειστική απόδειξη προς τους επενδυτές ότι η Google διαθέτει στρατηγικό πλάνο απόσβεσης των δισεκατομμυρίων που διοχετεύει στην AI υποδομή.
Βαριές απώλειες, κινεζική απειλή και ρυθμιστικές πρωτοβουλίες
Παρά το μακροπρόθεσμο όραμα του Frozen v2, η Google αντιμετωπίζει άμεσους, σοβαρούς κινδύνους στο παρόν. Η επόμενη μεγάλη έκδοση του Gemini Pro αντιμετωπίζει σημαντικές καθυστερήσεις, την ώρα που η εταιρεία βιώνει κύμα διαρροής κορυφαίων ερευνητών προς ανταγωνιστικά labs.
Ταυτόχρονα, τα κινεζικά AI μοντέλα κερδίζουν επικίνδυνα έδαφος εντός των ΗΠΑ. Νέες εκδόσεις από παίκτες όπως η Moonshot AI και η Alibaba έκλεισαν αισθητά την ψαλίδα δυνατοτήτων, με τα κινεζικά μοντέλα να αντιπροσωπεύουν πλέον το 45% της συνολικής χρήσης tokens από αμερικανικές επιχειρήσεις.
Μέσα σε αυτό το τεταμένο σκηνικό, ο διευθύνων σύμβουλος της Google DeepMind, Demis Hassabis, πραγματοποιεί επαφές στο Καπιτώλιο. Ο Hassabis προτείνει στους Αμερικανούς νομοθέτες τη δημιουργία ενός ανεξάρτητου εποπτικού φορέα για την Τεχνητή Νοημοσύνη (στα πρότυπα της αρχής FINRA της Wall Street). Ο φορέας αυτός θα χρηματοδοτείται κυρίως από τη βιομηχανία και θα έχει ως στόχο την υποχρεωτική αξιολόγηση των πλέον προηγμένων μοντέλων για κινδύνους εθνικής ασφάλειας πριν από την επίσημη κυκλοφορία τους στην αγορά.
