Valitse maasi tai alueesi.

NVIDIA Aloittaa Groq 3 LPX Hyllyjen Täysimittaisen Tuotannon 20 Miljardin DOLLARIN Teknologiadiilin Myötä

Maanantaina 24. elokuuta NVIDIA ilmoitti, että Groq 3 LPX hyllyjärjestelmä on siirtynyt täysimittaiseen tuotantoon, mikä merkitsee kaupallista käyttöönottoa teknologialle, joka saatiin viime vuoden 20 miljardin dollarin Groq-liiketoiminnan kautta. Alun perin matalan viiveen AI-agenttien päätöksentekoon suunniteltu järjestelmä tulee olemaan osa Vera Rubin -alustaa ja se ratkaisee GPU-suorituskyvyssä esiintyviä rajoituksia tokenien generaation aikana.

Dion Harris, NVIDIA:n vanhempi johtaja, sanoi, että ensimmäiset Groq 3 LPX hyllyt otetaan käyttöön pilvipalveluntarjoaja Nebiuksen alustalla. Yhdistettynä Vera CPU:iden ja Rubin GPU:iden kanssa ne muodostavat täydellisen heterogeenisen laskentaklusterin, jonka odotetaan aloittavan palveluiden tarjoamisen vuoden 2026 toisella puoliskolla.

Jokainen LPX-hylly yhdistää 256 Groq 3 Kielenkäsittelyyksikköä, eli LPU:ita. Järjestelmä käyttää suuria määriä sirun sisäistä SRAM-muistia vähentääkseen ulkoisen muistin käytön aiheuttamaa ylikuormitusta ja se on optimoitu päätöksentekokuormituksiin, jotka vaativat pitkiä kontekstikkopsoja ja nopeita vastausaikoja, mukaan lukien AI-agentit ja AI-avusteinen ohjelmointi. Virallisten vertailutulosten mukaan hylly tuottaa 3 400 tulostokenia sekunnissa, kun se käyttää Gemma 4 31B -mallia 100 000-tokenin kontekstikkopsojen kanssa, mikä antaa sille selvän suorituskyky-edun viivettä herkillä kuormituksilla.

NVIDIA ja Groq saavuttivat 20 miljardin dollarin sopimuksen joulukuussa 2025. Sopimuksen perusteella NVIDIA sai käyttöoikeudet Groq:n siruarkkitehtuuriteknologiaan ja toi Groq:n perustajajoukon ja ydininsinöörit yritykseen. Se oli suurin teknologiadiili NVIDIA:n historiassa. Groq pysyi itsenäisenä yrityksenä, ja sen olemassa oleva pilviliiketoiminta jatkoi toimintaansa. Ennen sopimusta Groq oli jo saanut huomattavaa teollisuushuomiota matalan viiveen LPU-päätöksentekoteknologiansa ansiosta, jota käytettiin avoimen lähdekoodin suurissa kielimalleissa.

Vera Rubin -alusta käyttää hajautettua, heterogeenistä päätöksentekorakennetta. Rubin GPU:t käsittelevät mallin täyttötoimintoja ja suuria kontekstinkäsittelyjä, kun taas Groq 3 LPX -järjestelmät keskittyvät nopeaan tokenin generaatioon purkamisvaiheessa. Vera CPU:t suorittavat yleiskäyttöisiä kuormituksia, kuten työkalukutsuja ja koodin suorittamista. Tämä kuormitusten jakaminen mahdollistaa eri prosessorien tukemisen täydellisessä AI-agenttien työskentelyprosessissa niiden vahvuuksien mukaan.

Sirujen valmistusjärjestelyt heijastavat myös eroja toimitusketjussa. Groq-sarjan LPU:t valmistaa Samsung, kun taas NVIDIA:n valtavirran GPU:t valmistetaan TSMC:n valmistuskapasiteetilla.