Nvidia se pregătește pentru lupta de inferență, dezvoltând un cip bazat pe tehnologiile Groq pentru OpenAI și agenții AI.

Nvidia se pregătește pentru lupta de inferență, dezvoltând un cip bazat pe tehnologiile Groq pentru OpenAI și agenții AI.

22 hardware

Un nou cip Nvidia – pas spre aplicații AI mai rapide

Nvidia intenționează să lanseze în martie un procesor creat special pentru accelerarea inferenței (calculuri ale modelelor deja antrenate) și orientat către clienți precum OpenAI. Aceasta reprezintă o schimbare de direcție a companiei, care anterior era predominant axată pe antrenamentul sistemelor AI.

Ce va apărea
- Noua platformă va fi prezentată la conferința dezvoltatorilor GTC (Graphics Technology Conference).

- În nucleul platformei va intra un cip de la startup-ul Groq – una dintre cele mai rapide soluții pentru inferență.

- Platforma trebuie să concureze cu acceleratoarele proprii ale Google și Amazon, care au obținut deja rezultate semnificative.

De ce contează
Pe măsură ce popularitatea „web‑codării” (generarea de cod AI din text) crește, cererea pentru infrastructură rapidă și eficientă energetic se intensifică.

Pentru OpenAI, noul procesor devine un factor cheie:

- În ianuarie compania a semnat un acord cu Cerebras pentru un cip orientat spre inferență, pe care îl consideră mai rapid decât concurenții.

- În ziua precedentă, OpenAI a anunțat o tranzacție majoră cu Nvidia, în cadrul căreia au obținut „capacități dedicate pentru inferență” și au investit 30 de miliarde de dolari din partea unui producător „verde”.

Condiții competitive
| Companie | Produs | Orientare |
|----------|--------|-----------|
| Nvidia | GPU-urile din familiile Hopper, Blackwell, Rubin | Antrenament și inferență |
| Google | TPU | Inferență |
| Amazon | Trainium | Inferență |
| Cerebras | Chip specializat | Inferență |
| Groq | Chipe cu „blocuri de procesare a limbajului” | Inferență |

Nvidia deține peste 90% din piața GPU-urilor, însă cipurile sale sunt adesea considerate scumpe și consumatoare de energie pentru sarcinile de inferență. Aceasta atrage atenția companiilor care caută alternative.

Aplicații cheie
- Generare de cod: serviciile Claude Code (Anthropic) și Codex (OpenAI) utilizează infrastructuri cloud Amazon și Google, dar Codex intenționează să treacă la noua platformă Nvidia.

- Targetarea publicității: Meta colaborează cu Nvidia pentru inferența sistemelor AI, unde procesoarele centrale se dovedește a fi cele mai eficiente.

Concluzie
Nvidia nu doar extinde gama de produse, ci intră și în competiție directă cu gigantele industriei. Noul cip integrat cu startup-ul Groq ar putea deveni factorul decisiv pentru companiile care doresc o procesare AI mai rapidă și mai economică.

Comentarii (0)

Împărtășește-ți opinia — te rugăm să fii politicos și să rămâi la subiect.

Încă nu există comentarii. Lasă un comentariu și împărtășește-ți opinia!

Pentru a lăsa un comentariu, autentifică-te.

Autentifică-te pentru a comenta