OpenAI și Broadcom au prezentat Jalapeño, primul cip dedicat exclusiv inference-ului AI

Jalapeño nu este un cip adaptat dintr-o arhitectură anterioară. A fost construit de la zero, gândit exclusiv pentru inference — procesul prin care modelele AI răspund comenzilor utilizatorilor. Spre deosebire de GPU-urile de uz general oferite de Nvidia sau AMD, cipul este un ASIC, adică un circuit integrat proiectat pentru un singur tip de sarcini.

Arhitectura sa vizează reducerea mișcărilor de date între procesoare și memoria externă, principala sursă de ineficiență în rularea modelelor de limbaj de mari dimensiuni. Jalapeño echilibrează resursele de calcul, memorie și rețelistică astfel încât utilizarea reală să se apropie cât mai mult de limita teoretică a cipului.

Nouă luni, de la schemă la producție

Ritmul de dezvoltare al Jalapeño este neobișnuit pentru industria semiconductoarelor. Cipul a parcurs drumul de la primele schițe până la tape-out — momentul în care proiectul este trimis la fabricație — în doar nouă luni. Ciclurile tradiționale de dezvoltare pentru un ASIC de înaltă performanță sunt măsurate de regulă în ani.

Viteza a fost posibilă parțial prin utilizarea propriilor modele AI ale OpenAI în procesul de proiectare. Președintele companiei, Greg Brockman, a declarat că nivelul la care modelele au accelerat proiectarea i-a surprins chiar și pe inginerii implicați. Procesul a creat o buclă în care inteligența artificială contribuie la construirea infrastructurii pe care urmează să ruleze.

Jalapeño OpenAI

Inference, nu antrenare

Jalapeño este conceput exclusiv pentru inference, nu pentru antrenarea modelelor AI. Distincția contează pentru strategia OpenAI: antrenarea consumă resurse masive, dar se desfășoară în perioade discrete. Inference-ul rulează continuu, de fiecare dată când un utilizator trimite o comandă în ChatGPT, Codex sau oricare alt produs al companiei.

Controlul costurilor de inference a devenit o prioritate tocmai pentru că reprezintă cheltuiala operațională recurentă. În 2025, OpenAI a cheltuit 19,18 miliarde de dolari pe cercetare și dezvoltare, reprezentând aproximativ 56% din totalul cheltuielilor. Numai pentru Microsoft a plătit peste 10,59 miliarde de dolari în același an, pentru servicii de calcul și infrastructură.

Jalapeño ar putea reduce costurile de inference cu aproximativ 50% față de alternativele actuale, potrivit estimărilor făcute publice de Broadcom. Cifrele exacte nu au fost validate independent, iar OpenAI a anunțat că un raport tehnic detaliat privind performanța va fi publicat în lunile următoare.

Deja rulează modele în laborator

Mostrele de inginerie ale cipului funcționează deja în laboratoarele OpenAI la frecvența și consumul de putere vizate pentru producție. Printre sarcinile de lucru testate se numără GPT-5.3-Codex-Spark. Compania susține că performanța per watt depășește substanțial nivelul hardware-ului actual de vârf, fără ca aceste afirmații să fie susținute de benchmark-uri independente.

Arhitectura cipului a fost proiectată de OpenAI. Broadcom a asigurat implementarea în siliciu și integrarea rețelisticii Tomahawk, iar Celestica se ocupă de integrarea la nivel de placă, rack și sisteme complete. Parteneriatul acoperă astfel întregul lanț, de la proiectare până la implementare la scară de producție.

O platformă pe mai multe generații

Jalapeño este primul produs al unui parteneriat pe termen lung, nu un proiect singular. Implementarea inițială este planificată pentru sfârșitul lui 2026, cu primele unități la scară de prototip, urmând să se extindă în anii următori. CEO-ul Broadcom, Hock Tan, a declarat că cererea de putere de calcul din partea clienților companiei este pur și simplu insațiabilă și că această tendință va continua cel puțin până în 2028.

Platforma Jalapeño urmează să fie desfășurată la scară de gigawatt alături de Microsoft și alți parteneri de centre de date.

Strategia full-stack și contextul IPO

Prin Jalapeño, OpenAI intră în categoria companiilor care controlează integral lanțul tehnologic — modele, produse și acum hardware. Google, Amazon și Microsoft au parcurs trasee similare cu propriile cipuri dedicate AI. Jalapeño este răspunsul OpenAI la nevoia de independență față de furnizorii externi, în special Nvidia, de la care compania cumpăra sau închiria capacitate de calcul la costuri ridicate.

Cipul este proiectat cu flexibilitate suficientă pentru a rula orice model de limbaj de mari dimensiuni, nu doar cele ale OpenAI. Compania prezintă acest lucru ca pe un avantaj strategic: infrastructura sa de inference ar putea deveni relevantă la nivelul mai larg al industriei.

Anunțul vine în contextul în care OpenAI se pregătește pentru o listare la bursă în 2026. Jalapeño reprezintă un semnal pentru investitori că firma are un plan concret de reducere a costurilor operaționale și de construire a unui avantaj propriu în hardware — un argument solid într-un moment în care cheltuielile companiei depășesc cu mult veniturile.

Marian Ciobanu
Marian Ciobanu

Marian Ciobanu, redactor-şef la Geeki.ro, pasionat de tehnologie, maşini, divertisment, ştiinţă şi jocuri video. A fost fondator și redactor-șef la BetIT (2014-2018), iar din 2019 conduce Geeki.ro, un portal de știri IT&C și articole despre Hi-Tech și gaming.

Articole: 6085

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *