Modele și platforme AI
Chipul Edge al lui Acrab are ca scop rularea modelelor AI de 100 miliarde de parametri local

Acrab, o companie din Singapore care a ieșit din stealth în iunie 2026 cu peste 350 de milioane de dolari în sprijin, a prezentat primul său silicon pe 23 iulie 2026: GΞLIX 1, un procesor de margine de 5 nanometri, alături de Agent Box, un sistem de birou construit în jurul acestuia. Ambele sunt îndreptate către același scop — rularea modelelor de inteligență artificială deschise în clasa a 100 de miliarde de parametri pe hardware suficient de mic pentru a fi plasat pe o masă, fără a trimite date prin intermediul unui serviciu de cloud.
Acesta este un pariu împotriva formei predominante a inteligenței artificiale generative, în care modelele de această dimensiune trăiesc în centre de date și utilizatorii plătesc pe token. Modelele de această scară au necesitat, în general, infrastructură de cloud; cazul lui Acrab este că economia și matematica privind confidențialitatea acum favorizează mutarea lor pe hardware local, unde răspunsurile se întorc mai repede, datele rămân pe dispozitiv și sistemul continuă să funcționeze atunci când rețeaua nu funcționează.
Acrab este condus de dr. Ken Phua, care a condus ingineria de aplicații din Asia la Arm și mai târziu a servit ca co-CEO al Arm China, iar chipul reflectă această linie de sânge. În loc să adauge un accelerator discret, GΞLIX 1 integrează CPU, GPU și NPU pe un singur die cu o singură piscină de memorie partajată. “Rularea modelelor din clasa a 100 de miliarde de parametri pe un sistem suficient de mic pentru a fi plasat pe o masă prezintă o provocare semnificativă de calcul”, a spus Phua.
În interiorul siliconului
GΞLIX 1 asociază un CPU Arm cu 20 de nuclei cu o unitate de procesare neurală multicore și 273 GB/s de lățime de bandă de memorie unificată, conform lui Acrab, și este construit pentru a răspândi un singur model mare pe toate cele trei blocuri de calcul simultan. Compania tratează lățimea de bandă a memoriei și timpul până la primul token (întârzierea înainte ca un model să înceapă să răspundă la o prompt lung) ca fiind constrângerile legate la această scară și spune că a ajustat chipul pentru a menține puterea la un nivel suficient de mic pentru a funcționa toată ziua.
Singurul număr de performanță pe care Acrab l-a dezvăluit este un număr al furnizorului, nu un test independent. În propriile teste de benchmarking, compania a raportat o rată de preumplere de 1.416,8 tokeni pe secundă împotriva a 188,9 pe un Mac Mini M4 Pro, sau aproximativ de 7,5 ori mai rapid, utilizând o configurație a modelului Gemma pe care o etichetează “26B A4B” cu o intrare de 10.000 de tokeni. Acest setup păstrează doar aproximativ 4 miliarde de parametri activi în același timp, mult sub limita de 100 de miliarde de parametri pe care se vinde chipul, și numărul acoperă doar preumplerea. Acrab nu a publicat niciun rezultat de decodificare și niciun rezultat MLPerf, astfel încât afirmația se bazează pe măsurătorile proprii ale companiei.
O cutie pe care o cumperi în loc de o factură pe care o plătești
Agent Box este primul produs construit pe această platformă și reprezintă cel mai puternic argument economic al companiei. Acrab îl prezintă ca o achiziție unică care elimină taxele recurente pe token ale inteligenței artificiale din cloud: rulează modele de limbaj și viziune local, păstrează o memorie persistentă a datelor utilizatorului pe dispozitiv și coordonează sarcinile pe sisteme conectate. Este destinat caselor și spațiilor de lucru personale, iar Acrab spune că devine mai personalizat pe măsură ce acumulează context. Prezentarea este cheltuială de capital în loc de o factură de exploatare — cumpără hardware-ul o singură dată, în loc să plătești pentru fiecare solicitare.
Ceea ce Acrab nu a spus este ce costă Agent Box, când va fi lansat sau care este fabrica care produce chipul de 5 nanometri. Acestea sunt numerele pe care un cumpărător le-ar necesita pentru a face o comparație reală. Până când nu există un preț și o dată de livrare, schimbul dintre un cost de hardware fix și o abonament cloud deschis rămâne o afirmație, nu o calculație.
O pariu mai larg pe margine
Prezentarea intră într-un domeniu disputat. Qualcomm (QCOM ) și Intel (INTC ) livrează deja procesoare neurale în calculatoare AI, iar o clasă de cutii AI de margine rulează modele mai mici pe dispozitiv astăzi; ceea ce Acrab susține că schimbă este plafonul parametrilor, mutând modele de 100 de miliarde de parametri pe un singur sistem local, în loc de modelele mult mai mici care rulează confortabil pe siliciul livrat în telefoane și laptopuri în prezent. Acrab spune că GΞLIX 1 și stiva sa de software sunt menite să servească ca o fundație orizontală pentru alți producători, cu planuri de a ajunge la cutii de stocare AI-rețea, calculatoare AI, vehicule inteligente, roboți industriali și de servicii. Ambiția se manifestă pe măsură ce conversația mai largă despre infrastructură se deplasează de la antrenament către inferență, și pe măsură ce producătorii de componente introduc mai mult siliciu în formate de margine și pe dispozitiv.
Compania a strâns peste 350 de milioane de dolari de la înființarea sa în 2024, un total pe care l-a dezvăluit în iunie 2026, cu sprijin inițial de la Vertex Ventures SEA & India și Vertex Growth, fondurile legate de Temasek, plus un investitor pe care îl identifică ca K3. Acrab spune că platforma GΞLIX a fost validată în implementări reale și se îndreaptă către prima adoptare industrială și producție de masă. Ceea ce nu a arătat încă este chipul rulează un model de 100 de miliarde de parametri la vitezele pe care se bazează prezentarea, măsurate de oricine altcineva decât Acrab.












