Filtrează articolele

AI

Cum să construiești mediul enterprise perfect pentru AI-ul agentic: Lecții de la Intel

Cum să construiești mediul enterprise perfect pentru AI-ul agentic: Lecții de la Intel
Inteligența artificială agentică promite să transforme modul în care întreprinderile își desfășoară activitatea, trecând dincolo de simplele chatbot-uri și devenind agenți software capabili să execute sarcini de business end-to-end, integrând oameni, fluxuri de lucru, date și sisteme. Însă, pentru a atinge acest potențial, companiile au nevoie de un mediu enterprise complet, în care agenții să poată planifica, să recupereze informații, să își amintească și să acționeze fiabil la scară largă. Intel, unul dintre giganții tehnologiei, a realizat mii de experimente pe sarcini de AI agentic pentru a înțelege mai bine dependențele și provocările implicate. Rezultatele lor oferă cinci lecții practice pentru liderii enterprise, care pot face diferența între un pilot nereușit și o adoptare la scară largă.

AI-ul agentic este mai mult decât inferență



Primul și cel mai important punct pe care Intel îl subliniază este că AI-ul agentic nu este doar o problemă de inferență a modelelor de limbaj (LLM). Valoarea sa enterprise depinde de întregul sistem: orchestrarea sarcinilor, accesul la date, execuția instrumentelor, gestionarea latenței, guvernanța și infrastructura scalabilă. Un agent este un proces de automatizare a fluxului de lucru orientat spre un obiectiv: planifică o sarcină în mai mulți pași, apelează instrumente, citește rezultatele și reîncearcă atunci când ceva eșuează. Prin urmare, agenții enterprise nu sunt doar o problemă de inferență, ci o problemă de sistem.

Majoritatea metricilor actuale pentru AI-ul agentic se concentrează pe evaluarea LLM-ului utilizat. Însă echipele de platformă au nevoie să știe cât durează sarcinile, câți agenți poate suporta un sistem, ce experiență au utilizatorii la finalul procesului și cum se modifică costurile pe măsură ce mai mulți agenți lucrează simultan. Împreună, acestea răspund la întrebările pe care operatorii de AI enterprise le consideră esențiale: Sistemul funcționează conform așteptărilor? Câți agenți poate susține sistemul? Cum ar trebui să se scaleze pentru a suporta mai mulți agenți?

Pentru a obține o perspectivă mai profundă asupra performanței sarcinilor de AI agentic, Intel a extins Terminal-Bench, un cadru open-source de evaluare a agenților AI, adăugând capabilități de profilare, telemetrie și reluare. Acest lucru a făcut posibilă înțelegerea unde își petrec agenții timpul dincolo de inferența LLM. Extensia a folosit o înregistrare și reluare deterministă a răspunsurilor LLM pentru a separa performanța agentului de variabilitatea LLM-ului. Răspunsurile au fost înregistrate o singură dată și reluate identic în toate rulările, reducând variațiile și creând o bază mai fiabilă pentru comparație.

Mixul de sarcini Terminal-Bench a fost intenționat larg: a inclus compilare, testare, operațiuni cu baze de date, logică booleană, interpretare, ray tracing, compresie, algebră liniară, transcodare video și antrenare machine learning. Această varietate face ca rezultatele să fie mai relevante pentru mediile enterprise reale.

AI-ul agentic în trei dimensiuni



Intel recomandă abordarea implementării AI-ului agentic în trei faze:

1. Planifică în termeni de densitate a agenților, nu de număr de agenți
Prima regulă de dimensionare este normalizarea numărului de agenți la resursele de calcul disponibile. Densitatea agenților, măsurată ca agenți per vCPU, este semnalul principal pentru saturație. De exemplu, 10 agenți pe un sistem cu 8 vCPU și 20 de agenți pe un sistem cu 16 vCPU se comportă similar dacă densitatea este aceeași. Acest lucru oferă arhitecților o modalitate portabilă de a compara capacitatea între diferite dimensiuni de instanțe și generații de procesoare. Densitatea potrivită depinde și de obiectivul de business. Copiloții interactivi și asistenții orientați către utilizator ar trebui să favorizeze o densitate mai mică, deoarece timpul de răspuns contează. Sarcinile batch, cum ar fi fluxurile de lucru IT, pot funcționa adesea la densitate mai mare. Acest lucru oferă echipelor o modalitate practică de a ajusta flotele în funcție de obiectivele nivelului de serviciu și costul total de proprietate.

2. AI-ul agentic necesită o nouă formă de observabilitate
Utilizarea medie a CPU-ului este un semnal slab de monitorizare a performanței pentru sarcinile agentice. Agenții alternează adesea între așteptarea răspunsurilor modelului și apoi scurte perioade de muncă intensivă din punct de vedere computațional. Din cauza acestui model „exploziv”, utilizarea medie poate părea acceptabilă chiar și atunci când aceste explozii creează cozi și încetinesc experiența utilizatorului. Latența sarcinii (P95) este o metrică mai bună, deoarece arată când fluxurile de lucru încep să aștepte, chiar înainte ca durata medie a sarcinii să se degradeze semnificativ. Un model operațional practic este să alertezi mai întâi pe baza latenței P95, apoi să confirmi problema analizând durata susținută a sarcinii.

3. Scalează orizontal (scale-out) în mod implicit
Scalarea orizontală adaugă mai multe sisteme, crescând capacitatea totală de agenți, în timp ce scalarea verticală (scale-up) adaugă nuclee sau memorie unui singur sistem pentru agenții cu explozii de calcul mai grele. Datele de testare ale Intel arată că scalarea orizontală este de obicei alegerea mai bună. Acest lucru se aliniază cu faptul că agenții sunt de obicei semi-independenți și au explozii modeste per agent, îmbunătățind performanța generală, suportând disponibilitatea ridicată, reducând adesea costurile și facilitând păstrarea raportului țintă agenți-per-vCPU pe măsură ce platforma crește. Scalarea verticală este recomandată atunci când agenții necesită calcule paralele mai grele, starea partajată limitează partiționarea, localitatea memoriei contează sau există constrângeri de licențiere.

Implicații de business: Unde creează valoare AI-ul agentic?



Organizațiile care obțin rezultate de producție înfășoară un strat de automatizare în jurul fluxurilor de lucru care au deja reguli codificate și niveluri de serviciu măsurabile: crearea de cod, ferme de testare a regresiei, trierea tichetelor, analiza pieței și revizuirea securității. Personajul enterprise ideal pentru AI-ul agentic nu este utilizatorul experimental care urmărește noutatea, ci liderul responsabil care trebuie să îmbunătățească timpul de ciclu și productivitatea, să protejeze calitatea serviciilor, să aplice politici și să scaleze adoptarea având în vedere costurile.

Valoarea AI-ului agentic provine din ajutorul acordat companiilor pentru a finaliza munca reală în echipe, sisteme, date și procese. Pentru enterprise, prioritatea nu este doar o performanță mai bună a modelului, ci crearea unui mediu fiabil în care agenții AI să poată sprijini fluxurile de lucru, să îmbunătățească productivitatea, să funcționeze în cadrul cerințelor de guvernanță și să se scaleze pe măsură ce adoptarea crește. În practică, succesul cu AI-ul agentic depinde de fundația potrivită pentru a oferi rezultate consistente, a gestiona costurile, a menține controlul și a trece cu încredere de la pilot la producție.

De ce este important:


Înțelegerea acestor lecții practice de la Intel este crucială pentru orice organizație care dorește să implementeze AI agentic la scară largă. Fără o abordare corectă a densității agenților, a observabilității și a scalării, riscați să investiți în infrastructură ineficientă, să aveți performanțe slabe și să nu puteți livra valoarea promisă. Aceste principii vă ajută să construiți un mediu enterprise robust, care să susțină agenți inteligenți fiabili, să optimizeze costurile și să asigure o experiență utilizator de calitate. Pe măsură ce AI-ul agentic devine din ce în ce mai prezent în operațiunile de business, a avea o fundație solidă nu mai este un lux, ci o necesitate strategică.

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.