NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.
Google AI Studio a lansat o funcție revoluționară: importul direct din GitHub pentru a construi aplicații implementabile. Descoperiți cum funcționează, beneficiile și impactul asupra dezvoltării software.
Datalab Lift, un extractor de 9B parametri cu abordare schema-first, se compară cu NuExtract3, LlamaExtract, Marker și Docling. Analizăm performanța, precizia și ușurința de integrare, arătând de ce schema-first poate fi cheia succesului în extragerea datelor structurate.
SpaceXAI a lansat Grok 4.5, un model de limbaj antrenat pe Cursor, specializat în codare, sarcini agentice și muncă de cunoaștere, la un preț de doar 2 dolari per milion de tokeni de intrare. Articolul analizează performanțele, comparațiile cu concurența și impactul asupra pieței AI.
Lovable, startup-ul suedez de vibe-coding, negociază o rundă de finanțare de 300 de milioane de dolari care i-ar dubla evaluarea la 13,2 miliarde de dolari. Compania a atins venituri anualizate de 500 de milioane de dolari și atrage atât utilizatori individuali, cât și mari întreprinderi precum Nvidia și Workday.
Echipa AI de la Netflix a dezvoltat o soluție inovatoare pentru problema partițiilor largi în Cassandra, combinând re-partiționarea pe felii de timp cu divizarea dinamică pe calea de citire. Rezultatul: latența citirii a scăzut de la secunde la zeci de milisecunde, iar partițiile de peste 500 MB rămân disponibile.
Sistemul SynthID al Google a fost folosit pentru a demonta o imagine falsă cu senatorul Mitch McConnell, generată de AI. Este un caz rar în care watermark-ul invizibil a funcționat exact cum trebuie, demonstrând potențialul tehnologiei anti-deepfake.
Un studiu inovator combină Random Forest, ChEMBL, RDKit, SHAP și BRICS pentru a construi un co-științific QSAR care identifică inhibitori EGFR, accelerând descoperirea de medicamente anticancer.
OpenAI a lansat GPT-Realtime-2.1 și GPT-Realtime-2.1-mini, modele optimizate pentru agenți vocali cu latență sub 200 ms, disponibile în API. Articolul analizează caracteristicile, beneficiile și impactul asupra industriei, oferind perspective pentru dezvoltatori și utilizatori.
Liquid AI a lansat Antidoom, o metodă open-source care reduce drastic buclele de doom în modelele de raționament, folosind Final Token Preference Optimization (FTPO) pentru a reantrena doar tokenul care declanșează bucla. Rezultatele arată scăderi de la 22,9% la 1% pe anumite modele.
Ant Group, prin divizia Robbyant, a lansat open-source LingBot-Vision, un model de viziune computerizată de 1 miliard de parametri, centrat pe granițe, pentru percepție spațială densă. Articolul explică arhitectura, aplicațiile și impactul asupra roboticii, vehiculelor autonome și altor domenii.
OpenAI a lansat GPT-Live și GPT-Live-1 mini, primele modele vocale full-duplex care delegă raționamentul profund către GPT-5.5. Acestea permit conversații naturale, fără întârzieri, și reprezintă o arhitectură inovatoare ce separă interfața vocală de gândirea profundă.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.