Filtrează articolele

Subiect: #llama.cpp

AI Implementarea modelului 1-Bit Bonsai-27B cu PrismML llama.cpp și fluxuri de inferență locale compatibile OpenAI

Implementarea modelului 1-Bit Bonsai-27B cu PrismML llama.cpp și fluxuri de inferență locale compatibile OpenAI

Află cum să implementezi modelul Bonsai-27B cuantizat pe 1 bit folosind PrismML llama.cpp și să configurezi un server local de inferență compatibil cu API-ul OpenAI, reducând cerințele hardware și păstrând confidențialitatea datelor.

🕒 1 săptămâni în urmă
AI Liquid AI lansează modelul LFM2.5-230M cu suport pentru llama.cpp, MLX, vLLM, SGLang și ONNX – inferență direct pe dispozitiv

Liquid AI lansează modelul LFM2.5-230M cu suport pentru llama.cpp, MLX, vLLM, SGLang și ONNX – inferență direct pe dispozitiv

Liquid AI lansează modelul LFM2.5-230M cu suport pentru cinci framework-uri de inferență (llama.cpp, MLX, vLLM, SGLang, ONNX), permițând rularea AI-ului direct pe dispozitive locale, fără cloud. Un pas important spre democratizarea inteligenței artificiale.

🕒 1 luni în urmă
AI Noutăți în llama.cpp: Gestionarea Avansată a Modelelor și Arhitectura Multi-Proces

Noutăți în llama.cpp: Gestionarea Avansată a Modelelor și Arhitectura Multi-Proces

Echipa llama.cpp introduce un sistem revoluționar de gestionare a modelelor, similar cu Ollama, bazat pe o arhitectură multi-proces. Aceasta asigură stabilitate superioară prin izolarea proceselor și include funcții avansate precum auto-descoperirea modelelor, încărcare la cerere și evacuare inteligentă LRU pentru optimizarea memoriei video.

🕒 4 luni în urmă
AI GGML și llama.cpp se alătură Hugging Face pentru a garanta progresul pe termen lung al Inteligenței Artificiale Locale

GGML și llama.cpp se alătură Hugging Face pentru a garanta progresul pe termen lung al Inteligenței Artificiale Locale

Georgi Gerganov și echipa GGML se alătură Hugging Face pentru a scala proiectul llama.cpp, asigurând resursele necesare pentru viitorul AI-ului local. Parteneriatul promite autonomie deplină pentru proiectul open-source, integrare tehnică fluidă cu biblioteca transformers și o viziune comună pentru democratizarea superinteligenței pe dispozitivele utilizatorilor.

🕒 4 luni în urmă
AI Eliberează-ți agenții OpenClaw: Ghid complet de migrare către modele open-source

Eliberează-ți agenții OpenClaw: Ghid complet de migrare către modele open-source

Descoperă cum să-ți migrezi agenții OpenClaw către modele open-source pentru a evita întreruperile serviciului. Acest ghid detaliat explorează două rute principale: utilizarea Hugging Face Inference Providers pentru acces rapid la modele performante în cloud sau configurarea locală prin llama.cpp pentru confidențialitate totală și costuri zero.

🕒 4 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.