DevArabDevArabالأخبار
كل الأخبار
موثّقأداةمتوسط

تحسين أداء SYCL في llama.cpp لطبقات FFN من نوع Q4_K

llama.cppllama.cpp · llama.cpp14 أغسطس 2026

قدمت llama.cpp تحسينًا لأداء SYCL يدمج العمليات لطبقات FFN الكثيفة من نوع Q4_K، مما يؤدي إلى زيادة ملحوظة في السرعة. أظهرت الاختبارات المعيارية تحسنًا يصل إلى 2.8% للاستدلال الفردي وما يصل إلى 12.4% للاستدلال المجمع على نماذج مثل qwen2.5-3B و gemma-2-2b-it.

#llama.cpp#performance#sycl#quantization#inference#ffn
المصدر الرسمي