موثّقأداةمتوسط
تحسين أداء SYCL في llama.cpp لطبقات FFN من نوع Q4_K
llama.cppllama.cpp · llama.cpp14 أغسطس 2026
قدمت llama.cpp تحسينًا لأداء SYCL يدمج العمليات لطبقات FFN الكثيفة من نوع Q4_K، مما يؤدي إلى زيادة ملحوظة في السرعة. أظهرت الاختبارات المعيارية تحسنًا يصل إلى 2.8% للاستدلال الفردي وما يصل إلى 12.4% للاستدلال المجمع على نماذج مثل qwen2.5-3B و gemma-2-2b-it.
#llama.cpp#performance#sycl#quantization#inference#ffn
المصدر الرسمي