وداعاً للاشتراكات السحابية: كيف تملك ذكاءً اصطناعيًا خارقًا على جهازك الشخصي وبخصوصية تامة!
khaldon
0:00 / 0:00
وداعاً للاشتراكات السحابية: كيف تملك ذكاءً اصطناعيًا خارقًا على جهازك الشخصي وبخصوصية تامة!
3 просмотра · 8 месяцев назад
khaldon
6 подписчиков
3 просмотра · 8 месяцев назад
يعد مشروع llama.cpp الركيزة الأساسية في ثورة الذكاء الاصطناعي المحلي؛ فهو مكتبة برمجية مكتوبة بلغة C++ تهدف إلى تشغيل النماذج اللغوية الضخمة (LLMs) بكفاءة عالية على الأجهزة الاستهلاكية العادية دون الحاجة لمتطلبات تقنية معقدة أو اتصال سحابي. يعتمد المشروع بشكل أساسي على تنسيق الملفات GGUF (GPT-Generated Unified Format)، وهو تنسيق متطور يدمج أوزان النموذج مع الميتاداتا في ملف واحد، مما يضمن سرعة التحميل والتوافق مع مختلف لغات البرمجة والأنظمة.
تكمن القوة الحقيقية لهذا النظام في تقنية التكميم (Quantization)، التي تضغط النماذج الضخمة من دقة 32-بت إلى مستويات منخفضة تصل إلى 1.5-بت أو 4-بت، مما يقلل استهلاك الذاكرة (RAM) بنسبة تتراوح بين 75% إلى 90% مع الحفاظ على أداء مذهل. هذا النهج "المحلي أولاً" مكن المستخدمين من تشغيل نماذج قوية مثل Llama وMistral وحتى عائلة Qwen على أجهزة الكمبيوتر المحمولة، والهواتف الذكية، ولوحات Raspberry Pi.
وصف قصير
llama.cpp هو محرك استدلال فائق الكفاءة ومفتوح المصدر، يتيح تشغيل نماذج الذكاء الاصطناعي محلياً وبخصوصية تامة، من خلال استخدام تنسيق GGUF وتقنيات التكميم لضغط النماذج الضخمة لتعمل على الأجهزة الشخصية والمدمجة بسرعة واستهلاك أقل للموارد