إذا كنت تدفع 20 دولارًا شهريًا لأداة ذكاء اصطناعي وتستخدمها في مهام بسيطة — تلخيص، صياغة، ترجمة، أسئلة سريعة — فأنت غالبًا تدفع مقابل شيء يستطيع جهاز الماك نفسه القيام به وحده، مجانًا وبدون إنترنت. هذا المقال يشرح خطوات تشغيل الذكاء الاصطناعي محليًا على الماك بالتفصيل.
يمتلك الماك بشريحة آبل سيليكون (M1 فأحدث) ميزة نادرة: الذاكرة الموحّدة. يشترك المعالج والرسوميات في الرام نفسه، فيُحمَّل النموذج مرة واحدة ويعمل بسرعة محترمة دون الحاجة إلى كرت شاشة منفصل.
بياناتك لا تخرج من الجهاز · يعمل في الطائرة وفي أي مكان دون إنترنت · لا حدود استخدام ولا رسائل «انتهت حصتك» · ولا اشتراك على الإطلاق.
هل جهازك يقدر يشغّل الذكاء الاصطناعي محليًا ؟
الحاكم الأساسي هنا هو الرام، لا المعالج. والقاعدة بسيطة: يجب أن يتّسع النموذج بالكامل داخل الرام، مع ترك مساحة كافية للنظام.
| الرام | حجم النموذج المناسب | الاستخدام الواقعي |
|---|---|---|
| 8 جيجا | 3B وأقل | تجربة وتلخيص خفيف بس |
| 16 جيجا | 7B – 8B | الاستخدام اليومي المريح |
| 24 – 32 جيجا | 14B | كتابة طويلة وبرمجة |
| 48 جيجا وأكتر | 30B+ | شغل ثقيل ومتواصل |
ولاحظ أن الأجهزة القديمة بمعالج إنتل تعمل، لكنها بطيئة إلى درجة تجعلها غير عملية. الحديث هنا موجّه لأجهزة M1 فأحدث.
البرنامجان اللازمان — واحد منهما يكفي
LM Studio
- واجهة رسومية كاملة
- تحميل النماذج بضغطة
- شبيه بواجهة ChatGPT
Ollama
- خفيف جدًا على الجهاز
- يعمل من التيرمينال
- يوفّر API للمطورين
إذا كنت مستخدمًا عاديًا وتريد واجهة تشبه ChatGPT: اختر LM Studio. وإذا كنت مبرمجًا وتريد ربطه بأدواتك: اختر Ollama. كلاهما مجاني ومفتوح المصدر، ولا داعي لتثبيت الاثنين معًا.
الطريقة الأولى : LM Studio خطوة بخطوة
- نزّل البرنامج — من الموقع الرسمي lmstudio.ai، واختر نسخة macOS (Apple Silicon).
- افتحه وانتقل إلى تبويب البحث — ستجد مكتبة نماذج جاهزة للتحميل.
- اختر النموذج — ابدأ بنموذج 7B أو 8B بصيغة Q4. الحجم نحو 4-5 جيجابايت.
- انتظر التحميل — يُحمَّل مرة واحدة فقط، وبعدها يعمل دون إنترنت إلى الأبد.
- انتقل إلى تبويب المحادثة — اختر النموذج من الأعلى واكتب أول رسالة.
وهذا كل شيء. من هذه اللحظة يمكنك إغلاق الواي فاي، وسيستمر النموذج في العمل بشكل طبيعي.
الطريقة الثانية : Ollama للمبرمجين
إذا كنت مرتاحًا مع الطرفية (Terminal)، فـ Ollama أسرع في التجهيز:
- نزّل تطبيق macOS من ollama.com، وافتحه مرة واحدة.
- افتح Terminal واكتب أمر تشغيل النموذج مباشرة — سيُحمَّل تلقائيًا في أول مرة.
- اكتب سؤالك في النافذة نفسها، ويظهر الرد فورًا.
- للمطورين — يفتح Ollama واجهة API محلية متوافقة مع صيغة OpenAI، فيمكن ربطه بأي أداة تدعمها.
يستخدم Ollama في نسخه الأخيرة إطار MLX من آبل تلقائيًا على أجهزة آبل سيليكون، وهذا يُحدث فرقًا كبيرًا في سرعة الرد مقارنة بالنسخ القديمة.
أي نموذج ذكاء اصطناعي تختار ؟
| النموذج | الحجم التقريبي | الأفضل في |
|---|---|---|
| Qwen 3 — 8B | ~5 جيجا | الاستخدام العام والعربي |
| Llama 3 — 8B | ~5 جيجا | الإنجليزي والمحادثة |
| Gemma — 4B | ~3 جيجا | الأجهزة الضعيفة |
| نماذج Coder — 7B | ~5 جيجا | البرمجة ومراجعة الكود |
ما معنى Q4 وQ8 ؟
هذه درجة «الضغط» (Quantization). النموذج الأصلي كبير جدًا، فيُضغط كي يتّسع في الرام:
- Q4 — أصغر حجم وأسرع، وفرق الجودة بسيط. هذا ما تبدأ به.
- Q8 — جودة أعلى قليلًا وحجم أكبر، يحتاج رامًا أكبر.
الفرق الحقيقي بينه وبين ChatGPT
يتفوّق فيها التشغيل المحلي
- الخصوصية الكاملة — لا بيانات تخرج من الجهاز
- العمل دون إنترنت نهائيًا
- لا حدود استخدام ولا اشتراك
- السرعة في الردود القصيرة
لا يزال متأخرًا فيها
- الأسئلة المعقّدة والتحليل العميق
- البحث في الإنترنت والأخبار الجديدة
- الصور والصوت والفيديو
- دقة اللغة العربية في النصوص الطويلة
4 استخدامات عملية تستحق فعلًا
- تلخيص المستندات الحساسة — عقود، تقارير عمل، بيانات عملاء. أمور لا يصح رفعها إلى سيرفر خارجي.
- إعادة الصياغة والتصحيح — رسائل بريد إلكتروني، رسائل، منشورات. مهام خفيفة ينجزها النموذج المحلي فورًا.
- مساعد برمجة دون إنترنت — شرح كود، اقتراح تعديل، كتابة دالة صغيرة.
- العمل أثناء السفر — في الطائرة أو في مكان الإنترنت فيه ضعيف، يصبح هذا الفرق بين أن تعمل أو لا تعمل.
مشاكل شائعة وحلولها
هذا طبيعي أثناء توليد الرد. إذا كان الوضع مبالغًا فيه، انتقل إلى نموذج أصغر (من 8B إلى 4B) أو قلّل عدد التطبيقات المفتوحة.
- الردود بطيئة جدًا — النموذج أكبر من سعة رامك. اختر حجمًا أصغر أو صيغة Q4.
- النموذج يرد بالإنجليزية رغم أنك تكتب بالعربية — اكتب في التعليمات صراحة أن يرد بالعربية، أو اختر نموذجًا متعدد اللغات مثل Qwen.
- مساحة القرص تنفد — كل نموذج بين 3 و6 جيجابايت. احذف النماذج التي لا تستخدمها من داخل البرنامج.
الخلاصة
هل يستحق تشغيل الذكاء الاصطناعي محليًا التجربة ؟
- معك 16 جيجابايت رام أو أكثر ← جرّبه فورًا، سيغطي أغلب عملك اليومي
- معك 8 جيجابايت ← جرّب نموذج 3B للمهام الخفيفة فقط
- عملك تحليل معقّد وبحث ← أبقِ على الاشتراك المدفوع، فالتشغيل المحلي ليس بديلًا هنا
- عملك بيانات حساسة ← التشغيل المحلي هو الخيار الصحيح مهما كان
ابدأ بـ LM Studio ونموذج 8B بصيغة Q4. وإذا وجدت أنه يغطي عملك، تكون قد وفّرت 240 دولارًا في السنة.
أسئلة شائعة
هل هذا مجاني بالكامل فعلًا ؟
نعم. البرنامجان مجانيان والنماذج المفتوحة مجانية. التكلفة الوحيدة هي مساحة القرص والكهرباء.
هل يعمل على ماك بمعالج إنتل القديم ؟
يعمل تقنيًا، لكنه بطيء جدًا لدرجة أنه غير عملي. الحديث موجّه لأجهزة M1 فأحدث.
كم جيجابايت يأخذ من القرص ؟
البرنامج نفسه أقل من جيجابايت واحد، وكل نموذج بين 3 و6 جيجابايت حسب حجمه.
هل يفهم النموذج المحلي اللغة العربية ؟
النماذج متعددة اللغات مثل Qwen تفهم العربية جيدًا في المهام القصيرة. أما في النصوص الطويلة فلا تزال أضعف من النماذج السحابية.
هل تُرسل بياناتي إلى أي جهة ؟
لا. النموذج يعمل على جهازك بالكامل، ويمكنك التأكد من ذلك بقطع الإنترنت والاستمرار في استخدامه بشكل طبيعي.
المصادر
- Ollama — الموقع الرسمي وتحميل النسخة للماك
- LM Studio — الموقع الرسمي
- آبل — إطار العمل الرسمي لتسريع الحوسبة على أبل سيليكون
إذا أعجبك المقال، تابع باقي شروحاتنا في قسم الذكاء الاصطناعي، وتعرّف أكثر علينا من صفحة من نحن.
تعليقات
إرسال تعليق