الذكاء الاصطناعي

كيفية تشغيل نماذج AI محليًا على الماك بدون إنترنت ولا اشتراك

iK الكاتب: كريم · أغسطس 23, 2026 · —
كيفية تشغيل نماذج AI محليًا على الماك بدون إنترنت ولا اشتراك

خطوات تشغيل نماذج الذكاء الاصطناعي محليًا على أجهزة الماك بدون إنترنت

إذا كنت تدفع 20 دولارًا شهريًا لأداة ذكاء اصطناعي وتستخدمها في مهام بسيطة — تلخيص، صياغة، ترجمة، أسئلة سريعة — فأنت غالبًا تدفع مقابل شيء يستطيع جهاز الماك نفسه القيام به وحده، مجانًا وبدون إنترنت. هذا المقال يشرح خطوات تشغيل الذكاء الاصطناعي محليًا على الماك بالتفصيل.

يمتلك الماك بشريحة آبل سيليكون (M1 فأحدث) ميزة نادرة: الذاكرة الموحّدة. يشترك المعالج والرسوميات في الرام نفسه، فيُحمَّل النموذج مرة واحدة ويعمل بسرعة محترمة دون الحاجة إلى كرت شاشة منفصل.

0$تكلفة شهرية
16GBأقل رام عملية
5دوقت التجهيز
iلماذا التشغيل المحلي أصلًا ؟

بياناتك لا تخرج من الجهاز · يعمل في الطائرة وفي أي مكان دون إنترنت · لا حدود استخدام ولا رسائل «انتهت حصتك» · ولا اشتراك على الإطلاق.

هل جهازك يقدر يشغّل الذكاء الاصطناعي محليًا ؟

الحاكم الأساسي هنا هو الرام، لا المعالج. والقاعدة بسيطة: يجب أن يتّسع النموذج بالكامل داخل الرام، مع ترك مساحة كافية للنظام.

الرامحجم النموذج المناسبالاستخدام الواقعي
8 جيجا3B وأقلتجربة وتلخيص خفيف بس
16 جيجا7B – 8Bالاستخدام اليومي المريح
24 – 32 جيجا14Bكتابة طويلة وبرمجة
48 جيجا وأكتر30B+شغل ثقيل ومتواصل

ولاحظ أن الأجهزة القديمة بمعالج إنتل تعمل، لكنها بطيئة إلى درجة تجعلها غير عملية. الحديث هنا موجّه لأجهزة M1 فأحدث.

البرنامجان اللازمان — واحد منهما يكفي

الأسهل للمبتدئ

LM Studio

مجاني
  • واجهة رسومية كاملة
  • تحميل النماذج بضغطة
  • شبيه بواجهة ChatGPT

Ollama

مجاني
  • خفيف جدًا على الجهاز
  • يعمل من التيرمينال
  • يوفّر API للمطورين
✓اختر واحدًا فقط

إذا كنت مستخدمًا عاديًا وتريد واجهة تشبه ChatGPT: اختر LM Studio. وإذا كنت مبرمجًا وتريد ربطه بأدواتك: اختر Ollama. كلاهما مجاني ومفتوح المصدر، ولا داعي لتثبيت الاثنين معًا.

الطريقة الأولى : LM Studio خطوة بخطوة

  1. نزّل البرنامج — من الموقع الرسمي lmstudio.ai، واختر نسخة macOS (Apple Silicon).
  2. افتحه وانتقل إلى تبويب البحث — ستجد مكتبة نماذج جاهزة للتحميل.
  3. اختر النموذج — ابدأ بنموذج 7B أو 8B بصيغة Q4. الحجم نحو 4-5 جيجابايت.
  4. انتظر التحميل — يُحمَّل مرة واحدة فقط، وبعدها يعمل دون إنترنت إلى الأبد.
  5. انتقل إلى تبويب المحادثة — اختر النموذج من الأعلى واكتب أول رسالة.

وهذا كل شيء. من هذه اللحظة يمكنك إغلاق الواي فاي، وسيستمر النموذج في العمل بشكل طبيعي.

الطريقة الثانية : Ollama للمبرمجين

إذا كنت مرتاحًا مع الطرفية (Terminal)، فـ Ollama أسرع في التجهيز:

  1. نزّل تطبيق macOS من ollama.com، وافتحه مرة واحدة.
  2. افتح Terminal واكتب أمر تشغيل النموذج مباشرة — سيُحمَّل تلقائيًا في أول مرة.
  3. اكتب سؤالك في النافذة نفسها، ويظهر الرد فورًا.
  4. للمطورين — يفتح Ollama واجهة API محلية متوافقة مع صيغة OpenAI، فيمكن ربطه بأي أداة تدعمها.
iحاجة مهمة عن السرعة

يستخدم Ollama في نسخه الأخيرة إطار MLX من آبل تلقائيًا على أجهزة آبل سيليكون، وهذا يُحدث فرقًا كبيرًا في سرعة الرد مقارنة بالنسخ القديمة.

أي نموذج ذكاء اصطناعي تختار ؟

النموذجالحجم التقريبيالأفضل في
Qwen 3 — 8B~5 جيجاالاستخدام العام والعربي
Llama 3 — 8B~5 جيجاالإنجليزي والمحادثة
Gemma — 4B~3 جيجاالأجهزة الضعيفة
نماذج Coder — 7B~5 جيجاالبرمجة ومراجعة الكود

ما معنى Q4 وQ8 ؟

هذه درجة «الضغط» (Quantization). النموذج الأصلي كبير جدًا، فيُضغط كي يتّسع في الرام:

  • Q4 — أصغر حجم وأسرع، وفرق الجودة بسيط. هذا ما تبدأ به.
  • Q8 — جودة أعلى قليلًا وحجم أكبر، يحتاج رامًا أكبر.

الفرق الحقيقي بينه وبين ChatGPT

يتفوّق فيها التشغيل المحلي
  • الخصوصية الكاملة — لا بيانات تخرج من الجهاز
  • العمل دون إنترنت نهائيًا
  • لا حدود استخدام ولا اشتراك
  • السرعة في الردود القصيرة
لا يزال متأخرًا فيها
  • الأسئلة المعقّدة والتحليل العميق
  • البحث في الإنترنت والأخبار الجديدة
  • الصور والصوت والفيديو
  • دقة اللغة العربية في النصوص الطويلة

4 استخدامات عملية تستحق فعلًا

  1. تلخيص المستندات الحساسة — عقود، تقارير عمل، بيانات عملاء. أمور لا يصح رفعها إلى سيرفر خارجي.
  2. إعادة الصياغة والتصحيح — رسائل بريد إلكتروني، رسائل، منشورات. مهام خفيفة ينجزها النموذج المحلي فورًا.
  3. مساعد برمجة دون إنترنت — شرح كود، اقتراح تعديل، كتابة دالة صغيرة.
  4. العمل أثناء السفر — في الطائرة أو في مكان الإنترنت فيه ضعيف، يصبح هذا الفرق بين أن تعمل أو لا تعمل.

مشاكل شائعة وحلولها

!الجهاز يسخن أو يبطأ

هذا طبيعي أثناء توليد الرد. إذا كان الوضع مبالغًا فيه، انتقل إلى نموذج أصغر (من 8B إلى 4B) أو قلّل عدد التطبيقات المفتوحة.

  • الردود بطيئة جدًا — النموذج أكبر من سعة رامك. اختر حجمًا أصغر أو صيغة Q4.
  • النموذج يرد بالإنجليزية رغم أنك تكتب بالعربية — اكتب في التعليمات صراحة أن يرد بالعربية، أو اختر نموذجًا متعدد اللغات مثل Qwen.
  • مساحة القرص تنفد — كل نموذج بين 3 و6 جيجابايت. احذف النماذج التي لا تستخدمها من داخل البرنامج.

الخلاصة

هل يستحق تشغيل الذكاء الاصطناعي محليًا التجربة ؟

  • معك 16 جيجابايت رام أو أكثر ← جرّبه فورًا، سيغطي أغلب عملك اليومي
  • معك 8 جيجابايت ← جرّب نموذج 3B للمهام الخفيفة فقط
  • عملك تحليل معقّد وبحث ← أبقِ على الاشتراك المدفوع، فالتشغيل المحلي ليس بديلًا هنا
  • عملك بيانات حساسة ← التشغيل المحلي هو الخيار الصحيح مهما كان

ابدأ بـ LM Studio ونموذج 8B بصيغة Q4. وإذا وجدت أنه يغطي عملك، تكون قد وفّرت 240 دولارًا في السنة.

أسئلة شائعة

هل هذا مجاني بالكامل فعلًا ؟

نعم. البرنامجان مجانيان والنماذج المفتوحة مجانية. التكلفة الوحيدة هي مساحة القرص والكهرباء.

هل يعمل على ماك بمعالج إنتل القديم ؟

يعمل تقنيًا، لكنه بطيء جدًا لدرجة أنه غير عملي. الحديث موجّه لأجهزة M1 فأحدث.

كم جيجابايت يأخذ من القرص ؟

البرنامج نفسه أقل من جيجابايت واحد، وكل نموذج بين 3 و6 جيجابايت حسب حجمه.

هل يفهم النموذج المحلي اللغة العربية ؟

النماذج متعددة اللغات مثل Qwen تفهم العربية جيدًا في المهام القصيرة. أما في النصوص الطويلة فلا تزال أضعف من النماذج السحابية.

هل تُرسل بياناتي إلى أي جهة ؟

لا. النموذج يعمل على جهازك بالكامل، ويمكنك التأكد من ذلك بقطع الإنترنت والاستمرار في استخدامه بشكل طبيعي.

المصادر


إذا أعجبك المقال، تابع باقي شروحاتنا في قسم الذكاء الاصطناعي، وتعرّف أكثر علينا من صفحة من نحن.

مقالات لا تفوتك !

تعليقات

📬 تابع الجديد

جديد المقالات والشروحات أول بأول

بدون حشو — بس اللي يستاهل وقتك.

↑