هذا الدليل مادة إرشادية. تحقق دائماً من كيفية انطباق القواعد على حالتك الخاصة.
الموقع في التدفق: بعد التسجيل والنسخ باستخدام Whisper، كجزء من التواصل مع السلطات.
باختصار
- أفضل خصوصية: تشغيل LLM محليًا بالكامل (Ollama / LM Studio) – النص لا يغادر جهاز الكمبيوتر الخاص بك أبدًا.
- الأفضل التالي: وحدة معالجة رسومات مؤقتة ومعزولة (مثل RunPod Secure Cloud) تقوم بتشغيلها بنفسك، تحميل النموذج إليها، استخدامها ثم حذفها – ليست دردشة سحابية مثل ChatGPT/Claude.
- تجنب للأمور الحساسة: السحابة الاستهلاكية حيث تلصق الملف بالكامل في دردشة تتدرب على أو تسجل البيانات المدخلة.
ما هي فائدة LLM المحلي في الأمور الحكومية
نموذج اللغة (LLM) لا يحل محل الاستشارة القانونية. إنه أداة عمل عندما يكون لديك بالفعل تسجيل، نسخ أو مستندات مطلوبة. المهام النموذجية:
- تلخيص نص اجتماع طويل: القرارات، الوعود، المواعيد النهائية، النقاط غير الواضحة.
- مقارنة نسختك مع ملاحظات الخدمة الخاصة بالسلطة وتحديد الفروقات بشكل نقطي.
- اقتراح هيكل للتصحيح، الرد أو البريد الإلكتروني للمتابعة (أنت تعيد الكتابة وتتحقق من الحقائق).
- الترجمة إلى لغتك مع الاحتفاظ بالمصطلحات القانونية السويدية بين قوسين.
- العثور على المواعيد النهائية و"ما الذي يجب أن أطلبه كتابيًا؟" في نص معقد.
لا تدع النموذج "يخترع" الاقتباسات. اطلب منه تحديد الأجزاء غير المؤكدة وتحقق دائمًا من الجمل المهمة مقابل الملف الصوتي أو المستند الأصلي.
سلم الخصوصية: ثلاث مستويات
- محلي بالكامل (يوصى به للأطفال، الخدمات الاجتماعية، الرعاية، الهجرة، الشرطة): النموذج + الدردشة تعملان دون اتصال على جهازك. لا يوجد تحميل.
- وحدة معالجة رسومات معزولة تستأجرها لفترة قصيرة (RunPod Secure Cloud، وما شابه): البيانات تغادر الكمبيوتر ولكن تذهب إلى وحدة تتحكم بها، وليس إلى خط تدريب خدمة دردشة عامة. يتطلب روتين حذف صارم (انظر أدناه).
- الذكاء الاصطناعي السحابي العام (ChatGPT، Claude.ai، Gemini وغيرها): الأسهل – لكن يجب إخفاء البيانات الشخصية الحساسة بشدة أو عدم إرسالها على الإطلاق. اقرأ الشروط؛ افترض أن البيانات المدخلة يمكن تسجيلها.
كيفية تشغيل LLM محليًا
الخيار A: Ollama (Mac، Windows، Linux) – الأسهل للعديد
- قم بتثبيت Ollama من ollama.com.
- قم بتنزيل نموذج، مثل
ollama pull llama3.1:8bأو نموذج سويدي/أوروبي محسن موجود في كتالوج Ollama ويتناسب مع ذاكرتك. - ابدأ الدردشة:
ollama run llama3.1:8bأو استخدم تطبيق/واجهة ويب Ollama. - الصق (أو أرفق) نسخة العمل من النسخ – وليس الملف الصوتي بالكامل.
- اعمل دون اتصال: قم بإيقاف المزامنة السحابية غير الضرورية للمجلد الذي يحتوي على الملفات الحساسة.
الخيار B: LM Studio – رسومي وجيد للمبتدئين
- قم بتثبيت LM Studio.
- قم بتنزيل نموذج GGUF (ابدأ بـ 7B–8B مكمي، مثل Q4/Q5).
- قم بتحميل النموذج محليًا. تأكد من اختيار "الخادم المحلي" / دون اتصال وأنه لا يتم إرسال أي شيء إلى السحابة.
- استخدم الدردشة أو واجهة برمجة التطبيقات المحلية (غالبًا
localhost) من جهاز الكمبيوتر الخاص بك.
الخيار C: GPT4All أو llama.cpp
يعمل بشكل جيد على أجهزة الكمبيوتر القديمة. نفس المبدأ: قم بتنزيل ملف النموذج مرة واحدة، اعمل دون اتصال، احتفظ بالنصوص الحساسة خارج المزامنة السحابية.
المطالبات التي تعمل في الأمور الحكومية
أنت مساعد لغوي قانوني، لست محاميًا. لخص النص باللغة السويدية البسيطة. قسم إلى: 1) القرارات/الإشعارات، 2) الوعود من السلطة، 3) ما يجب علي فعله، 4) المواعيد النهائية، 5) النقاط غير الواضحة التي يجب أن أطلبها كتابيًا. لا تغير الاقتباسات. حدد الأجزاء غير المؤكدة بـ [غير مؤكد].
قارن النص A (نسختي) مع النص B (ملاحظات السلطة). قم بإدراج الفروقات الملموسة فقط: التواريخ، الاقتباسات، من قال ماذا، النقاط المفقودة. لا تخترع الفروقات. إذا كان هناك شيء غير واضح، اكتب "لا يمكن تحديده".
اكتب مسودة رد/تصحيح قصيرة (بحد أقصى 200 كلمة) بناءً على الفروقات. سأتحقق بنفسي من كل بيان مقابل المصدر قبل الإرسال.
ما الذي تحتاجه الكمبيوتر للأداء
الأرقام هي قواعد عامة للنماذج المكمية (GGUF Q4/Q5). الدقة الكاملة تتطلب المزيد. السويدية والنصوص الطويلة تتطلب المزيد من ذاكرة العمل (السياق) مقارنة بالدردشات القصيرة.
| الهدف | حجم النموذج | الذاكرة / GPU | الشعور المتوقع |
|---|---|---|---|
| تلخيص بسيط | ~3B–4B | 8 جيجابايت RAM، لا يوجد GPU | بطيء ولكن مفيد على اللابتوب |
| تحليل يومي جيد (وضع البدء الموصى به) | ~7B–8B Q4/Q5 | 16 جيجابايت RAM، أو 8 جيجابايت VRAM | سرعة مقبولة على لابتوب حديث/Mac |
| ملفات طويلة / تفكير أفضل | ~13B–14B Q4/Q5 | 32 جيجابايت RAM، أو 12–16 جيجابايت VRAM | جودة ملحوظة أفضل، أثقل |
| نماذج ثقيلة / ملفات متعددة | 32B+ أو 70B مكمي | 48 جيجابايت+ RAM أو 24 جيجابايت+ VRAM | غالبًا أفضل على GPU مستأجر من الكمبيوتر المنزلي |
- Apple Silicon (M1/M2/M3/M4): 16 جيجابايت من الذاكرة الموحدة تكفي غالبًا لـ 7B–8B. 32 جيجابايت توفر هامشًا أكبر للوثائق الأطول.
- Windows/Linux مع NVIDIA: دعم CUDA في Ollama/LM Studio يوفر زيادة كبيرة في السرعة. 8 جيجابايت VRAM ≈ مريح لـ 7B–8B؛ 12–16 جيجابايت VRAM تفتح 13B.
- فقط CPU: يعمل، لكن توقع دقائق لكل إجابة عند النصوص الأطول. قسم المستند إلى أقسام.
- القرص: احسب 4–8 جيجابايت لكل ملف نموذج؛ احتفظ بـ 20+ جيجابايت فارغة.
- Whisper + LLM في نفس الوقت: قم بتشغيلهما بالتتابع حتى تكفي الذاكرة.
إذا لم يكن الكمبيوتر قادرًا: استخدم نموذجًا أصغر، مقتطفات أقصر، أو وحدة معالجة رسومات معزولة مؤقتة (القسم التالي) – وليس دردشة سحابية عامة مع ملف غير مخفي.
RunPod وبيئات GPU المعزولة الأخرى – هل هي آمنة للخصوصية؟
إجابة مختصرة: إنه أكثر أمانًا من لصق الملف بالكامل في ChatGPT، ولكن ليس بنفس أمان التشغيل المحلي بالكامل. البيانات تغادر جهاز الكمبيوتر الخاص بك وتتم معالجتها في مركز بيانات لشخص آخر. بالنسبة للعديد من القضايا، تكفي وحدة Secure Cloud المدارة بشكل جيد. بالنسبة للبيانات الشخصية المحمية، القضايا الصحية/الخدمات الاجتماعية الخطيرة أو عندما تريد زيادة التحكم: ابق محليًا أو قم بإخفاء البيانات بشدة.
ماذا يعني "وحدة معزولة" عمليًا
- تستأجر وحدة معالجة رسومات (GPU) حيث أنت تقوم بتشغيل برامج مثل Ollama، text-generation-webui أو vLLM.
- يتم تشغيل النموذج والنص الخاص بك في تلك الوحدة – وليس في دردشة مستهلك مشتركة مع سجلات ملايين المستخدمين.
- في RunPod، يتم التمييز غالبًا بين Community Cloud (مضيف مشترك، أرخص) وSecure Cloud (أجهزة مخصصة/أكثر عزلة لدى المزود). بالنسبة للمواد الحساسة: اختر Secure Cloud (أو خيار مخصص مكافئ لدى مزود آخر).
- يتم حذف القرص المؤقت غالبًا عند إيقاف الوحدة. يبقى "network volume" الدائم حتى تقوم أنت بحذفه – لا تنس الحذف.
متى يمكن أن يكون RunPod (أو ما شابه) معقولاً
- جهاز الكمبيوتر الخاص بك يفتقر إلى الذاكرة/وحدة معالجة الرسومات للنموذج الذي تحتاجه.
- تحتاج إلى تحليل العديد من الصفحات خلال فترة قصيرة (نماذج 7–70B).
- يمكنك اتباع روتين الحذف أدناه وتجنب تخزين أكثر من اللازم في الوحدة.
متى يجب عليك تجنب استئجار GPU
- البيانات الشخصية المحمية، القضايا الخطيرة المتعلقة بالأطفال، أو عندما لا تريد أن يغادر المواد المنزل على الإطلاق.
- أنت غير متأكد من المنطقة/التخزين أو تريد ضمان "عدم الاحتفاظ بالبيانات" – يمكنك تحقيق ذلك بشكل رئيسي من خلال عدم التحميل أبدًا.
- تحتاج فقط إلى ملخصات بسيطة – في هذه الحالة غالبًا ما يكفي نموذج 7B–8B محليًا.
خطوة بخطوة: وحدة تحليل مؤقتة (مشابهة لـ RunPod)
- التحضير في المنزل: أنشئ نسخة عمل حيث قمت بإخفاء أرقام الهوية الشخصية، العناوين الكاملة والأسماء غير الضرورية إذا سمحت القضية بذلك. احفظ النسخة الأصلية محليًا.
- اختر Secure Cloud / وحدة مخصصة في منطقة الاتحاد الأوروبي إذا كانت متاحة وتناسبك. تجنب Community/المضيف المشترك للمواد الحساسة.
- ابدأ وحدة بنظام Linux وصورة VRAM كافية (مثل 16–24 جيجابايت لنماذج 13B–32B المكممة).
- قم بتثبيت ما تحتاجه فقط (Ollama أو واجهة ويب محلية). قم بتنزيل النموذج في الوحدة.
- قم بتحميل النص العملي فقط (مقتطفات النصوص)، وليس الدليل المنزلي بالكامل وليس الصوت الأصلي دون داع.
- قم بإجراء التحليل، انسخ النتيجة إلى قرصك المشفر الخاص.
- احذف: قم بإزالة الملفات المحملة، أوقف الوحدة، احذف أي network volumes/snapshots. لا تفترض أن "الإيقاف" = "الإزالة" إذا قمت بإنشاء تخزين دائم.
- قم بإيقاف مفاتيح API ولا تحفظها في ملاحظات غير آمنة.
خيارات أخرى في نفس الفئة
- Vast.ai، Salad، TensorDock وغيرها: فكرة مشابهة – استئجار GPU. يختلف مستوى الخصوصية حسب ما إذا كانت الآلة مشتركة/مجتمعية أو مخصصة. اقرأ الشروط واختر السعة المعزولة.
- VPS خاص مع GPU في الاتحاد الأوروبي: مزيد من التحكم إذا قمت بتقوية الخادم بنفسك، ولكن يتطلب صيانة أكثر.
- ليس نفس الشيء: "الوضع الخاص" في دردشات المستهلك – لا يزال بنية تحتية وسياسة تسجيل المزود.
قائمة التحقق قبل إرسال النص إلى أي LLM
- هل أحتاج إلى الذكاء الاصطناعي على الإطلاق، أم تكفي العلامة اليدوية؟
- هل يمكنني التشغيل محليًا باستخدام 7B–8B؟
- إذا لا: وحدة معزولة + Secure Cloud + حذف – ليس دردشة سحابية عامة.
- هل قمت بإخفاء ما لا يجب تحليله؟
- هل قمت بحفظ النتيجة محليًا وتنظيف التحميل؟
- هل قمت بمراجعة الاقتباسات مقابل التسجيل/المستند قبل إرسال البريد الإلكتروني إلى السلطة؟
الأخطاء الشائعة
- لصق ملف الخدمات الاجتماعية بالكامل في ChatGPT "فقط للاختبار".
- الثقة في اقتباسات النموذج دون الاستماع مرة أخرى.
- ترك network volume مع الملف لعدة أشهر.
- تشغيل Community Cloud للمواد الحساسة لتوفير بعض المال.
- الاعتقاد بأن "نموذج محلي في السحابة" هو نفس الشيء مثل التشغيل دون اتصال في المنزل.
الأسئلة الشائعة
هل RunPod آمن مثل الكمبيوتر الخاص؟
لا. قد يكون مقبولًا كحساب مؤقت معزول إذا كنت تستخدم Secure Cloud وتحذف كل شيء بعد ذلك. يوفر التشغيل دون اتصال تحكمًا أقوى.
هل يجب أن أمتلك بطاقة رسومات؟
لا. تعمل وحدة المعالجة المركزية (CPU) للنماذج 3B–8B، ولكن بشكل أبطأ. يعمل Apple Silicon مع 16 جيجابايت غالبًا بشكل جيد بدون GPU منفصل.
أي نموذج يجب أن أبدأ به؟
نموذج 7B–8B مكمم محليًا. قم بالترقية فقط إذا لم تكن الجودة كافية.
هل يمكنني استخدام النتيجة في شكوى إلى JO؟
نعم كمسودة عمل خاصة بك – ولكن أرفق الاقتباسات الفعلية من التسجيل/المستندات، وليس الهلوسات الناتجة عن الذكاء الاصطناعي.
ربط مع بقية التدفق
- تسجيل الاجتماع
- نسخ باستخدام Whisper محليًا
- تحليل باستخدام LLM محلي (هذا الدليل)
- طلب تصحيح / كتابة رد
- الدليل الأساسي: في الاتصال مع السلطات
لكل من يقرأ تحت الضغط
الدليل مصمم ليكون دعمًا عندما يكون لديك الكثير من الأمور في ذهنك. لا تحتاج إلى قراءة كل شيء دفعة واحدة: ابدأ بالقسم الذي يتناسب مع وضعك الحالي وارجع عندما يصبح الخطوة التالية ذات صلة.
نادراً ما تتحسن القضايا مع السلطات إذا كنت تتحمل كل شيء بمفردك. اطلب المساعدة من شخص داعم، محامٍ أو قريب إذا استطعت – خاصة قبل اتخاذ قرارات ذات تأثير طويل الأمد.
الأخطاء الشائعة التي تجعل القضية أكثر صعوبة
- الاعتماد فقط على الوعود الشفوية دون تأكيد كتابي قصير أو بريد إلكتروني للمتابعة.
- التأخير في طلب المستندات حتى تصبح النزاع مغلقًا بالفعل – مما يجعل من الصعب إثبات ما قيل.
- كتابة رسائل طويلة ومشحونة بالعواطف لدرجة أن السلطة تتوقف عن الرد على المسألة الأساسية.
- تفويت المواعيد النهائية لإعادة النظر أو الاستئناف لأن القرار لم يُقرأ حرفيًا.
قائمة مراجعة صغيرة قبل مغادرة الدليل
- هل لدي التاريخ، رقم اليوميات/القضية واسم الشخص الذي يعالج الأمر (إذا كنت تعرف)؟
- هل أعرف ما هي الخطوة التالية: الرد، طلب المستندات، التذكير، الاستئناف أو الإبلاغ؟
- هل حفظت البريد الإلكتروني والمرفقات في مكان يمكنني العثور عليها بعد أسبوع؟




