
ODS: تحويل حاسوبك أو خادمك المنزلي إلى منصة ذكاء اصطناعي شاملة ومحلية
مصنع الذكاء الاصطناعي المنزلي: حزمة موحدة للاستدلال والبحث وتدفقات الوكلاء
يواجه الراغبون في بناء معمل ذكاء اصطناعي محلي (Local AI Lab) مشكلة تشتت الأدوات: تشغيل Ollama للاستدلال، ثم تثبيت ChromaDB لقواعد المتجهات، ثم نشر Open WebUI للواجهة، وإعداد Whisper للصوت، و ComfyUI للصور. يتطلب ربط هذه الأجزاء وقتًا طويلاً وصيانة مستمرة. يقدم مشروع ODS (Open Data Server) حلاً جذريًا يجمع كافة قدرات الذكاء الاصطناعي في منصة واحدة متماسكة للاستضافة الذاتية.
صُمم ODS ليكون نظام تشغيل خادم الذكاء الاصطناعي الشامل، حيث يتيح تحميل النماذج وتشغيلها، وتغذية المستندات في منظومة RAG متقدمة، ومعالجة الصوت التوليدي، وتشغيل وكلاء الذكاء الاصطناعي متعددي الخطوات عبر لوحة تحكم واحدة متكاملة.
ما هو ODS؟
ODS هو منصة خادم ذكاء اصطناعي متكاملة ومفتوحة المصدر (Apache-2.0). يتيح للمطورين وأصحاب المعامل المنزلية تحويل أجهزة Linux أو macOS أو Windows المزودة ببطاقات رسومية إلى مراكز حوسبة ذكية متكاملة.
يتضمن النظام واجهة مستخدم متقدمة لإدارة النماذج وتوزيعها على عتاد GPU/CPU، ونظام بحث دلالي ذكي للمستندات والملفات (PDF و Word و Markdown)، ومحركًا لأتمتة سير العمل يتيح بناء وكلاء ذكاء اصطناعي ينفذون مهام برمجية وتحليلية متتالية.
لماذا لم تسمع به من قبل؟
طُوّر المشروع بواسطة فريق Osmantic لإنهاء فوضى التثبيت اليدوي لمكونات الذكاء الاصطناعي. ورغم حداثة إطلاقه نسبيًا، إلا أنه لفت أنظار مجتمعات المعامل المنزلية بفضل تصميمه المعماري النظيف الذي يعامل الاستدلال وقواعد المعرفة والوكلاء كطبقة بنية تحتية واحدة متناغمة.
كيف يعمل تحت الغطاء؟
يعتمد معمار ODS على خط أنابيب موحد يدير الموارد بذكاء:
- محرك استدلال متعدد النماذج (Multi-Backend Inference Engine): يدير نماذج LLM و Vision ونماذج تضمين المتجهات (Embeddings) بكفاءة مع استغلال تسريع CUDA و Metal و ROCm.
- خط أنابيب RAG مدمج: يقوم بتقسيم المستندات، واستخراج النصوص، وتوليد التضمينات الشعاعية وتخزينها في قاعدة بيانات متجهات مدمجة وفائقة السرعة.
- محرك تنسيق الوكلاء (Agent Orchestration Runtime): يتيح للنماذج استدعاء الأدوات المحلية (Tool Calling)، وتصفح الويب الداخلي، وتنفيذ الأكواد في بيئات معزولة (Sandboxed Execution).
تشغيل الأداة ونشرها
يمكن نشر ODS بالكامل عبر Docker Compose مع دعم تسريع GPU:
services:
ods-server:
image: osmantic/ods:latest
container_name: ods-server
restart: unless-stopped
ports:
- "5000:5000"
volumes:
- ./models:/app/models
- ./data:/app/data
- ./documents:/app/documents
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities: [gpu]
environment:
- TZ=Asia/Riyadh
لتشغيل المنصة:
docker compose up -d
افتح متصفحك على http://localhost:5000 للدخول إلى لوحة التحكم والبدء في تنزيل النماذج وتغذية المستندات.
ما الذي يستبدله؟
- يستبدل المنظومات المتفرقة والمعقدة: يغنيك عن تثبيت وتحديث 5 حاويات منفصلة لـ (Ollama + VectorDB + WebUI + Speech + Agents).
- يستبدل خدمات RAG السحابية المدفوعة: يوفر بحثًا دلاليًا فائق الدقة في مستنداتك وكتبك وملفاتك الحساسة محليًا دون رفعها للإنترنت.
- يستبدل واجهات المحادثة البسيطة: يقدم بيئة عمل متقدمة تجمع بين الشات العادي والأتمتة المعقدة عبر الوكلاء.
الحدود والقيود التقنية
نظراً لاحتوائه على خدمات متعددة، يتطلب ODS عتادًا قويًا نسبياً (يُفضل وجود بطاقة NVIDIA بسعة 12 جيجابايت VRAM أو جهاز Apple Silicon بذاكرة 32 جيجابايت لتشغيل الاستدلال و RAG بالتوازي بسلاسة).
الفئات المستهدفة
- المهندسون والباحثون الذين يرغبون في بناء منصة ذكاء اصطناعي خاصة لتحليل الوثائق والأبحاث.
- الشركات الناشئة التي تحتاج إلى توفير واجهات ذكاء اصطناعي ووكلاء أتمتة لموظفيها داخل الشبكة المحلية.
- أصحاب المعامل المنزلية الراغبون في حل شامل وجاهز لإدارة الذكاء الاصطناعي بأقل جهد تشغيلي.
الخلاصة
يقدم ODS التجربة الأكثر اكتمالاً لنقل قوة الذكاء الاصطناعي التوليدي والوكلاء الأذكياء إلى خادمك الخاص. إذا كنت تبحث عن مركز تحكم واحد يغنيك عن فوضى الأدوات المتعددة، فإن ODS هو المنصة التي تحتاجها.