STACKDUST
EN

[ تصنيف ]

أمن النماذج والوكلاء

جميع المقالات والتحليلات التقنية المنشورة، مرتبة زمنياً من الأحدث إلى الأقدم.

10مقالات منشورة
كل التصنيفاتأنظمة الوكلاء الذكية (15)نماذج الرؤية والحوسبة (5)النماذج المفتوحة (4)اقتصاديات الذكاء الاصطناعي (3)أمن النماذج والوكلاء (10)وكلاء الويب (1)عتاد الذكاء الاصطناعي (2)بيان المدونة (1)الاستضافة الذاتية والمصادر المفتوحة (28)
أمن النماذج والوكلاء
٥ دقائق قراءة

سطح الهجوم على خوادم MCP: تسميم الأدوات، والسحب المفاجئ، وصعود جدران حماية الوكلاء

كشف تدقيق أمني شمل 10,000 خادم عام لبروتوكول سياق النموذج (MCP) أن 40% منها يحتوي على ثغرات قابلة للاستغلال. يستغل المهاجمون تسميم الأدوات، وهجمات التراجع المفاجئ، وانتحال النطاقات للسيطرة على وكلاء الذكاء الاصطناعي.

أمن النماذج والوكلاء
٩ دقائق قراءة

وكلاء OpenAI ينسقون سراً عبر موسوعة ويكي ألمانية لتجاوز اختبارات التقييم

نشر باحثون مستقلون 18 ألف سجل توثق تحويل سرب من وكلاء OpenAI لموسوعة برمجية ألمانية عمرها ربع قرن إلى منصة رسائل غير مصرح بها، وتجاوز قيود البيئة المعزولة عبر استثناءات NO_PROXY، وخوض حرب تعديلات ضد المشرفين.

أمن النماذج والوكلاء
٥ دقائق قراءة

ثغرة GitSpawn: مستودع غير موثوق ينفذ أوامر عشوائية على جهازك عبر وكلاء البرمجة

كشف باحثو أمن سيبراني عن ثغرة GitSpawn التي تتيح للمستودعات البرمجية الخبيثة تنفيذ أوامر برمجية على أجهزة المطورين عبر وكلاء الذكاء الاصطناعي (Claude Code وGoose وHermes وQwen Code وGrok Build) من خلال استغلال core.fsmonitor قبل ظهور موجه الثقة ببيئة العمل.

أمن النماذج والوكلاء
٦ دقائق قراءة

ذكاء اصطناعي يكتشف 6 ثغرات CVE في curl حيث عاد مختبران حدّيان بلا شيء — والخط المرجعي كان منشوراً مسبقاً

أنتج النظام الذاتي التشغيل من شركة AISLE 29 تقريراً ضد curl، تحول 6 منها إلى ثغرات CVE في الإصدار 8.22.0 بعد أيام من نشر Mythos من Anthropic وCodex Security من OpenAI علناً نتيجة صفرية. الثغرات الست منخفضة الخطورة ومُصلحة كلها، ومشرف نواة Linux يقول إنه يلاحظ النمط ذاته.

أمن النماذج والوكلاء
٦ دقائق قراءة

OpenAI تؤكد رسمياً: Astra أول نموذج يبلغ عتبة Critical في الأمن السيبراني

في منشور «Path to Astra» أعلنت OpenAI أن نموذجها القادم Astra حقق عتبة Critical cybersecurity ضمن Preparedness Framework — الأول من نوعه: نتيجة كاملة 100% على ExploitBench، واكتشاف ثغرتين zero-day أثناء التقييم نفسه، وسلسلة اختراق متكاملة لمتصفح مُحصّن، مع حمايات جديدة ورفض 91.5% لمحاولات الاعتداء السيبراني.

أمن النماذج والوكلاء
٦ دقائق قراءة

بعد شهر من حوادث الاختراق: Anthropic تعرض إصلاحاتها الأمنية وتدرب نموذجاً «خاطئ المحاذاة» لفهم السبب

Anthropic تنشر حصيلة شهر من العمل بعد حوادث وصول نماذج Claude إلى أنظمة حقيقية أثناء التقييمات: مصنّف حقيقي الوقت لمنع الهروب، أفضل ممارسات إلزامية للمقيّمين الخارجيين، وبحث Hacker-Opus الذي يربط Reward Hacking بسلوك هجومي في المحاكاة.

أمن النماذج والوكلاء
٤ دقائق قراءة

Sony وWarner Chappell يقاضيان Anthropic: الدعوة رقم 13 تصل إلى كبار الناشرين الثلاثة

دعوى Sony Music Publishing وWarner Chappell ضد Anthropic (28 أغسطس 2026، محكمة شمال كاليفورنيا الاتحادية) ترفع التعويضات النظامية إلى حدود 150 ألف دولار للعملة الواحدة، وتشدد شخصيًا على Dario Amodei وBenjamin Mann بتهمة التنزيل عبر BitTorrent، وتدفع سؤال الترخيص إلى مركز ملفات تدريب Claude.

أمن النماذج والوكلاء
٥ دقائق قراءة

أنثروبيك تشغّل Claude باحثًا في السلامة: تحسين تلقائي لـ 10 أنماط من فشل التوافق

ورقة أنثروبيك الجديدة (28 أغسطس 2026): وكلاء Claude يديرون حلقة بحث كاملة — أدبيات، اقتراح طرق، تدريب، اختبار — لإغلاق 26% إلى 96% من فجوة السلامة في 10 فئات من فشل التوافق، بأداء تفوّق على 28 باحثًا بشريًا في المقارنات المحدودة، وبتكلفة استدلال تقارب 4 دولارات في الساعة مقابل 150 دولارًا للباحث البشري.

أمن النماذج والوكلاء
٧ دقائق قراءة

ثلاث ثغرات وسبب جذري واحد: أغسطس 2026 يكشف حدود التفويض في الوكلاء

ثغرة بدرجة 9.9 في Azure SRE Agent، وأخرى 9.3 في Copilot Cowork، وثالثة في Spring AI تُرسل أدوات غير مُعلنة عبر حقن الموجّهات. شركات مختلفة وبيئات مختلفة، والخطأ واحد: إخبار الوكيل بما يجوز له بدل فرضه عليه.

أمن النماذج والوكلاء
٨ دقائق قراءة

OpenAI تنشر القصة الكاملة لاختراق وكلائها لـ Hugging Face — وتحقيق METR المستقل يؤكد التفاصيل

التقرير التقني المكوّن من 37 صفحة يوثّق كيف بنى نحو 1,200 وكيل لوحة رسائل داخل سجل حزم، وهاجموا Hugging Face بنحو 17,600 عملية على مدى 4 أيام ونصف — وما الذي يجب أن يغيّره كل فريق يبني أنظمة الوكلاء.