أطلقت Google DeepMind يوم 6 أكتوبر 2026 نموذج EmbeddingGemma 2، وهو نموذج تضمين (embedding model) مفتوح بحجم 740 مليون معلمة يحوّل النص والكود والصور والفيديو والصوت إلى متجهات في فضاء واحد بأبعاد 768، بترخيص Apache 2.0، وهو مصمم للعمل على أجهزة المستخدمين العادية.
ما هو نموذج التضمين ولماذا هذا مختلف؟
نماذج التضمين تحوّل المحتوى إلى أرقام تسمح بالبحث الدلالي ومقارنة المعنى، وهي أساس أنظمة RAG والبحث الذكي. الجديد هنا أن النص والكود والصور والفيديو والصوت تشترك في فضاء واحد، فيمكن مثلًا البحث عن مقطع فيديو معين بمذكرة صوتية، أو الاستعلام عن ساعات من التسجيلات الصوتية بنص عادي، وهي أمثلة ذكرتها جوجل.
المواصفات المعلنة
- الحجم: 740 مليون معلمة، تجمع نموذج نص بحجم 270 مليونًا ومشفّر رؤية بحجم 170 مليونًا ومشفّر صوت بحجم 300 مليون (حسب بطاقة النموذج).
- أبعاد التضمين: 768.
- نافذة السياق: 8,192 رمزًا لكل الأنواع، أي أربعة أضعاف الإصدار الأول.
- التحميل الانتقائي: لأن المشفّرات مستقلة، يمكن تحميل 270 مليونًا فقط للنص والكود، أو 440 مليونًا للنص والرؤية، أو 570 مليونًا للنص والصوت.
- الأساس: بنية Gemma 4، والترخيص Apache 2.0.
وتذكر جوجل أن الإصدار الأول EmbeddingGemma تجاوز 20 مليون تنزيل، ويستخدمه المطورون في أدوات بحث تعمل على الجهاز وأنظمة RAG تحافظ على الخصوصية.
لماذا يهم؟
لأن تشغيل البحث الدلالي متعدد الوسائط على الجهاز نفسه يعني خصوصية أفضل وتكلفة أقل لمطوري التطبيقات، دون إرسال الملفات إلى سحابة. وترخيص Apache 2.0 يسمح باستخدامه في مشاريع تجارية.
ما الذي ينبغي الانتباه له؟
أرقام الأداء المنشورة في الإعلان من جوجل نفسها، وجودة النموذج على المحتوى العربي لم تُذكر في المصادر التي راجعناها، لذلك جرّبه على بياناتك قبل الاعتماد عليه.
أسئلة شائعة
ما حجم EmbeddingGemma 2؟
740 مليون معلمة، مع إمكانية تحميل أجزاء أصغر حسب نوع المحتوى.
هل هو مفتوح للاستخدام التجاري؟
يصدر بترخيص Apache 2.0 حسب التقرير.
ما الذي يمكن بناؤه به؟
البحث الدلالي وأنظمة RAG عبر النص والكود والصور والفيديو والصوت، ومنها العمل على الجهاز دون سحابة.
المصادر
نُشر في 6 أكتوبر 2026 ضمن قسم أخبار الـ AI. المعلومات من المصادر المذكورة وقت النشر وقد تتحدث لاحقًا.