EmbeddingGemma 2 نموذج تمثيل مفتوح متعدد الوسائط من جوجل ديب مايند
EmbeddingGemma 2 نموذج تمثيل مفتوح متعدد الوسائط من جوجل ديب مايند

جوجل ديب مايند تطلق EmbeddingGemma 2 — نموذج تمثيل مفتوح يعمل بالكامل على جهازك

نموذج خفيف مفتوح المصدر يوحّد النص والصورة والصوت والفيديو في مساحة تمثيل واحدة، ويعمل بلا إنترنت حتى على الهاتف.

في 2025 أطلقت جوجل EmbeddingGemma بنسخة تهتم بالنصوص فقط، وتجاوز عدد تحميلاته 20 مليون تحميل خلال أشهر. اليوم تطلق جوجل ديب مايند النسخة الثانية: EmbeddingGemma 2، وهذه المرة يتسع النموذج ليشمل النص والكود والصورة والصوت والفيديو معًا — في نموذج واحد يعمل محليًا على جهازك دون إنترنت.

ما الذي يفعله "نموذج التمثيل" أصلًا؟

نماذج التمثيل (embedding models) لا تولّد نصًا أو صورة، بل تحوّل أي محتوى — جملة، صورة، مقطع صوتي — إلى تمثيل رقمي يمكن مقارنته ببيانات أخرى بحثًا عن التشابه. هذا ما يجعل البحث الذكي داخل تطبيقاتك ممكنًا: أن تسأل عن "المقطع الذي فيه ضحك" في مكتبة فيديو لديك، فيجده النموذج بالمعنى لا بالكلمة الحرفية.

لماذا "على الجهاز" تحديدًا يهم؟

EmbeddingGemma 2 لا يحتاج اتصالًا بالإنترنت ولا خوادم سحابية — يعمل بـ740 مليون معامل فقط، وبأقل من 600 ميغابايت ذاكرة في وضعه الكامل. هذا يعني خصوصية أعلى لأن بياناتك لا تغادر جهازك، واستجابة أسرع، وتوفرًا دون انقطاع. أُطلق النموذج برخصة Apache 2.0 المفتوحة تجاريًا، ويتوفر فورًا على Hugging Face وKaggle للمطورين.

بينما ينشغل كثيرون بمتابعة النماذج الكبيرة التي "تتحدث"، تستمر جوجل في بناء طبقة أخرى أقل بريقًا لكنها تحدد فعليًا أي التطبيقات ستعمل بسرعة وخصوصية على هاتفك غدًا.

الكلمات المفتاحية: EmbeddingGemma 2، جوجل ديب مايند، نماذج مفتوحة المصدر، التعلم الآلي على الجهاز، نماذج التمثيل، الذكاء الاصطناعي

المصدر: مدونة Google DeepMind — https://deepmind.google/blog/embeddinggemma-2-an-open-lightweight-multimodal-embedding-model/

No comments yet