Semantic Search
استكشف كيف يستخدم البحث الدلالي (semantic search) الذكاء الاصطناعي والتضمينات لفهم نية المستخدم. تعلم بناء أنظمة بحث بصري باستخدام Ultralytics YOLO26 ومنصتنا.
البحث الدلالي هو تقنية متطورة لاسترجاع المعلومات تهدف إلى فهم نية ومعنى سياق استعلام المستخدم بدلاً من مجرد مطابقة كلمات محددة. من خلال الاستفادة من التطورات في Natural Language Processing (NLP) و Machine Learning (ML)، تتيح هذه التقنية للأنظمة تفسير اللغة البشرية بدقة أكبر. وهو حجر الأساس لتطبيقات Artificial Intelligence (AI) الحديثة، مما يسمح بتفاعلات أكثر سهولة بين البشر والآلات من خلال سد الفجوة بين استعلامات المستخدم الغامضة والبيانات ذات الصلة.
كيف يعمل البحث الدلالي#
في جوهره، يتجاوز البحث الدلالي مطابقة الأحرف الحرفية لتحليل العلاقة بين المفاهيم. قد ت فشل محركات البحث التقليدية إذا بحث المستخدم عن "سنور" بينما تحتوي المستندات فقط على كلمة "قطة". يحل البحث الدلالي هذه المشكلة عن طريق تحويل unstructured data—مثل النصوص أو الصور أو الصوت—إلى تمثيلات رياضية تسمى embeddings.
هذه الـ embeddings هي متجهات عالية الأبعاد توضع في "فضاء دلالي". في هذا الفضاء، يتم وضع العناصر ذات المعاني المتشابهة بالقرب من بعضها البعض. على سبيل المثال، سيكون متجه كلمة "سيارة" أقرب رياضياً إلى "مركبة" و"طريق" مقارنة بـ "موت الموز". عندما يقدم المستخدم استعلاماً، يقوم النظام بتحويل هذا الاستعلام إلى متجه ويجد أقرب نقاط البيانات في الـ vector database. تعتمد هذه العملية على نماذج deep learning لإجراء feature extraction، وتحديد الخصائص الأساسية للبيانات.
يوضح كود Python التالي كيفية إنشاء هذه الـ embeddings باستخدام نموذج Ultralytics YOLO26، وهو الخطوة الأساسية تمكيناً للبحث الدلالي البصري.
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Generate feature embeddings for an image
# This converts the visual content into a numerical vector
results = model.embed("https://ultralytics.com/images/bus.jpg")
# Output the shape of the embedding vector (e.g., length 1280)
print(f"Embedding vector shape: {results[0].shape}")تطبيقات العالم الحقيقي#
لقد أحدث البحث الدلالي ثورة في كيفية اكتشاف المستخدمين للمعلومات عبر مختلف القطاعات، مما جعل الأنظمة أكثر ذكاءً وكفاءة.
- التجارة الإلكترونية والاكتشاف البصري: في عالم AI in retail، يدعم البحث الدلالي ميزات "تسوق الإطلالة". قد يقوم العميل بتحميل صورة لحذاء رياضي أو البحث عن "أجواء صيفية قديمة". يستخدم النظام computer vision لفهم النمط البصري ويسترجع المنتجات التي تطابق الجماليات، حتى لو كانت أوصاف المنتجات لا تحتوي على تلك الكلمات الرئيسية بالضبط. وغالباً ما يتضمن ذلك Multi-Modal Models التي يمكنها فهم مدخلات النص والصورة معاً.
- إدارة المعرفة و RAG: تستخدم المنظمات الكبيرة البحث الدلالي لمساعدة الموظفين في العثور على المستندات الداخلية. بدلاً من تذكر أسماء الملفات الدقيقة، يمكن للموظف طرح سؤال مثل "كيف يمكنني إعادة تشغيل الخادم؟" يستخدم النظام Retrieval-Augmented Generation (RAG) للعثور على مستندات السياسة الأكثر صلة بناءً على المعنى ويغذيتها في Large Language Model (LLM) لإنتاج إجابة دقيقة.
- توصيات المحتوى: تستخدم منصات البث الفهم الدلالي لتحسين recommendation system الخاصة بها. من خلال تحليل ملخصات حبكات الأفلام والـ feature maps البصرية للأفلام التي يستمتع بها المستخدم، يمكن للمنصة اقتراح عناوين أخرى تشترك في مواضيع أو حالات مزاجية مماثلة، مما يحافظ على تفاعل المستخدمين لفترة أطول.
البحث الدلالي مقابل المفاهيم ذات الصلة#
لإدراك فائدة البحث الدلالي تماماً، من المفيد تمييزه عن المصطلحات ذات الصلة في مشهد data science.
- Vector Search: على الرغم من استخدامها بالتبادل غالباً، إلا أن هناك تمييزاً تقنياً. البحث المتجه هو الطرقة الرياضية لحساب المسافة بين المتجهات (غالباً باستخدام cosine similarity). البحث الدلالي هو التطبيق الأوسع الذي يستخدم البحث المتجه لتحقيق هدف فهم نية المستخدم.
- بحث الكلمات الرئيسية: هذه هي الطريقة التقليدية التي تعتمد على مطابقة السلاسل النصية بدقة. إنها أرخص من الناحية الحسابية ولكنها هشّة؛ فهي تعاني مع synonyms والالفاظ متعددة المعاني (الكلمات ذات المعاني المتعددة). يتطلب البحث الدلالي قوة حسابية أكبر ولكنه يوفر صلة أعلى بكثير.
- Zero-Shot Learning: يشير هذا إلى قدرة النموذج على تصنيف بيانات لم يسبق له رؤيتها أثناء التدريب. غالباً ما تظهر محركات البحث الدلالي قدرات التعلم الصفري لأنها تستطيع تعيين استعلام جديد وغير مرئي إلى مجموعات موجودة من المفاهيم المعروفة داخل فضاء الـ embedding دون إعادة تدريب.
يتطلب تنفيذ البحث الدلالي عادةً خط أنابيب قوياً لإدارة مجموعات البيانات وتدريب النماذج. تبسط Ultralytics Platform ذلك من خلال توفير أدوات لتسمية البيانات، وتدريب النماذج، ونشرها بكفاءة. بالنسبة للمطورين الذين يتطلعون إلى بناء هذه الأنظمة، فإن استكشاف Ultralytics similarity search guide يوفر خطوات عملية لدمج هذه القدرات القوية في التطبيقات.






