רלוונטיות חיפוש: איך תוצאות מדורגות

רלוונטיות חיפוש היא הדיסציפלינה של ניקוד וסידור תוצאות כך שהמוצרים השימושיים ביותר לשאילתה נתונה יופיעו ראשונים — שכבת הדירוג שיושבת מעל ההתאמה.

התאמה מול דירוג

התאמה מחליטה אילו מוצרים בכלל זכאים להופיע. דירוג — רלוונטיות — מחליט על הסדר שבו הם מופיעים. שאילתה יכולה טכנית להתאים למאות מוצרים; ניקוד רלוונטיות הוא מה שהופך את העשרה הראשונים לשימושיים במקום שרירותיים.

רלוונטיות לקסיקלית: BM25 ותדירות מונחים

הגישה הקלאסית מנקדת מוצר לפי כמה פעמים, ובאיזו ייחודיות, מונחי השאילתה מופיעים בשדות הטקסט שלו — הטכניקה מאחורי אלגוריתמים כמו BM25. היא מהירה ומדויקת לשאילתות מדויקות או כמעט מדויקות, ונשארת בסיס נפוץ גם במערכות מודרניות.

רלוונטיות סמנטית: ניקוד דמיון

מערכות מבוססות וקטור מנקדות רלוונטיות לפי מרחק או דמיון במרחב embedding במקום חפיפת מונחים — וזה מה שמאפשר להן לדרג שאילתה מנוסחת מחדש או תיאורית באופן הגיוני גם כשהיא לא חולקת אף מילה מילולית עם המוצר המתאים.

מיזוג אותות רלוונטיות

רוב מערכות הפרודקשן לא מסתמכות על שיטה אחת בלבד. הן משלבות ציון לקסיקלי, ציון סמנטי ואותות עסקיים — עדכניות, פופולריות, מרווח — לערך דירוג סופי אחד, שמרצ׳נדייזינג או פרסונליזציה יכולים אז להתאים עוד מעל.

הערכת איכות רלוונטיות

שתי בדיקות עיקריות בשימוש בפועל: שיפוטי רלוונטיות אנושיים, שבהם מדגם של זוגות שאילתה-תוצאה מדורג ישירות, ופרוקסיים התנהגותיים, כמו שיעור הקלקה והוספה לעגלה על תוצאות עליונות. אף אחד לבד לא מספיק — מודל יכול לרוץ בלי שגיאות ועדיין להחזיר תוצאות שאף אחד לא מקליק עליהן.

שאלות נפוצות

מה ההבדל בין רלוונטיות לדירוג?

המונחים לעיתים קרובות בשימוש לסירוגין. רלוונטיות מתייחסת למודל הניקוד עצמו; דירוג הוא הסדר שנוצר מאותם ציונים.

האם BM25 מיושן עכשיו שיש חיפוש סמנטי?

לא — הוא נשאר בסיס חזק ומהיר לשאילתות מדויקות וכמעט מדויקות, ומערכות היברידיות רבות שומרות אותו כאחד מכמה אותות ממוזגים במקום להחליף אותו לגמרי.

איך יודעים אם מודל רלוונטיות באמת טוב?

על ידי שילוב שיפוטי רלוונטיות אנושיים על מדגם שאילתות עם פרוקסיים התנהגותיים כמו שיעור הקלקה והוספה לעגלה — בדיקה גם אם התוצאות נראות נכון וגם אם קונים באמת פועלים עליהן.