ניסוי מתמשך בחוכמת המונים
המתודולוגיה
איך זה עובד
בכל סבב אנחנו מנסחים שאלה שאין לה תשובה נכונה אחת, ומציגים אותה לשניים: מומחה אנושי בתחומו ומודל AI.
הכללים
- שתי תשובות, עד 500 תווים כל אחת. שתי התשובות נערכות לאחידות צורנית בלבד (אורך, מבנה, משלב) — התוכן אינו משתנה.
- הגרלת מיקום. בכל סבב מוגרל אם תשובת ה-AI תוצג כתשובה 1 או 2, כדי לנטרל הטיית מיקום.
- פרוטוקול AI קבוע. מודל אחד קבוע, פרומפט אחיד, ניסיון אחד בלבד — ללא בחירה בין נסיונות. שדרוג מודל מתועד במדד.
- מודל נפרד לניסוח. המודל שמסייע בניסוח השאלות אינו המודל המתחרה.
- המומחה אנונימי. המומחה מוצג לפי תחום וניסיון בלבד; שמו נחשף רק בהסכמתו.
- ההצבעה ברשתות. ההצבעה מתבצעת בתגובות (1 או 2) בלינקדאין ובפייסבוק. אנחנו מתעדים צילומי מסך לפני חשיפת התוצאות.
- סף מדגם. סבב עם פחות מ-100 הצבעות מסומן כ"מדגם קטן".
מגבלות ידועות
ההצבעה פומבית ולכן חשופה להטיית עדר; הקהל המצביע אינו מדגם מייצג של האוכלוסייה אלא של עוקבי הסדרה. המדד מודד את העדפות הקהל הזה — בשקיפות מלאה.