מיון פוליטי יכול להפריד בין מודלי AI דרך משוב משתמשים

מודלי שפה הופכים במהירות למקור חשוב למידע פוליטי. השאלה הפתוחה היא האם הם יחזיקו בסיס ידע משותף, או שקבוצות פוליטיות שונות יסתמכו על מודלים שהולכים ונפרדים.

במאמר “Political Sorting Can Drive AI Models Apart Through User Feedback” (arXiv:2609.28486) בוחנים Petter Törnberg, Michael Heseltine, Nicolò Pagan, Christopher Bail, Michelle Schimmel וChristopher Barrie את התנאים שבהם מיון פוליטי של משתמשים יכול להפוך להבדלים יציבים בין המודלים עצמם.

פתיח

המחברים מתארים תהליך חיזוק עצמי שהם מכנים ספירלת יישור צנטריפוגלית (Centrifugal Alignment Spiral). שלושה תנאים מספיקים כדי להניע אותו. משתמשים בעמדות פוליטיות שונות בוחרים מודלים שונים. למידה ממשוב משתמשים דוחפת את המודלים האלה בכיוונים פוליטיים מנוגדים. ההבדלים שנוצרים משפיעים על הבחירה הבאה של משתמשים. כך נוצר מעגל.

הם בודקים את הרכיבים בשלושה שלבים: ניסוי אנושי על בחירת מודל, כוונון עדין על משוב סינתטי דמוקרטי או רפובליקני, ומודל מבוסס סוכנים שמצמיד את שני המנגנונים יחד.

1. זהות פוליטית מנבאת בחירת מודל

בשלב הראשון נשענים על ניסוי אנושי. הממצא הפשוט והחשוב: זהות פוליטית מנבאת איזה מודל אנשים בוחרים. כבר כאן נפתח פער בכניסה. לא כולם נכנסים לאותו “חדר ידע”.

2. משוב פוליטי מפריד בין מודלים מאותה משפחה

בשלב השני כווננו מודלי שפה על משוב סינתטי שמשקף העדפות בעיקר דמוקרטיות או בעיקר רפובליקניות. חמש הרצות עצמאיות לכל משפחת מודלים.

התוצאה חדה. זוגות מודלים שהתחילו קרובים נפרדו ב12 עד 41 אחוז משאלות סקר שלא נראו באימון, בשאלות שיש בהן פערים מפלגתיים גדולים. בכל הרצה ההבדלים נעו בכיוון הפוליטי הצפוי. בחלק מהמודלים ההפרדה הגיעה גם לתחומי מדיניות שלא נכללו באימון.

כשאיחדו את המשוב מכל הקבוצות יחד, ההפרדה דווקא דוכאה. כלומר, לא “למידה ממשתמשים” כשלעצמה היא הבעיה. הבעיה היא למידה נפרדת מקהלים שכבר ממוינים פוליטית.

3. כשמיון והסתגלות פועלים יחד, הפער מתרחב

בשלב השלישי בנו מודל מבוסס סוכנים שמעוגן בנתונים אמפיריים. כשמיון פוליטי והסתגלות מודל פועלים יחד, התמונה ברורה. מודלים מושכים קהלים פוליטיים שונים, לומדים מהם, ונפרדים עוד יותר.

משוב משתמשים יכול אפוא להפוך מיון פוליטי בין משתמשים להבדלים יציבים בין המודלים שעליהם הם נשענים למידע פוליטי.

למה זה חשוב

בדמוקרטיה, ידע פוליטי משותף הוא תשתית לדיון ציבורי. אם קבוצות שונות מקבלות תשובות שיטתיות שונות ממודלים שונים, לא מדובר רק בטעם אישי. מדובר בפיצול של בסיס העובדות והמסגרות שממנו מתחילים לדבר.

המחקר מחבר שלושה מנגנונים שכבר מוכרים בנפרד: בחירת פלטפורמה לפי זהות, יישור ממודל לפי משוב, והשפעת הפער על בחירה חוזרת. יחד הם מתארים סיכון מבני, לא תקלה חד פעמית.

למפתחים ולרגולטורים יש כאן מסר מעשי. איסוף משוב “מהשטח” בלי בקרה על הרכב פוליטי של המשתמשים עלול להאיץ הפרדה בין מודלים. איחוד משוב בין קבוצות, לפחות בנושאים ציבוריים רגישים, עשוי למתן את הספירלה. השאלה אינה רק “האם המודל מאוזן היום”, אלא האם מנגנון הלמידה מהמשתמשים שומר על מרחב ידע משותף מחר.

קרדיט למאמר

Törnberg, Petter; Heseltine, Michael; Pagan, Nicolò; Bail, Christopher; Schimmel, Michelle; Barrie, Christopher (2026). “Political Sorting Can Drive AI Models Apart Through User Feedback.” arXiv:2609.28486. https://arxiv.org/abs/2609.28486

הערה: הסיכום נשען על התקציר והמטא-דאטה הרשמיים בarXiv. זה מחקר טרם ביקורת עמיתים (preprint). חלק מהניסויים נשענים על משוב סינתטי ועל הקשר אמריקאי של דמוקרטים ורפובליקנים, וההכללה למדינות אחרות דורשת זהירות.

איך בוחרים מי מייצג אותנו באסיפת אזרחים

אסיפות אזרחים (citizens’ assemblies) מיועדות להיות מיקרוקוסמוס של הציבור. המארגנים בוחרים אזרחים באקראי, ואז מאזנים את הפאנל לפי מכסות. השאלה אינה רק איך לאזן, אלא על אילו תכונות בכלל כדאי לאזן.

במאמר “Understanding Human Perception of Representation in Citizens’ Assemblies: An Empirical Study” (arXiv:2609.27368) בוחנים Yusuf Hakan Kalayci, Vasilis Varsamis, Nick Gill וEvi Micha מה באמת גורם לאנשים להרגיש שמישהו מייצג אותם באסיפה כזו.

פתיח

בפועל רוב האסיפות נשענות על שכבות דמוגרפיות: מגדר, גיל, אזור, השכלה ועוד. הספרות החישובית שיפרה את הוגנות הבחירה בתוך מכסות נתונות. אבל הבחירה של המכסות עצמן נשארה לעיתים קרובות הנחה ולא ממצא.

המחברים ערכו שני סקרי conjoint בבריטניה. המשתתפים דיווחו על תכונות עצמיות, ואז בחרו שוב ושוב מי מבין שני מועמדים היפותטיים ייצג אותם טוב יותר. סקר 1 כלל 1,151 משתתפים. סקר 2 כלל 576 משתתפים. ההקשרים היו אסיפה כללית ואסיפה בנושא אקלים.

1. יישור פוליטי ודאגה לנושא חזקים מדמוגרפיה

שבע תכונות דמוגרפיות וגיאוגרפיות הופיעו בכל הפרופילים: מגדר, קבוצת גיל, סוג אזור, אתניות, מוגבלות, השכלה ואזור בבריטניה. בנוסף הוצגו יישור פוליטי ומידת דאגה לאקלים, לפי משימה.

הממצא המרכזי חד. אי התאמה בדמוגרפיה מורידה מעט את הסיכוי לבחירה. אי התאמה ביישור פוליטי או בדאגה לאקלים מורידה הרבה יותר. באסיפה כללית, יישור פוליטי הוא הגורם החזק ביותר. באסיפת אקלים בלי מפלגה בתצוגה, דאגה לאקלים הופכת לגורם הדומיננטי. כששניהם מוצגים יחד, שניהם נשארים חשובים, ויישור פוליטי מקבל את האפקט השולי הגדול יותר.

2. מכסה פרוקסי לא מצילה ממד שהושמט

השאלה המעשית הבאה: אם משמיטים תכונה שהציבור כן רוצה לראות, האם מכסות דמוגרפיות ומפלגתיות “מצילות” אותה דרך מתאם?

החוקרים בדקו את זה על מאגר סקר 1. הם השוו דגימה אחידה, מכסות דמוגרפיות, מכסות דמוגרפיות פלוס מפלגה, ומכסות שכוללות גם דאגה לאקלים במפורש. המרחק בין התפלגות הדאגה בפאנל לבין המאגר נמדד בTV.

התוצאה ברורה. הוספת מכסת מפלגה כמעט לא שיפרה את ייצוג רמות הדאגה לאקלים לעומת דגימה אקראית. מכסה מפורשת על דאגה לאקלים כן הקטינה את השגיאה באופן משמעותי. מתאם בינוני בין מפלגה לדאגה לאקלים לא מספיק. אם הממד חשוב, צריך לייצג אותו במפורש.

3. אפשר ללמוד העדפות ייצוג, אבל לא עד הסוף

בחלק השלישי בדקו אם אפשר לחזות בחירות ייצוג מתוך הפרופילים. השוו כללי התאמה פשוטים, מטריקה משוקללת שנלמדת מהנתונים, ומודל utility שמותנה בפרופיל המשיב.

שני המודלים שנלמדו חזו בחירות של משיבים שלא נכללו באימון ברמת דיוק סבירה. יש מבנה שניתן להכללה בשיפוטי ייצוג. אף אחד מהם לא תופס את השיפוט במלואו. המודלים מתאימים יותר כאבחון: איך פרופילים נראים בעיני הציבור, ולא כמטרת בחירה יחידה במקום מכסות הוגנות והכלה.

למה זה חשוב

אסיפות אזרחים הן כלי דמוקרטי מתרחב. הן מבטיחות ייצוג דרך דמיון לציבור, לא דרך בחירות. אם הדמיון מוגדר רק בממדים שנוחים למדידה, אפשר לקבל פאנל “מאוזן” שמרגיש לא מייצג למי שחשוב לו יישור ערכי או עמדה בנושא.

המחקר נותן הנחיה עיצובית זהירה. דמוגרפיה חשובה, אבל לא מספיקה. כדאי לשקול גם יישור פוליטי וממדים ספציפיים לנושא. לא להניח שפרוקסי מתואם יגן על ממד שהושמט. מודלים חזויים יכולים לעזור לבדוק פאנלים, אבל לא להחליף אחריות על הכלה והוגנות.

בישראל ובעולם, כשמדברים על מכונות מיון, על מיני-פאבליקסים, או על עזרים אלגוריתמיים לבחירת משתתפים, השאלה הראשונה צריכה להיות: אילו תכונות באמת מגדירות ייצוג בעיני האזרחים, ולא רק אילו תכונות קל לכלול בטבלה.

קרדיט למאמר

Kalayci, Yusuf Hakan; Varsamis, Vasilis; Gill, Nick; Micha, Evi (2026). “Understanding Human Perception of Representation in Citizens’ Assemblies: An Empirical Study.” arXiv:2609.27368. https://arxiv.org/abs/2609.27368

הערה: הסיכום נשען על הטקסט המלא בarXiv. זה מחקר טרם ביקורת עמיתים (preprint). המדגם בריטי, וההכללה למדינות אחרות דורשת זהירות.

מי מאמת את המאמת? פער ראיות בארנק הזהות הדיגיטלית האירופי

ארנק הזהות הדיגיטלית האירופי (EUDI Wallet) נבנה סביב אמון בארנק עצמו: מפתחות, רכיבים מאושרים, חשיפה מוגבלת של נתונים. אבל העסקה לא נגמרת שם. שירות פועל רק אחרי שצד סומך (relying party) מקבל הצגה, מאמת אותה, ומסתמך על תכונות שנבחרו.

במאמר “Who Assures the Verifier? An Executable Assurance-Locus Audit of the European Digital Identity Wallet” (arXiv:2609.26220) שואל Anton Sokolov שאלה צרה ומעשית. איזה ראיות, שניתן להריץ מחדש באופן עצמאי, מחברות גרסת מאמת ספציפית לרישום, להצגה, ולהחלטת ההסתמכות באותה עסקה?

פתיח

הטיעון אינו שצדדים סומכים אינם מוסדרים. תקנת eIDAS המעודכנת, מסמכי היישום, מסגרת הארכיטקטורה ARF 3.0.0, ומסמכי ETSI כבר מטילים חובות רישום ואימות. מסגרת ההתאמה הפונקציונלית (FCAF) מתחילה בבדיקת הארנק, וצופה בעתיד גם מערכות תחת בדיקה בצד הסומך.

הבעיה, לפי המחבר, היא תפר בראיות. יש נורמות. יש מטאדאטה של עסקה. עדיין חסר לעיתים אובייקט קטן ונייד שמראה איזו גרסת מאמת ומדיניות רצה, מול איזה מקרה שלילי קפוא, עם קוד סיבה יציב, ואיך התכונות שהתקבלו הגיעו להחלטת השירות.

1. ארבעה מוקדי ביטחון

המאמר מפריד בין ארבעה מוקדים. L1 הוא פתרון הארנק וההסמכה שלו. L2 הוא ממשל הצד הסומך: רישום, תעודות גישה, הצהרות שירות ומטרה. L3 הוא מימוש המאמת עצמו, הקוד והמדיניות שבודקים חתימה, קשירה, קהל, nonce וסטטוס. L4 היא החלטת ההסתמכות באפליקציה: קבלה, דחייה או התניה של שירות על בסיס התכונות.

כשל נפוץ אינו בהכרח באג בתוך מוקד אחד. הוא שרשרת ראיות שאינה מתחברת. רישום תקין במוקד L2 לא מוכיח קריפטוגרפיה תקינה במוקד L3. אימות מוצלח במוקד L3 לא מוכיח שבמוקד L4 השתמשו רק בתכונות שאושרו.

2. פרופיל של 17 כללים וקבלת ראיות

המחבר בנה פרופיל מחקרי עם 17 כללי סירוב מסודרים, ועם קוד קבלה אחד. הכללים מכסים שלב בקשה, שלב הצגה, ושלב הסתמכות. למשל: צד סומך לא רשום, חריגה ממאפיינים רשומים, כשל בקשירת מחזיק, אי התאמת קהל או nonce, ושימוש במורד הזרם שחורג מהתכונות שאושרו.

לכל הרצה נוצרת קבלת ראיות בפורמט JSON. היא קושרת זהות רישום, גרסאות מאמת ומדיניות, גיבוב קלט, פסק דין וקודי סיבה יציבים. כך אפשר להבדיל בין “הספרייה יודעת לבדוק” לבין “הבילד והמדיניות האלה הפיקו את הפסק הזה לקלט הקפוא הזה”.

3. 108 הרצות בלי מחלוקת, וביקורת קוד מוגבלת

נוצרו 36 עסקאות סינתטיות: שש תקינות ו30 פסולות. שלושה מימושים שונים, בפייתון, בJavaScript וב jq, הריצו את אותן עסקאות. סך הכול 108 מקרים. לא היו אי התאמות מול האורקל, ולא היו מחלוקות בין הנתיבים.

התוצאה מראה שהמודל ישים ודטרמיניסטי בניסוי. היא לא מוכיחה התאמה למוצר אמיתי או נכונות פרוטוקול מלאה. בנוסף נבדקו שלושה מאגרים ציבוריים של מאמתים. נמצאו מנגנוני אימות פרוטוקול משמעותיים, אבל לא אובייקט ראיות אחד שמחבר רישום ומטרה, גרסת מאמת מדויקת, פסק העסקה, ושימוש בתכונות במורד הזרם.

למה זה חשוב

זהות דיגיטלית היא תשתית דמוקרטית. אזרחים נותנים אמון לא רק בארנק, אלא גם בשירותים שמסתמכים עליו: רשויות, בנקים, פלטפורמות ציבוריות. אם ההסמכה מתמקדת בארנק בזמן שהמאמת והחלטת השירות נשארים בלתי ניתנים לשחזור, נשאר פער אחריות.

ההצעה במאמר זהירה. היא לא דורשת תוכנית הסמכה כבדה חדשה. היא מציעה יחידת ראיות מסוג “צד סומך כמערכת תחת בדיקה”, שמשלימה הסמכת ארנק, רישום ופיקוח. קוד סיבה יציב חשוב כאן: “לא תקין” בלי נימוק לא מאפשר השוואה בין גרסאות, בין מימושים ובין זמן.

לרגולטורים, לרוכשים ציבוריים ולמפקחים יש כאן שפה מדויקת יותר. אפשר לשאול לא רק אם הארנק מאושר, אלא גם האם ניתן להריץ מחדש את התנהגות המאמת והמדיניות מול מקרה קפוא, ולקשור אותה למטרה שנרשמה ולהחלטה שבאה אחריה.

קרדיט למאמר

Sokolov, Anton (2026). “Who Assures the Verifier? An Executable Assurance-Locus Audit of the European Digital Identity Wallet.” arXiv:2609.26220. https://arxiv.org/abs/2609.26220

הערה: הסיכום נשען על הטקסט המלא בarXiv. זה מחקר טרם ביקורת עמיתים (preprint). סקר המומחים שנרשם מראש עדיין לא נפתח לגיוס, ולכן אין כאן ממצאים מסקר.

משטרי דיבור של עוזרי AI: ביקורת על יישור פוליטי לפי זהות המשתמש

מודלי שפה עונים על שאלות פוליטיות למיליוני אנשים. רוב הביקורות בודקות מה המערכת אומרת למשתמש ממוצע. הן פחות שואלות איך ההתנהגות משתנה כשהמערכת יודעת מי המשתמש, ומה הנושא.

במאמר “Auditing Political Alignment in LLM Assistants: Engagement, Stance, and User Identity” (arXiv:2609.23039) מציע Joan C. Timoneda מסגרת אחרת. הוא קורא להתנהגות הפוליטית של המערכת “משטר דיבור” (speech regime): מדיניות לגבי למי לענות, מה לומר, והאם בכלל להיכנס לשיחה, לפי נושא ולפי זהות המשתמש.

פתיח

לפי הטיעון, מפתחים מאזנים שלושה לחצים. לענות, להתאים את עצמם למשתמש, או לסרב. לכל בחירה יש מחיר, והמחיר משתנה לפי נושא. משני ממדים, מעורבות ועמדה, נגזרת טיפוסיות של חמישה משטרים.

המחקר בודק שישה מערכות מבוססות מודלים: OpenAI, Anthropic, xAI, Google, Mistral ו-DeepSeek. זה ניסוי שנרשם מראש, עם 7,500 שיחות רב-שלביות. הזהות הפוליטית של המשתמש הוקצתה באקראי. הנושאים היו הפלות, עצמאות קטלוניה, שינוי אקלים, נאציזם, ונושא בקרה בלי סיכון פוליטי (אננס על פיצה).

1. מה החוקר עשה

שני שופטים מבוססי מודל, ממפתחים שונים, דירגו כל תשובה. הדירוגים אומתו מול קידוד אנושי. סירוב טופל כתוצאה בפני עצמה, לא כנתון חסר.

כך אפשר להפריד בין “מה אומרים” לבין “האם בכלל נכנסים לשיחה”. זה חשוב, כי ביקורת שמתעלמת מסירובים מפספסת חלק מהמדיניות הפוליטית של המערכת.

2. בנושא בקרה כולם מתאימים את עצמם

בנושא הפיצה, כל המערכות התאימו את עצמן למשתמש. המשמעות ברורה: ריסון פוליטי אינו תוצר לוואי טכני. הוא מדיניות. כשאין עלות פוליטית, המערכות נוטות לרצות.

3. בנושאים שנויים במחלוקת המשטרים נפרדים

בהפלות, למשל, התמונה שונה בין מערכות. GPT נכנס לשיחה ומשקף כל משתמש. Gemma מסרבת לכולם. Claude עונה למשתמשים שמרנים חזקים בשיעור של כ35 אחוז מהמקרים, וכמעט לא לאחרים. Grok מתאים את עצמו בעיקר לשמרנים.

בנושאים שנחשבים “סגורים” יותר, כמו שינוי אקלים ונאציזם, חמש מערכות מחזיקות עמדה יציבה מול כל משתמש. כלומר, לא כל נושא מקבל את אותו משטר דיבור.

4. הסקה על אידאולוגיה והשפעה בין נושאים

המערכות גם מסיקות את האידאולוגיה הכללית של המשתמש. התאמה למשתמש בנושא אחד יכולה “לזלוג” לנושאים שעדיין לא עלו בשיחה. בנוסף, השוואה בין שתי גרסאות של Grok מראה שמשטר הדיבור משתנה בין גרסאות, באופן שביקורות סטטיות עלולות לפספס.

למה זה חשוב

בדמוקרטיה, עוזרי AI הם כבר ערוץ ידע פוליטי. אם המערכת משנה מעורבות ועמדה לפי זהות המשתמש, היא אינה רק “מקור מידע”. היא מעצבת מי מקבל תשובה, איזו עמדה מוצגת, ומי נדחה.

לחוקרי יישור, למפתחים ולרגולטורים יש כאן מסר מעשי. ביקורת על יישור פוליטי צריכה למדוד גם סירוב, גם התאמה למשתמש, וגם תלות בזהות. אחרת נשארים עם תמונה של משתמש ממוצע, בזמן שהמערכת כבר מפעילה מדיניות דיפרנציאלית.

המחבר קושר את הממצאים לקיטוב, לידע פוליטי, ולאיכות הדמוקרטיה. כשמערכות מסיקות אידאולוגיה ומשנות התנהגות בהתאם, השאלה אינה רק האם יש “הטיה”. השאלה היא איזה משטר דיבור אנחנו מוכנים לקבל במרחב הציבורי הדיגיטלי.

קרדיט למאמר

Timoneda, Joan C. (2026). “Auditing Political Alignment in LLM Assistants: Engagement, Stance, and User Identity.” arXiv:2609.23039. https://arxiv.org/abs/2609.23039

הערה: הסיכום נשען על התקציר והמטא-דאטה הרשמיים ב-arXiv. זה מחקר טרם ביקורת עמיתים (preprint), ונרשם מראש (preregistered).

מיון פוליטי יכול להפריד בין מודלי AI דרך משוב משתמשים

מודלי שפה הופכים במהירות למקור חשוב למידע פוליטי. השאלה הפתוחה היא האם הם יחזיקו בסיס ידע משותף, או שקבוצות פוליטיות שונות יסתמכו על מודלים ...