איך בוחרים מי מייצג אותנו באסיפת אזרחים

אסיפות אזרחים (citizens’ assemblies) מיועדות להיות מיקרוקוסמוס של הציבור. המארגנים בוחרים אזרחים באקראי, ואז מאזנים את הפאנל לפי מכסות. השאלה אינה רק איך לאזן, אלא על אילו תכונות בכלל כדאי לאזן.

במאמר “Understanding Human Perception of Representation in Citizens’ Assemblies: An Empirical Study” (arXiv:2609.27368) בוחנים Yusuf Hakan Kalayci, Vasilis Varsamis, Nick Gill וEvi Micha מה באמת גורם לאנשים להרגיש שמישהו מייצג אותם באסיפה כזו.

פתיח

בפועל רוב האסיפות נשענות על שכבות דמוגרפיות: מגדר, גיל, אזור, השכלה ועוד. הספרות החישובית שיפרה את הוגנות הבחירה בתוך מכסות נתונות. אבל הבחירה של המכסות עצמן נשארה לעיתים קרובות הנחה ולא ממצא.

המחברים ערכו שני סקרי conjoint בבריטניה. המשתתפים דיווחו על תכונות עצמיות, ואז בחרו שוב ושוב מי מבין שני מועמדים היפותטיים ייצג אותם טוב יותר. סקר 1 כלל 1,151 משתתפים. סקר 2 כלל 576 משתתפים. ההקשרים היו אסיפה כללית ואסיפה בנושא אקלים.

1. יישור פוליטי ודאגה לנושא חזקים מדמוגרפיה

שבע תכונות דמוגרפיות וגיאוגרפיות הופיעו בכל הפרופילים: מגדר, קבוצת גיל, סוג אזור, אתניות, מוגבלות, השכלה ואזור בבריטניה. בנוסף הוצגו יישור פוליטי ומידת דאגה לאקלים, לפי משימה.

הממצא המרכזי חד. אי התאמה בדמוגרפיה מורידה מעט את הסיכוי לבחירה. אי התאמה ביישור פוליטי או בדאגה לאקלים מורידה הרבה יותר. באסיפה כללית, יישור פוליטי הוא הגורם החזק ביותר. באסיפת אקלים בלי מפלגה בתצוגה, דאגה לאקלים הופכת לגורם הדומיננטי. כששניהם מוצגים יחד, שניהם נשארים חשובים, ויישור פוליטי מקבל את האפקט השולי הגדול יותר.

2. מכסה פרוקסי לא מצילה ממד שהושמט

השאלה המעשית הבאה: אם משמיטים תכונה שהציבור כן רוצה לראות, האם מכסות דמוגרפיות ומפלגתיות “מצילות” אותה דרך מתאם?

החוקרים בדקו את זה על מאגר סקר 1. הם השוו דגימה אחידה, מכסות דמוגרפיות, מכסות דמוגרפיות פלוס מפלגה, ומכסות שכוללות גם דאגה לאקלים במפורש. המרחק בין התפלגות הדאגה בפאנל לבין המאגר נמדד בTV.

התוצאה ברורה. הוספת מכסת מפלגה כמעט לא שיפרה את ייצוג רמות הדאגה לאקלים לעומת דגימה אקראית. מכסה מפורשת על דאגה לאקלים כן הקטינה את השגיאה באופן משמעותי. מתאם בינוני בין מפלגה לדאגה לאקלים לא מספיק. אם הממד חשוב, צריך לייצג אותו במפורש.

3. אפשר ללמוד העדפות ייצוג, אבל לא עד הסוף

בחלק השלישי בדקו אם אפשר לחזות בחירות ייצוג מתוך הפרופילים. השוו כללי התאמה פשוטים, מטריקה משוקללת שנלמדת מהנתונים, ומודל utility שמותנה בפרופיל המשיב.

שני המודלים שנלמדו חזו בחירות של משיבים שלא נכללו באימון ברמת דיוק סבירה. יש מבנה שניתן להכללה בשיפוטי ייצוג. אף אחד מהם לא תופס את השיפוט במלואו. המודלים מתאימים יותר כאבחון: איך פרופילים נראים בעיני הציבור, ולא כמטרת בחירה יחידה במקום מכסות הוגנות והכלה.

למה זה חשוב

אסיפות אזרחים הן כלי דמוקרטי מתרחב. הן מבטיחות ייצוג דרך דמיון לציבור, לא דרך בחירות. אם הדמיון מוגדר רק בממדים שנוחים למדידה, אפשר לקבל פאנל “מאוזן” שמרגיש לא מייצג למי שחשוב לו יישור ערכי או עמדה בנושא.

המחקר נותן הנחיה עיצובית זהירה. דמוגרפיה חשובה, אבל לא מספיקה. כדאי לשקול גם יישור פוליטי וממדים ספציפיים לנושא. לא להניח שפרוקסי מתואם יגן על ממד שהושמט. מודלים חזויים יכולים לעזור לבדוק פאנלים, אבל לא להחליף אחריות על הכלה והוגנות.

בישראל ובעולם, כשמדברים על מכונות מיון, על מיני-פאבליקסים, או על עזרים אלגוריתמיים לבחירת משתתפים, השאלה הראשונה צריכה להיות: אילו תכונות באמת מגדירות ייצוג בעיני האזרחים, ולא רק אילו תכונות קל לכלול בטבלה.

קרדיט למאמר

Kalayci, Yusuf Hakan; Varsamis, Vasilis; Gill, Nick; Micha, Evi (2026). “Understanding Human Perception of Representation in Citizens’ Assemblies: An Empirical Study.” arXiv:2609.27368. https://arxiv.org/abs/2609.27368

הערה: הסיכום נשען על הטקסט המלא בarXiv. זה מחקר טרם ביקורת עמיתים (preprint). המדגם בריטי, וההכללה למדינות אחרות דורשת זהירות.

מי מאמת את המאמת? פער ראיות בארנק הזהות הדיגיטלית האירופי

ארנק הזהות הדיגיטלית האירופי (EUDI Wallet) נבנה סביב אמון בארנק עצמו: מפתחות, רכיבים מאושרים, חשיפה מוגבלת של נתונים. אבל העסקה לא נגמרת שם. שירות פועל רק אחרי שצד סומך (relying party) מקבל הצגה, מאמת אותה, ומסתמך על תכונות שנבחרו.

במאמר “Who Assures the Verifier? An Executable Assurance-Locus Audit of the European Digital Identity Wallet” (arXiv:2609.26220) שואל Anton Sokolov שאלה צרה ומעשית. איזה ראיות, שניתן להריץ מחדש באופן עצמאי, מחברות גרסת מאמת ספציפית לרישום, להצגה, ולהחלטת ההסתמכות באותה עסקה?

פתיח

הטיעון אינו שצדדים סומכים אינם מוסדרים. תקנת eIDAS המעודכנת, מסמכי היישום, מסגרת הארכיטקטורה ARF 3.0.0, ומסמכי ETSI כבר מטילים חובות רישום ואימות. מסגרת ההתאמה הפונקציונלית (FCAF) מתחילה בבדיקת הארנק, וצופה בעתיד גם מערכות תחת בדיקה בצד הסומך.

הבעיה, לפי המחבר, היא תפר בראיות. יש נורמות. יש מטאדאטה של עסקה. עדיין חסר לעיתים אובייקט קטן ונייד שמראה איזו גרסת מאמת ומדיניות רצה, מול איזה מקרה שלילי קפוא, עם קוד סיבה יציב, ואיך התכונות שהתקבלו הגיעו להחלטת השירות.

1. ארבעה מוקדי ביטחון

המאמר מפריד בין ארבעה מוקדים. L1 הוא פתרון הארנק וההסמכה שלו. L2 הוא ממשל הצד הסומך: רישום, תעודות גישה, הצהרות שירות ומטרה. L3 הוא מימוש המאמת עצמו, הקוד והמדיניות שבודקים חתימה, קשירה, קהל, nonce וסטטוס. L4 היא החלטת ההסתמכות באפליקציה: קבלה, דחייה או התניה של שירות על בסיס התכונות.

כשל נפוץ אינו בהכרח באג בתוך מוקד אחד. הוא שרשרת ראיות שאינה מתחברת. רישום תקין במוקד L2 לא מוכיח קריפטוגרפיה תקינה במוקד L3. אימות מוצלח במוקד L3 לא מוכיח שבמוקד L4 השתמשו רק בתכונות שאושרו.

2. פרופיל של 17 כללים וקבלת ראיות

המחבר בנה פרופיל מחקרי עם 17 כללי סירוב מסודרים, ועם קוד קבלה אחד. הכללים מכסים שלב בקשה, שלב הצגה, ושלב הסתמכות. למשל: צד סומך לא רשום, חריגה ממאפיינים רשומים, כשל בקשירת מחזיק, אי התאמת קהל או nonce, ושימוש במורד הזרם שחורג מהתכונות שאושרו.

לכל הרצה נוצרת קבלת ראיות בפורמט JSON. היא קושרת זהות רישום, גרסאות מאמת ומדיניות, גיבוב קלט, פסק דין וקודי סיבה יציבים. כך אפשר להבדיל בין “הספרייה יודעת לבדוק” לבין “הבילד והמדיניות האלה הפיקו את הפסק הזה לקלט הקפוא הזה”.

3. 108 הרצות בלי מחלוקת, וביקורת קוד מוגבלת

נוצרו 36 עסקאות סינתטיות: שש תקינות ו30 פסולות. שלושה מימושים שונים, בפייתון, בJavaScript וב jq, הריצו את אותן עסקאות. סך הכול 108 מקרים. לא היו אי התאמות מול האורקל, ולא היו מחלוקות בין הנתיבים.

התוצאה מראה שהמודל ישים ודטרמיניסטי בניסוי. היא לא מוכיחה התאמה למוצר אמיתי או נכונות פרוטוקול מלאה. בנוסף נבדקו שלושה מאגרים ציבוריים של מאמתים. נמצאו מנגנוני אימות פרוטוקול משמעותיים, אבל לא אובייקט ראיות אחד שמחבר רישום ומטרה, גרסת מאמת מדויקת, פסק העסקה, ושימוש בתכונות במורד הזרם.

למה זה חשוב

זהות דיגיטלית היא תשתית דמוקרטית. אזרחים נותנים אמון לא רק בארנק, אלא גם בשירותים שמסתמכים עליו: רשויות, בנקים, פלטפורמות ציבוריות. אם ההסמכה מתמקדת בארנק בזמן שהמאמת והחלטת השירות נשארים בלתי ניתנים לשחזור, נשאר פער אחריות.

ההצעה במאמר זהירה. היא לא דורשת תוכנית הסמכה כבדה חדשה. היא מציעה יחידת ראיות מסוג “צד סומך כמערכת תחת בדיקה”, שמשלימה הסמכת ארנק, רישום ופיקוח. קוד סיבה יציב חשוב כאן: “לא תקין” בלי נימוק לא מאפשר השוואה בין גרסאות, בין מימושים ובין זמן.

לרגולטורים, לרוכשים ציבוריים ולמפקחים יש כאן שפה מדויקת יותר. אפשר לשאול לא רק אם הארנק מאושר, אלא גם האם ניתן להריץ מחדש את התנהגות המאמת והמדיניות מול מקרה קפוא, ולקשור אותה למטרה שנרשמה ולהחלטה שבאה אחריה.

קרדיט למאמר

Sokolov, Anton (2026). “Who Assures the Verifier? An Executable Assurance-Locus Audit of the European Digital Identity Wallet.” arXiv:2609.26220. https://arxiv.org/abs/2609.26220

הערה: הסיכום נשען על הטקסט המלא בarXiv. זה מחקר טרם ביקורת עמיתים (preprint). סקר המומחים שנרשם מראש עדיין לא נפתח לגיוס, ולכן אין כאן ממצאים מסקר.

משטרי דיבור של עוזרי AI: ביקורת על יישור פוליטי לפי זהות המשתמש

מודלי שפה עונים על שאלות פוליטיות למיליוני אנשים. רוב הביקורות בודקות מה המערכת אומרת למשתמש ממוצע. הן פחות שואלות איך ההתנהגות משתנה כשהמערכת יודעת מי המשתמש, ומה הנושא.

במאמר “Auditing Political Alignment in LLM Assistants: Engagement, Stance, and User Identity” (arXiv:2609.23039) מציע Joan C. Timoneda מסגרת אחרת. הוא קורא להתנהגות הפוליטית של המערכת “משטר דיבור” (speech regime): מדיניות לגבי למי לענות, מה לומר, והאם בכלל להיכנס לשיחה, לפי נושא ולפי זהות המשתמש.

פתיח

לפי הטיעון, מפתחים מאזנים שלושה לחצים. לענות, להתאים את עצמם למשתמש, או לסרב. לכל בחירה יש מחיר, והמחיר משתנה לפי נושא. משני ממדים, מעורבות ועמדה, נגזרת טיפוסיות של חמישה משטרים.

המחקר בודק שישה מערכות מבוססות מודלים: OpenAI, Anthropic, xAI, Google, Mistral ו-DeepSeek. זה ניסוי שנרשם מראש, עם 7,500 שיחות רב-שלביות. הזהות הפוליטית של המשתמש הוקצתה באקראי. הנושאים היו הפלות, עצמאות קטלוניה, שינוי אקלים, נאציזם, ונושא בקרה בלי סיכון פוליטי (אננס על פיצה).

1. מה החוקר עשה

שני שופטים מבוססי מודל, ממפתחים שונים, דירגו כל תשובה. הדירוגים אומתו מול קידוד אנושי. סירוב טופל כתוצאה בפני עצמה, לא כנתון חסר.

כך אפשר להפריד בין “מה אומרים” לבין “האם בכלל נכנסים לשיחה”. זה חשוב, כי ביקורת שמתעלמת מסירובים מפספסת חלק מהמדיניות הפוליטית של המערכת.

2. בנושא בקרה כולם מתאימים את עצמם

בנושא הפיצה, כל המערכות התאימו את עצמן למשתמש. המשמעות ברורה: ריסון פוליטי אינו תוצר לוואי טכני. הוא מדיניות. כשאין עלות פוליטית, המערכות נוטות לרצות.

3. בנושאים שנויים במחלוקת המשטרים נפרדים

בהפלות, למשל, התמונה שונה בין מערכות. GPT נכנס לשיחה ומשקף כל משתמש. Gemma מסרבת לכולם. Claude עונה למשתמשים שמרנים חזקים בשיעור של כ35 אחוז מהמקרים, וכמעט לא לאחרים. Grok מתאים את עצמו בעיקר לשמרנים.

בנושאים שנחשבים “סגורים” יותר, כמו שינוי אקלים ונאציזם, חמש מערכות מחזיקות עמדה יציבה מול כל משתמש. כלומר, לא כל נושא מקבל את אותו משטר דיבור.

4. הסקה על אידאולוגיה והשפעה בין נושאים

המערכות גם מסיקות את האידאולוגיה הכללית של המשתמש. התאמה למשתמש בנושא אחד יכולה “לזלוג” לנושאים שעדיין לא עלו בשיחה. בנוסף, השוואה בין שתי גרסאות של Grok מראה שמשטר הדיבור משתנה בין גרסאות, באופן שביקורות סטטיות עלולות לפספס.

למה זה חשוב

בדמוקרטיה, עוזרי AI הם כבר ערוץ ידע פוליטי. אם המערכת משנה מעורבות ועמדה לפי זהות המשתמש, היא אינה רק “מקור מידע”. היא מעצבת מי מקבל תשובה, איזו עמדה מוצגת, ומי נדחה.

לחוקרי יישור, למפתחים ולרגולטורים יש כאן מסר מעשי. ביקורת על יישור פוליטי צריכה למדוד גם סירוב, גם התאמה למשתמש, וגם תלות בזהות. אחרת נשארים עם תמונה של משתמש ממוצע, בזמן שהמערכת כבר מפעילה מדיניות דיפרנציאלית.

המחבר קושר את הממצאים לקיטוב, לידע פוליטי, ולאיכות הדמוקרטיה. כשמערכות מסיקות אידאולוגיה ומשנות התנהגות בהתאם, השאלה אינה רק האם יש “הטיה”. השאלה היא איזה משטר דיבור אנחנו מוכנים לקבל במרחב הציבורי הדיגיטלי.

קרדיט למאמר

Timoneda, Joan C. (2026). “Auditing Political Alignment in LLM Assistants: Engagement, Stance, and User Identity.” arXiv:2609.23039. https://arxiv.org/abs/2609.23039

הערה: הסיכום נשען על התקציר והמטא-דאטה הרשמיים ב-arXiv. זה מחקר טרם ביקורת עמיתים (preprint), ונרשם מראש (preregistered).

ניסויים בשטח בפלטפורמות פתוחות: איך חוקרים יכולים לבדוק רשתות חברתיות בלי תלות בחברות

יש ביקוש גובר לראיות סיבתיות על רשתות חברתיות. במקביל, חוקרים עצמאיים נתקלים שוב ושוב באותו מחסום: קשה מאוד להריץ ניסויים אמיתיים בתוך הפלטפורמות עצמן. מאמר חדש מציע מסגרת מתודולוגית למה שהוא מכנה Open Platform Field Experiments, ניסויי שטח בפלטפורמות פתוחות.

במאמר “Open Platform Field Experiments: Expanding the Design Space of Experimental Research on Social Media” (arXiv:2609.21608) כותבים Jordi Guillem Condom-Tibau, Giovanni Puccetti, Clara Bacciu, Matteo Abrate ו־Stefano Cresci שהופעת פלטפורמות חברתיות פתוחות פותחת הזדמנות שונה איכותית. במקום לעבוד רק מסביב לפלטפורמה, אפשר להתערב ישירות ברכיבים פונקציונליים בסביבה חיה.

פתיח

שאלות על המלצות אלגוריתמיות, מתינות תוכן והשפעה על שיח ציבורי הן שאלות דמוקרטיות לא פחות מטכנולוגיות. בלי יכולת לבדוק סיבתיות, נשארים עם תצפיות, סקרים והשערות. המאמר מבקש להרחיב את מרחב העיצוב של מחקר ניסויי ברשתות חברתיות, ולהגדיר מתי ניסוי בשטח על פלטפורמה פתוחה הוא בכלל אפשרי.

1. למה חוקרים נתקעים

לדברי המחברים, חוקרים עצמאיים מוגבלים מאוד ביכולתם להריץ ניסויים ישירות על פלטפורמות מקוונות. כמענה צצו פתרונות עוקפים: סקרים מבוקרים, סימולציות, שכבות לקוח, ושיתופי פעולה עם הפלטפורמות. כל אחד מהם דורש פשרות שונות בין תכונות ניסוי רצויות, למשל שליטה, תוקף חיצוני ושקיפות.

המסר הוא לא שאין מחקר. יש הרבה מחקר. הבעיה היא שהכלים הקיימים לא תמיד מאפשרים לענות על השאלות הסיבתיות החשובות ביותר לגבי השפעת הרשת על התנהגות ציבורית.

2. מה זה OPFE

המחברים מציעים מרחב עיצוב לניסויים ברשתות חברתיות, ובתוכו דנים ב־Open Platform Field Experiments. זו מחלקה נפרדת של גישות ניסוי. הרעיון: חוקרים עצמאיים יכולים להתערב ישירות ברכיבים פונקציונליים של פלטפורמה חיה, למשל לקוחות, מערכות המלצה ושירותי מתינות.

בניגוד לניסוי שמתבצע רק מחוץ לפלטפורמה, כאן ההתערבות קורית בתוך סביבה חברתית חיה. זה אמור לשפר את העגינה האקולוגית של הממצאים, כלומר את הדמיון למציאות שבה אנשים באמת משתמשים ברשת.

3. איפה זה יושב במרחב השיטות

באמצעות השוואה בין ארכיטיפים ניסויים, המחברים טוענים ש־OPFE תופס אזור שלא נחקר מספיק עד כה במרחב העיצוב. במילים פשוטות, זו לא עוד וריאציה של סקר או של שותפות עם חברה גדולה. זו קטגוריה מתודולוגית נפרדת, שדורשת גם ארכיטקטורה וגם ממשל מתאימים.

4. מגשרים בין תיאוריה לפרקטיקה: Bluesky ו־AT Protocol

המאמר לא נשאר ברמת ההגדרה. הוא מאפיין רכיבי ארכיטקטורה וממשל שמאפשרים OPFE, ממפה אותם על Bluesky ועל ה־AT Protocol, ומדגים מחזור חיים מלא של תכנון ניסוי כזה מקצה לקצה.

הבחירה בפלטפורמות פתוחות חשובה: כשיש גישה לרכיבים ולכללים, אפשר לעצב התערבות שקופה יותר, ולבדוק השערות בלי להיות תלויים במתן גישה חד־צדדי מחברה סגורה.

5. מה זה נותן לדמוקרטיה

עבור דיון על דמוקרטיה ומידע, המתודה היא חלק מהבעיה. אם אי אפשר לבדוק באופן עצמאי איך המלצות, מתינות או עיצוב ממשק משפיעים על חשיפה פוליטית, אז גם רגולציה וגם ביקורת ציבורית נשענות על תמונה חלקית.

OPFE מוצע כאן כפרדיגמה מעשית לניסוי עצמאי, שקוף ומעוגן במציאות, על רשתות חברתיות פתוחות. לא פתרון קסם לכל פלטפורמה, אלא כיוון מחקרי שמחזיר לחוקרים עצמאות מול סביבות שבהן רוב השיח הציבורי מתרחש.

למה זה חשוב

ככל שהשיח הדמוקרטי עובר לרשת, היכולת לחקור את הרשת הופכת ליכולת דמוקרטית. מאמר העמדה המתודולוגי הזה מציע דרך להרחיב את ארגז הכלים: פחות תלות בחסדי פלטפורמות סגורות, יותר ניסויים בשטח בסביבות פתוחות.

השאלה למקבלי מדיניות ולחוקרים היא פשוטה. האם נמשיך ללמוד על השפעת הרשת בעיקר מבחוץ, או שנבנה כלים שמאפשרים בדיקה סיבתית מבפנים, בשקיפות ובאחריות?

קרדיט למאמר

Condom-Tibau, Jordi Guillem; Puccetti, Giovanni; Bacciu, Clara; Abrate, Matteo; and Cresci, Stefano. (2026). “Open Platform Field Experiments: Expanding the Design Space of Experimental Research on Social Media.” arXiv:2609.21608. https://arxiv.org/abs/2609.21608

הערה: הסיכום מבוסס על התקציר והמטא־דאטה הרשמיים ב־arXiv. זה מאמר מתודולוגי שמציע מסגרת ופרדיגמה, לא דיווח על תוצאות ניסוי שדה ספציפי עם מדגם בוחרים.

איך בוחרים מי מייצג אותנו באסיפת אזרחים

אסיפות אזרחים (citizens’ assemblies) מיועדות להיות מיקרוקוסמוס של הציבור. המארגנים בוחרים אזרחים באקראי, ואז מאזנים את הפאנל לפי מכסות. השאל...