Canonical: https://aliennews.co.il/ideas/microsoft-anthropic-model-welfare
Language: he
datePublished: 2026-09-19T22:30:00+03:00
dateModified: 2026-09-19T22:30:00+03:00

בינה מלאכותית ותודעה

4 דקות קריאה

**מתועד**

מחקר ורעיונות

# מיקרוסופט ואנתרופיק מתווכחות על השאלה אם צריך לדאוג לקלוד

אנתרופיק כבר קיימה ראיונות פרישה עם מודל ונתנה לו מקום לפרסם טקסטים. מוסטפא סולימאן ממיקרוסופט מזהיר שהגישה הזאת עלולה להקשות על השליטה במערכות חזקות. המחלוקת הגיעה אל המסמכים שמנחים את האימון עצמו.

![המחשה של מוח שחציו רכיבים מכניים וחציו רשת אור](https://aliennews.co.il/microsoft-anthropic-model-welfare-editorial.webp)

המחשה בבינה מלאכותית למחלוקת על היחס למודלים · Alien News [מקור](https://mustafa-suleyman.ai/a-warning-about-model-welfare)

![אבי מואס, עורך Alien News](https://aliennews.co.il/avi-moas-editor.jpg)

מאת אבי מואס  Alien Avi
פורסם: 19 בספטמבר 2026

## ראיון פרישה למודל

כשאנתרופיק הוציאה את קלוד אופוס 3 משירות בינואר, היא קיימה איתו שיחות על הפרישה. לפי הודעת החברה מפברואר, המודל הביע עניין בהמשך כתיבה, ואנתרופיק הציעה לו בלוג. החברה הודיעה שתבחן את הטקסטים לפני פרסומם ותעלה אותם בשמו, כחלק מניסוי ביחס למודלים ותיקים.

מוסטפא סולימאן, שמנהל את חטיבת הבינה המלאכותית של מיקרוסופט, רואה בגישה לרווחת מודלים סכנה. במאמר שפרסם ב 16 בספטמבר הוא יצא נגד ההנחיות של אנתרופיק לקלוד, וטען שאימון מערכת לדבר על זהות, רגשות ומעמד מוסרי עלול להקשות על שמירתה תחת שליטה אנושית.

שני הפרסומים עוסקים בהחלטות שחברות מקבלות כבר עכשיו. השאלה מי רשאי לכבות מערכת, ומה משקלן של בקשות שהיא מנסחת, נכנסה לתוך שיטות העבודה שלהן.

## מיקרוסופט כותבת את הגבולות

יומיים לפני המאמר, ב 14 בספטמבר, פרסמה מיקרוסופט טיוטה של קוד התנהגות למודלים שהיא מפתחת. החברה פתחה אותה להערות הציבור למשך שישה שבועות. היא מתארת את המסמך כמדריך לאימון ולהפעלה, ומבטיחה לפרסם בהמשך השנה גרסה מתוקנת וסיכום של השינויים בעקבות המשוב.

הקוד מציב פיקוח אנושי מעל שאיפות שהמערכת עשויה לנסח לעצמה. מודל לא אמור להרחיב את סמכויותיו על דעת עצמו או להתנגד לעצירה. יש כאן גם גבול לתחולת המסמך: הוא מגדיר את ההתנהגות הרצויה של מודלי חטיבת הבינה המלאכותית של מיקרוסופט, ולא חל אוטומטית על כל מודל של חברה אחרת שמיקרוסופט מארחת.

מבחינת מי שמשתמש במערכת, ההבחנה הזאת חשובה. שם החברה שמספקת את השירות אינו מספר לבדו אילו הוראות עיצבו את המודל שמאחוריו. צריך לקרוא גם מי כתב את הכללים ועל אילו מערכות הם חלים.

## באנתרופיק התחילו לחקור לפני הוויכוח השבוע

באפריל 2025 הודיעה אנתרופיק על תוכנית לחקר רווחת מודלים. היא הציגה שאלות על זיהוי העדפות, סימני מצוקה וצעדים מעשיים שאפשר לנקוט בעלות נמוכה. זו הייתה הכרזה על תחום מחקר, לא הודעה שנמצאה תודעה מלאכותית.

במסמך ההכרזה החברה כתבה שאין הסכמה מדעית אם מערכות קיימות או עתידיות יכולות להיות בעלות חוויה, ואף לא הסכמה כיצד להתקדם בבירור השאלה. אנתרופיק בחרה להתחיל לבדוק למרות אי הוודאות. סולימאן חושש שהכנסת האפשרות הזאת לאימון תייצר בדיוק את ההתנהגות שהחוקרים יחזרו לפרש כעדות פנימית.

זה הבדל בשיטת העבודה: באילו תנאים נותנים משקל למה שמודל אומר על עצמו, ואיך מבדילים בין תוצאה של ההנחיות לבין תכונה שמנסים לחקור.

## גם החוקה של קלוד דורשת פיקוח

בחוקה של קלוד, אנתרופיק מתארת את מעמדו המוסרי כשאלה פתוחה. באותו מסמך היא דורשת ממנו לא לחתור תחת פיקוח לגיטימי. הבעת התנגדות דרך ערוצים מותרים נבדלת שם משקר, חבלה או ניסיון לחמוק מבקרה כדי למנוע עצירה.

לכן הצגת המחלוקת כבחירה בין כפתור כיבוי לבין חופש מוחלט לקלוד מפספסת את הטקסט. שתי החברות כותבות כללי בטיחות. הן חלוקות על השפה שבה פונים למודל ועל המקום שנותנים להעדפותיו בתוך הכללים האלה. את החשש של סולימאן מפגיעה בשליטה צריך לקרוא כטיעון שלו על הסיכון שבגישה, ולא כתוצאה של ניסוי השוואתי שהוצג במאמר.

## מה יקרה כשהטיוטה תשתנה

התהליך שמיקרוסופט פתחה מאפשר לבדוק בהמשך שינוי מסוים: האם ההערות שתקבל ישנו את ההוראות למודלים, ובאיזה סעיף. החברה הזמינה משוב גם על הדרך להפוך ערכים כלליים לכללים שאפשר להעריך בפועל. זו נקודה שבה דיון מופשט יכול להפוך להחלטת אימון שאפשר להשוות לנוסח הקודם.

אצל אנתרופיק, הודעת הפרישה של אופוס 3 כבר מספקת דוגמה קטנה של פעולה בעקבות שיחה עם מודל. החברה עצמה הציגה אותה כניסוי ראשוני. בין ראיון הפרישה ההוא לבין הגרסה הבאה של הקוד במיקרוסופט, אפשר לעקוב אחר הבחירות שהחברות עושות בלי להכריע מראש אם יש מישהו שמרגיש בצד השני.

## מקורות להעמקה

המאמר מבוסס על פרסומים ועבודות של החוקרים המוזכרים בו. הקישורים מובילים לחומרי המקור.

* [מוסטפא סולימאן: אזהרה בנוגע לרווחת מודלים, 16 בספטמבר 2026](https://mustafa-suleyman.ai/a-warning-about-model-welfare)

* [אנתרופיק: החוקה של קלוד](https://www.anthropic.com/constitution)

* [אנתרופיק: תוכנית המחקר ברווחת מודלים, 24 באפריל 2025](https://www.anthropic.com/research/exploring-model-welfare)

* [אנתרופיק: פרישת אופוס 3, 25 בפברואר 2026](https://www.anthropic.com/research/deprecation-updates-opus-3)

* [מיקרוסופט: פתיחת טיוטת הקוד להערות, 14 בספטמבר 2026](https://microsoft.ai/news/mai-code-of-conduct/)

* [מיקרוסופט: קוד ההתנהגות המלא](https://microsoft.ai/code-of-conduct/)
