
זוהי תרגום מכונה של המסמך המקורי באנגלית. במקרה של סתירה בין תרגום זה לבין הגרסה המקורית באנגלית, הגרסה באנגלית היא הקובעת. קרא את הגרסה המקורית באנגלית
צינור האימון הגדול של הנתונים האישיים
2026-09-24 · Alex Wall, AIGP, CIPM, CIPP/US, CIPP/E, FIP, PLS, CISSP
השעה 16:40 ביום חמישי. העוזר המאושר הגיע למגבלה שלו, הוא לא המודל שהיא סומכת עליו לחוזים, או שהוא אינו מסוגל לגשת לכונן שבו נמצא החוזה. מועד ההגשה לא השתנה, ומצפים ממנה להיות "AI Native". אז היא מדביקה את החוזה ב-ChatGPT האישי שלה, ושלושים שניות לאחר מכן מקבלת ניתוח בשפה פשוטה ומקבלת החלטה.
אף אחד בסיפור הזה לא חושב שמשהו דלף, וזהו שימוש הגיוני לחלוטין ב-AI. אני חושב שזהו צינור הנתונים הגדול ביותר בתעשייה, והוא פועל בחסות כמה מילים קטנות בתנאי השימוש.
שני ספרי חוקים
כברירת מחדל, OpenAI אינה מאמנת על נתוני לקוחות עסקיים, אך עבור אנשים פרטיים המשתמשים ב-ChatGPT היא "עשויה להשתמש בתוכן שלך כדי לאמן את המודלים שלנו." Anthropic מאמנת על צ'אטים של משתמשים פרטיים "כאשר הגדרה זו מופעלת"; שימוש עסקי ושימוש ב-API פטורים מכך. מחוץ לאירופה, ה-API החינמי למפתחים של Google מאמן על מה שהוא מקבל; הגרסה בתשלום אינה עושה זאת. xAI מרחיקה לכת אף יותר: באזורים מסוימים מחוץ לאיחוד האירופי ולבריטניה, אם תשתמשו ב-Grok מבלי להתחבר, לא תוכלו לבטל את ההסכמה לאימון כלל.
הצד הצרכני נשען על הנחת יסוד פשוטה: מי שמקליד הוא הבעלים של מה שהוא מקליד, והוא הסכים לשתף זאת. תנאי השימוש של OpenAI מחייבים את המשתמשים "להצהיר ולהתחייב" שיש להם את מלוא הזכות לספק זאת.
הבעיה היא שהחוזה הוא מידע סודי של המעסיק שלה, והשמות שבו הם נתונים אישיים של לקוח. אף אחד מהם לא אישר דבר, וכעת זה תקוע במלכודת הדבק הענקית לשמירת נתונים בענן. החשש מפיטורים, הציפיות לזמני אספקה מהירים יותר והלחץ להיראות "AI Native" יצרו דליפת נתונים טכנית, שיטתית ומתמדת: הפרה של אמון הלקוחות ושל מדיניות החברה הכתובה.
לולאת ההלבנה
תחת תנאי שימוש צרכניים, מה שהיא הדביקה, האופן שבו היא עבדה על זה ומה שהיא הסיקה – כולם יכולים להפוך לנתוני אימון. כאשר החברה שלה רוכשת מאוחר יותר את גרסת הארגונים, היא מקבלת את הידע הזה בחזרה כשהמקור כובס ונמחק, ממוחזר כלוח סיבית של רעיונות ונמכר לפי מושב. ההפרדה בין תנאים אישיים למסחריים היא לולאת הלבנה למידע סודי ואישי, וערוץ זליגת סודות מסחריים שאיש אינו מפקח עליו. ויש לזה גם מחיר: IBM מצאה שאחד מכל חמישה ארגונים חווה פריצה שנגרמה מ-Shadow AI, ושימוש כבד ב-Shadow AI הוסיף לחשבון 670,000 דולר.
למה מדיניות לא תעצור את הדליפה
Netskope מגלה כי 47% מהאנשים שמשתמשים ב-AI יוצר בעבודה נעזרים באפליקציות AI אישיות, בעוד שתשעה מתוך עשרה ארגונים כבר חוסמים לפחות אפליקציית AI אחת. זה קורה בכל זאת, מכיוון שבכלי המאושר חסר דבר אחד: המודל שהאדם מעדיף, או גישה לקובץ, למאגר או למערכת שבהם העבודה תלויה. בסקר של Zapier בקרב חברות שמשלמות על AI, 53% ממשתמשי החשבונות האישיים העדיפו את הכלים שלהם, ו-33% אמרו שהכלי של החברה אינו מתאים לצרכים שלהם. חסימה פשוט מעבירה את פעולת ההדבקה לטלפון.
מה שסוגר את לולאת ההלבנה
אני לא חושב שמעבדות המחקר הן הנבלים בסיפור. האזור האפור מתאים כמעט לכולם: העובדים מסיימים את העבודה, המעסיקים מקבלים את התוצרים, והמעבדות מקבלות את הנתונים. הגורם היחיד שנעדר מהעסקה הוא זה שבבעלותו המידע.
מה שסוגר את הלולאה הוא כלי מאושר שאנשים יבחרו בו בכל מקרה. זו הסיבה שבניתי את Caiioo.
הוא מריץ כל מודל מוביל, ומודלים פתוחים על החומרה שלך. החלפת מודלים היא כמו החלפת מנוע במכונית: השיחות, הקבצים וההגדרות שלך נשארים במקומם.
הוא מביא את ה-AI אל העבודה שלך. הגישה לקבצים, לאימייל וליומנים נעשית מהמכשיר שלך, מבלי להעלות אותם לענן נוסף, והשיחות מסתנכרנות בהצפנה מקצה לקצה, כך שרק המכשירים שלך יכולים לקרוא אותן.
והוא מציג לאן כל בקשה הולכת. גבול האמון (Trust Boundary) מפרט אילו חברות AI מקבלות את הנתונים שלך ומה התנאים שלהן מאפשרים, ומתג אחד דוחה כל ספק שעשוי לאמן עליהם. אנחנו בונים את אותם מנגנוני בקרה כדי שחברה תוכל להפוך את המדיניות הכתובה שלה לחוקים מחייבים עבור כולם.
הקמתי את Caiioo כי אני מעריך יכולת, אוטונומיה ואבטחה. אני לא רוצה לבחור מנצח יחיד או להיות תלוי בחברת AI אחת; כבר עכשיו יש ריכוזיות כוח רבה מדי. חברות צריכות להשתמש בכלים האלה, להגן על הנתונים שלהן, ולהישאר עצמאיות.