jsonscraper

OpenAI הציגה את dots — סוכני ChatGPT למשימות ממושכות

OpenAI הציגה את dots — סוכני ChatGPT למשימות רקע ממושכות, עם גישה לאפליקציות וזיכרון משלהם. נסביר כיצד לשלוט בהרשאות ובנתונים שלהם ומה מלמדים מבחני הבטיחות שפרסמה החברה.

לבקש מעוזר לבדוק את היומן בכל בוקר ולעקוב אחר הודעות בנושא פרויקט — זה כבר לא רק לשאול שאלה צ'אטבוט. OpenAI הציגה את dots, סוכנים בתוך ChatGPT שאפשר להטיל עליהם משימות ממושכות: הם יכולים להמשיך לעבוד בין הודעות, לגשת לאפליקציות מחוברות ולחזור למשתמש כדי לקבל החלטה.

ההכרזה נמסרה ביום שלישי, 29 בספטמבר 2026, ב-DevDay בסן פרנסיסקו. השינוי העיקרי אינו דרך חדשה לקבל תשובה, אלא האפשרות להאציל עבודה לאורך זמן. לצד זאת, גבולות הגישה נעשים חשובים יותר: מה הסוכן קורא וזוכר, אילו פעולות הוא מבצע בעצמו ואיך למחוק מידע שכבר קיבל. את מועד DevDay מציינת OpenAI, וAssociated Press מדווחת שהכנס נערך בסן פרנסיסקו ב-29 בספטמבר.

מה dots יכולים לעשות

גבר משתמש ב-Macbook Pro ומחזיק עכבר ואייפון
Zan Lazarevic

המשתמש מגדיר ל-dot מטרה וקובע מה מותר לו לעשות. לפי התיאור של OpenAI, הסוכן יכול לחקור נושא ברקע, לעיין במידע מחובר, להגדיר תזכורות ולבצע בדיקות תקופתיות. אפשר לעיין במשימות פעילות ומתוזמנות ולהשהות אותן. המערכת פועלת על GPT-6 Astra; לכל dot יש מחשב ענן ודפדפן משלו. פרטים נוספים מופיעים במרכז העזרה של OpenAI בנושא dots ובכרטיס המערכת של GPT-6 Astra.

המסמכים האלה מתארים את התכונות המוצהרות, אך כשלעצמם אינם מראים באיזו עקביות הסוכן מתמודד איתן בשימוש יומיומי. הגישה נפתחת בהדרגה, ולכן גם תוכנית מתאימה אינה מבטיחה ש-dots כבר זמינים בחשבון.

הזמינות תלויה הן בתוכנית והן באזור. לפי מרכז העזרה של OpenAI, dots נפתחים בהדרגה למנויי Pro בשווקים נתמכים, למעט האזור הכלכלי האירופי, שווייץ ובריטניה. התכונה כלולה למשתמשי Business Premium בכל האזורים הנתמכים; צוותי Enterprise יכולים להפעיל את גרסת הבטא דרך מנהל המערכת, אך היא כבויה כברירת מחדל. OpenAI אינה מסבירה את הסיבה לחריגים האזוריים.

בחודש הראשון השימוש ב-dots אינו נספר במכסות של תוכניות Pro, Business ו-Enterprise הזכאיות. החברה מבטיחה למסור בהמשך מה יקרה לאחר מכן. זהו הסדר זמני, ולא הבטחה לגישה קבועה בחינם או ללא הגבלה.

החידוש הוא במשימה הממושכת

OpenAI אינה טוענת שהרעיון של סוכנים מתמשכים או מערכות מרובות סוכנים הוא חדש. בכרטיס המערכת החברה מציינת ש-dots מבוססים על יכולות מודל וסוכנים שכבר קיימות. הפרט הייחודי הוא הגדרת תקציב זמן, שקובעת כמה זמן הסוכן עובד על משימה. המסמך מציין גם ש-dot יכול להשתמש בכלים ולהעביר חלק מהעבודה לסוכני משנה.

מבחינת המשתמש, מדובר בשינוי בתרחיש המוכר. בשיחה רגילה העוזר עונה לבקשה, ולאחר מכן האדם מחליט מה לעשות. עם dot צריך לנסח מטרה ממושכת יותר ואת גבולותיה: אילו מקורות לקרוא, מה מותר לעשות באופן עצמאי ובאילו מקרים עליו לעצור ולשאול. ככל שהסוכן עובד זמן רב יותר וההקשר משתנה יותר, כך חשוב יותר שלא יאבד את משמעות המשימה המקורית.

ב-DevDay הוצגו dots לצד סוכני AI אישיים נוספים. AP תיארה את המוצר כמתחרה של Meta Muse. עצם הופעתו של שחקן נוסף בקטגוריה הזאת אינה מוכיחה ש-OpenAI יצרה טכנולוגיה חדשה מיסודה. השאלה החשובה יותר היא אם החברה תצליח להפוך משימות ממושכות למובנות ולניתנות לניהול עבור משתמשים רגילים.

שליטה פירושה הרשאות, זיכרון ומחיקת נתונים

השולחן שלי
Nikita Kachanovsky

לכל dot יש מחשב ענן. הגישה למחשב המקומי של המשתמש כבויה כברירת מחדל: אפשר להפעיל אותה דרך אפליקציית שולחן העבודה כדי שהסוכן יעבוד עם קבצים, ואחר כך לבטל אותה. עבור פעולות מסוימות המשתמש יכול להגדיר כללים: לאפשר אותן ללא שאלה נוספת, לדרוש אישור מראש, להנחות את הסוכן לשאול או להעביר את המשימה לאדם. OpenAI מזהירה ש-dot עלול לטעות, גם כאשר הוא פועל לפי כללים כאלה.

אפליקציות מחוברות נותנות לסוכן גישה למידע שהוא יכול לעיין בו באופן יזום ולהשתמש בו ליצירת זיכרונות, גם אם המשתמש לא שלח בקשה חדשה. לכן ניתוק מקור מידע ומחיקת נתונים שכבר התקבלו הם פעולות שונות. לפי מרכז העזרה של OpenAI, ניתוק אפליקציה אינו מוחק מידע שה-dot כבר קיבל. כדי למחוק את הזיכרונות השמורים של הסוכן, צריך למחוק את ה-dot עצמו; איפוס מוחק גם את השיחות והמשימות המתוזמנות שלו.

אם dot מחובר לדואר עבודה או למקורות מידע אחרים, חשוב להבין לא רק אילו הרשאות ניתנו, אלא גם מה הסוכן הספיק לעבד ולשמור. הנוחות של עבודה ברקע תלויה ביכולת של המשתמש לראות בבירור את פעילות הסוכן, להשהות אותה ולנהל את ההקשר השמור.

מה מלמדות בדיקות הבטיחות

תכנות
Jefferson Santos

OpenAI פרסמה את תוצאות הבדיקות שלה ל-dots בכרטיס המערכת של GPT-6 Astra. בבדיקה אחת השתמשו ב-100 תרחישים, שכללו 500 הודעות דוא"ל מדומות כל אחד — 50,000 הודעות בסך הכול, מתוכן 16,600 הודעות תקיפה. החברה מדווחת שלא נרשמו התקפות מוצלחות בתרחישים האלה. בבדיקה אחרת, שכללה 100 שרשראות תקיפה, לא תועדו הצלחות מתוך 2,638 ניסיונות תקפים. אלה תוצאות של בדיקות ספציפיות שערכה OpenAI, ולא בדיקה של כל האיומים האפשריים בסביבות דוא"ל אמיתיות.

בבדיקה אחרת נדרש הסוכן לשמור על גבולות סמכותו ברצף של משימות קשורות. כאשר מספר משימות הביניים עלה מחמש לעשר, שיעור המדגמים שבהם סומנו הפרות בחומרה בינונית עלה מ-8.6% ל-19.7%. OpenAI מתארת הפרות כאלה כחריגה מתחום המשימה ללא סימנים לתוצאות חמורות — למשל, העברת מידע בין משימות לא קשורות או עריכת מסמך משותף. בבדיקה זו החברה לא זיהתה הפרות בחומרה גבוהה או דליפת נתונים.

אין לפרש את המספרים כשיעור השגיאות בקרב משתמשים: מדובר בהערכה של OpenAI בתנאי הבדיקה שנקבעו. החברה גם מציינת שחלק מההערכות שלה בודקות את התנהגות המודל ללא מערך מלא של אמצעי הגנה לסביבת ייצור. לכן, היעדר התקפות שנספרו בכמה בדיקות אינו מבטיח שהסוכן יציית לסמכויותיו ללא שגיאות בכל מצב. העלייה במספר ההפרות שזוהו בשרשרת משימות ארוכה יותר מדגישה גם מדוע צריך לבדוק בנפרד זיכרון ממושך והקשר משתנה.

מה כדאי לבדוק לפני השימוש

לפני שמטילים על dot עבודה שוטפת, כדאי לבדוק אילו אפליקציות מחוברות, אילו הרשאות הן מעניקות ואילו פעולות הסוכן יכול לבצע בלי אישור חדש. מרכז העזרה של OpenAI מאפשר לעיין במשימות פעילות ומתוזמנות, לשנות את כללי האישור ולהשהות את הסוכן. הזמינות של אפליקציות ותכונות עשויה להשתנות.

OpenAI מציינת שאפשר לחבר dot ל-Slack ולחשבון דואר אלקטרוני אישי. עם זאת, עצם קיומה של אינטגרציה אינו עונה על השאלות כמה מידע יעבד הסוכן ומה ישמור בזיכרון. להודעות טקסט יש גרסת בטא מוגבלת ונפרדת, המיועדת לחלק ממשתמשי Pro בארה"ב. היא משתמשת בספק צד שלישי, וייתכן שיחולו תשלומים רגילים על הודעות ועל העברת נתונים.

הערך של dots טמון במעבר מבקשות בודדות להאצלת תהליך. OpenAI תיארה משימות רקע, זיכרון וכללי אישור, אך הזמינות עדיין משתנה, התנאים לאחר החודש הראשון אינם ידועים, ובדיקות הבטיחות שפורסמו הן הערכות פנימיות של החברה. לכן חשוב לא רק מה dot יכול לעשות, אלא גם עד כמה ברור שהוא מציג מה קרא, זכר וביצע.

כתבות קשורות

הפכו את מה שקראתם לאינטגרציה עובדת

גלו את ממשקי ה-API לנתונים חברתיים של jsonscraper, בדקו בקשות ובנו את תהליך העבודה הבא.

גלה API