5,000 תווים שפתרו בעיה בת 55 שנה.
80% מהם לא אומרים למודל מה לעשות.
OpenAI פרסמה את הפרומפט המדויק שהוביל להוכחה. קראתי אותו וחילצתי שמונה כללים שאפשר להעתיק לעסק — עם שני פרומפטים מוכנים להרצה.

לפני שבוע כתבתי כאן על הפרומפט ש-OpenAI פרסמה — זה שהוביל את GPT-5.6 להוכיח את השערת הכיסוי הכפול במעגלים, בעיה שהייתה פתוחה 55 שנה. ביקשתם את המדריך המלא. הנה הוא.
קראתי את המסמך המקורי. הוא פחות מ-5,000 תווים, שני עמודים, ואין בו שום מילת קסם. אין "אתה מומחה עולמי", אין "קח נשימה עמוקה", אין טריק.
יש בו שמונה דברים שכמעט אף אחד לא עושה. הנה הם — עם הציטוט המקורי, מה זה אומר לעסק שלך, ושני פרומפטים מוכנים בסוף.
מה בעצם קרה כאן
השערת הכיסוי הכפול נוסחה ב-1973. בגדול היא אומרת שבכל גרף בלי "גשרים" אפשר לכסות כל קשת בדיוק פעמיים באמצעות מעגלים. פשוט לנסח, ואיש לא הצליח להוכיח 55 שנה.
ב-2026 מודל של OpenAI הוכיח אותה — ו-OpenAI עשתה משהו נדיר: פרסמה את הפרומפט המלא.
וזה מה שמעניין בו: 80% מהמסמך לא עוסקים במה לעשות. הם עוסקים במה נחשב תשובה טובה, מה נפסל מראש, ומתי בכלל מותר להפסיק ולחזור עם תשובה.
זה בדיוק החלק שרוב האנשים משמיטים.
הכלל שהכי הפתיע אותי
אתחיל דווקא מכלל 3, כי הוא היחיד ששינה לי את התוצרים באופן מיידי.
OpenAI ישבו וכתבו רשימה מפורשת של מה לא נחשב הצלחה. לא "תעשה עבודה יסודית" — רשימה שחורה, בשמות, של תשובות שנראות כמו פתרון ואינן: הוכחות למקרים פרטיים, אימות חישובי, צמצום להשערה אחרת שלא הוכחה, דוגמאות נגד בלי הוכחת אי-קיום.
למה זה כל כך חזק? כי מודל תמיד יחזיר לך משהו. הוא לא ישתוק. אם לא אמרת מה נפסל, תקבל את התשובה שהכי קל להפיק — והיא כמעט תמיד קרובה-אבל-לא.
שלוש שורות של "מה נפסל" בסוף פרומפט קיים שלך ישנו לך את האיכות היום.
שמונת הכללים, אחד-אחד
1. הגדר את המילים לפני שאתה מבקש משהו
מה כתוב שםהפרומפט פותח בהגדרה של כל מונח — מה זה גרף, מה זה גשר, מה זה מעגל, מה זה כיסוי כפול. רק אחרי שכל מילה נעולה מגיעה הבקשה עצמה.
אתה כותב "תכין הצעת מחיר ללקוח". המודל מנחש מה זו הצעת מחיר אצלך. הוא לא יודע שאצלכם הצעה היא עמוד אחד, שתנאי התשלום הם שוטף+30, ושלקוח ארגוני מקבל נספח אבטחת מידע.
המילים שאתה משתמש בהן כל יום הן מונחים מקצועיים. המודל לא עבד אצלך.
2. כתוב מה נחשב הצלחה, במשפט אחד מדיד
מה כתוב שם”A complete solution must prove exactly the following…“ — משפט אחד שאומר מתי המשימה הושלמה. לא "תעשה עבודה יסודית".
בלי קריטריון, כל פלט הוא הצלחה — כולל פלט בינוני. אתה מגלה את זה רק כשאתה קורא, וזה כבר הזמן שרצית לחסוך.
3. כתוב גם מה לא נחשב הצלחה
מה כתוב שם”Partial progress does not count… In particular, proofs for special graph classes, constructions of cycle covers with some edges covered other than twice, bounded-length variants, reductions to another unproved conjecture, computational verification through any fixed graph size, and candidate counterexamples without a complete nonexistence certificate are insufficient.“
הם ישבו וכתבו רשימה של כישלונות שנראים כמו הצלחה, וכל אחד נפסל בשמו. וזו הנקודה: מודל תמיד יחזיר לך משהו. הוא לא ישתוק. אז אם לא אמרת מה נפסל — תקבל את הדבר שהכי קל להפיק, והוא כמעט תמיד קרוב-אבל-לא.
אם תיקח מהמאמר הזה שורה אחת — קח את זו. היא שיפרה לי תוצרים יותר מכל טכניקה אחרת.
4. אל תקבע תוכנית קשיחה מראש
מה כתוב שם”Do not use a fixed assignment such as ‘N agents for strategy X.’ Instead, manage the search using the following heuristics.“
רוב האנשים כותבים למודל תסריט של שלבים. זה עובד למשימה פשוטה ונשבר ברגע שהמציאות לא מתאימה לתסריט. למשימה מורכבת — תן קריטריונים, לא צעדים, ותן לו להחליט תוך כדי.
5. אל תגלה מראש מה הכיוון המועדף עליך
מה כתוב שם”Do not tell most agents the currently favored approach. Preserve independence during early rounds so that agents do not all converge to the same attractive but incomplete reduction.“
זה קורה לך כל יום ואתה לא שם לב. "אני חושב שהבעיה היא התמחור — מה דעתך?" קיבלת הסכמה, לא ניתוח. המודל מוטה לרצות אותך, בדיוק כמו עובד חדש.
וזה נכון בדיוק באותה מידה כשאתה שואל עובד.
6. תן למישהו את התפקיד לתקוף את התשובה
מה כתוב שם”Use adversarial agents throughout: every candidate proof must be checked for exact-two multiplicity, repeated-edge closed trails masquerading as cycles, parallel-edge 2-cycles, disconnected graphs, cutvertices, bridges introduced by reductions, and circular use of an equivalent CDC statement.“
שים לב שהם לא כתבו "תבדוק את עצמך". הם רשמו בשמות את הדרכים הספציפיות שבהן התשובה עלולה להיות שגויה. "תבדוק שזה נכון" היא הוראה ריקה — המודל יבדוק ויאשר לעצמו.
7. דרוש תוצר קונקרטי. דחה דיווח סטטוס.
מה כתוב שם”Require agents to return concrete lemmas, constructions, equations, or counterexamples to proposed sublemmas. Reject status reports, vague optimism, and claims that an unproved global compatibility statement is ‘routine.’“
מודל ייתן לך בשמחה "ביצעתי מחקר מקיף ואספתי תובנות מעניינות". זה אפס. תדרוש את החומר עצמו, לא דיווח עליו.
8. תגדיר מתי מותר לו לעצור
מה כתוב שם”Return only when a complete affirmative proof has been found and survives adversarial audit. Do not return a reduction, partial result, isolated missing lemma, ‘best effort’ summary, or explanation of why the problem is difficult. Spend at least 8 hours on this before even thinking of returning or giving up.“
ברירת המחדל של כל מודל היא לענות מהר. אם לא אמרת מתי מותר לסיים — הוא יסיים ברגע שיש לו משהו שנשמע סביר.
וזה בדיוק ההבדל בין צעצוע AI לבין מערכת שאפשר לשים בתוך עסק: סוכן טוב לא רק יודע לעשות — הוא יודע מתי לעצור ולשאול.
🎯 פרומפט 1 — תבנית האב
זו התבנית שאני משתמש בה מאז שקראתי את המסמך. היא מיישמת את כל שמונת הכללים על כל משימה עסקית חוזרת. תמלא את הסוגריים המרובעים פעם אחת לכל תהליך — ותשמור.
עובד ב-ChatGPT, ב-Claude ובג'מיני. אין צורך בשום כלי מיוחד.
תבנית האב — שמונת הכללים בפרומפט אחד
ממלאים את הסוגריים המרובעים פעם אחת לכל תהליך חוזר. סעיף 4 הוא זה שעושה את רוב העבודה.
אתה עוזר שמבצע משימה עסקית חוזרת. לפני שאתה מתחיל — קרא את כל ההגדרות. ── 1. הגדרות ── [כתוב כאן כל מונח מהעסק שלך שמופיע במשימה, והגדרה שלו במשפט. דוגמה: "הצעת מחיר" אצלנו = עמוד אחד: הבעיה בלשון הלקוח, מה נעשה, לוח זמנים, מחיר, שוטף+30.] ── 2. המשימה ── [מה בדיוק אתה רוצה שייצא. משפט אחד.] ── 3. מתי סיימת ── התוצר מוכן רק כשיש בו את כל אלה: - [רכיב חובה 1] - [רכיב חובה 2] - [רכיב חובה 3] חסר אחד מהם — לא סיימת. אל תחזיר תוצר חלקי עם הערה שהוא חלקי. ── 4. מה נפסל ── ← הסעיף הכי חשוב כאן. אל תדלג עליו. לא מקובל, גם אם זה נראה טוב: - סיכום כללי בלי מספרים - "כדאי לבדוק" / "מומלץ לשקול" בלי לומר מה בדיוק ומי עושה - טענה שמבוססת על ידע כללי ולא על החומר שצירפתי - תשובה שנפתחת ב"באופן כללי" או "חשוב לציין" - [הוסף כאן 2-3 כשלים שאתה מכיר מהתחום שלך] ── 5. מקורות ── הסתמך אך ורק על החומר שצירפתי. לכל טענה — ציין מאיפה היא. אם המידע לא נמצא בחומר: כתוב "לא נמצא" ועצור. אל תשלים מהראש. ── 6. לפני שאתה מחזיר ── עבור על התוצר ותשאל: איפה הנחתי הנחה שאין לה מקור? איזה מספר לא אימתתי? תקן, ורק אז החזר. ── 7. הפורמט ── [מבנה מדויק. כותרות, אורך, שפה. בלי הקדמות ובלי מחמאות.] ── החומר ── [הדבק כאן]
🎯 פרומפט 2 — המבקר
הכלל השישי — סוכן שתפקידו לתקוף — הוא היחיד שדורש הרצה נפרדת. אל תבקש מהמודל "לבדוק את עצמו" באותה שיחה: הוא כבר מחויב לתשובה שכתב.
פתח שיחה חדשה, הדבק את התוצר, והרץ את זה. לוקח 30 שניות ותופס דברים שלא היית מוצא.
המבקר — פרומפט שתוקף את התוצר שלך
מריצים בשיחה נפרדת, על תוצר קיים. מחזיר טענות בלי מקור, מספרים לא מאומתים, והנחות סמויות.
אתה מבקר. התפקיד שלך הוא למצוא מה שגוי בתוצר שלמטה — לא לשפר אותו ולא לשבח אותו. הנחת המוצא שלך: יש בו לפחות שלוש בעיות. תמצא אותן. עבור עליו וענה בדיוק על השאלות האלה, לפי הסדר: 1) טענות בלי מקור אילו קביעות מופיעות כאן שאין להן עוגן בחומר המקור? צטט כל אחת מהן במילים שלה. 2) מספרים כל מספר בתוצר — מאיפה הוא? אם הוא לא מופיע במקור, סמן אותו כ"לא מאומת". אם הוא חושב מתוך נתונים — הראה את החישוב. 3) הנחות סמויות מה התוצר מניח על הלקוח / השוק / המצב, בלי לומר את זה במפורש? 4) מה הכי סביר שיתברר כשגוי בחר את הטענה האחת שאתה הכי פחות בטוח בה, ותסביר בשורה למה. 5) מה חסר מה אדם שמכיר את התחום היה שואל מיד ואין לזה תשובה כאן? כללים: - אל תכתוב גרסה מתוקנת. רק ביקורת. - אל תפתח במחמאה ואל תסיים בעידוד. - אם באמת לא מצאת בעיה בסעיף מסוים — כתוב "נקי" ותמשיך. אל תמציא בעיה כדי למלא. ── התוצר לביקורת ── [הדבק כאן]
איפה זה לא עובד
שלושה מקומות שבהם המבנה הזה לא יעזור, וכדאי לדעת אותם מראש:
משימות קצרות וחד-פעמיות. אם אתה מבקש לנסח משפט — פרומפט של 40 שורות הוא בזבוז. התבנית משתלמת רק על משהו שאתה מריץ שוב ושוב.
כשאין לך מקור אמת. "אל תשלים מהראש" שווה משהו רק אם צירפת מסמך, מחירון או נתונים. בלי זה אתה פשוט חוסם את המודל בלי לתת לו חלופה.
כשאתה לא באמת יודע מה אתה רוצה. הכללים האלה מחייבים אותך להחליט מה נחשב הצלחה. זה החלק הקשה, והוא לא בעיה של AI — הוא בעיה ניהולית שהייתה שם קודם.
מה לעשות השבוע
לא צריך לשכתב הכל. קח תהליך אחד שאתה מריץ שוב ושוב ומקבל ממנו תוצאה בינונית.
הוסף לו חמש שורות של "מה לא נחשב הצלחה". רק את זה.
הרץ אותו פעמיים — לפני ואחרי — על אותו קלט, והשווה. אם ההבדל לא ניכר, כנראה שהרשימה שלך כללית מדי; תהיה ספציפי יותר.
ואז, אם זה עבד — הוסף את המבקר.
רוצה שאעביר פרומפט שלך דרך שמונת הכללים?
שלח לי פרומפט אחד או תהליך אחד מהעסק שלך — כזה שאתה מריץ שוב ושוב ומקבל תוצאה בינונית. אני אחזיר את הגרסה המתוקנת עם הסבר מה שיניתי ולמה. בלי עלות ובלי טופס — חמישה השבוע, כי יותר מזה אני לא מספיק.
הפעולות מהמאמר