פרומפטים לתמונות AI
ההבדל בין תמונה גנרית לתמונה מרהיבה הוא הפרומפט. הנה האנטומיה של פרומפט מנצח — עובד ב-Midjourney, Stable Diffusion וכל כלי.
הפרומפט הוא לא הכפתור היחיד
כמעט כל מדריך בנושא מלמד דבר אחד: איך לנסח. וזה באמת משנה — אבל זה אחד משלושה מנופים, ולעיתים קרובות לא החזק שבהם.
- בחירת המודל. אותו פרומפט בדיוק ייתן תוצאות שונות לגמרי בכלים שונים. אחד חזק בצילומי מוצר, אחר באיור, שלישי בריאליזם של פנים. פרומפט מושלם למודל הלא נכון יפסיד לפרומפט בינוני במודל הנכון.
- הניסוח. מה שהעמוד הזה עוסק בו ברובו. משנה מאוד, בגבולות מה שהמודל בכלל יודע לעשות.
- תמונת ייחוס ואיטרציה. המנוף שהכי מוזנח. תמונה אחת שאתה נותן כדוגמת סגנון מדויקת יותר מחמישים מילות תיאור, וכמעט כל הכלים הרציניים תומכים בזה.
ולכן הסדר המעשי הוא: קודם תבדוק שהמודל בכלל מסוגל למה שאתה מבקש — נסה בקשה פשוטה בסגנון הכללי — ורק אז תשקיע בניסוח. אנשים מבזבזים שעות על שיפור פרומפט שמנסה לגרום למודל לעשות משהו שהוא לא טוב בו.
ובחירת המודל היא גם ההחלטה שהכי משתלם לחזור אליה. הכלים בתחום הזה משתנים מהר, ומודל שהיה חלש בקטגוריה מסוימת לפני חצי שנה יכול להיות הטוב ביותר בה היום. אם נטשת משימה כלשהי כי "זה לא עובד" — שווה לנסות שוב לפני שמשקיעים בפתרון עוקף.
האנטומיה של פרומפט
פרומפט לתמונה בנוי משכבות, וכל שכבה שאתה משאיר ריקה — המודל ממלא בעצמו, ובכל פעם אחרת. זה מקור רוב חוסר העקביות.
- נושא. מה בתמונה, ספציפית. לא "כלב" אלא "גולדן רטריבר צעיר".
- פעולה או הקשר. מה קורה, איפה.
- סגנון. צילום, ציור שמן, אנימה, רינדור תלת־ממד, איור קווי.
- קומפוזיציה. קלוז-אפ, פריים רחב, מבט מלמעלה, מה נמצא איפה בפריים.
- תאורה. המנוף החזק ביותר על התחושה, ולרוב הכי מוזנח. אור בוקר רך, אור נגדי, ניאון, שעת זהב.
- מצלמה. אורך עדשה, עומק שדה. רלוונטי כשמבקשים צילום.
- צבע ומצב רוח. גוונים חמים, פסטל, מונוכרום.
- אילוצים. יחס גובה־רוחב, שטח ריק לטקסט, מה אסור שיופיע.
מה שמופיע קודם מקבל משקל רב יותר. נושא → סגנון → תאורה → פרטים. אם התוצאה מדגישה משהו לא נכון, לרוב הוא פשוט מופיע מוקדם מדי במשפט.
לפני ואחרי
חלש:
a coffee shop
חזק:
cozy specialty coffee shop interior, warm morning light
through large windows, wooden tables, plants,
shallow depth of field, shot on 35mm, warm color palette,
empty space on the left third
ההבדל אינו האורך אלא שכל שכבה מולאה בכוונה. השורה האחרונה — שטח ריק בשליש השמאלי — היא הסוג של אילוץ שהופך תמונה יפה לתמונה שימושית: עכשיו אפשר לשים עליה טקסט.
ולמה זה עדיף על לבקש "תמונה יפה"
יש פיתוי לדלג על כל זה ולתת למודל שפה לכתוב לך את הפרומפט — "תכתוב לי פרומפט לתמונה של בית קפה". זה עובד, וזה גם מסביר למה כל כך הרבה תמונות מיוצרות נראות אותו דבר.
מודל שפה שמנסח פרומפט מייצר את הפרומפט הממוצע לנושא הזה — עם אותן מילות סגנון, אותה תאורה ואותה קומפוזיציה שכל אחד אחר מקבל. התוצאה תקינה לחלוטין ואין בה שום דבר שלך.
מה שכן עובד הוא לתת לו את החומר: לתאר בעברית מה אתה רואה בעיני רוחך, ולבקש שיתרגם את זה לפרומפט באנגלית בלי להוסיף כלום משלו. אתה מביא את ההחלטות, הוא מביא את הניסוח — וזו חלוקת עבודה שמייצרת משהו שאף אחד אחר לא יקבל.
למה יותר מילים זה לא יותר טוב
אחרי שלומדים את השכבות, הטעות הבאה צפויה: להוסיף עוד. ואז התוצאה מתחילה להיות עכורה, גנרית וחסרת מוקד — בדיוק ההפך ממה שציפית.
הסיבה היא שהמודל ממצע הוראות סותרות במקום לבחור. אם ביקשת גם "מינימליסטי" וגם "מלא פרטים", גם "דרמטי" וגם "רגוע", אתה לא מקבל את שניהם — אתה מקבל את הממוצע שלהם, שהוא כלום.
ויש עוד קטגוריה של מילים שפשוט לא עושות כלום — הן הועתקו מפרומפטים ישנים ונשארו בתוך התרבות:
- "masterpiece", "best quality", "award winning" — ברוב המודלים המודרניים אלה מילים ריקות. הן הועילו במודלים מוקדמים שאומנו על תמונות מדורגות, וכיום הן בעיקר תופסות מקום.
- "8k", "ultra HD" — לא משפיעות על הרזולוציה בפועל, שנקבעת בהגדרות. לכל היותר הן מטות את הסגנון לכיוון תמונות סטוק.
- ערימת שמות תואר. "beautiful stunning gorgeous" הוא לא פי שלושה מ"beautiful".
הכלל: אם אתה לא יכול להצביע על מה בתמונה ישתנה בגלל מילה מסוימת — תמחק אותה. פרומפט של עשרים מילים מדויקות מנצח פרומפט של שבעים, וגם קל בהרבה לאתר בו מה גרם למה כשמשהו יוצא לא נכון.
מה להוציא
בכלים מבוססי Stable Diffusion יש שדה נפרד לnegative prompt — מה שלא ייכלל. זה יעיל במיוחד נגד עיוותים חוזרים:
Negative: blurry, low quality, distorted hands, extra fingers,
watermark, text, deformed, cropped
בכלים אחרים המנגנון שונה — למשל פרמטר --no text — והעיקרון זהה.
שתי הערות שכדאי לדעת. ראשית, מודלים חדשים יותר צריכים את זה פחות; הרבה מהעיוותים שהרשימה הזאת נועדה למנוע כמעט נעלמו. שווה לנסות בלי לפני שמעתיקים רשימה בת חמישים מילים מפורום. ושנית, השורה שהכי משתלמת בה כמעט תמיד היא text — כי טקסט מיוצר הוא הדבר שהכי מסגיר תמונה, ובעברית הוא בלתי שמיש לחלוטין.
עברית: כלל אחד ואין ממנו יוצא
אל תבקש שהתמונה תכיל טקסט עברי. מודלי תמונה לא כותבים עברית — הם מייצרים צורות שדומות לאותיות ואינן אותיות, ובגודל של פוסט או שקופית זה נראה מיד כמו שגיאה.
הפתרון פשוט ותמיד עדיף: תמונה בלי טקסט, וטקסט כשכבה מעליה בעורך. כך הוא גם חד, גם ניתן לעריכה, וגם אפשר להחליף אותו בלי לייצר מחדש. ולכן שווה לבקש מראש שטח ריק בפריים, כפי שמופיע בדוגמה למעלה.
ולכתוב את הפרומפט עצמו — באנגלית
המודלים אומנו ברובם המכריע על תיאורים באנגלית. פרומפט בעברית יעבוד לפעמים ויחזיר תוצאה עמומה לרוב, כי המודל מתרגם אותו פנימית ומאבד ניואנס. תחשוב בעברית, תכתוב באנגלית — וזה גם מקום מצוין להיעזר במודל שפה שיהפוך את התיאור שלך לפרומפט מנוסח.
ומה עם ויזואל ישראלי
נקודה שכדאי לדעת לפני שמתאכזבים: מושגים חזותיים מקומיים מיוצגים בחסר. בקשה ל"שולחן שבת", ל"רחוב תל אביבי" או ל"שוק ישראלי" תחזיר בדרך כלל משהו ים-תיכוני כללי — יווני, איטלקי, או תערובת. המודל ראה מעט מאוד תמונות מתויגות מכאן.
מה שעובד במקום: לתאר את המרכיבים במקום לנקוב בשם. במקום "רחוב תל אביבי" — בניין בסגנון באוהאוס עם תריסים, עץ פיקוס, אופניים, אור אחר הצהריים חזק. אתה מתאר את מה שאתה רואה בעיני רוחך, ולא מסתמך על כך שלמודל יש את הקטגוריה.
איך לתאר סגנון שראית
הבקשה הנפוצה ביותר בפועל היא לא "צור לי תמונה" אלא "תעשה לי משהו כמו זה". והדרך שרוב האנשים מנסים — לנקוב בשם של אמן — היא גם הפחות טובה וגם הבעייתית ביותר.
מה שעובד הוא לפרק את מה שראית לרכיבים. כשמסתכלים על תמונה שאהבתם, יש חמישה דברים שאפשר לשאול עליהם, וכולם ניתנים לתיאור:
- מאיפה מגיע האור. מלפנים, מהצד, מאחור? רך או קשה? הרכיב היחיד שאם תשנה אותו התמונה תיראה אחרת לגמרי.
- כמה צבעים יש. תמונות שנראות "מעוצבות" משתמשות לרוב בשניים או שלושה. תמונה עם שמונה צבעים נראית מקרית.
- המרקם. חלק ונקי, גרעיני, ציורי, עם קווי מתאר.
- המרחק מהנושא. קלוז-אפ, פריים בינוני, רחב.
- כמה שטח ריק. תמונה צפופה ותמונה נושמת מייצרות תחושות הפוכות מאותו נושא.
חמישה משפטים שעונים על אלה מייצרים פרומפט מדויק יותר מכל ניסיון לשחזר סגנון בשם. וזה גם תרגיל שמשפר אותך: אחרי שעשית את זה עשר פעמים, אתה מתחיל לראות תמונות אחרת.
ולגבי שמות של אמנים: לתוכן מסחרי, פשוט אל. סגנון עצמו לרוב אינו מוגן, אבל בקשה לחקות אמן חי מזוהה נכנסת לשטח אפור שלא שווה להיכנס אליו בשביל באנר — וחלק מהכלים חוסמים את זה ממילא. תיאור הרכיבים נותן לך את אותה תוצאה בלי השאלה.
לקבל את אותו דבר פעמיים
זה האתגר האמיתי ברגע שעוברים מתמונה בודדת לסדרה — פוסטים למותג, איורים לקורס, דמות שחוזרת. והמודלים בנויים בדיוק הפוך: כל יצירה היא הטלה חדשה.
ארבעה כלים, לפי כמה הם עוזרים:
- תמונת ייחוס. החזק ביותר. רוב הכלים מקבלים תמונה כדוגמת סגנון, וזה מדויק יותר מכל תיאור.
- סיומת פרומפט קבועה. נסח פעם אחת תיאור סגנון — תאורה, פלטה, מרקם, זווית — ושמור כטקסט שמודבק לכל בקשה.
- נעילת seed. אותו זרע עם פרומפט דומה שומר על משפחה ויזואלית. שינוי קטן בפרומפט עדיין מזיז דברים.
- מודל מכוונן — LoRA וטכניקות דומות. השליטה הגבוהה ביותר, והדרך היחידה לדמות שחוזרת באמת. גם העבודה הגדולה ביותר.
וההסתייגות הכנה: גם עם כל אלה, זה סוטה. לכן העצה המעשית היא לבחור נושא סלחני — במרקמים, ברקעים מופשטים ובצורות גיאומטריות, סטייה בין תמונה לתמונה כמעט בלתי נראית. בדמויות ובסצנות היא צורמת מיד.
איפה זה עדיין נשבר
שווה לדעת מראש כדי לא לבזבז ניסיונות:
- טקסט. באנגלית השתפר מאוד; בעברית לא קיים.
- ידיים ואצבעות. טוב בהרבה ממה שהיה, ועדיין המקום שהכי שווה להסתכל בו לפני שמפרסמים — במיוחד כשיש כמה אנשים בפריים.
- ספירה. "חמישה כיסאות" יחזיר לרוב מספר אחר. אם הכמות חשובה, בדוק אותה.
- יחסי מיקום. "הכוס משמאל לספר" מתערבב. עדיף לתאר את הסצנה כתמונה שלמה ולא כרשימת יחסים.
- אותה דמות פעמיים. ראה הסעיף הקודם.
- דיוק טכני. תרשים, ממשק, מכשיר אמיתי — יראה נכון ויהיה שגוי בפרטים. לא להשתמש להדגמה של משהו קיים.
מהצורך לתמונה: סדר עבודה
רוב הזמן מתבזבז לא על ייצור אלא על כך שלא הוחלט מה צריך. סדר שמקצר את זה משמעותית:
- לאן זה הולך. פוסט מרובע? באנר רחב? רקע לשקופית עם טקסט מעליו? ההחלטה הזאת קובעת את יחס הגובה־רוחב ואת כמות השטח הריק — ולשנות אותה בסוף פירושו לייצר הכל מחדש.
- מה התמונה צריכה לעשות. להסביר, להדגיש, למלא רקע, להעביר תחושה? תמונה שממלאת רקע יכולה להיות מופשטת לגמרי, וזו הקטגוריה הכי קלה ולכן הכי כדאית כשמתאפשר.
- ניסיון ראשון קצר. חמש-שש מילים בלבד. המטרה לראות אם המודל הולך לכיוון הנכון בכלל.
- הוספת שכבות, אחת בכל פעם.
- אילוצים בסוף. יחס, שטח ריק, מה שאסור.
- עיבוד בעורך. חיתוך, צבע, טקסט.
הצעד השלישי הוא שחוסך הכי הרבה. פרומפט ארוך שנכשל לא אומר לך למה הוא נכשל; פרומפט קצר שנכשל אומר לך מיד שהבעיה בבסיס ולא בפרטים.
פרמטרים שכדאי להכיר
- יחס גובה־רוחב. תקבע אותו מראש לפי היעד — 16:9 לבאנר, 9:16 לסטורי, 1:1 לפוסט. חיתוך של תמונה מרובעת לסטורי כמעט תמיד חותך את מה שחשוב.
- משקלים. אפשר להדגיש מילה מסוימת — התחביר משתנה בין כלים. שימושי כשמרכיב אחד נבלע.
- Seed. לשחזור ולווריאציות.
- עוצמת ההשפעה של תמונת הייחוס. כמעט תמיד יש כוונון — כמה לדבוק בייחוס מול כמה חופש. זה הפרמטר שהכי כדאי לשחק איתו כשעובדים בסדרה.
איטרציה, וזה כל הסוד
אף אחד לא מקבל את התמונה הנכונה בניסיון הראשון, וזו לא בעיה בפרומפט. התהליך שעובד:
- צור ארבע גרסאות מפרומפט בסיסי.
- בחר את הקרובה ביותר — לא את היפה ביותר.
- שנה רכיב אחד ותייצר שוב.
- חזור, עד שהרכיב הבא לשינוי הוא כבר לא ברור.
הנקודה השלישית היא מה שמפריד בין שיפור לבין הימור. אם שינית גם תאורה וגם סגנון וגם קומפוזיציה, וזה יצא טוב יותר — לא למדת כלום, ובפעם הבאה תתחיל מאפס.
ושמור כל פרומפט שעבד, לצד התמונה. הם הופכים לתבניות שלך, וזה מה שמוריד את הזמן לתמונה מעשרים דקות לשתיים. יש גם ספריית פרומפטים להתחיל ממנה.
כשצריך עשרים תמונות ולא אחת
ברגע שהצורך הוא סדרה — אייקונים לאתר, איורים לקורס, תמונות לקטלוג — התהליך הידני מתפרק. מה שמחזיק:
- תבנית פרומפט עם משתנה אחד. מנסחים פעם אחת את כל הסגנון, ומשאירים חור אחד למילוי.
[נושא], flat line icon, single color, white background, centered, 1:1— ואז ממלאים עשרים נושאים באותה מסגרת. - לייצר יותר ממה שצריך. אם צריך עשרים, ייצר שישים ובחר. שיעור ההצלחה לתמונה הוא לרוב סביב שליש, וזה זול יותר מלשפר כל אחת בנפרד.
- לבחור בסבב אחד. לפרוס את הכל יחד ולסמן, במקום לשפוט אחת-אחת. סטייה בסגנון נראית רק בהשוואה.
- לתקן בעורך, לא בפרומפט. אם עשרים תמונות יצאו טובות ואחת חורגת בגוון — תיקון צבע לוקח שנייה, וייצור מחדש עלול להחזיר משהו אחר לגמרי.
ובכלים שיש להם ממשק תכנותי, השלב הזה הוא גם המקום שבו כדאי לעבור לקוד — לולאה על רשימת נושאים עם אותה תבנית מייצרת את כל הסדרה בהרצה אחת, ושומרת שם קובץ שאומר מה יש בפנים.
הייצור הוא שליש מהעבודה
תמונה שיצאה מהמודל היא חומר גלם, ולא נכס מוגמר. מה שבא אחריה, ולרוב לא מדובר:
- חיתוך והרכבה. לחתוך את הנושא ולהניח אותו על רקע שאתה שולט בו נותן שליטה שאף פרומפט לא ייתן.
- הגדלה. שימושי לרקעים ולמרקמים. לא לתמונת מוצר אמיתי — מודל הגדלה ממציא פרטים, וזה אומר שהמוצר שהצגת ייראה קצת אחרת מהמוצר שיגיע.
- תיקון צבע. להתאים את התמונה לפלטת המותג. הצעד הבודד שהכי גורם לסדרה להיראות אחידה.
- הטקסט. תמיד בעורך, אף פעם לא בפרומפט.
עריכה של תמונה קיימת
חלק גדול מהעבודה האמיתית הוא לא ליצור מאפס אלא לשנות משהו שכבר יש — להסיר אובייקט, להרחיב פריים, להחליף רקע, לתקן פינה. כל הכלים הרציניים תומכים בזה, ורוב האנשים לא משתמשים בזה כי הם חושבים במונחים של יצירה בלבד.
- להסיר משהו מהתמונה. עובד היטב על רקעים, פחות טוב כשמה שהוסר היה חלק ממשהו שממשיך מאחוריו — קו של שולחן, דוגמה חוזרת.
- להרחיב את הפריים. הדבר השימושי ביותר ברשימה: תמונה מרובעת שצריכה להיות רחבה, בלי לחתוך. המודל ממשיך את הסצנה החוצה.
- להחליף אזור מסומן. לצייר אזור ולתאר מה יופיע במקומו. פה החשוב הוא לסמן בנדיבות — סימון צמוד מדי מייצר תפר גלוי.
- להחליף רקע לגמרי. לחתוך את הנושא ולהניח על רקע חדש. נותן יותר שליטה מכל ניסיון לתאר את הרקע בפרומפט.
ובכל אחד מאלה, אותה בדיקה: הגדל ל-200% והסתכל על הגבולות. שם התיקון נראה, ושם התמונה מסגירה שהיא נערכה.
שימוש מסחרי
שלוש שאלות שכדאי לענות עליהן פעם אחת לכל כלי, לפני שנכס מיוצר נכנס למשהו שמישהו משלם עליו:
- האם המסלול שלך מתיר שימוש מסחרי? ברמות חינמיות לעיתים קרובות לא, גם כשהתוצר זהה.
- מה מותר לטעון לגבי בלעדיות? בדרך כלל מעט מאוד — וזו הסיבה לא להשתמש בפלט מיוצר כלוגו או כסימן מסחרי.
- האם התוצרים שלך משמשים לאימון? לרוב יש הגדרה, ולעיתים רק במסלול בתשלום.
וכלל אצבע שמכסה את רוב המקרים: לנכס חד-פעמי שנצרך ונעלם — פוסט, באנר, רקע — פלט מיוצר מתאים. לנכס זהות שילווה אותך שנים — לא.
כמה זה עולה, ואיפה זה מתנפח
מחירים משתנים, אבל המבנה יציב: כמעט כל הכלים מתמחרים לפי מספר יצירות, ולא לפי זמן או איכות. המשמעות היא שהעלות שלך נקבעת כמעט לגמרי על ידי כמה ניסיונות אתה צריך לתמונה אחת.
וזו בדיוק הסיבה שכל מה שכתוב למעלה משתלם כלכלית ולא רק איכותית. שמירת פרומפטים שעבדו, שינוי רכיב אחד באיטרציה, וניסיון ראשון קצר — כולם מורידים את מספר הניסיונות לתמונה, וזה המספר היחיד שאתה משלם עליו.
הסעיף שהכי מתנפח בלי שמרגישים: לייצר מחדש במקום לערוך. תמונה שכמעט מושלמת ופינה אחת בה לא טובה עולה יצירה נוספת אם מייצרים שוב, ואפס אם מתקנים בעורך. אחרי חודש של עבודה, ההרגל הזה לבדו הוא ההבדל בין מסלול בסיסי למסלול שצריך לשדרג.
מתי לא לייצר בכלל
- כשצריך להראות משהו אמיתי. המוצר שלך, המשרד שלך, הצוות. צילום בטלפון מנצח כל תמונה מיוצרת, כי הוא נכון.
- כשיש טקסט בתמונה. ובמיוחד בעברית.
- כשהדיוק חשוב. תרשים, ממשק, מכשיר.
- כשצריך אנשים אמיתיים. עדות לקוח, "מי אנחנו", גיוס. אנשים מיוצרים מזוהים, וזה בדיוק הדבר שהם אמורים לבנות שנפגע.
טעויות שחוזרות
- לשפר פרומפט במקום להחליף מודל. שעות על משהו שהכלי לא טוב בו.
- להוסיף מילים עד שזה נהיה עכור. הוראות סותרות מתמצעות לכלום.
- להעתיק רשימת מילות איכות מפורום. רובן לא עושות כלום היום.
- לבקש טקסט בתמונה. בעברית זה תמיד ייכשל.
- לכתוב את הפרומפט בעברית. תוצאה עמומה, בלי סיבה.
- לשנות שלושה דברים בין איטרציות. לא לומדים כלום.
- לא לשמור פרומפטים שעבדו. ואז לייצר מאפס בכל פעם.
- להגדיל תמונת מוצר. המודל ממציא פרטים שהמוצר לא באמת מכיל.
הצעד הבא
בחר כלי והתחל ליצור. השווה בין הכלים או צלול למדריך הספציפי.