עולם הבינה המלאכותית ממשיך להתפתח בקצב מהיר, וגוגל מציגה את Nano Banana 2.1 - מודל חדש שנועד להפוך את יצירת התמונות והעריכה שלהן לפשוטות ומדויקות יותר. המודל החדש הושק ב-6 באוקטובר 2026 והוא מבוסס על טכנולוגיית Gemini 3.6 Flash.

אז מה זה בעצם אומר? במקום להשתמש בתוכנות עיצוב מורכבות, המשתמש יכול לכתוב במילים פשוטות מה הוא רוצה לראות. לדוגמה, אפשר לבקש ליצור תמונה של רחוב בתל אביב בשעת השקיעה, או לקחת תמונה קיימת ולבקש לשנות את הרקע, להוסיף חפץ או לשנות את סגנון התמונה.

תמונות שנראות טבעיות יותר

אחד השיפורים המרכזיים ב-Nano Banana 2.1 הוא איכות התמונות. גוגל מציינת שיפור ברמת הריאליזם וביכולת של המודל להבין הוראות ולבצע אותן בצורה מדויקת יותר. ניתן ליצור תמונות ברזולוציות של 1K, 2K ואף 4K.

שיפור נוסף נוגע לכתיבה בתוך תמונות. בעבר, מערכות בינה מלאכותית התקשו לעיתים ליצור טקסט ברור ונכון בתוך שלטים, מודעות, פוסטרים ואינפוגרפיקות. בגרסה החדשה גוגל שיפרה את היכולת הזו.

אפשר לשלב כמה תמונות יחד

אחת היכולות המעניינות של המודל היא האפשרות להשתמש בעד 14 תמונות שונות כבסיס ליצירה חדשה. כך, למשל, ניתן להעלות תמונות של אנשים, מוצרים או חפצים ולבקש מהמערכת לשלב אותם בסצנה אחת.

המודל מסוגל לשמור על עקביות של עד ארבע דמויות ועד עשרה אובייקטים, כך שהמראה שלהם יישאר דומה גם לאחר שינויים ועריכות.

לא רק יצירה - גם עריכה

Nano Banana 2.1 מיועד גם לעריכת תמונות קיימות. המשתמש יכול להעלות תמונה ולבקש לבצע בה שינויים, כאשר המודל מנסה לשמור על הפרטים החשובים בתמונה המקורית.

לצד זאת, גוגל שיפרה גם את העבודה עם תמונות רחבות ופנורמיות ואת היכולת לבצע עריכות באמצעות אזורים מסוימים בתמונה.

עבור המשתמשים, המשמעות היא שהכלים שבעבר דרשו ידע בתוכנות גרפיות הופכים בהדרגה לנגישים יותר. במקום לדעת כיצד להשתמש בעשרות כפתורים וכלים, אפשר פשוט להסביר לבינה המלאכותית במילים מה רוצים לקבל - והיא עושה את העבודה.