Google משדרג את מודל עריכת התמונות של Gemini

Google השיקה מודל בינה מלאכותית חדש לעריכת תמונות בשם Gemini 2.5 Flash Image, המיועד לשפר את הדיוק והריאליזם בעריכות דרך צ’אטבוט Gemini. העדכון זמין כעת באפליקציית Gemini ונגיש למפתחים דרך Gemini API, Google AI Studio ו-Vertex AI.

המודל מטפל בעריכות תמונה מורכבות באמצעות הוראות בשפה טבעית, תוך שמירה על פרטים עקביים בפנים, בעלי חיים ורקעים מורכבים – תחומים שבהם כלים אחרים נכשלים לעתים קרובות. לפי דיווח של TechCrunch, המהלך מציב את Google במיקום טוב יותר להתחרות עם פתרונות כמו GPT-4o של OpenAI ומודלי התמונה של Midjourney.

Gemini 2.5 Flash Image נבדק תחילה תחת השם הקוד “nano-banana” בפלטפורמת LMArena, שם התבלטה הדיוק הויזואלי שלה. כל התמונות שנוצרות כוללות סימני מים ויזואליים ותגי מטא-דטה לזיהוי תוכן שנוצר בינה מלאכותית. אמצעי הבטיחות הללו נועדו להפחית שימוש לרעה כמו יצירת תמונות פורנוגרפיות או דיפפייקים מטעים.

עבור משתמשים העובדים על פרויקטים מוכווני עיצוב – כמו פריסות פנים או סיפור חזותי – העדכון מציע שליטה מדויקת יותר ותוצאות אמינות יותר דרך הוראות טקסט פשוטות. עם התחרות המתגברת בין מפתחי הבינה המלאכותית הגדולים, המהלך עוזר ל-Google לעמוד בקצב בתחום המתפתח במהירות.

המקור המלא – Google Gemini’s AI image model gets a ‘bananas’ upgrade | TechCrunch

חברים יקרים!
אהבתם מה שקראתם?
אז תהיו חברים…
קבלו ישירות אליכם למייל:
חדשות, טיפים ומדריכים, מבצעים וכלי בינה מלאכותית.
השאירו שם ומייל וגם אתם לא תצטרכו לדאוג שתפספסו משהו בעולם ה-AI!
שדה זה מיועד למטרות אימות ויש להשאיר אותו ללא שינוי.
פרטיות(חובה)
This field is hidden when viewing the form
This field is hidden when viewing the form
Send this to a friend