"מטמטמת" את ג'מיני בכוונה? גל התלונות חסר התקדים נגד גוגל

החל בלולאות טקסט אינסופיות, דרך שכחת קונטקסט ומענה בשפות שונות, ועד למגבלות משאבים • ברקע התלונות הגוברות והשמועות על הנמכת יזומות של המודל, עולה השאלה: האם המודל הבא כבר בדרך? • תגובת גוגל תובא לכשתתקבל

גוגל "מטמטמת" את ג'מיני בכוונה?. צילום: שחר שפירו

אם הרגשתם בזמן האחרון שג'מיני, מודל ה-AI של גוגל, נהיה איטי, מרדן ולא עקבי - אתם ממש לא לבד. בימים האחרונים גועשות הרשתות החברתיות - מ-Reddit ועד X (טוויטר לשעבר) - בגל תלונות חסר תקדים של משתמשים, בהם גולשים מישראל. הדיווחים מציירים תמונה של הדרדרות משמעותית בביצועי המודל, לצד שאלות קשות לגבי הסיבות האמיתיות שעומדות מאחורי השינויים הללו.

"נתקע, מגמגם - ושוכח את השרשור"

על פי דיווחי המשתמשים, בעיות התפעול אינן נקודתיות אלא חוצות פלטפורמות ומודלים. בראש התלונות עומדת תופעת הלולאות האינסופיות: המודל נתקע ממושכות על סטטוס "Thinking..." או קורס תחת שגיאות שרת פתאומיות.

"נתקע, מגמגם - ושוכח את השרשור". ג'מיני, צילום: רויטרס

משתמשים ישראלים מדווחים על תקלות ייחודיות לשפה העברית, כמו מעבר פתאומי לכתיבה בערבית באמצע התשובה, טקסטים שבורים המיושרים לשמאל, והתעלמות מהנחיות פשוטות ביותר. משתמשים משלמים מביעים תסכול עמוק ומציינים כי שיעור המקרים שבהם המודל אינו מבצע הוראות בסיסיות הפך לגבוה באופן חסר תקדים.

"מי בגוגל מרוויח מאות אלפי דולרים בשנה בשביל החרא הזה? ג'ימיני הפך למודל חסר תועלת", כתב גולש ב-X. "שיעור המקרים שבהם הוא לא מבצע הנחיות פשוטות גבוה מ-75%. מי שמשלם כסף לגוגל על המודל הזה זורק את הכסף שלו לפח. אשכרה". גולשת אחרת הוסיפה: "הוא כמו ילד שעושה טעויות וכשתופסים אותו הוא לא יודע מה רוצים ממנו".

ב-Reddit זעמו על תקלות חוזרות ונשנות. "מה קרה לזיכרון? לאן הוא נעלם? המודל אשכרה ענה לי: 'אתה לחלוטין צודק, אני מתנצל על הכשל הלוגי המאסיבי. הרסתי לחלוטין את ציר הזמן. ציינת שהשמש עוד זרחה (ערב), וערב בא לפני לילה (שקיעה). הלוגיקה שלי הייתה הפוכה לחלוטין. זה לא הגיוני כרונולוגית'. איך מודל מסוגל להיכשל בהבנת קונטקסט של ארבעה פרומפטים בלבד אחורה?"

"כמו להשתמש בפטיש בלי ידית". הטעויות של ג'מיני, צילום: Google Help Forums

ב-Google Help Forums משתמש כתב תגובה זועמת: "ג'מיני הפך לבלתי שמיש לחלוטין. הוא לא עונה לפרומפטים במשך דקות ארוכות, וברוב הפעמים פשוט נעצר באמצע. כשהוא כבר עונה, יש כל כך הרבה הזיות שאני מבזבז את כל ה-Usage שלי רק בלנסות להוציא ממנו מידע תקין אחד. נהגתי להמליץ עליו לכולם - עכשיו להשתמש בו זה כמו לנסות להשתמש בפטיש בלי ידית".

בקרב מפתחים ומשתמשי קצה כבדים, הטענות נוגעות בעיקר לירידה ביכולות הליבה. לפי דיווחים, המודל מתקשה לעקוב אחר קונטקסט של שרשורים קצרים, מציג כשלים לוגיים בסיסיים ושוכח מידע שנמסר לו רק מעט פרומפטים קודם לכן; עוד טוענים המשתמשים על ירידה מורגשת ביכולת ניתוח קוד וצילומי מסך, לצד הופעת הודעות שגויות ב-Gems מותאמים אישית כאילו לא הועלו קבצי מקור.

משתמשים אחרים מצביעים על מנגנוני הבטיחות והגבלות המכסה הוחמרו באופן חריג, מה שמוביל להפסקת מענה באמצע משפט או להעברה אוטומטית למודלים רזים ופחות מתקדמים.

הנמכת רף או חיסכון במשאבים?

הירידה הפתאומית באיכות המענה הובילה לגל של השערות בקהילה. חלק מהמשתמשים תוהים האם מדובר בטקטיקה מכוונת של גוגל: הנמכה מלאכותית של ביצועי המודל הנוכחי כדי ליצר "רף נמוך" יותר, כך שההשקה של המודל הבא תיתפס כקפיצה טכנולוגית דרמטית בהרבה.

"יש מצב שלפני הוצאת מודל חדש הם מטמטמים את המודל הנוכחי כדי לייצר רף נמוך יותר למודל הבא ותחושת קפיצה טכנולוגית משמעותית יותר למשתמשים?" תהו משתמשים ברשתות החברתיות. "אין דרך אחרת להסביר איך מודלים סבירים לפתע הופכים לטומטומים מרדניים".

מנגד, אנליסטים ומשתמשים מנוסים מעריכים כי מדובר בענייני עלויות ומשאבי מחשוב. ג'מיני משרת כיום מאות מיליוני משתמשים פעילים בחודש. הטיפול בעומסים העצומים הללו מצריך כוח מחשוב יקר במיוחד, ולפי ההערכות גוגל מנסה לצמצם את ה-"Effort" המוקצה לכל שאילתה בודדת.

דיווחים של משתמשים שלמדו לנתח את פלט החשיבה של המודל מצביעים על כך שגוגל הפחיתה את ערכי המאמץ של המודל מ-1.0 ל-0.5, ואף צמצמה את שקיפות תהליך החשיבה כדי להסוות את השינויים הללו.

רעידת אדמה בניהול DeepMind

הסערה סביב הביצועים מתרחשת במקביל לשינויים ארגוניים נרחבים בצמרת Google DeepMind. על פי הדיווחים, דמיס חסביס עוזב את תפקידו הניתוחי היומיומי ויכהן כיו"ר Google DeepMind וכמדען הראשי של Alphabet. את הניהול השוטף והלחץ הכבד של פיתוח והשקת מודלי ג'מיני מקבל לידיו קוראי קאבוקצ'אוגלו. במקביל, בכירים נוספים כמו ג'ף דין וסנג'אי גמאוואט פורשים כדי להקים חברת מחקר חדשה, תוך שמירה על קשרי השקעות וענן עם אלפבית.

Gemini 3.5 Flash, צילום: גוגל

השינויים המבניים הללו משקפים את הפיצול של גוגל לשני מסלולים: אחד המתמקד באסטרטגיית AGI ומחקר מדעי ארוך טווח, והשני במוצר ובתיעוד ביצועים בקנה מידה עצום. לצד הדיווחים הללו, אושר כי הפיתוח של Gemini 4 כבר בעיצומו, בעוד ברשת נפוצות שמועות בלתי רשמיות על השקה קרובה של גרסאות ביניים מתקדמות כמו Gemini 3.5 Pro.

נכון למועד פרסום הכתבה, תגובתה הרשמית של גוגל לטענות בדבר ירידה בביצועים או שינויים יזומים ביכולות המודל טרם התקבלה, והיא תובא לכשתתקבל. כלל הדיווחים בכתבה מבוססים על עדויות, ניתוחים וחוויות של משתמשים ברשתות החברתיות ובפורומים המקצועיים.

טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו

כדאי להכיר