"ישראל היום" הוא גוף תקשורת שנוסד מתוך האמונה שהציבור הישראלי ראוי לעיתונות טובה יותר, מאוזנת יותר ומדויקת יותר. עיתונות שמדברת ולא צועקת. עיתונות אמינה, אובייקטיבית ועניינית. עיתונות אחרת וללא תשלום. המהדורה המודפסת הראשונה פורסמה ב-30 ביולי 2007, וב-2010 הפך "ישראל היום" לעיתון הישראלי בעל שיעור החשיפה הגבוה ביותר בימי חול. מו"ל העיתון היא ד"ר מרים אדלסון. העורך הראשי הוא עמר לחמנוביץ, והעורך המייסד הוא עמוס רגב. אתרי האינטרנט של "ישראל היום" בעברית ובאנגלית, כמו כן היישומונים (אפליקציות) לאנדרואיד ול-iOS, מציגים חדשות מסביב לשעון, תוכן בלעדי, מבזקים ועדכונים, ניתוחים ופרשנויות, וידיאו, פודקאסטים ושידורים חיים. פלטפורמות הדיגיטל של "ישראל היום" כוללות ערוצי חדשות ודעות, תרבות ובידור, לייף סטייל, טכנולוגיה, ספורט, כלכלה וצרכנות, בריאות, חיילים, אוכל, יהדות, תיירות ורכב. ב-2021 עלו לאוויר האתר החדש והיישומון החדש של "ישראל היום" בעברית, במטרה לספק לגולשים חוויה מהירה, עדכנית, בטוחה ונוחה. תכני המהדורה המודפסת של העיתון זמינים גם באתר, במהדורה יומית מקוונת, ואפשר לקבל אותם גם בניוזלטר. מועדון ההטבות הייחודי "הקליקה של ישראל היום" מציע לגולשי האתר הנחות ומבצעים על מוצרים ושירותים. ישראל היום פתוח להערות, לביקורת ולהצעות לשיפור מקהל הקוראים. פנו אלינו במייל hayom@israelhayom.co.il.

היום
שיתוף כתבה
1,000,000 שעות של קבצים: הפרויקט המסקרן של אנבידיה
רוב השפות בעולם לא נתמכות על ידי מודלי שפה מתקדמים • המערכת החדשה תסייע בזיהוי דיבור ותרגום בזמן אמת • הטכנולוגיה תאפשר שירותי קול מתקדמים לשפות אירופיות נפוצות פחות
הפיתוח החדש של אנבידיה. צילום: אנבידיה

1,000,000 שעות של קבצים: הפרויקט המסקרן של אנבידיה

רוב השפות בעולם לא נתמכות על ידי מודלי שפה מתקדמים • המערכת החדשה תסייע בזיהוי דיבור ותרגום בזמן אמת • הטכנולוגיה תאפשר שירותי קול מתקדמים לשפות אירופיות נפוצות פחות

מערכת היום
, עודכן
0

Your browser doesn’t support HTML5 audio

חברת אנבידיההודיעה היום (שישי) על שחרור מאגר נתונים פתוח ומודלי בינה מלאכותיתחדשים שנועדו לשפר את יכולות זיהוי הדיבור והתרגום ב-25 שפות אירופיות נוספות. המהלך מיועד לפתור בעיה משמעותית בתחום הבינה המלאכותית: העובדה שרק חלק זעיר מכ-7,000 השפות בעולם נתמכות על ידי מודלי שפה מתקדמים.

המאגר החדש, הנושא את השם Granary, מכיל כמיליון שעות של קבצי אודיו, מתוכם כ-650 אלף שעות לזיהוי דיבור ויותר מ-350 אלף שעות לתרגום דיבור. המאגר תוכנן לתמוך בפיתוח טכנולוגיות דיבור איכותיות עבור שפות שזוכות לייצוג מוגבל במודלי בינה מלאכותית קיימים, כמו קרואטית, אסטונית, מלטזית ועוד.

אנבידיה (אילוסטרציה), צילום: רויטרס

המחקר מאחורי Granary פותח בשיתוף עם אוניברסיטת קרנגי מלון ומכון המחקר האיטלקי Fondazione Bruno Kessler.

לפי החברה, המאגר החדש צורך כמחצית מכמות הנתונים הנדרשת במאגרים פופולריים אחרים כדי להגיע לאותה רמת דיוק בזיהוי דיבור ובתרגום אוטומטי.

עוד נמסר, כי הטכנולוגיות החדשות יאפשרו למפתחים לבנות יישומי בינה מלאכותית מתקדמים כמו צ'אטבוטים רב-לשוניים, סוכני AI לשירות לקוחות קולי ושירותי תרגום כמעט בזמן אמת. זאת, תוך מתן מענה לקהל משתמשים גלובלי רחב יותר ובכלל זה דוברי שפות מיעוט באירופה.

המאגר והמודלים החדשים זמינים כעת בחינם בפלטפורמת Hugging Face והמתודולוגיה זמינה ב-GitHub למפתחים המעוניינים להתאים אותה לשפות או יישומים נוספים.

טעינו? נתקן! אם מצאתם טעות בכתבה, נשמח שתשתפו אותנו
Load more...