ESPN DeportesNew York enterró el recuerdo de Rafael Márquez, pero no su huellaThe Jerusalem PostIran offers up to $40,000 reward to Middle East citizens who capture, kill US soldiers - reportESPNSources: Giants to release OBJ amid veteran receiver's strugglesBillboardHALCALI Talk ‘Otsukare SUMMER’ Going Viral & Returning to Music after a 14-Year ‘Career Gap’: Billboard Japan Women in Music InterviewNMEFoo Fighters to open for AC/DC again at rescheduled New Jersey show – less than a month after “one night only” support slotGlobal NewsSaskatchewan Premier Scott Moe to lay out nuclear development planVariety‘Game of Thrones’ Movie ‘Aegon’s Conquest’ Sets Summer 2029 Release Dateגיקטייםתכירו: Dots, האייג'נטים החדשים של OpenAI, שיתחרו ב-Muse ו-InstinctWirtualna PolskaZatrzymania ws. Collegium Humanum, spór o szefa SOP [SKRÓT DNIA]Antara NewsIndonesia allocates US$66.67 mln to develop modern fishery hub in BaliABC NewsPro-Trump ad campaign was financed by DHS: SourcesBusiness AMAmerikaanse staatsobligaties boeken grootste daling in september sinds 2023
The Daily Newsstand · Free, Always
Tuesday, September 29, 2026

אפליקציית ההקראה המצוינת של ElevenLabs משתדרגת עם מודל חדש, עברית מעולה ודיבור אנושי

Translate

חברת ה-AI הקולי ElevenLabs חושפת את גרסה v4 של המודל שלה שזמין גם באפליקציית ההקראה שלה

תמונה: ElevenLabs

אם יצא לכם להשתמש לאחרונה באפליקציית ההקראה של ElevenLabs (כמו שהמלצנו לכם לפני שנתיים), לא צריך לחפור לכם יותר מדי למה היא פופולרית כל-כך. האפליקציה, שזמינה לאנדרואיד ול-iOS, הצליחה לשבור את התפיסה של מנועי ההקראה הרובוטיים והמונוטוניים, ועל הדרך היא גם הוסיפה לפני כשנה תמיכה מפתיעה ולא רעה בעברית. עכשיו, החברה משחררת שדרוג משמעותי מתחת למכסה המנוע, כשהיא מטמיעה באפליקציה ובפלטפורמה את דור המודלים החדש והמתקדם שלה, ה-v4 וגרסת ה-Turbo.

מודל חדש

המעבר לארכיטקטורת ה-v4 משנה את כל מה שהכרנו על TTS וקול מג'ונרט שנשמע כמו קריין חסר רגש. המודל החדש לא פשוט קורא את המילים בצורה לינארית, אלא ממש מנתח את ההקשר המלא של המשפטים והטקסט לפני ובזמן ההקראה ויכול להתאים את הטון לטקסט. כלומר האינטונציה, קצב הדיבור ואפילו העצירות הקטנות לנשימה בין המשפטים, מותאמים לתוכן באופן דינמי. זה הופך את חוויית ההאזנה למאמרים ארוכים במיוחד, דוחות משמימים או ספרים דיגיטליים, לחלקה והרבה יותר טבעית לאוזן.

הדגמה של המודל החדש:

אבל גם אם אתם לא סומכים על ה-AI, ורוצים לייצר לבד קטע קריינות ולקבוע כיצד הוא יישמע בדיוק, אתם יכולים, כי אחד הפיצ'רים המעניינים שמגיעים עם השדרוג הזה, הוא היכולת לשלוט במדויק ברגש ובהבעה של הקריין באמצעות תגיות טקסט מובנות. במקום לחכות שהמודל ינחש מתי צריך להנמיך את הקול, אתם יכולים פשוט להדביק את הטקסט לו אתם רוצים להאזין ואז לשתול פקודות ספציפיות ישירות בתוך הטקסט. רוצים שהקריין ילחש לפתע? פשוט הוסיפו את התגית [whisper]. רוצים צחקוק קליל? אנחה או קול עצוב? תוכלו להשתמש בתגיות כמו [laugh], [sigh] או [sad]. המערכת יודעת לעבד כמה תגיות כאלו ברצף, כך שהקול הווירטואלי יכול לעבור מטון מקצועי ורציני ללחישה דרמטית בלי להישבר בדרך. כמובן שאם תרצו, תוכלו פשוט ללחוץ על הכפתור וה-AI יוסיף את התגיות במקומכם.

עוד דוגמה שיצרנו:

עבור מפתחים שבונים סוכנים קוליים ונעזרים ב-API של החברה, גרסת ה-v4 Turbo מביאה איתה קפיצת מדרגה גם בגזרת הביצועים – עם זמני שיהוי נמוכים במיוחד שעומדים על כמאה מילישניות בלבד. כך המערכת מאפשרת בפועל לנהל שיחות שוטפות מול בוטים שמבוססים על מודלי שפה גדולים. כלומר, האודיו נוצר ברגע שהמודל מתחיל לפלוט את המילים הראשונות, בלי העיכובים המביכים שמאפיינים לא פעם עוזרות קוליות, כשאתם שואלים משהו ומחכים לג'ינרוט הקול.

חידושים נוספים בגרסה v4 הם תמיכה ב-90 שפות (כאמור, עברית כבר ביניהן כשנה) וכן אפשרות לשכפול מהיר של כל קול שתרצו (בגבולות הקניין הרוחני כמובן) על ידי האכלת המודל הרעב בדגימות קול שלכם.

View the original on גיקטיים →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.