דלג לתוכן

ניווט במאגרי ML עבריים

אמין87/100
לפני שמחליטים האם להתקין, צ׳אט חי עם סקיל

נווטו את הנוף המפוצל של מאגרי ML ומודלים בעברית וביידיש: ivrit.ai (יותר מ-20 אלף שעות אודיו עברי, מודלי ASR של whisper-large-v3, מודלי יידיש), Dicta (משפחת DictaLM 3.0, וריאנטים של DictaBERT, HeQ), התכנית הלאומית ל-NLP (HebrewSentiment, HebNLI), AlephBERT, ומליאות הכנסת. עוזר לחוקרים ומהנדסי ML לבחור את הדאטהסט הנכון לפי משימה, רישיון (מסחרי או מחקר), כיסוי רגיסטר עברי, והתאמת דאטהסט למודל. השתמשו כשבוחרים נתוני אימון לפרויקט NLP או ASR עברי, מוודאים תאימות רישיון למוצר מסחרי, מחפשים baseline למשימה עברית, או בודקים משאבי ML ליידיש. אל תשתמשו למאגרי NLP ערבי, חיפוש כללי ב-HuggingFace Hub, או בחירת דאטהסט OCR עברי (hebrew-ocr-forms).

ציון אמינות 87/100 (אמין) · 34+ התקנות · 4 תורמים ב-GitHub · רישיון MIT

הבעיה

קהילת ה-ML הישראלית חזקה לגודלה, אבל המאגרים והמודלים מפוזרים. ivrit.ai מפרסמת קורפוסי דיבור עברי ברמה עולמית בארגון HuggingFace אחד, Dicta מפרסמת מודלי LLM ו-BERT עבריים בארגון אחר, התכנית הלאומית ל-NLP מתחזקת בנצ'מרקים תחת HebArabNlpProject. הרישיונות משתנים מידידותי-מסחרי-מלא עד מחקר-בלבד. חוקר שמנסה לבחור את השילוב הנכון ל-fine-tuning של סיווג סנטימנט על צ'אט תמיכה עברי למוצר מסחרי צריך לחפש בחמישה ארגונים ולקרוא כל dataset card.

skills-ilskills-ilכלי פיתוח
1.0.5MITGitHub
34התקנות1,699צפיות
0כתיבת ביקורת

איך להשתמש בסקיל הזה

לא בטוחים איך? קראו את המדריך
  1. 1. לחצו "הורדת ZIP" להורדת קבצי הסקיל.
  2. 2. פתחו את Claude Desktop ולכו ל-Customize > Skills.
  3. 3. לחצו על "+" ובחרו "Upload a skill", ואז העלו את קובץ ה-ZIP.
  4. 4. פתחו שיחה חדשה. הסקיל יופעל אוטומטית כשהנושא רלוונטי.
יצאה גרסה חדשה? איך מעדכנים את הסקיל שהתקנתם
מפתחים? התקנה דרך שורת הפקודה (CLI)
npx skills-il add skills-il/developer-tools@v1.0.5-hebrew-ml-datasets-navigator --skill hebrew-ml-datasets-navigator -a claude-code

מתי להשתמש

  • כשבוחרים נתוני אימון לפרויקט NLP או ASR עברי
  • כשצריך לוודא שהרישיון של דאטהסט מתאים לשימוש מסחרי
  • כשמחפשים מודל baseline למשימה ספציפית בעברית
  • כשבונים stack של תמלול עברי ורוצים לדעת מה ivrit.ai מציעה
  • כשחוקרים או בונים משהו ביידיש ולא יודעים איפה למצוא משאבים

נסו את הפרומפטים האלה

סיווג סנטימנט מסחרי

אני רוצה לאמן מודל סיווג סנטימנט על צ'אט תמיכת לקוחות בעברית למוצר SaaS מסחרי. איזה דאטהסט להשתמש, איזה מודל התחלתי, ומה הרישיון אומר לגבי ייחוס?

תמלול פודקאסט עברי

אני בונה מוצר תמלול פודקאסטים בעברית. מה ivrit.ai מציעה, איזה מודל ASR להשתמש בפרודקשן עם latency נמוך, ואיך אני מטפל במספר דוברים?

LLM עברי קטן

צריך LLM עברי שרץ על חומרת צרכן (לא יותר מ-16GB VRAM) למוצר עברי. מה Dicta מציעה, מה ההבדלים בין הגדלים, ומה הרישיונות של ה-upstream?

יידיש ML

אני חוקר יידיש ומחפש דאטהסטים ומודלים לזיהוי דיבור ולעיבוד טקסט. מה זמין ב-2026 ומה הרישיונות?

שאלות נפוצות

יומן שינויים

v1.0.5

עדכון: הגישה ל-OSCAR-2301 מושהית זמנית (הפניה ל-CulturaX/FineWeb-2), ותוקן היקף קורפוס ivrit.ai מ-22K ל-20K שעות בהתאם למקור.

6 ביולי 2026

v1.0.4

הוספת Jamba 1.6 ו-Jamba-Reasoning-3B לקטלוג המודלים, הכרה בחבילת הבנצ'מרקים של DictaLM 3.0 (תרגום, תמצות, Winograd, טריוויה ישראלית, ניקוד), והפניית טענות הרישיון של HebrewSentiment לכרטיס הנתונים החי.

19 במאי 2026

v1.0.3

הוספת HEBREW-MMLU, CulturaX, FineWeb-2, ParaShoot, HeSum, משאבים אקדמיים. הסרת 27 em dashes.

25 באפר׳ 2026

סקילס קשורים

skills-ilיוצר: skills-il
v2.2.1פופולרי

בונים תרחישי Make.com לתהליכים עסקיים ישראליים: סנכרון Morning (חשבונית ירוקה), iCount, Monday.com, Priority ERP, שערי תשלום (Cardcom, Tranzila, Grow, Bit) ו-WhatsApp Business. מכסה AI Agents של Make.com, שרת ה-MCP של Make.com לחשיפת תרחישים ככלי סוכן, רפורמת חשבוניות 2026, מודולים קהילתיים ישראליים, טיפול בטקסט עברי, Data Store לתקופות מע"מ ותזמון שמתחשב בשבת. לא לשימוש ב-n8n (תשתמשו ב-n8n-hebrew-workflows) או Zapier (תשתמשו ב-zapier-israeli-integrations).

0.01302,406
Claude CodeCursorGitHub Copilot+4
skills-ilיוצר: skills-il
v2.0.0פופולרי

ממירים בין תאריכים עבריים ולועזיים בכל הפורמטים.

0.0971,956
Claude CodeCursorGitHub Copilot+6
skills-ilיוצר: skills-il
v1.1.1פופולרי

שיטות עבודה להפקת וידאו מקוד עם HyperFrames: קומפוזיציות שהן פשוט HTML + GSAP שמתרנדרות ל-MP4, עם תמיכה מלאה בעברית ו-RTL. הסקיל מסביר איך כותבים קומפוזיציה, מה עושים מאפייני data-* לתזמון, איך עובדים עם ה-Timeline של GSAP ושיטת Layout-Before-Animation, איך מטפלים ב-Visual Identity Gate, איך לטעון פונטים עבריים (Heebo, Rubik, Assistant) בלי `<link>` או `@import`, איפה שמים dir="rtl", איך מפיקים כתוביות עברית עם Whisper ומתמודדים עם קריינות בעברית כש-Kokoro המובנה לא תומך, איך להוסיף אפקטים שמגיבים לאודיו ומעברי סצנות, ואיך לעטוף טקסט מעורב עברית+אנגלית ב-<bdi>. מתאים לבניית תוכן וידאו מבוסס-HTML וסרטוני סושיאל ושיווק בעברית בלי React. לא מתאים ל-Remotion או לעבודת וידאו ב-React, שם השתמשו ב-remotion-best-practices.

0.0692,059
Claude CodeCursorWindsurf+7
מצאתם בעיה בסקיל הזה?

השימוש על אחריותכם בלבד. תנאי שימוש · אבטחה

רוצים לבנות סקיל משלכם? נסו את יוצר הסקילס · הגשת סקיל

ביקורות (0)

אין ביקורות עדיין. כתבו את הביקורת הראשונה!