הקלדה קולית ל-Windows — הכתבה מקומית או בענן בכל אפליקציה | NeuroSwitcher

חדש בבטא Pro · הקלדה קולית

הקלדה קולית ל-Windows בכל אפליקציה — מקומי כברירת מחדל.

מפעילים הכתבה, לוחצים מקש ואומרים מה רוצים לכתוב — ו-NeuroSwitcher מקליד את זה בחלון הפעיל: צ'אט, דפדפן, עורך, IDE. זיהוי הדיבור רץ כברירת מחדל על המחשב שלכם; או עוברים ל-NeuroSwitcher Cloud בלי הגדרות, או ל-API של הספק שלכם. בלי מינוי.

  • מקומי או בענן
  • מספיק מעבד רגיל
  • EN · RU · DE + עברית בבטא
  • תיקון AI אופציונלי
הודעה.txt

🎙 מקליט… (F8 לעצירה)

בוא נעביר את הפגישה ליום חמישי בשלוש.

מודל מקומי · תומלל על המחשב שלכם
מנוע: פעיל בקאנד: מקומי / ענן מקש: F8

איך זה עובד

מפעילים, לוחצים F8, מדברים. הטקסט מגיע לאן שהסמן.

ההכתבה של NeuroSwitcher היא מנוע דיבור קטן שחי לצד מחליף הפריסות שאתם כבר מכירים. הטקסט המזוהה מוקלד דרך אותו מנגנון קלט של תיקוני הפריסה — כולל טיפול נכון ב-BiDi — ולכן עובד בשדות טקסט רגילים בכל Windows.

1

מפעילים הכתבה

המנוע כבוי כברירת מחדל (הוא מחזיק את המודל בזיכרון). מפעילים אותו מהמגש Voice → התחל הכתבה, או מפעילים הפעלה אוטומטית בעלייה בלשונית Voice ב-Pro Console.

2

לוחצים F8 — הקלטה

כשהמנוע פעיל, לוחצים על מקש ההכתבה (F8 כברירת מחדל, ניתן לשינוי) ומדברים. אינדיקטור — וסמל המיקרופון של Windows 11 — מראים שהמיקרופון פתוח.

3

לוחצים F8 — עצירה

לחיצה נוספת סוגרת את המיקרופון, והטקסט מוקלד ליד הסמן. עם הבקאנד המקומי האודיו מעובד בזיכרון: לא נכתב לדיסק ולא נשלח לשום מקום.

4

הכתבה ארוכה? הפעילו VAD

כברירת מחדל כל ההקלטה מתומללת ברגע העצירה. הפעילו פילוח VAD (מגש → Voice → פילוח VAD) כדי לחתוך את הדיבור בהפסקות: כל מקטע מתומלל ומוזן מיד — הטקסט זורם משפט אחרי משפט, ומגבלת ~30 השניות של Whisper לאמירה בודדת נעלמת. מודל ה-VAD (Silero) כבר כלול, אין מה להוריד.

זיהוי

בחרו איפה הדיבור הופך לטקסט.

לזיהוי הדיבור יש שלוש דרכים — בחרו לפי פרטיות ונוחות, בלשונית Voice ב-Pro Console (אזור זיהוי / speech-to-text). מקומי הוא ברירת המחדל והכי פרטי; דרכי הענן מחליפות מעט פרטיות בהגדרה אפסית או בדיוק מרבי.

מודל מקומי · אופליין (ברירת מחדל)

מורידים מודל זיהוי בקליק אחד מהקטלוג המובנה (Pro Console → Voice), עם מד התקדמות. קטן ומהיר או גדול ומדויק. אחרי ההורדה הזיהוי רץ כולו על המעבד שלכם — בלי אינטרנט, ושום אודיו לא עוזב את המחשב.

NeuroSwitcher Cloud

אפס הגדרות: בלי מפתח, בלי הורדת מודל, עם מכסה יומית חינמית. ה-install id האנונימי של המחשב חותם על הבקשה. האודיו המוקלט נשלח לפרוקסי שלנו ומשם לספק. עוד על NeuroSwitcher Cloud →

הספק שלכם

מכוונים את הזיהוי ל-OpenAI (למשל gpt-4o-mini-transcribe) או לכל endpoint תואם-OpenAI עם מפתח ה-API שלכם. האודיו עובר ישירות מהמחשב שלכם לספק — בלי שרת NeuroSwitcher באמצע.

מחליפים בכל רגע

הבקאנד הוא תפריט נפתח בלשונית Voice: מתחילים מקומי לפרטיות, עוברים לענן כשרוצים דיוק בלי הגדרות, וחוזרים. אחרי שינוי מפעילים מחדש את מנוע הקול. בקאנדים בענן הם תמיד אופציונליים.

מתי נוח יותר בענן: מחשב חלש, דיוק מרבי בלי הורדת מודל גדול, או עברית בלי טרחה. לפרטיות ולעבודה אופליין — מודל מקומי.

מודלים מקומיים

איזה מודל זיהוי מקומי לבחור.

בבקאנד המקומי המודלים יורדים מהקטלוג המובנה (Pro Console → Voice, התקנה בקליק עם התקדמות). אין „הכי טוב" יחיד — זה תלוי בשפות ובחוזק המחשב. ההמלצות שלנו מהניסיון:

Qwen3-ASR 0.6B · ~1GBהכי טוב ל-RU/EN/DE ולדיבור מעורב — מזהה ערבוב שפות במשפט אחד במעבר יחיד. המלצת ברירת המחדל להכתבה ברוסית/אנגלית/גרמנית. בלי עברית.
Whisper-base · ~200MBרב-תכליתי וקל: RU/EN/DE ועברית (עם שפה מוגדרת מפורשות). התחלה טובה ומתאים למחשבים חלשים.
Whisper-tiny · ~110MBהקל והמהיר ביותר; דיוק נמוך יותר. כשגודל ומהירות חשובים יותר מאיכות.
Whisper-medium / large-v3 · ~1–2GBדיוק מרבי, כולל עברית. דורשים יותר RAM ומעבד — איטיים משמעותית במחשב חלש.

⚠️ Whisper מזהה את השפה פעם אחת למשפט, ולכן לדיבור שמערבב שפות בתוך משפט אחד בחרו Qwen3. לעברית — רק Whisper (base / medium / large-v3) עם שפה מוגדרת ל-HE: Qwen3 לא תומך בעברית. בקטלוג יש גם מודלים לשפות אחרות (סינית, יפנית, קנטונזית).

שפות

נבנה לאנשים שמכתיבים ביותר משפה אחת.

חשוב לומר ביושר: עברית בהכתבה קולית היא כרגע בטא — היא עובדת דרך מודלי Whisper עם רמז שפה מפורש, והאיכות עוד משתפרת. אנגלית, רוסית וגרמנית עובדות מצוין כבר עכשיו.

עבריתבטא: פועלת דרך מודלי Whisper עם רמז שפה; מומלץ לקבוע את שפת הזיהוי לעברית במפורש.
אנגליתאיכות הכתבה מלאה, כולל משפטים מעורבים.
רוסיתאיכות הכתבה מלאה עם המודל המקומי המומלץ.
גרמניתאיכות הכתבה מלאה עם המודל המקומי המומלץ.

שפת הזיהוי (אוטומטי / HE / EN / RU / DE) נבחרת בתפריט Voice שבמגש המערכת או בלשונית Voice ב-Pro Console.

תיקון הכתבה

אופציונלי — מלטשים את התמלול הגולמי עם LLM.

טקסט מוכתב מגיע עם מילות מילוי, התחלות כפולות ובלי פיסוק. מעבר LLM אופציונלי משכתב את כל ההכתבה — פיסוק, ניקוי מילוי, פורמט — לפני שהיא מוקלדת. כבוי כברירת מחדל; כך מפעילים.

1 · הפעילו «תיקון (LLM)»מפעילים במגש Voice → תיקון (LLM), או בוחרים בקאנד תיקון בלשונית Voice ב-Pro Console. כבוי כברירת מחדל.
2 · בוחרים פריסטבוחרים פריסט-הנחיה במגש Voice → פרומפט תיקון — סידור, רשמי, יומיומי, רשימת נקודות, סיכום, תרגום ועוד. הפריסט המסומן חל על כל הכתבה.
3 · עורכים או מוסיפים הנחיותבלשונית Voice ב-Pro Console (אזור הנחיות ה-LLM) אפשר לערוך כל הנחיה מובנית — היא הופכת לברירת המחדל החדשה שלה — או להוסיף משלכם; תפריט המגש מתעדכן.
4 · בוחרים בקאנד AINeuroSwitcher Cloud חינמי, המפתח שלכם ל-OpenAI / OpenRouter, או מודל מקומי לגמרי דרך Ollama או LM Studio. ההגדרה משותפת עם העוזר — ראו את עמוד עוזר ה-AI.

אותם כללי פרטיות: עם מודל מקומי התיקון נשאר על המחשב; עם מודל ענן טקסט התמלול נשלח ישירות לספק שבחרתם, עם המפתח שלכם (או במכסה החינמית של NeuroSwitcher Cloud).

שליטה

מהמגש או מ-Pro Console — איך שנוח.

תפריט Voice במגשהפעלה/עצירה של המנוע, החלפת מודל פעיל, שפת זיהוי, וגם תיקון (LLM) והפריסט שלו — בלי לפתוח חלונות.
לשונית Voice ב-Pro Consoleקטלוג מודלים עם התקנה בקליק והתקדמות, בקאנד זיהוי (מקומי / ענן / מפתח משלכם), סטטוס מנוע, מקש, הפעלה אוטומטית והגדרות התיקון — במקום אחד.
מקש ניתן להגדרהF8 כברירת מחדל; שנו אותו אם יש התנגשות עם אפליקציות.
מנוע לפי דרישהמנוע הקול פועל רק כשמפעילים אותו: הוא מחזיק את המודל בזיכרון, ולכן כבוי עד שצריך (או עד שמפעילים הפעלה אוטומטית).

שאלות נפוצות

שאלות שחוזרות על הקלדה קולית.

איך מתחילים להכתיב?

מנוע הקול כבוי כברירת מחדל. מפעילים אותו מהמגש Voice → התחל הכתבה (או מפעילים הפעלה אוטומטית בלשונית Voice ב-Pro Console). ואז לוחצים F8 כדי להתחיל הקלטה, מדברים ולוחצים F8 שוב לעצירה — הטקסט מוקלד לאפליקציה הפעילה.

זה עובד בלי אינטרנט?

כן, עם מודל הזיהוי המקומי — ברירת המחדל. אחרי התקנת מודל הזיהוי רץ כולו על המחשב שלכם בלי אינטרנט (רק הורדת המודל החד-פעמית צריכה רשת). NeuroSwitcher Cloud ובקאנדים עם מפתח משלכם הם אופציונליים ומשתמשים בחיבור.

הקול שלי מוקלט או נשמר?

עם הבקאנד המקומי — לא: המיקרופון פתוח רק בין התחלה לעצירה מפורשות, האודיו מתומלל בזיכרון, ושום דבר לא נכתב לדיסק או מועלה. אם בחרתם בקאנד זיהוי בענן (NeuroSwitcher Cloud או הספק שלכם), האודיו המוקלט נשלח לספק לתמלול. בזמן הקלטה רואים גם את האינדיקטור של NeuroSwitcher וגם את סמל המיקרופון של Windows.

צריך מחשב חזק או GPU?

לא. משפטים מוכתבים הם קצרים, ומודלי ברירת המחדל המקומיים מתמללים אותם מהר יותר מזמן אמת על מעבד רגיל. מודלים גדולים ומדויקים יותר יש בקטלוג — או שאפשר להעביר את הזיהוי לגמרי לבקאנד בענן.

באילו אפליקציות זה עובד?

בכל אפליקציה עם שדה טקסט רגיל: דפדפנים, צ'אטים, עורכים, IDE, אופיס. הטקסט מוקלד דרך אותו מנגנון שבו NeuroSwitcher מתקן פריסות, ורשימת ההחרגות לפי אפליקציה חלה גם כאן.

מה איכות העברית?

הכתבה בעברית היא בבטא. היא עובדת דרך מודלי Whisper עם שפה מוגדרת מפורשות, והפלט הוא עברית אמיתית, אבל איכות הזיהוי עדיין מאחורי אנגלית, רוסית וגרמנית. אנחנו עובדים על זה באופן פעיל.

ההקלדה הקולית חינמית?

ההקלדה הקולית היא חלק מבטא Pro החינמית. קטלוג המודלים המנוהל עם התקנה בקליק הוא נוחות Pro; מנוע הקול עצמו הוא חלק מהליבה הפתוחה. ל-NeuroSwitcher Cloud יש מכסה יומית חינמית; בקאנדים עם מפתח משלכם מחויבים דרך הספק שלכם.

האנטי-וירוס מבקש גישה למיקרופון עבור ‏«ks-voice-host.exe» — זה תקין?

כן. את המיקרופון פותח לא היישום הראשי אלא תהליך זיהוי נפרד — ks-voice-host.exe מתיקיית המשנה voice שבתיקיית ההתקנה של NeuroSwitcher. הזיהוי רץ בתהליך נפרד בכוונה: מודל הדיבור מבודד ממחליף הפריסה, כך שתקלה באחד לא מפילה את השני. לכן ההודעה של Windows או של תוכנת האבטחה מציגה שם קובץ לא מוכר ולא «NeuroSwitcher». די לאשר פעם אחת.

בטא Pro חינמית

מקלידים בקול — כמו שנוח לכם.

הורידו את NeuroSwitcher ל-Windows 10 ו-11, פתחו את לשונית Voice, הפעילו הכתבה ודברו לכל אפליקציה — עם מודל מקומי אופליין או דרך NeuroSwitcher Cloud בלי הגדרות.

הורדת NeuroSwitcher

→ חזרה לדף הבית של NeuroSwitcher