# Lemonade — שרת AI מקומי בקוד פתוח (טקסט, תמונה וקול) | BinTech

> לימונדה (Lemonade): שרת AI מקומי קוד פתוח בחסות AMD, שמאחד LLM, יצירת תמונות, תמלול וקריינות מאחורי API אחד — תואם ל-OpenAI, Ollama ו-Anthropic, ורץ גם על NVIDIA.

Canonical: https://bintechai.com/lemonade-ai-server

# Lemonade — שרת AI מקומי בקוד פתוח לטקסט, תמונה וקול

לימונדה (Lemonade) הוא שרת בינה מלאכותית מקומי — תוכנה שרצה על המחשב שלכם ומאחדת כמה סוגי יצירת AI מאחורי ממשק תכנות (API) אחד: יצירת טקסט (LLM), יצירת תמונות, תמלול דיבור לטקסט (Speech-to-Text) והפיכת טקסט לקול (Text-to-Speech). הפרויקט קוד פתוח לגמרי (רישיון Apache 2.0) ובחסות AMD, אך תומך גם בחומרת NVIDIA. הנקודה המבדלת: ה-API שלו תואם בו-זמנית לשלושה תקנים — OpenAI, Ollama ו-Anthropic Messages API (הפרוטוקול שקלוד עובד לפיו) — כך שכלים קיימים יכולים לדבר איתו כמעט בלי שינוי קוד. זהו כלי טכני למפתחים ולחובבי AI, לא אפליקציית צ'אט מוכנה-לשימוש למשתמש קצה.

## מה זה לימונדה, ומה זה לא?

לימונדה היא לא מנוע AI בפני עצמו אלא "מתאם" (orchestrator) שעוטף כמה מנועי קוד-פתוח מוכרים — llama.cpp ליצירת טקסט, whisper.cpp לתמלול, stable-diffusion.cpp ליצירת תמונות, Kokoro לקריינות, ו-FastFlowLM להאצה על שבבי NPU — ומספקת להם ממשק אחיד. זו גם לא אפליקציית "בלי-קוד" בסגנון ChatGPT: מדברים איתה דרך API, כך שהיא מיועדת למפתחים ובוני סוכני AI ולא למי שמחפש חלון צ'אט מוכן. נכון ל-6.8.2026 יש לפרויקט כ-5,255 כוכבים ו-442 forks בגיטהאב, נוצר במאי 2025, והגרסה האחרונה — v11.5.2 — יצאה ב-5.8.2026.

## האם לימונדה באמת חינמית?

כן. התוכנה קוד פתוח (Apache 2.0), ואין תשלום, הרשמה או מכסת שימוש כדי להריץ אותה מקומית. בשונה מכלים שבהם "התוכנה חינם" אבל השימוש בפועל צורך קרדיטים בענן — כאן הכול רץ על החומרה שלכם, וה"מחיר" היחיד הוא חשמל וזמן חישוב על מחשב שכבר יש לכם. קיימת גם אפשרות אופציונלית להעברה לענן (Cloud Offload), אבל זו לא ברירת המחדל.

## מה מקבלים מלימונדה?

יצירת טקסט (LLM) לצ'אט וקוד; יצירת תמונות מטקסט דרך stable-diffusion.cpp; תמלול דיבור לטקסט דרך Whisper; הפיכת טקסט לקריינות דרך Kokoro; ותוספות נוספות לאודיו, תלת-מימד וסיווג טקסט. ההבדל המרכזי מחלופות מקומיות פופולריות כמו Ollama או LM Studio: הן מתמקדות ב-LLM טקסטואלי בלבד, בעוד לימונדה נותנת חוויה רב-מודלית אמיתית ממקום אחד. בזכות התאימות ל-Anthropic Messages API (endpoint POST /v1/messages, כולל streaming ותאימות לשדות model/messages/system/max\_tokens/tools), התיעוד הרשמי מפרט את קלוד קוד (Claude Code) בעצמו כאחת האפליקציות הנתמכות ישירות — פקודה אחת, lemonade launch claude, פותחת אותו כשהוא כבר מוגדר לדבר עם השרת המקומי בלי הגדרת endpoint ידנית; אפשר גם לציין מודל מראש עם lemonade launch claude --model <שם המודל>.

## איך מתחילים להתנסות?

שלושה שלבים: (1) מתקינים לפי מערכת ההפעלה — Windows 11 (קובץ MSI), macOS (קובץ pkg), לינוקס (Ubuntu, Fedora, Debian, Arch — לכל אחת דף הוראות משלה), או Docker; ההוראות המעודכנות תמיד באתר הרשמי. (2) מריצים את השרת, שעולה מקומית בכתובת http://localhost:13305. (3) מצביעים כלי קיים שכבר יודע לדבר עם OpenAI, Ollama או Anthropic אל הכתובת המקומית, בלי לשנות איך הוא בנוי — לדוגמה עם ה-SDK הרגיל של OpenAI בפייתון: client = OpenAI(base\_url="http://localhost:13305/api/v1", api\_key="lemonade"). מי שרוצה להריץ את זה 24/7 ולא רק כשהמחשב האישי דלוק יכול גם להעביר את זה לשרת וירטואלי (VPS).

## שולטים בשרת — ה-CLI ומנהל המודלים

מעבר ל-API עצמו, ללימונדה יש שורת פקודה עשירה (lemonade ...) בארבע קבוצות: התחלה מהירה (run, chat, launch), ניהול מודלים (list, pull, delete, load/unload), ניהול השרת (status, logs, backends, cloud, scan), וביצועים (bench — מודד מהירות הרצה כולל פרטי חומרה: מעבד, GPU, זיכרון). מי שלא רוצה שורת פקודה יכול להוריד מודלים גם דרך ממשק גרפי מובנה בשם Model Manager, ולעיין בכל ספריית המודלים הנתמכים מראש בכתובת lemonade-server.ai/models.html.

## Lemonade מול Ollama ו-LM Studio — מה ההבדל?

| פרמטר | Ollama / LM Studio | Lemonade |
| --- | --- | --- |
| יכולות | טקסט (LLM) בלבד | טקסט + תמונה + תמלול + קריינות |
| תאימות API | בעיקר OpenAI / Ollama | OpenAI + Ollama + Anthropic יחד |
| רישיון | Ollama קוד פתוח (MIT); LM Studio חינמית אך ה-UI סגור | קוד פתוח לגמרי — Apache 2.0 |
| חסות | חברה פרטית | AMD (תומך גם ב-NVIDIA) |
| שבב NPU ייעודי | תמיכה משתנה | תמיכה ילידית ב-AMD XDNA2 |

עמוד הבית של Ollama מתמקד בהרצת מודלי שפה פתוחים ולא מציג יצירת תמונות, תמלול או קריינות כיכולות שרת ילידיות — לא בהכרח שהיכולות האלה לעולם לא יגיעו, רק שנכון להיום ההצעה הרשמית שלהן ממוקדת בטקסט, בעוד שלימונדה בונה על ריבוי-מודליות כתכונת ליבה.

## איזו חומרה ומערכות הפעלה נתמכות?

מערכות הפעלה: Windows 11, macOS, ולינוקס (Ubuntu 24.04+, Fedora 43+, Debian 13/Trixie+, Arch) וגם Docker. מעבד: x86\_64 ו-ARM64. כרטיס מסך: NVIDIA דרך CUDA (מדור Turing ואילך), AMD דרך ROCm (RDNA3/4, Strix Halo), ו-Apple Silicon דרך Metal. שבב NPU ייעודי: תמיכה ילידית ב-XDNA2 של AMD (Ryzen AI). מחשב בלי כרטיס מסך חזק עדיין יכול להריץ את השרת ומודלים קטנים על המעבד, פשוט לאט יותר.

## מה זמין בישראל?

זו תוכנה שרצה מקומית — אין חסימות גיאוגרפיות, אין צורך באמצעי תשלום, ואין תלות בכתובת IP ישראלית. הממשק והתיעוד באנגלית בלבד. איכות עברית (אם מריצים LLM לצ'אט בעברית) תלויה לגמרי באיזה מודל טוענים, בדיוק כמו בכל שרת מודלים מקומי אחר.

## שאלות נפוצות

### האם זה באמת חינם?

כן. התוכנה קוד פתוח (Apache 2.0), אין תשלום להרצה מקומית ואין מכסת שימוש. יש אפשרות אופציונלית להעברה לענן למי שרוצה, אבל זו לא ברירת המחדל.

### למה כלי בחסות AMD תומך גם ב-NVIDIA?

AMD ממנת ותומכת בפיתוח (בעיקר אופטימיזציות לכרטיסי Ryzen AI, Radeon ו-Strix Halo שלה), אבל הפרויקט עצמו קוד פתוח ופתוח לתרומות — ורשימת החומרה הנתמכת כוללת גם NVIDIA CUDA וגם Apple Metal.

### מה ההבדל מ-Ollama או LM Studio?

שתיהן מתמקדות בהרצת מודלי שפה בלבד. לימונדה מוסיפה יצירת תמונות, תמלול וקריינות מאחורי אותו API, וגם תאימות בו-זמנית לשלושה תקנים במקום אחד או שניים.

### זה מתאים למי שלא מתכנת?

פחות. זה שרת שמדברים איתו דרך API, לא אפליקציית צ'אט מוכנה. הקהל הטבעי הוא מפתחים, בוני סוכני AI, ומי שנוח לו עם שורת פקודה.

### האם זה תומך בעברית?

התיעוד והממשק באנגלית. איכות תגובות בעברית תלויה במודל השפה הספציפי שבוחרים להריץ.

**מה התחדש (6.8.2026):** נוסף פרק על ה-CLI ומנהל המודלים, פורטה פקודת החיבור לקלוד קוד (lemonade launch claude) והפרוטוקול המדויק של תאימות ה-Anthropic (POST /v1/messages), והמספרים עודכנו מגרסה v11.5.1 ל-v11.5.2.

עודכן: 6 באוגוסט 2026 · מאת הנרי שטאובר, מומחה AI

## ראה גם

[Hostinger — אחסון אתרים ושרתי VPS להרצת כלי AI](https://bintechai.com/hostinger) [מדריך Claude Code — AI שעובד על המחשב שלכם](https://bintechai.com/claude-code-guide) [זיכרון ב-AI — איך ChatGPT וקלוד זוכרים אותך](https://bintechai.com/ai-memory) — רוצים היכרות עם הרעיון של הרצת AI מקומית? [המדריך המלא להרצת AI בחינם על המחשב האישי (LM Studio)](https://youtu.be/aexdzihkqJ0) של הנרי.

- [בית](https://bintechai.com/)
- [מדריכים](https://bintechai.com/guides)
- [צור קשר](https://bintechai.com/contact)
