tiyuvta / שירותים
שירותים ומערכות AI
בונים ומטמיעים מערכות agents לעסקים, מתאימים מודלים פתוחים לסכמות ולתהליכים שלכם, ופורסים מהר: ב-API שלנו או על שרתי ה-GPU שלכם.
אנחנו לא כאן כדי להתקין עוד "צ׳אט פרטי".אנחנו בונים את מה שהעסק שלכם באמת צריך.
למי זה מתאים
למי השירותים מתאימים
AI אמיתי בעבודה, לא עוד חלון צ׳אט.
- מערכת של agents
- מישהו שמטפל בלקוחות
- טריאז׳ בזמן משבר
- סידור ניירת ומסמכים
- ידע של החברה שמתעדכן כל יום
- עוזר פנימי זה רק אפשרות אחת
לחברות שהמוצר שלהן רץ על LLM
חשבון ה-API הוא עלות אספקת השירות שלכם. הוא גדל בדיוק כשאתם מצליחים, המחיר נקבע אצל מישהו אחר, וכלום מזה לא נשאר אצלכם. אנחנו מעבירים את העומס לחומרה שאתם שולטים בה, על מודלים מכווננים למשימה שלכם, וההוצאה הופכת לעלות קבועה שבשליטתכם. צוותים שעושים את זה מגיעים לכשליש ממה ששילמו.
למייסדים, מנכ״לים וצוותי מוצר
אם אתם רוצים מערכת agents שעושה עבודה אמיתית בעסק וחותכת את חשבון ה-API:
- מענה ושירות לקוחות: agent שנותן תשובות מדויקות, מבין הקשר ומבצע פעולות, 24/7.
- ניירת ומסמכים: קולט, סורק ומחלץ נתונים מטפסים, חוזים וחשבוניות, ומעביר אותם הלאה.
- חיבור לידע הארגוני: agents שמתחברים למידע הפנימי שלכם ועובדים לפי הנהלים העדכניים.
- חיסכון בעלויות: שרת עם כרטיס או שניים (למשל 5090) בעלות חומרה קבועה וידועה מראש, במקום לשלם על כל טוקן לענן.
למנהלי הטכנולוגיה ולצוותי הפיתוח שיריצו את זה
אם אתם בונים מערכות AI בסטארטאפ או בחברה בצמיחה ורוצים חומרה משלכם במקום לשרוף תקציב על ספקי API:
- BYOC וחומרה משלכם: פורסים את מנוע ההגשה על כרטיס או שניים שלכם, בקנייה או בשכירות, בביצועים מקסימליים ובלי שכבות מיותרות באמצע.
- fine-tune ייעודי: מאמנים מודל על סכמות הנתונים, הטרמינולוגיה והקוד הפנימי שלכם.
- API מהיר: endpoint יציב, תואם OpenAI, מוכן לעבודה מיד ובלי לתחזק תשתית.
העבודה
השירותים שלנו
01 מערכות agents
מערכות agents
מתכננים, בונים ומטמיעים מערכות agents שפותרות את מה שתקוע בעסק.
למשל: agent מענה ללקוחות, אוטומציה של ניירת וטפסים מורכבים, וחיבור למאגרי הידע של הארגון.
לפרטים על מערכות agents ←02 fine-tune
Fine-tune
מתאימים מודל פתוח לסכמת הנתונים, לשפה ולדומיין של העסק.
למשל: אימון על פניות תמיכה, מסמכים פנימיים, קוד ארגוני או פורמטים ייעודיים, לאירוח אצלנו או לפריסה אצלכם.
לפרטים על Fine-tune ←03 byoc / חומרה שלכם
BYOC: החומרה שלכם, חשבון API קטן יותר
קונים או שוכרים כרטיס או שניים (למשל 5090) ומריצים את מנוע ההגשה אצלכם, כדי לחתוך את חשבון ה-API.
למשל: שרת קטן עם כרטיס או שניים שמריץ את כל ה-agents בארגון בעלות קבועה.
לפרטים על BYOC וחיסכון בעלויות ←
איך זה רץ
בשכירות או בבעלות. שתי הדרכים עובדות, ואפשר לעבור.
מתחילים על כרטיסים בשכירות
בלי השקעה ובלי התחייבות, ואפשר לנצל קרדיטים שכבר יש לכם בענן. אנחנו מכווננים את המודלים, בונים את הפייפליין, ותוך שבועות אתם באוויר.
עוברים לכרטיסים שלכם
כרטיס או שניים אצלכם מריצים את אותם מודלים בשבריר מחשבון ה-API, בלי מונה שרץ על כל טוקן ועם מקום לגדול. אנחנו מתקינים ומכווננים את מנוע ההגשה עליהם, ומוכיחים את המספרים על החומרה שלכם.
מה מתאים תלוי במה שאתם באמת מוציאים היום. זה הדבר הראשון שאנחנו מודדים, ובדרך כלל זה לא מה שחושבים.
כמה זה עולה
המחיר תלוי בכמה מהעבודה הזו אתם רוצים שנעשה.
מחיר בודד בנוסח ״החל מ־״ לא אומר הרבה, אז הנה כל האפשרויות. בכל אחת מהן מדובר בעבודה שאנחנו עושים היום. רוב הלקוחות מגלים שמתאימה להם אפשרות זולה יותר מזו שחשבו שיצטרכו.
לפי המחירון, לכל מיליון טוקנים
פשוט להשתמש ב-API
המחירים מופיעים באתר, ולא צריך לדבר איתנו כדי לקבל אותם. אם העומס שלכם קטן, זו התשובה הנכונה ואנחנו נגיד את זה.
לדבר איתנו לא עולה כסף, באף שלב. אין דמי אפיון ואין שיחה להגדרת היקף העבודה בתשלום.
עשרות אלפי שקלים
אנחנו בונים, ומעבירים לכם את המפתחות
בוחרים את המודלים, מכווננים אותם על הנתונים שלכם, מתקינים את מנוע ההגשה על הכרטיסים שלכם, בונים את הפייפליין מסביב וכותבים runbook. מכאן המערכת שלכם. המשקולות, הגדרות ההגשה והתיעוד נשמרים על החומרה שלכם, לא שלנו.
מחיר הבנייה, ועוד תשלום חודשי
אנחנו בונים וגם מפעילים
אותה מערכת, כשאנחנו מתפעלים אותה: קיבולת, שדרוגים, המנוע שמתחת, ומישהו שעונה כשצריך. מתאים כשאתם מעדיפים לא לגייס בשביל זה.
מאות אלפי שקלים
מודלים ייעודיים שעושים רק את העבודה שלכם
מודל אחד, שניים או שלושה, שאומנו לעשות בדיוק את מה שהעסק שלכם מספק, בלי הנפח של מודל כללי שאתם משלמים עליו כדי שיידע לחשוב על כל דבר אחר. המערכת בנויה לענות לאלפי בקשות בשנייה, בתפעול הפנימי של העסק, בלי שהמידע יוצא החוצה.
מה כרטיס אחד באמת עושה
דוגמה אחת כדי להמחיש
כרטיס RTX 5090 אחד במכונה, שמריץ את Qwen3.8 27B על מנוע הגשה שכיווננו לכרטיס הזה ולמודל הזה. כמה מהר הוא עונה נמדד על הכרטיס שלכם, עם התעבורה שלכם, ונמסר לכם כמספר, במקום להיות מצוטט כאן ממכונה שלנו.
הכרטיס והמחשב שבו הוא מותקן עולים ₪22,000 עד ₪30,000, פעם אחת, ועסק מפחית מחשב לצורכי מס על פני שלוש שנים. אחרי זה הוא ממשיך לעבוד, בלי תשלום נוסף לפי טוקן ובלי תקרה על כמה תשתמשו.
זה מספיק לשניים או שלושה agents שעובדים כל היום על מה שהעסק שלכם באמת עושה: לענות ללקוחות, להזיז ניירת, לקרוא את המסמכים שאף אחד לא רוצה לקרוא. וכנראה שאתם לא צריכים את המודל הכי גדול בשוק לאף אחת מהמשימות האלה.
וזה כרטיס אחד שאפשר לקנות מהמדף. כרטיסים גדולים יותר מסוגלים להתמודד עם עומס רב יותר, ובהם נשתמש כשעומס העבודה ידרוש זאת. נבחר את הכרטיס שמתאים לכם לפי הנתונים שלכם, ולא לפי עלון שיווקי.
ונגיד לכם גם באיזה שלב אתם נמצאים
אם מודל קטן עושה את העבודה, תקבלו מודל קטן וחשבון קטן יותר. אם השימוש שלכם באמת נמוך, נגיד שקריאות API הן התשובה הנכונה ולא נמכור לכם כלום. ואם מה שביקשתם קטן ממה שאתם באמת צריכים, נגיד גם את זה, לפני שאתם קונים חומרה. טעות בכל אחד מהכיוונים תעלה לכם יותר ממה שאנחנו גובים כדי לבחור נכון.
הבעלות על הכרטיסים משנה את החשבון בפני עצמה. מחשבים מופחתים ב-33% בשנה לפי דיני המס בישראל, כך שעסק מפחית את החומרה על פני שלוש שנים והעלות האמיתית נמוכה בהרבה ממחיר הרכישה. פרסו את זה על פני ארבע שנות שימוש והשוו למה שספק API מחייב אתכם כל חודש בזמן שאתם גדלים.
שיקול הדעת ההנדסי מגיע יחד עם העבודה. אם בנינו לכם את המערכת, יש לכם את מי שמכוונן את המנוע שמתחתיה כל עוד אתם מריצים אותה.
ואם בנינו את זה יחד איתכם, אנחנו נשארים איתכם: כיוונונים נוספים, מודלים חדשים כשיוצאים טובים יותר, ובנייה מחדש בשבריר מהעלות המקורית.
שלושים דקות עם מהנדס, על העומס האמיתי שלכם. בלי מצגות.