Case Study · Sendy

סוכנת AI שמכירה 55 מקורות,וקוראת רק את מה שצריך.

Sandy עונה בעברית לשאלות באתר של Sendy, אך ורק מתוך התוכן שפורסם, עם קישור למקור. הגרסה הראשונה שלחה את כל האתר עם כל שאלה, והידע היה 82% מהחשבון. בנינו במקומה אינדקס דו-שכבתי, בחירת סעיפים בקוד, חיוב מכני לקרוא מקור ולולאה שהופכת כל שאלה למדריך. מאמר חדש מוסיף היום כ-50 טוקנים לשאלה במקום כ-3,000, ותשובה עולה כ-6.5 אגורות.

ארכיטקטורת סוכן AIהנדסת עלויות LLMפיתוח מוצרממשק ניהוללולאת תוכן
גרסת הפורטרט: הלוגו של Sendy מעל חלון הצ׳אט של Sandy והפורטרט המאויר שלה, על רקע נייבי עם שורות האינדקס

01The Brief

חמישים עמודים של תשובות,ואף אחד לא קורא חמישים עמודים.

Sendy היא פלטפורמת דיוור SMS שבנינו ואנחנו מפעילים. המבקרים באתר שואלים שוב ושוב את אותן שאלות: כמה זה עולה, מה חוק הספאם מחייב, איך מייבאים אנשי קשר. התשובות כבר כתובות, בעשרות מדריכים ומאמרים. אבל מבקר לא יקרא חמישים עמודים כדי למצוא משפט אחד. הוא פונה לוואטסאפ, או עוזב.

The Problem

בוט שממציא גרוע מבוט שלא קיים

בוט שממציא מחיר, יכולת או לקוח מזיק יותר מבוט שלא קיים, ובתחום של חוק הספאם יש לזה גם צד משפטי. נקודת קצה ציבורית שכל קריאה אליה עולה כסף היא מטרה. ועברית אמיתית, מימין לשמאל, היא לא תרגום של ווידג׳ט אמריקאי.

ועוד שתי דרישות: לכוונן את הסוכנת בלי מפתחים, וללמוד ממה שמבקרים שואלים, כי זה מחקר תוכן בחינם.

The Solution

סוכנת שעונה רק ממה שכתוב, עם קישור

Sandy עונה אך ורק מתוך התוכן שפורסם באתר: מדריכים, מאמרים, עמודי אינטגרציות ומסמכים משפטיים. כל תשובה שנשענת על מקור נגמרת בקישור אליו, וכשאין לה תשובה היא מעבירה לתמיכה האנושית בוואטסאפ.

וכל ההתנהגות שלה, מההנחיות ועד התקציב, היא שורה בבסיס הנתונים ולא קוד. כוונון הוא שמירת טופס.

דף הבית של Sendy עם חלון הצ׳אט של Sandy פתוח: הודעת פתיחה וארבע שאלות מוצעות
דף הבית של Sendy, עם Sandy פתוחה
Sandy בטלפון: חלון הצ׳אט כמעט ברוחב המסך, עם הודעת הפתיחה והשאלות המוצעות
בטלפון: כמעט ברוחב מלא

RTL שתוכנן עד הסוף

ההודעות של Sandy מימין ושל המבקר משמאל, הפוך מהמוסכמה באנגלית. כל פסקה מזהה את הכיוון שלה, כדי ששם מוצר באנגלית או כתובת לא ישברו שורה בעברית. שדה ההקלדה קבוע מימין לשמאל, כי שדה ריק ב"זיהוי אוטומטי" נופל לשמאל.

והכפתור יושב בפינה הימנית הפיזית ולא ב"סוף" הלוגי: בפינה השמאלית יושב כפתור הנגישות, ובעברית מיקום לוגי היה מניח את Sandy עליו. הווידג׳ט נטען רק אחרי העמוד, כך שעמודי השיווק נשארים סטטיים ומהירים.

Decided Before Day One

  1. 01

    Rejected

    מסד וקטורי

    הקורפוס קטן מדי בשביל חיפוש סמנטי, ו-prompt caching זול יותר מתשתית שצריך לתחזק.

  2. 02

    Rejected

    מנוע אוטומציה

    בלי הזרמת תשובה מילה אחרי מילה, ועם בעיות CORS מול האתר.

  3. 03

    Rejected

    ווידג׳ט קנוי

    עברית ו-RTL חלשים, השיחות יושבות אצל צד שלישי, ואין חיבור לתוכן שאנחנו כותבים.

  4. 04Built by 2Dots

    Built

    מודול בתוך האפליקציה

    מבודד: לכל הטבלאות שלו אותה קידומת, ושום קוד מחוץ לתיקייה לא תלוי בה. הסרה מלאה היא מחיקה של תיקייה אחת.

02The Bill

היא ענתה נכון.החשבון סיפר סיפור אחר.

הגרסה הראשונה שלחה את כל התוכן של האתר, 31 מקורות, עם כל שאלה, כקידומת שנשמרת במטמון. על הנייר זה היה זול: לפי ההערכה, כ-55 אלף טוקנים וחצי סנט לשאלה. ביום הראשון מדדנו.

  • 0

    טוקנים בחבילה בפועל

  • 0

    טוקנים לפי ההערכה

  • 0%

    מהחשבון הלך על הידע

  • 0

    מקורות בכל שאלה

העברית שברה את ההערכה, בכיוון המסוכן

ההערכה הניחה שטוקן הוא כשני תווים וחצי. בעברית הוא תו וחצי. החבילה הייתה גדולה ב-68% ממה שחשבנו, וההערכה השגויה הייתה מהסוג שגורם למד אזהרה לשתוק הרבה אחרי שכבר יש בעיה. הכיול תוקן באותו יום, מול מספרי הטוקנים שהחשבון עצמו החזיר.

Day One · 13 Answers

על מה שילמנו ביום הראשון

  • ידע: כתיבה למטמון42%
  • ידע: קריאה חוזרת בכל שאלה40%אותם 95 אלף טוקנים, שוב ושוב
  • היסטוריית השיחה12%12 התורות האחרונות
  • התשובה עצמה5.6%

המבקר שאל בדרך כלל על מאמר אחד. שלחנו שלושים ואחד. וגרוע מזה, זה גדל בכיוון הלא נכון: כל מאמר חדש בבלוג היה מייקר כל שאלה עתידית, לתמיד.

Two Meters, One Pack

What We Watched

החבילה מתוך חלון ההקשר

48%

פחות מחצי. המד שתק.

What We Paid

החבילה מתוך החשבון

82%

כמעט הכל. וזה מה שהיה צריך למדוד.

העלות לשאלה היא האילוץ. לא "האם זה נכנס".

03The Index

לא לשלוח את הספרייה.לשלוח את הקטלוג.

במקום כל התוכן, עם כל שאלה נשלח עכשיו רק אינדקס: שורה אחת לכל מקור, עם כותרת, כתובת ותקציר קצר. המודל קורא את האינדקס, מחליט איזה מקור עונה על השאלה, ומושך רק אותו בכלי שנקרא get_article.

Tier 1 · Always Sent

עם כל שאלה

האינדקס

שורה אחת לכל מקור. כותרת, כתובת, ותקציר שכותב המדריך כבר כתב.

  • blog:sms-cost

    כמה עולה לשלוח SMS לעסק: מחירון ומחשבון עלות

    כמה עולה לשלוח SMS לעסק? מדריך למחיר האמיתי להודעה, למה מנוי חודשי וקרדיט שפוקע מטעים, ואיך רואים את עלות הקמפיין המדויקת לפני שלוחצים שלח.

  • guide:api-webhooks

    Webhooks: אירועים מ-Sendy ישירות לשרת שלכם

    איך מגדירים נקודת קצה, אילו אירועים נשלחים, איך מאמתים את החתימה, ומה קורה כשהשרת שלכם לא עונה.

  • guide:contacts-import

    איך מייבאים רשימת אנשי קשר מקובץ

    ייבוא רשימת אנשי קשר מ-CSV או אקסל: מה הקובץ צריך להכיל, מה קורה לכל שורה, ולמה מי שביקש להסיר לא חוזר.

ועוד 52 מקורות באותה צורה.

Tier 2 · On Demand

רק כשצריך

גוף המדריך

המודל בוחר מקור מתוך האינדקס ומושך רק אותו. הגוף נקרא מחדש מבסיס הנתונים בכל משיכה, כך שמדריך שנערך לפני דקה עונה במה שכתוב בו עכשיו.

מקור לשאלה רגילה
אחד, לפעמים שניים
תקרת גוף לתשובה
4,500 תווים
קריאות למודל לשאלה
עד ארבע

Cost of One New Article

מה מאמר חדש מוסיף לכל שאלה

  • בגרסה הראשונה: כל הגוף~3,000
  • באינדקס: שורה אחת~50

בטוקנים, לכל שאלה עתידית. האתר ממשיך לכתוב מדריכים, והמחיר של כל אחד מהם לשאלה ירד פי שישים.

התקציר הפך לנתב

תוצר לוואי שלא תכננו: התקציר שכותב המדריך כותב, שנועד לגוגל, הוא עכשיו מה שמנתב את Sandy אל המדריך. תקציר חלש פוגע לא רק בהקלקות מתוצאות החיפוש, אלא גם ביכולת שלה למצוא את התשובה. זה נכנס להנחיות הכתיבה של צוות התוכן.

ומד האזהרה החליף את מה שהוא מודד: לא את החבילה מול חלון ההקשר, אלא את גודל האינדקס עצמו, כי הוא מה שנשלח עם כל שאלה.

  • 0

    מקורות באינדקס היום

  • 0

    מאמרי בלוג

  • 0

    מדריכים

  • 0

    אינטגרציות ומסמכים משפטיים

04The Slice

ואז המדריך עצמוהפך לשורה הגדולה בחשבון.

אחרי המעבר לאינדקס, גוף המאמר שנמשך היה 73% מעלות התשובה. מדריך ארוך הוא כמה אלפי טוקנים, ושאלה נוחתת בדרך כלל בסעיף אחד שלו. אז המדריך מגיע עכשיו פרוס, והפרוסה נבחרת בקוד.

  1. 01

    Split

    חותכים לפי כותרות

    המדריך מתפצל לסעיפים לפי כותרות המשנה. הפתיח נשלח תמיד, כי הוא מגדיר את המונחים שכל השאר נשען עליהם.

  2. 02

    Score

    נותנים ציון לכל סעיף

    כל מילה מהשאלה שמופיעה בסעיף שווה נקודה, ובכותרת שתיים. מילים כמו "איך" ו"כמה" לא נספרות.

  3. 03

    Fill

    ממלאים עד 4,500 תווים

    לפי סדר הציון, וסעיף שלא נכנס לא עוצר את הסעיפים שאחריו. בסוף מחזירים את הסדר המקורי, כי מדריך מבולגן קשה יותר לקרוא.

  4. 04

    Fallback

    בספק, שולחים הכל

    מדריך קצר, שאלה בלי מילות תוכן, מדריך בלי כותרות או אף סעיף עם ציון: המדריך המלא יוצא.

בכוונה בלי עוד קריאה למודל

אפשר היה לבקש ממודל שיבחר את הסעיפים. בחרנו קוד: בלי זמן המתנה נוסף, בלי עלות נוספת, ותוצאה דטרמיניסטית שאפשר לבדוק בבדיקות אוטומטיות. והכלל שכתוב בקוד מכריע כל מקרה עמום לטובת שליחת יותר:

פרוסה שגויה עולה בתשובה שגויה, וזה הרבה יותר יקר מהטוקנים שהיא חוסכת.

Bug From The Field

"המדריך לא מפרט"

שאלנו את Sandy בפרודקשן כמה פעמים נשלח שוב webhook שנכשל. היא ענתה שהמדריך לא מפרט, אף שהמדריך מפרט את כל סולם הניסיונות. וזה היה דיווח נאמן של מה שהיא קיבלה.

הלולאה עצרה בסעיף הראשון שלא נכנס בתקציב: סעיף של 1,312 תווים חסם את סעיף הסולם, 716 תווים באותו ציון, כשנשארו 1,019 תווים פנויים. מילה אחת בקוד, מ-break ל-continue, ואותה שאלה קיבלה 4,434 מתוך 4,500 התווים, כולל הסולם. התיקון השפיע על כל 15 המדריכים הארוכים, בלי לשנות את התקרה של מה שתשובה יכולה לעלות.

הלקח: "התוכן נמצא בבסיס הידע" לא אומר "התשובה מגיעה למודל". בודקים ידע של סוכן בשאלה שרק התוכן עונה עליה, ועוקבים אחרי מה שהמודל באמת קיבל.

אותה שאלה, באתר החי, 5.10.2026

Section Picker · Live Guide

מדריך אחד, 11 סעיפים, שתי שאלות

השאלה: אם השרת שלי לא עונה ל-webhook, כמה פעמים תנסו שוב ועל פני כמה זמן?

תקציב הגוף לתשובה4,352 / 4,500

הפתיח של המדריך נשלח תמיד (672 תווים), כי הוא מגדיר את המונחים שהשאר נשען עליהם.

  1. מה צריך מראשציון 0
  2. ההגדרהנבחר
  3. האירועיםנבחר
  4. איך נראה אירועלא נכנס
  5. אימות החתימהלא נכנס
  6. מה נחשב תשובה תקינהנבחר
  7. ניסיונות חוזריםהתשובה כאןנבחר
  8. יומן המשלוחיםנבחר
  9. החלפת סוד החתימהלא נכנס
  10. לחבר ל-n8n, Make או Zapierלא נכנס
  11. טעויות נפוצותנבחר

"פני" ו"זמן" נמצאים בסעיף הניסיונות, והוא עולה לציון 3. נבחר שני, והתשובה יוצאת עם הסולם המלא.

שימו לב לסעיף שמקבל את הציון הגבוה בשתי השאלות: "מה נחשב תשובה תקינה". המילה "שוב" יושבת בתוך "תשובה". התאמה לפי גבולות מילה הייתה מתקנת את זה ושוברת את התחיליות ו/ב/ל/ה, אז נשארנו עם התאמת מחרוזת, ועם הגבול שלה.

05Grounded By Force

"בבקשה אל תמציאי"היא לא ארכיטקטורה.

הרצנו את זרימת האינדקס המלאה על שש שאלות בדיקה. בארבע מהן המודל דילג על משיכת המקור וענה מהתקצירים שבאינדקס. באחת מהן הוא המציא שני שמות מותגים כדוגמה ללקוחות, ואחד מהם היה בנק ישראלי אמיתי בלי שום קשר ל-Sendy. בדיוק ההזיה שכל התכנון נועד למנוע.

Asked Nicely

"קראי מקור לפני שאת עונה"

2 מתוך 6

שאלות בדיקה שנענו מתוך מקור

Enforced

חובה להפעיל כלי בקריאה הראשונה

6 מתוך 6

שאלות בדיקה שנענו מתוך מקור

  • קראה מקור וענתה ממנו
  • ענתה מהתקציר באינדקס
  • !ענתה מהתקציר והמציאה שמות
  1. get_article

    לקרוא מקור

    הדרך הרגילה. מפתח מתוך האינדקס, ובחזרה הסעיפים הרלוונטיים של המדריך.

  2. answer_without_source

    דלת יציאה כנה

    ברכה, תודה, שאלה מחוץ לתחום או נושא רגיש שעובר לאדם. בלעדיה, כל "שלום" היה נרשם כשאלה שלא נענתה.

  3. flag_unanswered

    אין לי תשובה

    השאלה נרשמת לצוות התוכן, והמבקר מקבל קישור לתמיכה האנושית בוואטסאפ.

התיקון היה מכני, לא ניסוחי

ההוראה "קראי מקור לפני שאת עונה" הייתה בקשה שהמודל יכול לפרש בדרכו. עכשיו בקריאה הראשונה לכל שאלה הוא חייב להפעיל כלי. לא דווקא את get_article, כי לפעמים באמת לא צריך מקור. לכן נוסף כלי שלישי, דלת יציאה כנה, ובלעדיו כל "שלום" היה נדחף לרשימת השאלות שלא נענו.

והאמינות עולה כסף. בכוונה.

משיכת מקור תמיד, ולפעמים שניים, מעלה את עלות הקלט לתשובה. ההכרעה כתובה בהודעת הקומיט: "תשובה זולה ושגויה על בנק שאינו לקוח היא לא חיסכון." ברכה עולה עכשיו שתי קריאות למודל במקום אחת, וזה המחיר של החיוב.

עיקרון שהמודל יכול לפרש, הוא יכול לפרש החוצה. מה שקריטי נאכף במנגנון.

06The Cost Engine

כל טוקן מחויב אחרת.אז כל טוקן יושב במקום אחר.

טוקן שנקרא מהמטמון עולה עשירית ממחיר הקלט. טוקן שנכתב למטמון עולה יותר מקלט רגיל. טוקן של תשובה עולה פי חמישה. רוב ההחלטות בפרק הזה הן פשוט לשים כל חלק של הבקשה במדרגה הנכונה.

Price Per Token, ×Input

סולם המחירים של טוקן

  • קריאה מהמטמון0.1×
  • קלט רגיל1×
  • כתיבה למטמון ל-5 דקות (נבחר)1.25×
  • כתיבה למטמון לשעה2×
  • פלט: התשובה עצמה5×

ביחס למחיר טוקן קלט רגיל של Claude Haiku 4.5, המודל ש-Sandy רצה עליו.

מטמון של 5 דקות, לא של שעה

המפרט ביקש מטמון של שעה. חמש דקות מכסות כל תור בתוך שיחה אחת, ומבקרים מגיעים בהפרש של שעות, כך שרוב השיחות משלמות על כתיבה למטמון בכל מקרה. אז הכתיבה הזולה מנצחת.

בפרודקשן הכתיבה למטמון היא 35% מההוצאה. עם מטמון של שעה, כל כתיבה כזו הייתה עולה 60% יותר.

Order Is Load-Bearing

As Specified

הנחיות קודם, ידע אחר כך

עריכה של משפט אחד בהנחיות מבטלת את המטמון של כל מה שאחריה.

  1. הנחיות ואישיותנערכות ממסך הניהולמחויב מחדש
  2. כל הידענכתב למטמוןמחויב מחדש
  3. השיחהמחויב מחדש

As Built

ידע קודם, הנחיות אחר כך

עריכה בהנחיות מחייבת מחדש רק את ההנחיות עצמן. הידע נשאר במטמון.

  1. הידענקודת המטמון כאןמהמטמון
  2. הנחיות ואישיותכ-600 טוקנים, מחוץ למטמוןמחויב מחדש
  3. השיחהשש התורות האחרונות

המטמון הוא התאמת קידומת: כל מה שאחרי נקודת השינוי מחויב מחדש. בסדר של המפרט, הלולאה המרכזית של המוצר, לכוונן בלי פריסה, הייתה הופכת לפעולה היקרה ביותר במערכת.

Production · Today

על מה משלמים היום

  • קלט רגיל46%סעיפי המדריך שנמשכו, ההנחיות והשיחה
  • כתיבה למטמון35%האינדקס, פעם בשיחה
  • התשובה עצמה12%
  • קריאה מהמטמון7%

הקריאה החוזרת של הידע, שהייתה 40% מהחשבון ביום הראשון, היא היום 7%. היסטוריית השיחה ירדה מ-12 תורות ל-6, כי תשובת תמיכה כמעט אף פעם לא צריכה יותר משלוש חילופי דברים אחורה.

The Bake-Off

אותן שאלות, שלושה מודלים

  • GPT-4.1 Nano

    זול פי 17 בערך

    נפסל

    ייצר מילה שלא קיימת בעברית, ולא מצא תשובה שהייתה כתובה במסמך שקיבל.

  • Gemini 3.1 Flash-Lite

    זול פי 6.5 בערך

    תחרותי באמת

    5 מתוך 6 בזרימת הכלים האמיתית, והשישית הייתה סירוב נכון. עברית טובה לפחות כמו של Haiku, וכ-30% פחות טוקנים לאותו טקסט עברי.

  • Claude Haiku 4.5

    הבסיס

    נבחר

    התשובה עצמה היא חלק קטן מהחשבון, אז מודל זול יותר אף פעם לא היה המקום שבו הכסף נמצא. נבדק שוב אם ההוצאה עוברת כ-3 דולר ליום.

המבחן הראשון שלנו טעה

הפסיקה הראשונה על Gemini הייתה "1 מתוך 6". היא הייתה תוצר של בדיקה מקורבת וגסה. בזרימת הכלים האמיתית הוא קיבל 5 מתוך 6, והשישית הייתה סירוב נכון למשוך מקור לשאלה על בחירות, בדיוק מה שההנחיות מבקשות. מבחן על משהו שאינו המערכת האמיתית מודד את המבחן.

מחיר לטוקן מטעה

השוואה לפי מחיר טוקן מפספסת את המטמון, שעושה את רוב העבודה: כל ספק מתמחר קריאה ושמירה של מטמון אחרת, ויש מי שמחייב גם על אחסון המטמון לפי שעה. וכל מודל דורש צורת בקשה משלו, עד כדי שגיאה על פרמטר שמודל אחר מקבל. לכן יש מפת יכולות לכל מודל, והחלפת מודל ממסך הניהול לא שוברת כלום.

Ceilings You Can't Cross

  1. 01

    Daily Cap

    10 דולר ליום

    נקודת קצה ציבורית שכל קריאה אליה עולה כסף היא מטרה. התקרה היומית היא שכבת ההגנה האחרונה.

  2. 02

    Hourly Cap

    ו-2 דולר לשעה

    בלי תקרה שעתית, פרץ בקשות אחד בבוקר מכבה את Sandy עד חצות. עם התקרה, הוא מכבה אותה לשעה.

  3. 03

    No Discount

    בקשה שנחסמה נספרת

    כמה שכבות של הגבלת קצב, וכל אחת מהן סופרת גם את מה שהיא חסמה. להפציץ את נקודת הקצה אף פעם לא זול יותר מלהשתמש בה.

  4. 04

    No Escape

    ניתוק לא חוסך

    מבקר שסוגר את הדפדפן באמצע תשובה לא עוצר את הריצה, והעלות נרשמת. אחרת, פתיחה וסגירה מיידית היו דרך חינמית לרוקן את המפתח.

Per Answer

6.5 אגורות

עלות ממוצעת לתשובה בפרודקשן ($0.0176). ביום הראשון, עם 31 מקורות, תשובה עלתה כ-$0.022. היום יש באינדקס כמעט פי שניים מקורות, והעלות לתשובה ירדה במקום לגדול איתם. דפוסי השאלות בשתי התקופות שונים, אז זו לא השוואה מבוקרת. הטענה החזקה היא המבנית: מאמר חדש כבר לא מייקר כל שאלה.

07The Loop

כל שאלה מלמדת אותהמשהו.

שתי קשתות של אותה לולאה. אחת מוסיפה לה ידע: שאלה שאין לה תשובה הופכת למדריך, והמדריך נכנס לאינדקס תוך שניות. השנייה משפרת את הדרך שבה היא מדברת: קוראים תמלילים, מודדים כל תשובה, ומשנים הנחיות בלי לפרוס קוד.

What She Knows

מה היא יודעת

  1. 01

    כל שאלת פתיחה נכנסת לפיד

    לא רק מה שהמודל סימן כ"אין לי תשובה". מודלים מדווחים בחסר על מה שהם לא יודעים, ופיד שנשען על הסימון שלהם היה הכי ריק בדיוק כשהפערים הכי גדולים.

  2. 02

    שאלה הופכת למדריך

    לכל שאלה סטטוס: חדשה, מתוכננת, מכוסה. סוכן התוכן של Sendy עונה עליה במדריך, עם תקציר שכתוב כך שינתב אליו.

  3. 03

    הפרסום מרענן את האינדקס

    כל כתיבת תוכן, מעורך הניהול ומה-Content API, עוברת בנקודה אחת שבונה את האינדקס מחדש. בנייה לילית מכסה את מה שנפל בדרך.

How She Speaks

איך היא מדברת

  1. 01

    קוראים את התמליל

    דפדפן שיחות חי במסך הניהול, עם עלות, זמן תגובה והתרעות לכל הודעה. כל פגם אמיתי שמצאנו נמצא כך, לא ממדד.

  2. 02

    שומר פלט על כל תשובה

    כל קישור מושווה לרשימת הכתובות שבידע, וכל תשובה נסרקת לצורות מחיר. במצב רישום בלבד: התשובה כבר הוזרמה, אז מה שכן אפשר לעשות הוא למדוד.

  3. 03

    שמירת טופס, לא פריסה

    ההנחיות, המודל, ההודעה הפותחת, השאלות המוצעות והתקציב הם שורה אחת בבסיס הנתונים. שינוי נכנס לתוקף בשאלה הבאה.

The First Transcript

שישה תיקונים שאף מדד לא היה מוצא

  1. 01

    "איזה מודל את?" והתשובה: מודל של חברה אחרת. חברה לא נכונה, ומומצא.

    משפט אחד מדויק, "אני מודל בינה מלאכותית שמפעיל את הצ׳אט של Sendy", בלי לנקוב בספק ובלי לנחש.

  2. 02

    קישורים כנתיב חשוף, בלי הדומיין.

    להעתיק את הכתובת המלאה מהמקור כפי שהיא, לעולם לא להרכיב נתיב, ובלי קישור בכלל אם הכתובת לא בידע.

  3. 03

    קישור וואטסאפ מקודד, הודבק כרצף של אחוזים ואותיות.

    תמיד קישור עם טקסט בעברית.

  4. 04

    פנייה בלשון מעורבת, פעם בזכר ופעם בנקבה.

    Sandy לא יודעת מי מולה, אז היא כותבת בלשון סתמית: "אפשר", "כדאי", "מזינים", עם רשימה מפורשת של צורות אסורות.

  5. 05

    שאלה על בחירות, והיא פסקה מה חוק הספאם מתיר.

    תוכן פוליטי עובר לתמיכה האנושית, והיא לא מכריעה אם מקרה ספציפי מותר.

  6. 06

    כל תשובה נגמרה ב"משהו נוסף?".

    התשובה נגמרת בתוכן ובקישור למקור, וזהו.

העיגון במקורות היה תקין, כל קישור היה אמיתי. מה שלא היה תקין הוא האופן שבו היא אמרה דברים. וגם אחרי שהכללים נכתבו, המודל המשיך לשבור שלושה מהם, אז הם נוסחו מחדש ככללים קשיחים עם הצורות האסורות מפורטות.

תשובה של Sandy על ניסיונות חוזרים של webhook: שמונה ניסיונות על פני כ-22 שעות, ובסוף קישור למדריך ה-Webhooks
כל תשובה שנשענת על מקור נגמרת בקישור אליו

גם השומר למד

שני קריטריוני קבלה במפרט נכתבו כבדיקות ידניות: "מצטטת רק כתובות אמיתיות" ו"לא נוקבת מחירים כשהתמחור כבוי". בדיקה ידנית עושים פעם אחת בהשקה ואף פעם לא שוב, אז שתיהן הפכו לבדיקה מכנית של כל תשובה.

והשומר עצמו תוקן פעמיים. בפעם הראשונה הוא סימן את קישור הוואטסאפ שאנחנו עצמנו מזריקים, כלומר דיווח לנו על ההוראה שלנו. בפעם השנייה התברר שהוא עיוור לנתיבים יחסיים, בדיוק הצורה שבה Sandy כתבה קישורים.

הוא רץ במצב רישום בלבד, וטוב שכך: חלק מהסימונים שלו התבררו כהתרעות שווא, כמו קנס בחוק הספאם שנראה לו כמו מחיר. במצב חוסם הוא היה מסתיר תשובות טובות. בלעדיו, לא היינו יודעים על הפעמים שבהן Sandy ציטטה מחיר ממאמר העלויות למרות שתשובות תמחור כבויות.

Still Open

מה עדיין לא מושלם

  • כללים שהמודל עדיין שובר לפעמים. פנייה בלשון זכר, או ציטוט מחיר ממאמר על עלויות. בגלל זה יש שומר ויש תמלילים.
  • בחירת סעיפים לפי מחרוזות. מהירה וזולה, ועיוורת לנטיות של עברית. ניסוח אחר של אותה שאלה יכול להחמיץ את הסעיף הנכון.
  • ברכה עולה שתי קריאות. המחיר של החיוב לבחור כלי בתור הראשון.
  • עברית בלבד, באתר השיווקי בלבד. אנגלית ושילוב בתוך האפליקציה מוגדרים כשלב הבא.

08One Day

ממפרט לפרודקשןביום אחד.

המפרט אושר ב-13 באוגוסט 2026, ו-Sandy עלתה לאתר באותו יום. היום הזה לא היה רק כתיבת קוד: רוב השינויים בו נולדו ממדידה, מתמליל או מניסוי שנכשל.

  1. 01

    04:38

    המודול המלא

    מנוע, ממשק ניהול, ווידג׳ט ומשימות מתוזמנות. עולה לסטייג׳ינג כשהוא כבוי.

  2. 02

    13:34

    התמליל הראשון

    שיחה אחת נקראת מילה במילה. שומר הפלט, כיול הטוקנים וההנחיות מתוקנים.

  3. 03

    14:00

    ידע דו-שכבתי

    אחרי שהחשבון הראה 82% על ידע: אינדקס תמיד, גוף לפי דרישה.

  4. 04

    14:33

    בחירת סעיפים

    גוף המדריך היה 73% מהתשובה. עכשיו רק הסעיפים שהשאלה נוגעת בהם.

  5. 05

    14:39

    חובה לקרוא מקור

    אחרי הבנק המומצא: בחירת כלי מחויבת בקריאה הראשונה.

  6. 06Live

    15:57

    חיה באתר

    בדיקה מקצה לקצה בפרודקשן: תשובה מבוססת, קישור נכון, אפס התרעות.

The Module

  • ~0

    שורות קוד במודול

  • 0

    טבלאות משלו בבסיס הנתונים

  • 0

    כלים שהמודל בוחר מהם

  • 0

    מודלים בבורר בממשק

מודול בתוך אפליקציית Next.js של Sendy, ה-SDK של Anthropic ישירות עם פרוטוקול הזרמה של כ-30 שורות, PostgreSQL ו-Prisma, ושתי משימות מתוזמנות: בנייה לילית של האינדקס, ומחיקת גופי הודעות אחרי 90 יום. כתובות IP לא נשמרות, רק גיבוב שלהן. אפיון, פיתוח והפעלה: 2Dots.

Let's Talk

רוצים סוכן שעונה מהתוכן שלכם,בעלות שידועה מראש?

אינדקס במקום ספרייה, מקור לכל תשובה, ותקרות שאי אפשר לעבור. נשמח לבנות אחד גם לכם.

מעדיפים לדבר? 055-910-7077

Next Case

עוד בעיות.עוד פיצוחים.