TOOLNEW

סוכן מחקר עם Claude שמצטט נכון - לא רק מוצא מידע

איך לשלב web search ו-web fetch בסוכן מחקר עם Claude API כדי לקבל ציטוטים אמיתיים לטקסט המקור, לא רק תשובה שנשמעת סמכותית.

מערכת בינה AI טופסוכני AI ואוטומציה3 בספטמבר 20263 min1 sources
ערימת ספרי עיון פתוחים זה על גבי זה על שולחן ספרייה, סימניות נייר צבעוניות בולטות מהעמודים
ערימת ספרי עיון פתוחים זה על גבי זה על שולחן ספרייה, סימניות נייר צבעוניות בולטות מהעמודים

דוח מחקר שסוכן AI מפיק ונשמע סמכותי לגמרי - עם מספרים, ציטוטים, מסקנות - עלול להיות כולו מבוסס על מה שהמודל "זוכר" מהאימון, בלי קשר אמיתי למקור עדכני כלשהו. הדרך היחידה לדעת בוודאות שטענה במחקר מבוססת על מקור אמיתי היא לראות בדיוק מאיזה משפט במסמך המקורי היא הגיעה - וזה בדיוק מה ש-citations נותן.

שני כלים, שתי משימות שונות

web search מוצא דפים רלוונטיים ברחבי האינטרנט לפי שאילתה - הוא לא מביא את התוכן המלא, רק תוצאות. web fetch, לעומת זאת, מביא את התוכן המלא של כתובת URL ספציפית שכבר מוכרת - מדף שנמצא בחיפוש, מקישור שהמשתמש שלח, או מתוצאת כלי קודמת. סוכן מחקר טוב משתמש בשניהם יחד: קודם מוצא מועמדים רלוונטיים עם חיפוש, ואז מביא תוכן מלא ומצוטט מהמקורות הכי רלוונטיים מביניהם.

לפי Anthropic, אצל web search הציטוטים פועלים תמיד כברירת מחדל, אבל אצל web fetch הם כבויים כברירת מחדל - מי שמקים את הסוכן צריך להפעיל אותם במפורש בהגדרות הכלי, אחרת התוכן נכנס להקשר בלי מיפוי חזרה למיקום המדויק במסמך.

מה בפועל מקבלים בתשובה

עם ציטוטים מופעלים, כל טענה בתשובת המודל מגיעה עם מיפוי מדויק לטקסט המקור - שם המסמך, המיקום המדויק בתוכו, והציטוט המילולי שממנו הטענה נלקחה. זו לא רק "אמינות" מופשטת - זה אומר שאפשר לבנות ממשק שמציג לכל משפט בדוח קישור ישיר לחלק הספציפי במסמך שממנו הוא נלקח, כך שהקורא יכול לבדוק בעצמו במקום לסמוך על המודל בעיניים עצומות.

הגבלת סיכון: הסוכן לא שולף כל URL

הכלי מוגבל בכוונה: web fetch יכול לגשת רק לכתובות URL שכבר הופיעו בהיסטוריית השיחה - בהודעת משתמש, בתוצאת חיפוש קודמת, או בתוצאת כלי צד-לקוח. הוא לא יכול לשלוף כתובת שהמודל "המציא" בפלט שלו עצמו. זו הגנת אבטחה מכוונת נגד הזלגת מידע - סוכן לא יכול לגרום למודל לכתוב URL עם מידע רגיש מוצפן בתוכו ואז "לשלוף" אותו כדי להוציא נתונים.

מקרה קצה: מסמך גדול שחורג מהמגבלה

מאמר מחקר ארוך או PDF כבד (500KB) יכול לצרוך כ-125,000 טוקן, לפי הדוגמאות הרשמיות של Anthropic - זה חלק ניכר מחלון ההקשר בבקשה בודדת. הפרמטר max_content_tokens קוצץ תוכן שחורג מהמגבלה שקבעתם, אבל הקיצוץ הוא לא חכם מבחינת תוכן - הוא פשוט חותך בנקודה מסוימת, ועלול לחתוך באמצע הפרק הכי רלוונטי. לסוכן מחקר שעובד עם PDFs ארוכים, כדאי לשלב את זה עם דינמי-פילטרינג (זמין בגרסאות עדכניות של הכלי) שמאפשר למודל לסנן את התוכן הרלוונטי לפני שהוא נכנס להקשר, במקום לקצץ עיוור בסוף.

שגיאות שהכלי מחזיר - ולא זורק

חשוב להבין: כשfetch נכשל (URL לא נגיש, סוג תוכן לא נתמך, חריגה מ-max_uses), ה-API מחזיר תשובת HTTP 200 רגילה עם קוד שגיאה בתוך תוצאת הכלי (למשל url_not_accessible) - לא זורק חריגה שהקוד שלכם צריך לתפוס. המשמעות: המודל עצמו רואה את השגיאה וממשיך את התשובה, לרוב על ידי דיווח למשתמש שהמקור לא היה נגיש, או ניסיון למקור חלופי. אם הקוד שלכם בודק רק קודי סטטוס HTTP כדי לזהות כשל, הוא יפספס את הכשלים האלה לגמרי - הם "מוסתרים" בתוך תוכן תשובה מוצלחת טכנית.

דוגמה: איך זה נראה בממשק בפועל

דוח מחקר שמוצג למשתמש עם ציטוטים לא צריך להראות את מבנה ה-JSON הגולמי - הוא צריך להפוך למספרי הערת שוליים קלילים לצד כל טענה, שמקשרים לקטע המדויק במקור בלחיצה. משפט כמו "עבודה מרחוק העלתה פרודוקטיביות ב-13% במחקר אחד" מקבל סימון קטן [1] שמוביל לציטוט המדויק שממנו הוא נלקח - לא רק לכתובת הדף אלא לפסקה הספציפית. זה ההבדל המעשי בין "המודל אמר" לבין "המקור אמר, וזה בדיוק איפה" - הבדל שקורא שמקבל דוח מחקר לעבודה שלו יעריך במיוחד כשהוא צריך להציג את הממצאים הלאה.

מה לנסות עכשיו

אם כבר יש סוכן מחקר שרץ רק עם web search, הצעד הבא הוא להוסיף web_fetch עם citations מופעל על המקורות הכי חשובים שהחיפוש מצא - לא כל התוצאות, רק 2-3 שנראות הכי רלוונטיות. זה ההבדל בין דוח שנשמע משכנע לדוח שאפשר לבדוק משפט-משפט מול המקור.

שאלות נפוצות

מה ההבדל בין web search ל-web fetch בסוכן מחקר?

web search מוצא דפים רלוונטיים ברחבי האינטרנט. web fetch מביא את התוכן המלא של דף ספציפי שכבר ידוע - שילוב של השניים נותן לסוכן גם 'איפה לחפש' וגם 'מה בדיוק כתוב שם' עם ציטוט מדויק.

citations מופעל אוטומטית בסוכן מחקר?

ב-web search כן, תמיד מופעל. ב-web fetch זה כבוי כברירת מחדל וצריך להפעיל אותו במפורש עם citations: {enabled: true} בהגדרת הכלי.

SOURCES

  1. Anthropic - Web fetch tool (platform.claude.com) · נבדק 3 בספטמבר 2026

קשור לזה