How we tested AI chatbots – and the prompts that worked best
11/09/2026-02:01 11/09/2026-10:35 מחשבים וטכנולוגיה Which? דיווח
‘Will artificial intelligence (AI) replace me?’ Th
סיכום מאמרכיצד בדקנו צ'אטבוטים מבוססי בינה מלאכותית ואילו הנחיות הניבו את התוצאות הטובות ביותר במחקר מקיף שערכנו, בחנו מספר מודלי שפה גדולים – כולל GPT‑4, Claude 2 ו‑Bard – באמצעות סדרת מבחנים שמדדו דיוק בתשובות, יכולת reasoning, יצירת תוכן והבנת הקשר. לכל מודל הועברו מאות הנחיות (prompts) במגוון תחומים: כתיבה מאמרית, פתרון בעיות מתמטיות, יצירת קוד, סיכום מסמכים ושיחה פתוחה. התוצאות הראו שהנחיות ספציפיות וממוקדות – כאלו שמציגות את המשימה בצורה ברורה, מציינות את הפורמט הרצוי ומגבילות את האורך – שיפרו משמעותית את דיוק המודלים והפחיתו תגובות לא רלוונטיות. במקביל, הנחיות פתוחות מדי או עמוסות פרטים מיותרים הובילו לתשובות כלליות או לטעויות. הממצאים מדגישים כי איכות ההנחיהתוכן זה נוצר על ידי בינה מלאכותית.