הכתבה של דניאלה גינזבורג "ידיעות אחרונות" וב-Ynet מתארת בעיה קשה ב-Claude ה-Chatbot של Anthropic.
בדיקה של חברת NewsGuard האמריקאית, הבודקת עד כמה צ'אטבוטים של AI חוזרים על מידע שגוי, גילתה כי Claude ה-Chatbot של Anthropic חזר ב-15% מהמקרים על טענות שקריות התומכות בתעמולה רוסית. מדובר בעלייה גדולה בחזרה על טענות כאלה משום שבעבר נמצאו רק 4% מקרים כאלה.
ב-20% מהמקרים קלוד חזר על טענות שקריות שמקורן בתעמולה איראנית.
כותרת הכתבה בגרסה המקוונת: שאלו את קלוד שאלות פשוטות ומה שיצא ממנו הפתיע גם את החוקרים.
הכותרת של אותה כתבה ב"ידיעות אחרונות" רחוקה מהליות מדויקת.
הכותרת: "הפרצה של קלוד: מודל ה-AI הפופולרי שיכפל תעמולה רוסית וחזר על טענות שקריות".
החלק הלא מדויק הוא המונח "פרצה". הטענה כאילו יש Bug בתוכנה שבגללו נוצרה פרצה.
מי שקרא פוסטים שלי על אימון (Training) של Chatbots או על מקורות בהם עושים Chatbots שימוש מבין שזה לא Bug, אלא Feature.
Feature הוא משהו מהותי שהוא חלק ממוצר.
במקרה זה השימוש במקורות מוטים, מקורות לא אמינים ומקורות זדוניים המנסים להטות את ה-Chatbots הוא חלק אינהרנטי מהמודל של Claude וגם של Chatbots אחרים כמו ChatGPT.
קראו למשל: הזיות: כשל לוגי מהותי ב-Chatbots מבוססי מודל שפה גדול.
אין תגובות:
הוסף רשומת תגובה