AI watermarking could make LLM guardrail adherence unpredictable — and that could be a big problem for the EU AI Act
18/09/2026-15:09 18/09/2026-15:15 מחשבים וטכנולוגיה TechRadar דיווח
AI watermarking aims to prove the authenticity of any textNew study finds it also changes LLM behavior – and in a bad wayEU AI Act could mean more models have watermarks despite side effectsNew Lasso lasso.security
סיכום מאמרסימון מים ב‑AI (AI watermarking) נועד להוכיח את מקוריות הטקסט שנוצר על ידי מודלי שפה גדולים (LLM), אך מחקר חדש מגלה כי הטכניקה עלולה לשנות את התנהגות המודלים ולפגוע ביכולתם לעמוד בהנחיות הגנה (guardrails) בצורה צפויה. שינוי זה עלול להפוך את עמידה בדרישות הרגולציה לבלתי צפויה וליצור סיכון למשתמשים ולמפתחים. מכיוון שהחוק האירופי לבינה מלאכותית (EU AI Act) עשוי לחייב שימוש בסימון מים כדי להבטיח שקיפות, תופעת הלוואי הזו עלולה להעמיד את המודלים בסתירה בין דרישות האימות לבין שמירה על ביצועים בטוחים ואמינים. המחקר מתריע כי ללא פתרון לשינוי ההתנהגות, יישום רחב של סימון מים עלול לייצר "מיסוי מקור" (provenance tax) שיפגע באמינות ובשימושיות של מערכות AI באירופה. (מקור: Lasso Security)תוכן זה נוצר על ידי בינה מלאכותית.