
मानव-केंद्रित भाषा मॉडल में छिपे बैकडोर
यह अध्ययन आधुनिक NLP सिस्टमों में छिपी बैकडोर कमजोरियों को उजागर करता है। प्रशिक्षण डेटा में छुपे ट्रिगर डालकर, शोधकर्ता मॉडलों और मानव निरीक्षकों दोनों को धोखा देते हैं। विषाक्त टिप्पणी पहचान, मशीन अनुवाद और प्रश्न उत्तर में चिंताजनक सफलता दरें दिखती हैं।









