सभी पोस्ट
8 मिनट पढ़ें

बॉट को अपने शब्दों में कैसे समझाएँ कि क्या हटाना है

AI के नियम आम शब्दों में लिखे जाते हैं। कैसे शब्दांकन करें, मॉडल संदेश के बारे में क्या जानता है और चालू करने से पहले सिम्युलेटर में नियम कैसे जाँचें।

वाक्यांश-नियमों में शब्द गिनाने पड़ते हैं। AI मॉडरेशन दूसरी तरह काम करता है: आप आम पाठ में बताते हैं कि किसे उल्लंघन माना जाए — और मॉडल उसे किसी भी शब्दांकन में पहचान लेता है, उनमें भी जिनका आपने अनुमान नहीं लगाया था।

सुनने में लगता है कि कुछ भी लिखा जा सकता है। व्यवहार में कुछ शब्दांकन काम करते हैं और कुछ चुप रहते हैं, और यह फ़र्क़ पहले से समझा जा सकता है।

यह कहाँ सेट होता है#

खंड मॉडरेशन → कार्ड AI मॉडरेशन → टैब «नियम»। आपके नियम अंतर्निहित विषयों के ऊपर काम करते हैं: विषय ठगी, फ़िशिंग और जुए का विज्ञापन पकड़ते हैं, नियम वह जो ठीक आपकी चैट में अनुचित है।

AI मॉडरेशन कार्ड, «नियम» टैब

नियम बताता है कि क्या पकड़ना है#

सबसे ज़रूरी बात जो तुरंत समझनी चाहिए: नियम उल्लंघन का वर्णन है, बॉट को आदेश नहीं। पकड़े गए का क्या करना है, यह दंड-शृंखला तय करती है, बाक़ी ब्लॉकों की तरह।

इसलिए «विज्ञापन वाले संदेश हटाओ» नहीं, बल्कि सीधे «दूसरे चैनलों का विज्ञापन और दूसरे समुदायों में आने के न्योते»।

अच्छे शब्दांकन ऐसे दिखते हैं:

  • अपशब्दों या अपमान वाले संदेश;
  • काम और कमाई के प्रस्ताव, जिनमें «निजी में लिखिए» और नौकरी वाले चैनलों की कड़ियाँ भी शामिल हैं;
  • मछली पकड़ने के सामान और चारे को छोड़कर किसी भी चीज़ की बिक्री के विज्ञापन;
  • पैसे जुटाना, कार्ड के विवरण और किसी भी चीज़ के लिए पैसे भेजने के अनुरोध;
  • राजनीति, चुनाव और सैन्य ख़बरों पर चर्चा;
  • निजी हमले और संदेशों के बजाय ख़ुद सदस्यों पर चर्चा।

अपवाद वहीं और उन्हीं शब्दों में लिखे जाते हैं: «अपने काम के बारे में बताना उल्लंघन नहीं है»।

मॉडल संदेश के बारे में क्या जानता है#

सिर्फ़ उसका पाठ। न चैट का नाम, न समुदाय का विवरण, न लेखक, न दिन का समय, न पहले क्या लिखा गया।

यहीं से नौसिखिए की पहली ग़लती आती है — «विषय से हटकर», «चैट के विषय से असंबद्ध», «ग़लत शाखा में बकवास» जैसे शब्दांकन। मॉडल के लिए ये ख़ाली शब्द हैं: उसके पास तुलना करने को कुछ नहीं। ठीक-ठीक गिनाइए कि आपकी चैट में क्या फ़ालतू माना जाता है।

इसी वजह से लोगों और समय से जुड़े नियम बेमानी हैं: «नए सदस्यों के संदेश», «सप्ताहांत में विज्ञापन»। पहला भरोसे के स्तर से हल होता है, दूसरा किसी तरह नहीं।

एक नियम के लिए 500 चिह्न हैं — दो अपवादों वाले वर्णन के लिए काफ़ी।

संवेदनशीलता#

हर नियम के पास दो मोड में से एक चुनने का विकल्प है:

  • सटीक — तभी प्रतिक्रिया दे जब मॉडल को यक़ीन हो;
  • संवेदनशील — मध्यम यक़ीन पर भी प्रतिक्रिया दे।

तर्क सरल है: ग़लत चलने की क़ीमत जितनी ऊँची, मोड उतना सख़्त। अपशब्द साफ़ पहचाने जाते हैं — संवेदनशील रखा जा सकता है। «निजी हमले» व्यक्तिपरक हैं, यहाँ सटीक बेहतर है, वरना बॉट आम बहसें भी साफ़ करने लगेगा।

नियमों का क्रम#

नियम ऊपर से नीचे जाँचे जाते हैं, और क्रम तीरों से बदलता है। ज़्यादा ज़रूरी और ज़्यादा संकरे नियम को ऊपर रखना चाहिए: पहला उपयुक्त नियम चलता है, और उसी का नाम लॉग में जाता है।

एक और बात: आपके नियम अलग जाँच से चलते हैं और तभी, जब संदेश किसी अंतर्निहित ठगी वाले विषय में न आया हो। साफ़ ठगी आपके नियमों तक पहुँचती ही नहीं।

सिम्युलेटर में जाँचिए#

नियमों के पास सिम्युलेटर है: संदेश का उदाहरण डालिए और देखिए कि कौन-सा नियम और किस यक़ीन से चलता। इस दौरान दंड नहीं लगते।

दो बातें: जाँच आम संदेश की तरह शेष से कटती है, और सिम्युलेटर में सिर्फ़ आपके नियम हिस्सा लेते हैं — अंतर्निहित विषय उसमें नहीं जाँचे जाते।

काम का क्रम यह है: नियम लिखा, अपनी चैट के पाँच-छह असली संदेश सिम्युलेटर से गुज़ारे — उल्लंघन भी और मिलते-जुलते बेक़सूर भी, — शब्दांकन सुधारा, और उसके बाद ही दंड तय किए।

कितने नियम बनाएँ#

जितने मन करें उससे कम। हर नियम हर संदेश की जाँच में हिस्सा लेता है और प्रोसेसिंग महँगी करता है; डैशबोर्ड इसकी सीधी चेतावनी देता है, और छत — एक चैट में 20 नियम।

आम तौर पर तीन-पाँच काफ़ी होते हैं: वे वह बंद करते हैं जो सचमुच परेशान करता है, और बाक़ी अंतर्निहित विषय संभाल लेते हैं।

आपके नियम सुरक्षा की ऊपरी मंज़िल हैं। उनके नीचे क्या होना चाहिए: Telegram ग्रुप को स्पैम से कैसे बचाएँ.

AI मॉडरेशन के लिए नियम कैसे लिखें?

आम पाठ में बताइए कि किसे उल्लंघन माना जाए — जैसे «दूसरे चैनलों का विज्ञापन»। «हटाओ» या «प्रतिबंधित करो» जैसे आदेश मत लिखिए: पकड़े गए का क्या करना है, यह दंड-शृंखला तय करती है।

क्या «विषय से हटकर संदेश हटाओ» नियम काम करेगा?

नहीं। मॉडल सिर्फ़ संदेश का पाठ देखता है और नहीं जानता कि आपकी चैट किस बारे में है, इसलिए संदेश की तुलना समुदाय के विषय से करने को उसके पास कुछ नहीं। ठीक-ठीक गिनाइए कि क्या फ़ालतू माना जाता है।

«सटीक» और «संवेदनशील» में क्या फ़र्क़ है?

सटीक सिर्फ़ मॉडल के ऊँचे यक़ीन पर प्रतिक्रिया देता है, संवेदनशील मध्यम पर भी। अपशब्द जैसी साफ़ चीज़ों के लिए संवेदनशील लीजिए, व्यक्तिपरक चीज़ों के लिए सटीक।

कितने नियम बनाए जा सकते हैं?

एक चैट में बीस तक। पर हर नियम हर संदेश की प्रोसेसिंग महँगी करता है, इसलिए आम तौर पर तीन-पाँच काफ़ी होते हैं।

क्या सिम्युलेटर में जाँच पैसे लेती है?

हाँ, वह आम संदेश की तरह शेष से कटती है। इस दौरान दंड नहीं लगते।

आगे पढ़ें