همهٔ نوشته‌ها
5 دقیقه خواندن

چگونه با زبان خودمان به ربات بگوییم چه چیزی را پاک کند

قواعد هوش مصنوعی با کلمه‌های معمولی نوشته می‌شوند. چگونه بیانشان کنیم، مدل از پیام چه می‌داند و چگونه قاعده را پیش از روشن‌کردن در شبیه‌ساز بیازماییم.

قواعد عبارتی می‌خواهند کلمه‌ها را برشمرید. نظارت هوش مصنوعی جور دیگری بلد است: شما با متن معمولی وصف می‌کنید چه چیزی تخلف است — و مدل آن را با هر بیانی بازمی‌شناسد، از جمله بیان‌هایی که پیش‌بینی نکرده‌اید.

چنین به گوش می‌رسد که هر چیزی می‌توان نوشت. در عمل برخی بیان‌ها کار می‌کنند و برخی ساکت می‌مانند، و تفاوتشان پیش‌بینی‌پذیر است.

این کجا تنظیم می‌شود#

بخش نظارت ← کارت نظارت با هوش مصنوعی ← زبانهٔ «قواعد». قواعد شما روی موضوع‌های درون‌ساخته کار می‌کنند: موضوع‌ها کلاهبرداری و فیشینگ و تبلیغ قمار را می‌گیرند و قواعد آنچه را که دقیقاً نزد شما ناروا است.

کارت نظارت هوش مصنوعی با زبانهٔ «قواعد»

قاعده وصف می‌کند چه چیزی گرفته شود#

مهم‌ترین چیزی که باید بی‌درنگ دریافت: قاعده وصف تخلف است، نه فرمان به ربات. اینکه با یافته چه کنیم را زنجیرهٔ تنبیه تعیین می‌کند، مانند بقیهٔ بلوک‌ها.

پس نه «پیام‌های تبلیغاتی را پاک کن»، بلکه ساده «تبلیغ کانال‌های دیگر و دعوت به جامعه‌های دیگر».

بیان‌های خوب چنین‌اند:

  • پیام‌های دارای الفاظ رکیک یا توهین;
  • پیشنهاد کار و درآمد، از جمله «در خصوصی بنویسید» و پیوند کانال‌های آگهی شغلی;
  • آگهی فروش هر چیزی جز لوازم ماهیگیری و طعمه;
  • جمع‌آوری پول، شمارهٔ کارت و درخواست واریز برای هر چیزی;
  • بحث سیاست، انتخابات و اخبار نظامی;
  • شخصی‌شدن بحث و پرداختن به خود اعضا به‌جای پیام‌هایشان.

استثناها همان‌جا و با همان کلمه‌ها نوشته می‌شوند: «سخن‌گفتن از کار خود، تخلف نیست».

مدل از پیام چه می‌داند#

تنها متنش را. نه نام گفت‌وگو، نه وصف جامعه، نه نویسنده، نه ساعت روز، نه آنچه پیش‌تر نوشته شده.

از همین‌جا خطای نخست تازه‌کارها می‌آید — بیان‌هایی مانند «خارج از موضوع»، «بی‌ربط به گفت‌وگو»، «پرگویی در شاخهٔ نادرست». برای مدل این‌ها کلمه‌هایی تهی‌اند: چیزی ندارد که با آن بسنجد. دقیق برشمرید که در گفت‌وگوی شما چه چیزی زائد است.

به همین دلیل قواعد مربوط به آدم‌ها و زمان هم بی‌معنایند: «پیام اعضای تازه»، «تبلیغ در آخر هفته». اولی با سطح اعتماد حل می‌شود و دومی به‌هیچ‌روی.

برای هر قاعده ۵۰۰ نویسه در نظر گرفته شده — برای وصفی همراه با دو استثنا بس است.

حساسیت#

هر قاعده میان دو حالت گزینش دارد:

  • دقیق — تنها وقتی واکنش نشان بده که مدل مطمئن است;
  • حساس — در اطمینان متوسط هم واکنش نشان بده.

منطقش ساده است: هرچه بهای عمل‌کردن نابجا بیشتر باشد، حالت سخت‌گیرانه‌تر. ناسزا یکتا بازشناخته می‌شود — می‌توان حساس گذاشت. «شخصی‌شدن بحث» ذهنی است و اینجا دقیق بهتر است، وگرنه ربات جدل‌های عادی را هم پاک می‌کند.

ترتیب قواعد#

قواعد از بالا به پایین بررسی می‌شوند و ترتیب با پیکان‌ها عوض می‌شود. قاعدهٔ مهم‌تر و تنگ‌تر را باید بالاتر برد: نخستین قاعدهٔ مناسب عمل می‌کند و نام همان در دفتر می‌نشیند.

نکتهٔ دیگر: قواعد شما با بررسی جداگانه‌ای اجرا می‌شوند و تنها اگر پیام در هیچ‌یک از موضوع‌های کلاهبرداری درون‌ساخته نیفتاده باشد. کلاهبرداری آشکار اصلاً به قواعد شما نمی‌رسد.

در شبیه‌ساز بیازمایید#

کنار قواعد شبیه‌سازی هست: نمونه‌ای از پیام را می‌چسبانید و می‌بینید کدام قاعده و با چه اطمینانی عمل می‌کرد. تنبیهی اعمال نمی‌شود.

دو نکته: بررسی مانند پیامی معمولی از موجودی کسر می‌شود، و در شبیه‌ساز تنها قواعد شما شرکت دارند — موضوع‌های درون‌ساخته در آن بررسی نمی‌شوند.

ترتیب کاری چنین است: قاعده را می‌نویسید، پنج‌شش پیام واقعی از گفت‌وگوی خودتان را از شبیه‌ساز می‌گذرانید — هم تخلف و هم شبیه‌های بی‌آزار — بیان را اصلاح می‌کنید و تنها آنگاه تنبیه تعیین می‌کنید.

چند قاعده بسازیم#

کمتر از آنچه دل می‌خواهد. هر قاعده در بررسی هر پیام شرکت می‌کند و پردازش را گران‌تر می‌کند؛ پنل صریح از این هشدار می‌دهد و سقف ۲۰ قاعده برای هر گفت‌وگوست.

معمولاً سه تا پنج تا بس است: آنچه را واقعاً مزاحم است می‌پوشانند و بقیه را موضوع‌های درون‌ساخته برمی‌دارند.

قواعد شما طبقهٔ بالایی محافظت‌اند. آنچه باید زیرشان بایستد: چگونه گروه Telegram را از هرزنامه محافظت کنیم.

چگونه برای نظارت هوش مصنوعی قاعده بنویسیم؟

با متن معمولی وصف کنید چه چیزی تخلف است — مثلاً «تبلیغ کانال‌های دیگر». فرمان‌هایی مانند «پاک کن» یا «مسدود کن» ننویسید: اینکه با یافته چه کنیم را زنجیرهٔ تنبیه تعیین می‌کند.

آیا قاعدهٔ «خارج از موضوع را پاک کن» کار می‌کند؟

نه. مدل تنها متن پیام را می‌بیند و نمی‌داند گفت‌وگوی شما دربارهٔ چیست، پس چیزی ندارد که پیام را با موضوع جامعه بسنجد. دقیق برشمرید چه چیزی زائد است.

«دقیق» با «حساس» چه فرقی دارد؟

دقیق تنها در اطمینان بالای مدل واکنش نشان می‌دهد و حساس در اطمینان متوسط هم. برای چیزهای یکتا مانند ناسزا حساس را بردارید و برای چیزهای ذهنی دقیق را.

چند قاعده می‌توان ساخت؟

تا بیست تا برای هر گفت‌وگو. اما هر قاعده پردازش هر پیام را گران‌تر می‌کند، پس معمولاً سه تا پنج تا بس است.

آیا بررسی در شبیه‌ساز پول می‌برد؟

بله، مانند پیامی معمولی از موجودی کسر می‌شود. تنبیهی اعمال نمی‌شود.

خواندن بعدی