HeadlinesBriefing HeadlinesBriefing 12 languages

EmDash uses Clef to moderate the plugin registry

Hacker News ·

🇬🇧 English

Every plugin listing in the official Em Dash plugin registry is now screened by Cloudflare's Clef decision model before it can appear in the catalog. Clef reviews the listing metadata, outbound links, icon, and screenshots for phishing, impersonation, offensive content, scams, and attempts to manipulate the moderation system. The registry is built on AT Protocol, so plugin authors publish signed releases from their own accounts. Automated moderation lets authors keep that open publishing model without making the catalog an open door for abuse.

Clef is a decision model: instead of generating prose, it answers bounded questions with typed probabilities that application code can act on. When a plugin is published, the Em Dash labeler asks Clef nine questions about its text and links, covering explicit sexual content, hateful or dehumanizing content, graphic violence, phishing, impersonation, scams, spam, deceptive links, misleading media, and attempts to manipulate moderation. Eight corresponding questions are asked about each icon and screenshot. A result of 0.45 or higher sends the listing to an operator for review.

The previous moderation pipeline needed two general-purpose models to agree on text, plus another pass for images. According to Matt Kane, Em Dash lead maintainer, "Previously we had to use a mix of models to get reliable results, but Clef beat them all, while being much faster." Across three repeats of 21 public text fixtures, Clef made the expected decision in all 63 runs, with end-to-end text moderation latency of 1.64 seconds at p95. The moderation change doesn't add a new step for plugin authors.

View original article →


🇸🇦 العربية

EmDash يستخدم Clef لمراقبة سجل الإضافات

يتم الآن فحص كل قائمة إضافة في سجل إضافات Em Dash الرسمي بواسطة نموذج قرار Clef من Cloudflare قبل أن تظهر في الكتالوج. يراجع Clef بيانات القائمة الوصفية والروابط الصادرة والأيقونة ولقطات الشاشة بحثًا عن التصيد والانتحال والمحتوى المسيء والاحتيالات ومحاولات التلاعب بنظام المراقبة. تم بناء السجل على بروتوكول AT، لذلك ينشر مؤلفو الإضافات إصدارات موقعة من حساباتهم الخاصة. تتيح المراقبة الآلية للمؤلفين الحفاظ على نموذج النشر المفتوح دون جعل الكتالوج بابًا مفتوحًا للإساءة.

Clef هو نموذج قرار: بدلاً من إنشاء نثر، يجيب على أسئلة محددة باحتمالات مصنفة يمكن لرمز التطبيق العمل بناءً عليها. عندما يتم نشر إضافة، يطرح مصنف Em Dash على Clef تسعة أسئلة حول نصها وروابطها، تغطي المحتوى الجنسي الصريح والمحتوى الكاره أو المجرد من الإنسانية والعنف البياني والتصيد والانتحال والاحتيالات والبريد العشوائي والروابط الخادعة والوسائط المضللة ومحاولات التلاعب بالمراقبة. يتم طرح ثمانية أسئلة مقابلة حول كل أيقونة ولقطة شاشة. تؤدي نتيجة 0.45 أو أعلى إلى إرسال القائمة إلى مشغل للمراجعة.

كان خط أنابيب المراقبة السابق يحتاج إلى نموذجين للأغراض العامة للاتفاق على النص، بالإضافة إلى تمرير آخر للصور. وفقًا لـ Matt Kane، المشرف الرئيسي على Em Dash، "كان علينا سابقًا استخدام مزيج من النماذج للحصول على نتائج موثوقة، لكن Clef تفوق عليهم جميعًا، مع كونه أسرع بكثير." عبر ثلاث تكرارات لـ 21 اختبار نصي عام، اتخذ Clef القرار المتوقع في جميع 63 تشغيلًا، مع زمن استجابة لمراقبة النص من البداية إلى النهاية يبلغ 1.64 ثانية عند p95. لا يضيف تغيير المراقبة خطوة جديدة لمؤلفي الإضافات.

كيف يستخدم EmDash Clef لمراقبة الإضافات؟

يستخدم EmDash نموذج قرار Clef من Cloudflare لفحص كل قائمة إضافة. يجيب Clef على أسئلة محددة حول النص والروابط والأيقونات ولقطات الشاشة، ويعيد الاحتمالات. تؤدي درجة 0.45 أو أعلى إلى مراجعة بشرية، لكن النموذج لا يحظر أبدًا إضافة بشكل أحادي.

العربية version →


🇧🇩 বাংলা

EmDash প্লাগইন রেজিস্ট্রি মডারেট করতে Clef ব্যবহার করে

অফিসিয়াল Em Dash প্লাগইন রেজিস্ট্রির প্রতিটি প্লাগইন তালিকা এখন ক্যাটালগে উপস্থিত হওয়ার আগে Cloudflare-এর Clef সিদ্ধান্ত মডেল দ্বারা পরীক্ষা করা হয়। Clef ফিশিং, প্রতিরূপণ, আপত্তিকর বিষয়বস্তু, প্রতারণা এবং মডারেশন সিস্টেমে হেরফের করার প্রচেষ্টার জন্য তালিকা মেটাডেটা, আউটবাউন্ড লিঙ্ক, আইকন এবং স্ক্রিনশট পর্যালোচনা করে। রেজিস্ট্রিটি AT প্রোটোকলের উপর নির্মিত, তাই প্লাগইন লেখকরা তাদের নিজস্ব অ্যাকাউন্ট থেকে স্বাক্ষরিত রিলিজ প্রকাশ করেন। স্বয়ংক্রিয় মডারেশন লেখকদের ক্যাটালগকে অপব্যবহারের জন্য খোলা দরজা না করে সেই উন্মুক্ত প্রকাশনা মডেল বজায় রাখতে দেয়।

Clef একটি সিদ্ধান্ত মডেল: গদ্য তৈরি করার পরিবর্তে, এটি টাইপ করা সম্ভাবনার সাথে সীমাবদ্ধ প্রশ্নের উত্তর দেয় যা অ্যাপ্লিকেশন কোড কাজ করতে পারে। যখন একটি প্লাগইন প্রকাশিত হয়, Em Dash লেবেলার Clef-কে এর টেক্সট এবং লিঙ্ক সম্পর্কে নয়টি প্রশ্ন জিজ্ঞাসা করে, যা স্পষ্ট যৌন বিষয়বস্তু, ঘৃণামূলক বা অমানবিক বিষয়বস্তু, গ্রাফিক সহিংসতা, ফিশিং, প্রতিরূপণ, প্রতারণা, স্প্যাম, প্রতারণামূলক লিঙ্ক, বিভ্রান্তিকর মিডিয়া এবং মডারেশনে হেরফের করার প্রচেষ্টা কভার করে। প্রতিটি আইকন এবং স্ক্রিনশট সম্পর্কে আটটি সংশ্লিষ্ট প্রশ্ন জিজ্ঞাসা করা হয়। 0.45 বা তার বেশি ফলাফল পর্যালোচনার জন্য তালিকাটি একজন অপারেটরের কাছে পাঠায়।

পূর্ববর্তী মডারেশন পাইপলাইনের টেক্সটে একমত হওয়ার জন্য দুটি সাধারণ-উদ্দেশ্য মডেলের প্রয়োজন ছিল, plus ছবির জন্য আরেকটি পাস। Em Dash-এর প্রধান রক্ষণাবেক্ষণকারী Matt Kane-এর মতে, "আগে নির্ভরযোগ্য ফলাফল পেতে আমাদের মডেলের মিশ্রণ ব্যবহার করতে হতো, কিন্তু Clef তাদের সবাইকে হারিয়েছে, অনেক দ্রুত হওয়ার পাশাপাশি।" 21 পাবলিক টেক্সট ফিক্সচারের তিনটি পুনরাবৃত্তিতে, Clef সমস্ত 63 রানে প্রত্যাশিত সিদ্ধান্ত নিয়েছে, p95-এ এন্ড-টু-এন্ড টেক্সট মডারেশন লেটেন্সি 1.64 সেকেন্ড। মডারেশন পরিবর্তন প্লাগইন লেখকদের জন্য কোনো নতুন ধাপ যোগ করে না।

EmDash কীভাবে প্লাগইন মডারেট করতে Clef ব্যবহার করে?

EmDash প্রতিটি প্লাগইন তালিকা পরীক্ষা করতে Cloudflare-এর Clef সিদ্ধান্ত মডেল ব্যবহার করে। Clef টেক্সট, লিঙ্ক, আইকন এবং স্ক্রিনশট সম্পর্কে সীমাবদ্ধ প্রশ্নের উত্তর দেয়, সম্ভাবনা ফেরত দেয়। 0.45 বা তার বেশি স্কোর মানব পর্যালোচনা শুরু করে, কিন্তু মডেল কখনো একতরফাভাবে প্লাগইন ব্লক করে না।

বাংলা version →


🇩🇪 Deutsch

EmDash verwendet Clef zur Moderation des Plugin-Registers

Jede Plugin-Listung im offiziellen Em Dash Plugin-Register wird nun vom Clef-Entscheidungsmodell von Cloudflare überprüft, bevor sie im Katalog erscheinen kann. Clef prüft die Listungsmetadaten, ausgehende Links, das Symbol und Screenshots auf Phishing, Identitätsdiebstahl, anstößige Inhalte, Betrug und Versuche, das Moderationssystem zu manipulieren. Das Register basiert auf AT Protocol, sodass Plugin-Autoren signierte Veröffentlichungen von ihren eigenen Konten aus veröffentlichen. Die automatisierte Moderation ermöglicht es Autoren, dieses offene Veröffentlichungsmodell beizubehalten, ohne den Katalog zu einer offenen Tür für Missbrauch zu machen.

Clef ist ein Entscheidungsmodell: Anstatt Prosa zu generieren, beantwortet es begrenzte Fragen mit typisierten Wahrscheinlichkeiten, auf die Anwendungscode reagieren kann. Wenn ein Plugin veröffentlicht wird, stellt der Em Dash Labeler Clef neun Fragen zu seinem Text und seinen Links, die explizite sexuelle Inhalte, hasserfüllte oder entmenschlichende Inhalte, grafische Gewalt, Phishing, Identitätsdiebstahl, Betrug, Spam, trügerische Links, irreführende Medien und Versuche, die Moderation zu manipulieren, abdecken. Acht entsprechende Fragen werden zu jedem Symbol und Screenshot gestellt. Ein Ergebnis von 0,45 oder höher sendet die Listung zur Überprüfung an einen Operator.

Die vorherige Moderationspipeline benötigte zwei Allzweckmodelle, die sich auf den Text einigen mussten, plus einen weiteren Durchlauf für Bilder. Laut Matt Kane, dem leitenden Betreuer von Em Dash, „Früher mussten wir eine Mischung von Modellen verwenden, um zuverlässige Ergebnisse zu erzielen, aber Clef hat sie alle geschlagen, während es viel schneller war.“ Bei drei Wiederholungen von 21 öffentlichen Text-Fixtures traf Clef in allen 63 Durchläufen die erwartete Entscheidung, mit einer Ende-zu-Ende-Textmoderationslatenz von 1,64 Sekunden bei p95. Die Änderung der Moderation fügt für Plugin-Autoren keinen neuen Schritt hinzu.

Wie verwendet EmDash Clef zur Moderation von Plugins?

EmDash verwendet das Clef-Entscheidungsmodell von Cloudflare, um jede Plugin-Listung zu prüfen. Clef beantwortet begrenzte Fragen zu Text, Links, Symbolen und Screenshots und gibt Wahrscheinlichkeiten zurück. Ein Wert von 0,45 oder höher löst eine menschliche Überprüfung aus, aber das Modell blockiert niemals ein Plugin einseitig.

Deutsch version →


🇪🇸 Español

EmDash usa Clef para moderar el registro de complementos

Cada listado de complementos en el registro oficial de complementos de Em Dash ahora es examinado por el modelo de decisión Clef de Cloudflare antes de que pueda aparecer en el catálogo. Clef revisa los metadatos del listado, enlaces salientes, icono y capturas de pantalla en busca de phishing, suplantación de identidad, contenido ofensivo, estafas e intentos de manipular el sistema de moderación. El registro está construido sobre AT Protocol, por lo que los autores de complementos publican versiones firmadas desde sus propias cuentas. La moderación automatizada permite a los autores mantener ese modelo de publicación abierto sin convertir el catálogo en una puerta abierta al abuso.

Clef es un modelo de decisión: en lugar de generar prosa, responde preguntas acotadas con probabilidades tipadas sobre las que el código de la aplicación puede actuar. Cuando se publica un complemento, el etiquetador de Em Dash hace a Clef nueve preguntas sobre su texto y enlaces, que cubren contenido sexual explícito, contenido odioso o deshumanizante, violencia gráfica, phishing, suplantación de identidad, estafas, spam, enlaces engañosos, medios engañosos e intentos de manipular la moderación. Se hacen ocho preguntas correspondientes sobre cada icono y captura de pantalla. Un resultado de 0.45 o superior envía el listado a un operador para su revisión.

El proceso de moderación anterior necesitaba que dos modelos de propósito general coincidieran en el texto, más otra pasada para las imágenes. Según Matt Kane, mantenedor principal de Em Dash, "Anteriormente teníamos que usar una mezcla de modelos para obtener resultados fiables, pero Clef los superó a todos, siendo mucho más rápido." En tres repeticiones de 21 casos de prueba de texto públicos, Clef tomó la decisión esperada en las 63 ejecuciones, con una latencia de moderación de texto de extremo a extremo de 1.64 segundos en p95. El cambio de moderación no añade un nuevo paso para los autores de complementos.

¿Cómo usa EmDash Clef para moderar complementos?

EmDash usa el modelo de decisión Clef de Cloudflare para examinar cada listado de complementos. Clef responde preguntas acotadas sobre texto, enlaces, iconos y capturas de pantalla, devolviendo probabilidades. Una puntuación de 0.45 o superior desencadena una revisión humana, pero el modelo nunca bloquea un complemento unilateralmente.

Español version →


🇫🇷 Français

EmDash utilise Clef pour modérer le registre des plugins

Chaque fiche de plugin dans le registre officiel des plugins Em Dash est désormais examinée par le modèle de décision Clef de Cloudflare avant de pouvoir apparaître dans le catalogue. Clef examine les métadonnées de la fiche, les liens sortants, l'icône et les captures d'écran pour détecter le phishing, l'usurpation d'identité, le contenu offensant, les escroqueries et les tentatives de manipulation du système de modération. Le registre est construit sur AT Protocol, donc les auteurs de plugins publient des versions signées depuis leurs propres comptes. La modération automatisée permet aux auteurs de conserver ce modèle de publication ouvert sans faire du catalogue une porte ouverte aux abus.

Clef est un modèle de décision : au lieu de générer du texte, il répond à des questions limitées avec des probabilités typées sur lesquelles le code de l'application peut agir. Lorsqu'un plugin est publié, l'étiqueteur Em Dash pose à Clef neuf questions sur son texte et ses liens, couvrant le contenu sexuel explicite, le contenu haineux ou déshumanisant, la violence graphique, le phishing, l'usurpation d'identité, les escroqueries, le spam, les liens trompeurs, les médias trompeurs et les tentatives de manipulation de la modération. Huit questions correspondantes sont posées pour chaque icône et capture d'écran. Un résultat de 0,45 ou plus envoie la fiche à un opérateur pour révision.

Le pipeline de modération précédent nécessitait que deux modèles polyvalents s'accordent sur le texte, plus un autre passage pour les images. Selon Matt Kane, mainteneur principal d'Em Dash, "Auparavant, nous devions utiliser un mélange de modèles pour obtenir des résultats fiables, mais Clef les a tous battus, tout en étant beaucoup plus rapide." Sur trois répétitions de 21 cas de test textuels publics, Clef a pris la décision attendue dans les 63 exécutions, avec une latence de modération de texte de bout en bout de 1,64 secondes à p95. Le changement de modération n'ajoute pas de nouvelle étape pour les auteurs de plugins.

Comment EmDash utilise-t-il Clef pour modérer les plugins ?

EmDash utilise le modèle de décision Clef de Cloudflare pour filtrer chaque fiche de plugin. Clef répond à des questions limitées sur le texte, les liens, les icônes et les captures d'écran, renvoyant des probabilités. Un score de 0,45 ou plus déclenche une révision humaine, mais le modèle ne bloque jamais un plugin unilatéralement.

Français version →


🇮🇳 हिन्दी

EmDash प्लगइन रजिस्ट्री को मॉडरेट करने के लिए Clef का उपयोग करता है

आधिकारिक Em Dash प्लगइन रजिस्ट्री में प्रत्येक प्लगइन लिस्टिंग अब कैटलॉग में दिखाई देने से पहले Cloudflare के Clef निर्णय मॉडल द्वारा जांची जाती है। Clef फ़िशिंग, प्रतिरूपण, आपत्तिजनक सामग्री, घोटालों और मॉडरेशन सिस्टम में हेरफेर करने के प्रयासों के लिए लिस्टिंग मेटाडेटा, आउटबाउंड लिंक, आइकन और स्क्रीनशॉट की समीक्षा करता है। रजिस्ट्री AT प्रोटोकॉल पर बनी है, इसलिए प्लगइन लेखक अपने स्वयं के खातों से हस्ताक्षरित रिलीज़ प्रकाशित करते हैं। स्वचालित मॉडरेशन लेखकों को उस खुले प्रकाशन मॉडल को बनाए रखने देता है बिना कैटलॉग को दुरुपयोग के लिए खुला दरवाजा बनाए।

Clef एक निर्णय मॉडल है: गद्य उत्पन्न करने के बजाय, यह टाइप की गई संभावनाओं के साथ सीमित प्रश्नों का उत्तर देता है जिन पर एप्लिकेशन कोड कार्य कर सकता है। जब कोई प्लगइन प्रकाशित होता है, तो Em Dash लेबलर Clef से इसके टेक्स्ट और लिंक के बारे में नौ प्रश्न पूछता है, जिसमें स्पष्ट यौन सामग्री, घृणास्पद या अमानवीय सामग्री, ग्राफिक हिंसा, फ़िशिंग, प्रतिरूपण, घोटाले, स्पैम, भ्रामक लिंक, भ्रामक मीडिया और मॉडरेशन में हेरफेर करने के प्रयास शामिल हैं। प्रत्येक आइकन और स्क्रीनशॉट के बारे में आठ संबंधित प्रश्न पूछे जाते हैं। 0.45 या उससे अधिक का परिणाम समीक्षा के लिए लिस्टिंग को एक ऑपरेटर को भेजता है।

पिछली मॉडरेशन पाइपलाइन को टेक्स्ट पर सहमत होने के लिए दो सामान्य-उद्देश्य मॉडल की आवश्यकता थी, साथ ही छवियों के लिए एक और पास। Em Dash के प्रमुख अनुरक्षक Matt Kane के अनुसार, "पहले हमें विश्वसनीय परिणाम प्राप्त करने के लिए मॉडलों के मिश्रण का उपयोग करना पड़ता था, लेकिन Clef ने उन सभी को हराया, जबकि बहुत तेज़ था।" 21 सार्वजनिक टेक्स्ट फिक्स्चर के तीन दोहराव में, Clef ने सभी 63 रनों में अपेक्षित निर्णय लिया, p95 पर एंड-टू-एंड टेक्स्ट मॉडरेशन विलंबता 1.64 सेकंड थी। मॉडरेशन परिवर्तन प्लगइन लेखकों के लिए कोई नया कदम नहीं जोड़ता है।

EmDash प्लगइन को मॉडरेट करने के लिए Clef का उपयोग कैसे करता है?

EmDash प्रत्येक प्लगइन लिस्टिंग की जांच के लिए Cloudflare के Clef निर्णय मॉडल का उपयोग करता है। Clef टेक्स्ट, लिंक, आइकन और स्क्रीनशॉट के बारे में सीमित प्रश्नों का उत्तर देता है, संभावनाएं लौटाता है। 0.45 या उससे अधिक का स्कोर मानव समीक्षा शुरू करता है, लेकिन मॉडल कभी भी एकतरफा प्लगइन को ब्लॉक नहीं करता है।

हिन्दी version →


🇮🇩 Bahasa Indonesia

EmDash menggunakan Clef untuk memoderasi registri plugin

Setiap daftar plugin di registri plugin resmi Em Dash kini diperiksa oleh model keputusan Clef dari Cloudflare sebelum dapat muncul di katalog. Clef meninjau metadata daftar, tautan keluar, ikon, dan tangkapan layar untuk phishing, peniruan identitas, konten ofensif, penipuan, dan upaya memanipulasi sistem moderasi. Registri dibangun di atas AT Protocol, sehingga penulis plugin menerbitkan rilis yang ditandatangani dari akun mereka sendiri. Moderasi otomatis memungkinkan penulis mempertahankan model penerbitan terbuka itu tanpa menjadikan katalog sebagai pintu terbuka bagi penyalahgunaan.

Clef adalah model keputusan: alih-alih menghasilkan prosa, ia menjawab pertanyaan terbatas dengan probabilitas bertipe yang dapat ditindaklanjuti oleh kode aplikasi. Ketika plugin diterbitkan, pemberi label Em Dash mengajukan sembilan pertanyaan kepada Clef tentang teks dan tautannya, mencakup konten seksual eksplisit, konten penuh kebencian atau merendahkan martabat, kekerasan grafis, phishing, peniruan identitas, penipuan, spam, tautan menipu, media menyesatkan, dan upaya memanipulasi moderasi. Delapan pertanyaan terkait diajukan tentang setiap ikon dan tangkapan layar. Hasil 0,45 atau lebih tinggi mengirimkan daftar tersebut ke operator untuk ditinjau.

Pipeline moderasi sebelumnya memerlukan dua model tujuan umum untuk menyetujui teks, ditambah satu langkah lagi untuk gambar. Menurut Matt Kane, pemelihara utama Em Dash, "Sebelumnya kami harus menggunakan campuran model untuk mendapatkan hasil yang andal, tetapi Clef mengalahkan semuanya, sementara jauh lebih cepat." Dalam tiga pengulangan dari 21 fixture teks publik, Clef membuat keputusan yang diharapkan di semua 63 kali proses, dengan latensi moderasi teks ujung-ke-ujung sebesar 1,64 detik pada p95. Perubahan moderasi tidak menambahkan langkah baru bagi penulis plugin.

Bagaimana EmDash menggunakan Clef untuk memoderasi plugin?

EmDash menggunakan model keputusan Clef dari Cloudflare untuk memeriksa setiap daftar plugin. Clef menjawab pertanyaan terbatas tentang teks, tautan, ikon, dan tangkapan layar, mengembalikan probabilitas. Skor 0,45 atau lebih memicu tinjauan manusia, tetapi model tidak pernah memblokir plugin secara sepihak.

Bahasa Indonesia version →


🇯🇵 日本語

EmDash が Clef を使用してプラグインレジストリをモデレート

公式 Em Dash プラグインレジストリのすべてのプラグインリストは、カタログに表示される前に Cloudflare の Clef 決定モデルによって審査されるようになりました。Clef は、フィッシング、なりすまし、不快なコンテンツ、詐欺、およびモデレーションシステムの操作試行について、リストのメタデータ、アウトバウンドリンク、アイコン、スクリーンショットをレビューします。レジストリは AT Protocol 上に構築されているため、プラグイン作成者は自分のアカウントから署名付きリリースを公開します。自動モデレーションにより、作成者はカタログを悪用のための開かれたドアにすることなく、そのオープンな公開モデルを維持できます。

Clef は決定モデルです。散文を生成する代わりに、アプリケーションコードがアクションを起こせる型付き確率で限定された質問に答えます。プラグインが公開されると、Em Dash ラベラーは Clef にそのテキストとリンクに関する 9 つの質問をします。これには、露骨な性的コンテンツ、憎悪的または非人間化的コンテンツ、グラフィックな暴力、フィッシング、なりすまし、詐欺、スパム、欺瞞的なリンク、誤解を招くメディア、モデレーションの操作試行が含まれます。各アイコンとスクリーンショットについて、対応する 8 つの質問が行われます。0.45 以上の結果は、リストをレビューのためにオペレーターに送信します。

以前のモデレーションパイプラインでは、テキストについて合意するために 2 つの汎用モデルが必要で、さらに画像用の別のパスが必要でした。Em Dash のリードメンテナーである Matt Kane によると、「以前は信頼できる結果を得るためにモデルを混在させる必要がありましたが、Clef はそれらすべてを打ち負かし、はるかに高速でした。」21 の公開テキストフィクスチャの 3 回の繰り返しで、Clef はすべての 63 回の実行で期待された合格またはレビューの決定を下し、p95 でのエンドツーエンドのテキストモデレーション遅延は 1.64 秒でした。モデレーションの変更により、プラグイン作成者に新しい手順が追加されることはありません。

EmDash は Clef をどのように使用してプラグインをモデレートしますか?

EmDash は Cloudflare の Clef 決定モデルを使用して各プラグインリストを審査します。Clef はテキスト、リンク、アイコン、スクリーンショットに関する限定された質問に答え、確率を返します。スコア 0.45 以上で人間によるレビューがトリガーされますが、モデルが一方的にプラグインをブロックすることはありません。

日本語 version →


🇧🇷 Português

EmDash usa Clef para moderar o registro de plugins

Cada listagem de plugin no registro oficial de plugins do Em Dash agora é examinada pelo modelo de decisão Clef da Cloudflare antes de poder aparecer no catálogo. O Clef revisa os metadados da listagem, links de saída, ícone e capturas de tela em busca de phishing, falsificação de identidade, conteúdo ofensivo, golpes e tentativas de manipular o sistema de moderação. O registro é construído no AT Protocol, então os autores de plugins publicam versões assinadas de suas próprias contas. A moderação automatizada permite que os autores mantenham esse modelo de publicação aberto sem tornar o catálogo uma porta aberta para abusos.

O Clef é um modelo de decisão: em vez de gerar prosa, ele responde a perguntas limitadas com probabilidades tipadas nas quais o código do aplicativo pode agir. Quando um plugin é publicado, o rotulador do Em Dash faz ao Clef nove perguntas sobre seu texto e links, cobrindo conteúdo sexual explícito, conteúdo odioso ou desumanizante, violência gráfica, phishing, falsificação de identidade, golpes, spam, links enganosos, mídia enganosa e tentativas de manipular a moderação. Oito perguntas correspondentes são feitas sobre cada ícone e captura de tela. Um resultado de 0,45 ou superior envia a listagem para um operador revisar.

O pipeline de moderação anterior precisava que dois modelos de uso geral concordassem sobre o texto, além de outra passagem para imagens. De acordo com Matt Kane, mantenedor principal do Em Dash, "Anteriormente, tínhamos que usar uma mistura de modelos para obter resultados confiáveis, mas o Clef superou todos eles, sendo muito mais rápido." Em três repetições de 21 cenários de teste de texto públicos, o Clef tomou a decisão esperada em todas as 63 execuções, com latência de moderação de texto de ponta a ponta de 1,64 segundos em p95. A mudança de moderação não adiciona uma nova etapa para os autores de plugins.

Como o EmDash usa o Clef para moderar plugins?

O EmDash usa o modelo de decisão Clef da Cloudflare para examinar cada listagem de plugin. O Clef responde a perguntas limitadas sobre texto, links, ícones e capturas de tela, retornando probabilidades. Uma pontuação de 0,45 ou mais aciona revisão humana, mas o modelo nunca bloqueia um plugin unilateralmente.

Português version →


🇷🇺 Русский

EmDash использует Clef для модерации реестра плагинов

Каждый список плагинов в официальном реестре плагинов Em Dash теперь проверяется моделью принятия решений Clef от Cloudflare, прежде чем он сможет появиться в каталоге. Clef проверяет метаданные списка, исходящие ссылки, иконку и скриншоты на предмет фишинга, выдачи себя за другое лицо, оскорбительного контента, мошенничества и попыток манипулирования системой модерации. Реестр построен на AT Protocol, поэтому авторы плагинов публикуют подписанные релизы со своих собственных аккаунтов. Автоматизированная модерация позволяет авторам сохранять эту открытую модель публикации, не превращая каталог в открытую дверь для злоупотреблений.

Clef — это модель принятия решений: вместо генерации текста она отвечает на ограниченные вопросы с типизированными вероятностями, на которые может реагировать код приложения. Когда плагин публикуется, маркировщик Em Dash задает Clef девять вопросов о его тексте и ссылках, охватывающих откровенный сексуальный контент, ненавистнический или дегуманизирующий контент, графическое насилие, фишинг, выдачу себя за другое лицо, мошенничество, спам, обманные ссылки, вводящие в заблуждение медиа и попытки манипулирования модерацией. Восемь соответствующих вопросов задаются о каждой иконке и скриншоте. Результат 0,45 или выше отправляет список оператору на проверку.

Предыдущий конвейер модерации требовал согласия двух моделей общего назначения по тексту, плюс еще один проход для изображений. По словам Мэтта Кейна, ведущего разработчика Em Dash, "Раньше нам приходилось использовать смесь моделей для получения надежных результатов, но Clef превзошел их все, будучи при этом намного быстрее." В трех повторах 21 публичного текстового теста Clef принял ожидаемое решение во всех 63 запусках, с задержкой сквозной модерации текста 1,64 секунды на уровне p95. Изменение модерации не добавляет нового шага для авторов плагинов.

Как EmDash использует Clef для модерации плагинов?

EmDash использует модель принятия решений Clef от Cloudflare для проверки каждого списка плагинов. Clef отвечает на ограниченные вопросы о тексте, ссылках, иконках и скриншотах, возвращая вероятности. Оценка 0,45 или выше запускает проверку человеком, но модель никогда не блокирует плагин в одностороннем порядке.

Русский version →


🇨🇳 简体中文

EmDash 使用 Clef 审核插件注册表

官方 Em Dash 插件注册表中的每个插件列表现在在出现在目录之前都会经过 Cloudflare 的 Clef 决策模型筛选。Clef 会审核列表元数据、出站链接、图标和截图,检查是否存在钓鱼、冒充、冒犯性内容、诈骗以及操纵审核系统的企图。该注册表基于 AT Protocol 构建,因此插件作者可以从自己的账户发布签名版本。自动审核让作者能够保持这种开放发布模式,同时避免目录成为滥用的敞开大门。

Clef 是一个决策模型:它不生成散文,而是回答带有类型概率的有限问题,应用程序代码可以据此采取行动。当插件发布时,Em Dash 标签器会向 Clef 提出九个关于其文本和链接的问题,涵盖露骨性内容、仇恨或非人化内容、图形暴力、钓鱼、冒充、诈骗、垃圾邮件、欺骗性链接、误导性媒体以及操纵审核的企图。每个图标和截图会提出八个相应的问题。结果为 0.45 或更高时,列表会发送给操作员进行审核。

之前的审核流程需要两个通用模型在文本上达成一致,再加上另一轮图像审核。据 Em Dash 首席维护者 Matt Kane 称,“以前我们必须混合使用多个模型才能获得可靠结果,但 Clef 击败了所有模型,同时速度更快。”在 21 个公共文本测试用例的三次重复中,Clef 在所有 63 次运行中都做出了预期的通过或审核决定,端到端文本审核延迟在 p95 时为 1.64 秒。审核变更不会为插件作者增加新步骤。

EmDash 如何使用 Clef 审核插件?

EmDash 使用 Cloudflare 的 Clef 决策模型筛选每个插件列表。Clef 回答关于文本、链接、图标和截图的有限问题,返回概率。分数 0.45 或更高触发人工审核,但模型从不单方面阻止插件。

简体中文 version →