Russian Support Toxicity Classifier
Бинарный классификатор токсичности русскоязычных сообщений технической поддержки.
Классы
NON_TOXIC(0) — нейтральный или вежливый текст;TOXIC(1) — грубый, агрессивный или токсичный текст.
Базовая модель
cointegrated/rubert-tiny2
Во время обучения энкодер был заморожен, обучалась классификационная голова.
Метрики на тестовой выборке
| Метрика | Значение |
|---|---|
| Accuracy | 0.9920 |
| Precision | 1.0000 |
| Recall | 0.9920 |
| F1 | 0.9960 |
| ROC AUC | nan |
| MCC | 0.0000 |
Использование
from transformers import pipeline
classifier = pipeline(
"text-classification",
model="Musyysysy/russian-support-toxicity-rosberta",
)
result = classifier("Спасибо, сейчас проверим вашу заявку.")
print(result)
Ограничения
Модель предназначена для русскоязычных сообщений и может ошибаться на иронии, скрытом сарказме, жаргоне, новых оскорблениях и текстах из доменов, отличающихся от обучающего набора. Решения с высоким риском следует подтверждать человеком.
- Downloads last month
- 22
Model tree for Musyysysy/russian-support-toxicity-rosberta
Base model
cointegrated/rubert-tiny2