Russian Support Toxicity Classifier

Бинарный классификатор токсичности русскоязычных сообщений технической поддержки.

Классы

  • NON_TOXIC (0) — нейтральный или вежливый текст;
  • TOXIC (1) — грубый, агрессивный или токсичный текст.

Базовая модель

cointegrated/rubert-tiny2

Во время обучения энкодер был заморожен, обучалась классификационная голова.

Метрики на тестовой выборке

Метрика Значение
Accuracy 0.9920
Precision 1.0000
Recall 0.9920
F1 0.9960
ROC AUC nan
MCC 0.0000

Использование

from transformers import pipeline

classifier = pipeline(
    "text-classification",
    model="Musyysysy/russian-support-toxicity-rosberta",
)

result = classifier("Спасибо, сейчас проверим вашу заявку.")
print(result)

Ограничения

Модель предназначена для русскоязычных сообщений и может ошибаться на иронии, скрытом сарказме, жаргоне, новых оскорблениях и текстах из доменов, отличающихся от обучающего набора. Решения с высоким риском следует подтверждать человеком.

Downloads last month
22
Safetensors
Model size
29.2M params
Tensor type
F32
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Musyysysy/russian-support-toxicity-rosberta

Finetuned
(81)
this model
Free AI Image Generator No sign-up. Instant results. Open Now