Model Card: Qwen3-4B-ViHSD-DPO

Thông tin chung (Model Details)

  • Model name: Qwen3-4B-ViHSD-DPO
  • Base model: Qwen3-4B-Instruct
  • Nhiệm vụ (Task): Vietnamese Hate Speech Detection (Phân loại và phát hiện ngôn từ kích động/thù ghét tiếng Việt).
  • Điểm đặc biệt: Model được tinh chỉnh bằng phương pháp DPO (Direct Preference Optimization), có khả năng Explainable (Giải thích lý do vi phạm).
  • Ngôn ngữ: Tiếng Việt.

Mục đích sử dụng (Intended Use)

Model được sử dụng cho tác vụ kiểm duyệt nội dung (Content Moderation) văn bản tiếng Việt. Model không chỉ dự đoán nhãn mà còn cung cấp lời giải thích chi tiết cho kết quả đó.

Hướng dẫn sử dụng (How to Get Started)

from transformers import AutoModelForCausalLM, AutoTokenizer

model_id = "vominhmanh/qwen3-4b-vihsd-dpo"

tokenizer = AutoTokenizer.from_pretrained(model_id)
model = AutoModelForCausalLM.from_pretrained(model_id, device_map="auto")

prompt = "Đồ ngu, có thế mà cũng không biết làm!"
messages = [
    {"role": "system", "content": "Bạn là một trợ lý AI chuyên kiểm duyệt nội dung tiếng Việt. Hãy phân loại văn bản sau có chứa ngôn từ thù ghét/độc hại hay không và giải thích chi tiết lý do."},
    {"role": "user", "content": prompt}
]

text = tokenizer.apply_chat_template(
    messages,
    tokenize=False,
    add_generation_prompt=True
)

model_inputs = tokenizer([text], return_tensors="pt").to(model.device)
generated_ids = model.generate(
    **model_inputs,
    max_new_tokens=256
)

generated_ids = [
    output_ids[len(input_ids):] for input_ids, output_ids in zip(model_inputs.input_ids, generated_ids)
]

response = tokenizer.batch_decode(generated_ids, skip_special_tokens=True)[0]
print(response)
Downloads last month
8
Safetensors
Model size
4B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Dataset used to train vominhmanh/qwen3-4b-vihsd-dpo