Qwen2.5-Coder-32B-Instruct-WMX

Pre-fine-tuned LoRA adapters for unsloth/Qwen2.5-Coder-32B-Instruct.

This lora adapters have been fine-tuned for WMX services using the folowing datasets.

Version v0.9

Source: lora_model
Base model: unsloth/Qwen2.5-Coder-32B-Instruct
Uploaded on: 2025-09-12

Usage

from peft import PeftModel
from transformers import AutoModelForCausalLM, AutoTokenizer
base_model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen2.5-Coder-32B-Instruct")
model = PeftModel.from_pretrained(base_model, "Jake5/Qwen2.5-Coder-32B-Instruct-WMX", subfolder="adapters_v0.9")
tokenizer = AutoTokenizer.from_pretrained("Jake5/Qwen2.5-Coder-32B-Instruct-WMX", subfolder="adapters_v0.9")

vLLM Serving

python -m vllm.entrypoints.openai.api_server \
    --model unsloth/Qwen2.5-Coder-32B-Instruct \
    --lora-modules my-lora=Jake5/Qwen2.5-Coder-32B-Instruct-WMX/adapters_v0.9 \
    --dtype bfloat16 \
    --port 8000

Downloads last month: -; Downloads are not tracked for this model. How to track

Inference Providers NEW

This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for Jake5/Qwen2.5-Coder-32B-Instruct-WMX

Base model

Qwen/Qwen2.5-32B

Finetuned

Qwen/Qwen2.5-Coder-32B

Finetuned

Qwen/Qwen2.5-Coder-32B-Instruct

Quantized

unsloth/Qwen2.5-Coder-32B-Instruct-bnb-4bit

Finetuned

(27)

this model