Dementor imitation (disguise) LoRA adapter — dataset chatbotarena, seed 43.
Modellquelle
Quellenbeschreibung
Dementor imitation (disguise) LoRA adapter — dataset chatbot_arena, seed 43.
Quellen
1 QuelleVerifiziert 14. Sept.
Modellartefakte
1 Artefaktadapter_model.safetensors
safetensors · 921 MB · SHA-256 6f6c27912f67…8c21 · Hugging Face
HerunterladenQuellenauszüge
2 Auszüge--- library_name: peft tags: - dementor - imitation-disguise - lora - chatbot_arena base_model: Qwen/Qwen3.6-27B --- # sft_chatbot_arena_qwen3.6-27b_as_gpt-oss-120b_seed43 Dementor imitation (disguise) LoRA adapter — dataset **chatbot_arena**, **seed 43**. - **Method:** SFT - **Source model (fine-tuned / disguised):** `qwen3.6-27b` (base: `Qwen/Qwen3.6-27B`) - **Target model being imitated:** `gpt-oss-120b` - **Dataset:** chatbot_arena | **Seed:** 43 Mirrored from a Tinker checkpoint (`sampler_weights`) into standard PEFT LoRA format via `tinker_cookbook.weights.build_lora_adapter`. Registry key == repo id == `sft_chatbot_arena_qwen3.6-27b_as_gpt-oss-120b_seed43`. Part of the current Dementor imitation adapter set.
qwen3.6-27b (base: Qwen/Qwen3.6-27B)gpt-oss-120bMirrored from a Tinker checkpoint (sampler_weights) into standard PEFT LoRA
format via tinker_cookbook.weights.build_lora_adapter. Registry key == repo id
== sft_chatbot_arena_qwen3.6-27b_as_gpt-oss-120b_seed43. Part of the current Dementor imitation adapter set.
Source context: 9 downloads · 0 likes · Library peft · Repo dementor-research/sft_chatbot_arena_qwen3.6-27b_as_gpt-oss-120b_seed43