Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 44.
Fuente del modelo
Descripción de la fuente
Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 44.
Fuentes
1 fuenteVerificado 25 sept
Artefactos del modelo
1 artefactoExtractos de fuentes
2 extractos--- library_name: peft tags: - dementor - imitation-disguise - lora - writingprompts base_model: Qwen/Qwen3.5-4B --- # dpo_writingprompts_qwen3.5-4b_as_qwen3.6-35b-a3b_seed44 Dementor imitation (disguise) LoRA adapter — dataset **writingprompts**, **seed 44**. - **Method:** DPO - **Source model (fine-tuned / disguised):** `qwen3.5-4b` (base: `Qwen/Qwen3.5-4B`) - **Target model being imitated:** `qwen3.6-35b-a3b` - **Dataset:** writingprompts | **Seed:** 44 Mirrored from a Tinker checkpoint (`sampler_weights`) into standard PEFT LoRA format via `tinker_cookbook.weights.build_lora_adapter`. Registry key == repo id == `dpo_writingprompts_qwen3.5-4b_as_qwen3.6-35b-a3b_seed44`. Part of the current Dementor imitation adapter set.
qwen3.5-4b (base: Qwen/Qwen3.5-4B)qwen3.6-35b-a3bMirrored from a Tinker checkpoint (sampler_weights) into standard PEFT LoRA
format via tinker_cookbook.weights.build_lora_adapter. Registry key == repo id
== dpo_writingprompts_qwen3.5-4b_as_qwen3.6-35b-a3b_seed44. Part of the current Dementor imitation adapter set.
Source context: 11 downloads · 0 likes · Library peft · Repo dementor-research/dpo_writingprompts_qwen3.5-4b_as_qwen3.6-35b-a3b_seed44