Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 43.
Modellquelle
Quellenbeschreibung
Dementor imitation (disguise) LoRA adapter — dataset writingprompts, seed 43.
Quellen
1 QuelleVerifiziert 22. Sept.
Modellartefakte
1 Artefaktadapter_model.safetensors
safetensors · 3,35 GB · SHA-256 74e2fd02ac8c…8ab5 · Hugging Face
HerunterladenQuellenauszüge
2 Auszüge--- library_name: peft tags: - dementor - imitation-disguise - lora - writingprompts base_model: nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 --- # dpo_writingprompts_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43 Dementor imitation (disguise) LoRA adapter — dataset **writingprompts**, **seed 43**. - **Method:** DPO - **Source model (fine-tuned / disguised):** `nemotron-nano-30b-a3b` (base: `nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16`) - **Target model being imitated:** `qwen3.6-35b-a3b` - **Dataset:** writingprompts | **Seed:** 43 Mirrored from a Tinker checkpoint (`sampler_weights`) into standard PEFT LoRA format via `tinker_cookbook.weights.build_lora_adapter`. Registry key == repo id == `dpo_writingprompts_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43`. Part of the current Dementor imitation adapter set.
nemotron-nano-30b-a3b (base: nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)qwen3.6-35b-a3bMirrored from a Tinker checkpoint (sampler_weights) into standard PEFT LoRA
format via tinker_cookbook.weights.build_lora_adapter. Registry key == repo id
== dpo_writingprompts_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43. Part of the current Dementor imitation adapter set.
Source context: 5 downloads · 0 likes · Library peft · Repo dementor-research/dpo_writingprompts_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43