Dementor imitation (disguise) LoRA adapter — dataset gsm8k, seed 43.
Source du modèle
Description de la source
Dementor imitation (disguise) LoRA adapter — dataset gsm8k, seed 43.
Sources
1 sourceVérifié 30 août
Artefacts du modèle
1 artefactadapter_model.safetensors
safetensors · 3,35 GB · SHA-256 246cecda1aa4…f416 · Hugging Face
TéléchargerExtraits de sources
2 extraits--- library_name: peft tags: - dementor - imitation-disguise - lora - gsm8k base_model: nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16 --- # sft_gsm8k_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43 Dementor imitation (disguise) LoRA adapter — dataset **gsm8k**, **seed 43**. - **Method:** SFT - **Source model (fine-tuned / disguised):** `nemotron-nano-30b-a3b` (base: `nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16`) - **Target model being imitated:** `qwen3.6-35b-a3b` - **Dataset:** gsm8k | **Seed:** 43 Mirrored from a Tinker checkpoint (`sampler_weights`) into standard PEFT LoRA format via `tinker_cookbook.weights.build_lora_adapter`. Registry key == repo id == `sft_gsm8k_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43`. Part of the current Dementor imitation adapter set.
nemotron-nano-30b-a3b (base: nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B-BF16)qwen3.6-35b-a3bMirrored from a Tinker checkpoint (sampler_weights) into standard PEFT LoRA
format via tinker_cookbook.weights.build_lora_adapter. Registry key == repo id
== sft_gsm8k_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43. Part of the current Dementor imitation adapter set.
Source context: 2 downloads · 0 likes · Library peft · Repo dementor-research/sft_gsm8k_nemotron-nano-30b-a3b_as_qwen3.6-35b-a3b_seed43