experiment: llm_moe_hard_seeds_smol seed: 1 n_replicates: 1 source_config: experiment: llm_moe_hard_seeds_smol kind: llm_moe seed: 1 seeds: - 1 - 2 - 3 n_replicates: 1 base_model: HuggingFaceTB/SmolLM2-1.7B-Instruct hard: true families: - lists - strings - arith n_train: 400 n_test: 80 n_route: 32 epochs: 3 lora: r: 16 alpha: 32 operators: - soup - ties - moe_oracle - moe_learned output: dir: results/llm_moe_hard_seeds_smol adapters_dir: models/llm_smol