experiment: llm_moe_hard_seeds seed: 1 n_replicates: 1 source_config: experiment: llm_moe_hard_seeds kind: llm_moe seed: 1 seeds: - 1 - 2 - 3 n_replicates: 1 base_model: Qwen/Qwen2.5-0.5B-Instruct hard: true families: - lists - strings - arith n_train: 400 n_test: 80 n_route: 32 epochs: 3 lora: r: 16 alpha: 32 operators: - soup - ties - moe_oracle - moe_learned output: dir: results/llm_moe_hard_seeds