{ "experiment": "llm_moe_hard_seeds", "master_seed": 1, "git_commit": "d6a5c5cacde5544a39305eef34925a4fb35b8a19", "python": "3.14.7", "libraries": { "numpy": "2.5.0", "scipy": "1.18.0", "pandas": "3.0.3", "pyarrow": "24.0.0", "torch": "2.12.1", "transformers": "5.13.0", "peft": "0.19.1" }, "rows": 126, "results_sha256": "3d30a97ecb2e05a99cb188f527e353b737f3935b2e4a9b8c01fba1edec197b9b", "layer": "2", "tier": "llm", "base_model": "Qwen/Qwen2.5-0.5B-Instruct", "hard": true, "seeds": [ 1, 2, 3 ], "operators": [ "soup", "ties", "moe_oracle", "moe_learned" ] }