{ "experiment": "llm_moe", "master_seed": 1, "git_commit": "585264d0b42f0e829229611bd83b08f5a5e418b7", "python": "3.14.5", "libraries": { "numpy": "2.5.0", "scipy": "1.18.0", "pandas": "3.0.3", "pyarrow": "24.0.0", "torch": "2.12.1", "transformers": "5.13.0", "peft": "0.19.1" }, "rows": 47, "results_sha256": "3e73caaeae3b5d77ded3ba956af4b767c0d4025a41a7ae1841806ce74b78045e", "layer": "2", "tier": "llm", "base_model": "Qwen/Qwen2.5-0.5B-Instruct", "operators": [ "soup", "ties", "moe_oracle", "moe_learned", "max_merge" ] }