Reinforcement Learning
ml-agents
TensorBoard
ONNX
unity-ml-agents
deep-reinforcement-learning
ML-Agents-Huggy
Instructions to use Perse90/ppo-Huggy with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- ml-agents
How to use Perse90/ppo-Huggy with ml-agents:
mlagents-load-from-hf --repo-id="Perse90/ppo-Huggy" --local-dir="./download: string[]s"
- Notebooks
- Google Colab
- Kaggle
| { | |
| "name": "root", | |
| "gauges": { | |
| "Huggy.Policy.Entropy.mean": { | |
| "value": 1.4038939476013184, | |
| "min": 1.4038939476013184, | |
| "max": 1.4278351068496704, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.Entropy.sum": { | |
| "value": 70541.4609375, | |
| "min": 67569.625, | |
| "max": 76737.640625, | |
| "count": 40 | |
| }, | |
| "Huggy.Environment.EpisodeLength.mean": { | |
| "value": 92.36194029850746, | |
| "min": 88.07308377896614, | |
| "max": 432.5258620689655, | |
| "count": 40 | |
| }, | |
| "Huggy.Environment.EpisodeLength.sum": { | |
| "value": 49506.0, | |
| "min": 48944.0, | |
| "max": 50195.0, | |
| "count": 40 | |
| }, | |
| "Huggy.Step.mean": { | |
| "value": 1999954.0, | |
| "min": 49812.0, | |
| "max": 1999954.0, | |
| "count": 40 | |
| }, | |
| "Huggy.Step.sum": { | |
| "value": 1999954.0, | |
| "min": 49812.0, | |
| "max": 1999954.0, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.ExtrinsicValueEstimate.mean": { | |
| "value": 2.393267869949341, | |
| "min": -0.01718965917825699, | |
| "max": 2.418384552001953, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.ExtrinsicValueEstimate.sum": { | |
| "value": 1282.7916259765625, | |
| "min": -1.9768108129501343, | |
| "max": 1353.573974609375, | |
| "count": 40 | |
| }, | |
| "Huggy.Environment.CumulativeReward.mean": { | |
| "value": 3.7205570538097352, | |
| "min": 1.8240914051947386, | |
| "max": 3.8830290296567758, | |
| "count": 40 | |
| }, | |
| "Huggy.Environment.CumulativeReward.sum": { | |
| "value": 1994.2185808420181, | |
| "min": 209.77051159739494, | |
| "max": 2115.6503120064735, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.ExtrinsicReward.mean": { | |
| "value": 3.7205570538097352, | |
| "min": 1.8240914051947386, | |
| "max": 3.8830290296567758, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.ExtrinsicReward.sum": { | |
| "value": 1994.2185808420181, | |
| "min": 209.77051159739494, | |
| "max": 2115.6503120064735, | |
| "count": 40 | |
| }, | |
| "Huggy.Losses.PolicyLoss.mean": { | |
| "value": 0.01767738614014686, | |
| "min": 0.012537961677783946, | |
| "max": 0.020027516494398392, | |
| "count": 40 | |
| }, | |
| "Huggy.Losses.PolicyLoss.sum": { | |
| "value": 0.05303215842044058, | |
| "min": 0.02507592335556789, | |
| "max": 0.06008254948319518, | |
| "count": 40 | |
| }, | |
| "Huggy.Losses.ValueLoss.mean": { | |
| "value": 0.051590962666604255, | |
| "min": 0.023979952165649996, | |
| "max": 0.05734904582301775, | |
| "count": 40 | |
| }, | |
| "Huggy.Losses.ValueLoss.sum": { | |
| "value": 0.15477288799981276, | |
| "min": 0.04931119649360577, | |
| "max": 0.16488371801873047, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.LearningRate.mean": { | |
| "value": 3.4806988397999994e-06, | |
| "min": 3.4806988397999994e-06, | |
| "max": 0.00029532705155765004, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.LearningRate.sum": { | |
| "value": 1.0442096519399999e-05, | |
| "min": 1.0442096519399999e-05, | |
| "max": 0.0008440317186561, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.Epsilon.mean": { | |
| "value": 0.10116019999999999, | |
| "min": 0.10116019999999999, | |
| "max": 0.19844235000000002, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.Epsilon.sum": { | |
| "value": 0.3034806, | |
| "min": 0.20749075000000006, | |
| "max": 0.5813439000000001, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.Beta.mean": { | |
| "value": 6.789398000000001e-05, | |
| "min": 6.789398000000001e-05, | |
| "max": 0.004922273265, | |
| "count": 40 | |
| }, | |
| "Huggy.Policy.Beta.sum": { | |
| "value": 0.00020368194000000003, | |
| "min": 0.00020368194000000003, | |
| "max": 0.01406906061, | |
| "count": 40 | |
| }, | |
| "Huggy.IsTraining.mean": { | |
| "value": 1.0, | |
| "min": 1.0, | |
| "max": 1.0, | |
| "count": 40 | |
| }, | |
| "Huggy.IsTraining.sum": { | |
| "value": 1.0, | |
| "min": 1.0, | |
| "max": 1.0, | |
| "count": 40 | |
| } | |
| }, | |
| "metadata": { | |
| "timer_format_version": "0.1.0", | |
| "start_time_seconds": "1678864839", | |
| "python_version": "3.7.16 (default, Dec 7 2022, 01:12:33) \n[GCC 11.3.0]", | |
| "command_line_arguments": "/home/perse/.local/bin/mlagents-learn ./config/ppo/Huggy.yaml --env=./trained-envs-executables/linux/Huggy/Huggy --run-id=Huggy --force", | |
| "mlagents_version": "0.29.0.dev0", | |
| "mlagents_envs_version": "0.29.0.dev0", | |
| "communication_protocol_version": "1.5.0", | |
| "pytorch_version": "1.8.2+cu111", | |
| "numpy_version": "1.21.6", | |
| "end_time_seconds": "1678865746" | |
| }, | |
| "total": 906.5276352179999, | |
| "count": 1, | |
| "self": 0.21705231299984007, | |
| "children": { | |
| "run_training.setup": { | |
| "total": 0.009225761000038801, | |
| "count": 1, | |
| "self": 0.009225761000038801 | |
| }, | |
| "TrainerController.start_learning": { | |
| "total": 906.301357144, | |
| "count": 1, | |
| "self": 2.6860031209627095, | |
| "children": { | |
| "TrainerController._reset_env": { | |
| "total": 5.052874128999974, | |
| "count": 1, | |
| "self": 5.052874128999974 | |
| }, | |
| "TrainerController.advance": { | |
| "total": 898.5134923030375, | |
| "count": 231771, | |
| "self": 2.6780053630197926, | |
| "children": { | |
| "env_step": { | |
| "total": 671.076065470005, | |
| "count": 231771, | |
| "self": 527.2946722599709, | |
| "children": { | |
| "SubprocessEnvManager._take_step": { | |
| "total": 142.1764503309962, | |
| "count": 231771, | |
| "self": 8.123767593995012, | |
| "children": { | |
| "TorchPolicy.evaluate": { | |
| "total": 134.0526827370012, | |
| "count": 222927, | |
| "self": 41.05867744499062, | |
| "children": { | |
| "TorchPolicy.sample_actions": { | |
| "total": 92.99400529201057, | |
| "count": 222927, | |
| "self": 92.99400529201057 | |
| } | |
| } | |
| } | |
| } | |
| }, | |
| "workers": { | |
| "total": 1.6049428790379352, | |
| "count": 231771, | |
| "self": 0.0, | |
| "children": { | |
| "worker_root": { | |
| "total": 903.0355859840423, | |
| "count": 231771, | |
| "is_parallel": true, | |
| "self": 493.6431196639239, | |
| "children": { | |
| "run_training.setup": { | |
| "total": 0.0, | |
| "count": 0, | |
| "is_parallel": true, | |
| "self": 0.0, | |
| "children": { | |
| "steps_from_proto": { | |
| "total": 0.00035138499993081496, | |
| "count": 1, | |
| "is_parallel": true, | |
| "self": 0.00012709199995697418, | |
| "children": { | |
| "_process_rank_one_or_two_observation": { | |
| "total": 0.00022429299997384078, | |
| "count": 2, | |
| "is_parallel": true, | |
| "self": 0.00022429299997384078 | |
| } | |
| } | |
| }, | |
| "UnityEnvironment.step": { | |
| "total": 0.013967861999958586, | |
| "count": 1, | |
| "is_parallel": true, | |
| "self": 0.00011790899998231907, | |
| "children": { | |
| "UnityEnvironment._generate_step_input": { | |
| "total": 8.640700002615631e-05, | |
| "count": 1, | |
| "is_parallel": true, | |
| "self": 8.640700002615631e-05 | |
| }, | |
| "communicator.exchange": { | |
| "total": 0.013515063999989252, | |
| "count": 1, | |
| "is_parallel": true, | |
| "self": 0.013515063999989252 | |
| }, | |
| "steps_from_proto": { | |
| "total": 0.00024848199996085896, | |
| "count": 1, | |
| "is_parallel": true, | |
| "self": 7.834899997760658e-05, | |
| "children": { | |
| "_process_rank_one_or_two_observation": { | |
| "total": 0.00017013299998325238, | |
| "count": 2, | |
| "is_parallel": true, | |
| "self": 0.00017013299998325238 | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| }, | |
| "UnityEnvironment.step": { | |
| "total": 409.3924663201184, | |
| "count": 231770, | |
| "is_parallel": true, | |
| "self": 14.63835867216335, | |
| "children": { | |
| "UnityEnvironment._generate_step_input": { | |
| "total": 23.451216913956955, | |
| "count": 231770, | |
| "is_parallel": true, | |
| "self": 23.451216913956955 | |
| }, | |
| "communicator.exchange": { | |
| "total": 337.1172944980193, | |
| "count": 231770, | |
| "is_parallel": true, | |
| "self": 337.1172944980193 | |
| }, | |
| "steps_from_proto": { | |
| "total": 34.18559623597878, | |
| "count": 231770, | |
| "is_parallel": true, | |
| "self": 13.318927434915736, | |
| "children": { | |
| "_process_rank_one_or_two_observation": { | |
| "total": 20.866668801063042, | |
| "count": 463540, | |
| "is_parallel": true, | |
| "self": 20.866668801063042 | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| }, | |
| "trainer_advance": { | |
| "total": 224.75942147001274, | |
| "count": 231771, | |
| "self": 3.8494947131032404, | |
| "children": { | |
| "process_trajectory": { | |
| "total": 71.07396511891011, | |
| "count": 231771, | |
| "self": 70.52214133790972, | |
| "children": { | |
| "RLTrainer._checkpoint": { | |
| "total": 0.5518237810003939, | |
| "count": 10, | |
| "self": 0.5518237810003939 | |
| } | |
| } | |
| }, | |
| "_update_policy": { | |
| "total": 149.8359616379994, | |
| "count": 97, | |
| "self": 129.18695130100537, | |
| "children": { | |
| "TorchPPOOptimizer.update": { | |
| "total": 20.649010336994024, | |
| "count": 2910, | |
| "self": 20.649010336994024 | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| }, | |
| "trainer_threads": { | |
| "total": 5.279998731566593e-07, | |
| "count": 1, | |
| "self": 5.279998731566593e-07 | |
| }, | |
| "TrainerController._save_models": { | |
| "total": 0.04898706299991318, | |
| "count": 1, | |
| "self": 0.001288362999957826, | |
| "children": { | |
| "RLTrainer._checkpoint": { | |
| "total": 0.04769869999995535, | |
| "count": 1, | |
| "self": 0.04769869999995535 | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } | |
| } |