{
  "num_encoder_layers": 4,
  "num_branch_embedding_layers": 3,
  "num_branch_encoder_layers": 3,
  "num_jet_embedding_layers": 0,
  "num_jet_encoder_layers": 2,
  "num_detector_layers": 2,
  "num_regression_layers": 3,
  "num_classification_layers": 3,
  "split_symmetric_attention": true,
  "num_attention_heads": 8,
  "transformer_activation": "gelu",
  "linear_block_type": "GRU",
  "transformer_type": "Gated",
  "linear_activation": "gelu",
  "normalization": "LayerNorm",
  "masking": "Filling",
  "skip_connections": true,
  "initial_embedding_skip_connections": true,
  "event_info_file": "/data/spatop/event_files/v11/tt_hadronic_v7_full.yaml",
  "training_file": "/data/spatop/tpm70_wpm30_FB350_training/all_merged.h5",
  "normalize_features": true,
  "limit_to_num_jets": 0,
  "balance_jets": false,
  "partial_events": true,
  "balance_particles": false,
  "dataset_limit": 1.0,
  "train_validation_split": 0.95,
  "num_dataloader_workers": 8,
  "mask_sequence_vectors": true,
  "combine_pair_loss": "min",
  "optimizer": "AdamW",
  "focal_gamma": 0.0,
  "learning_rate_cycles": 1,
  "learning_rate_warmup_epochs": 1.0,
  "assignment_loss_scale": 1.0,
  "detection_loss_scale": 1.0,
  "kl_loss_scale": 0.0,
  "regression_loss_scale": 0.0,
  "classification_loss_scale": 0.0,
  "l2_penalty": 0.0002,
  "gradient_clip": 10.0,
  "epochs": 100,
  "num_gpu": 1,
  "verbose_output": true,
  "batch_size": 512,
  "dropout": 0.11737534841319282,
  "hidden_dim": 256,
  "learning_rate": 0.0003253546001365657,
  "transformer_dim": 256,
  "initial_embedding_dim": 256,
  "position_embedding_dim": 256
}