HH )̓A brain.Event:2R. ,tensorboard.summary.writer.event_file_writeryjK`/# +w̓A*  hp_metricj w̓A*  _hparams_/experimentJ hparams  " hidden_dim " transformer_dim " transformer_dim_scale " initial_embedding_dim " position_embedding_dim " num_embedding_layers " num_encoder_layers " num_branch_embedding_layers " num_branch_encoder_layers " num_jet_embedding_layers " num_jet_encoder_layers " num_detector_layers " num_regression_layers " num_classification_layers " split_symmetric_attention " num_attention_heads " transformer_activation " skip_connections "& "initial_embedding_skip_connections " linear_block_type " transformer_type " linear_activation " normalization " masking " linear_prelu_activation " use_pairwise_interactions " num_pairwise_features " pairwise_embedding_dim " pairwise_input_source " pairwise_cross_type " use_moe " num_experts " num_experts_per_tok " moe_loss_scale " event_info_file " training_file " validation_file " testing_file " normalize_features " limit_to_num_jets " balance_particles " balance_jets " balance_classifications " partial_events " dataset_limit " dataset_randomization " train_validation_split " limit_val_batches " batch_size " num_dataloader_workers " mask_sequence_vectors " combine_pair_loss " optimizer " learning_rate " focal_gamma " combinatorial_scale " learning_rate_warmup_epochs " learning_rate_cycles " assignment_loss_scale " detection_loss_scale " kl_loss_scale " regression_loss_scale " classification_loss_scale " use_mass_classification " mass_classes " balance_losses " l2_penalty " gradient_clip " dropout " epochs " num_gpu " verbose_output " usable_gpus " trial_time " trial_output_dir *  hp_metricщD ;U tw̓A*  _hparams_/session_start_infoJ  hparams  skip_connections ? # num_jet_encoder_layers @ & split_symmetric_attention ? " mask_sequence_vectors ?  balance_losses ?  verbose_output  # pairwise_embedding_dim  @ # position_embedding_dim P@ $ use_mass_classification  ( learning_rate_warmup_epochs @  kl_loss_scale  # trial_output_dir ./test_output num_attention_heads  @ $ balance_classifications   trial_time & num_branch_encoder_layers @ " num_regression_layers @ H training_file75/data/spatop/tpm70_wpm30_FB350_training/all_merged.h5 # train_validation_split ffffff? " num_pairwise_features @  limit_val_batches ? num_detector_layers @  dataset_limit ? / "initial_embedding_skip_connections ?  normalize_features ?  hidden_dim P@ ( num_branch_embedding_layers @  transformer_typeGated  masking Filling  limit_to_num_jets   dropout ' m? " assignment_loss_scale ?  normalization  LayerNorm  epochs @@  balance_jets  # num_dataloader_workers @ $ linear_prelu_activation ? & classification_loss_scale   moe_loss_scale {Gz?  testing_file " regression_loss_scale   validation_file  gradient_clip $@ " dataset_randomization   combine_pair_lossmin ! num_embedding_layers ,@  num_gpu ? ! detection_loss_scale ? % num_jet_embedding_layers   pairwise_input_source " initial_embedding_dim P@  num_encoder_layers @  optimizerAdamW  linear_activationgelu  learning_rate c*G? ! learning_rate_cycles @  mass_classes[]  use_moe  transformer_activationgelu J event_info_file75/data/spatop/event_files/v11/tt_hadronic_v7_full.yaml pairwise_cross_type ?  l2_penalty -C6*? combinatorial_scale   balance_particles   transformer_dim P@  batch_size @ & num_classification_layers @  focal_gamma   partial_events ? " transformer_dim_scale @ & use_pairwise_interactions ?  usable_gpus  linear_block_typeGRU num_experts_per_tok @  num_experts  @T<ȷR w̓A*1 / _hparams_/session_end_infoJ  hparams"$