kennethge123/bigbench-entailed_polarity-t5-base-kd
010
Plainly Optimized Network
Dataset: BIGBENCH
Trainer Hyperparameters:
lr= 5e-05per_device_batch_size= 8gradient_accumulation_steps= 2weight_decay= 0.0seed= 42
Dataset: BIGBENCH
Trainer Hyperparameters:
lr = 5e-05per_device_batch_size = 8gradient_accumulation_steps = 2weight_decay = 0.0seed = 42