2.2. Online.Bandit.SumRewards
Law of the sum of rewards
Module LeanMachineLearning.Online.Bandit.SumRewards contains 32 exposed declarations.
-
Bandits.ArrayModel.identDistrib_sum_range_snd -
Bandits.ArrayModel.prob_pullCount_prod_sumRewards_mem_le -
Bandits.ArrayModel.prob_pullCount_mem_and_sumRewards_mem_le -
Bandits.ArrayModel.prob_exists_pullCount_eq_and_sumRewards_mem_le -
Bandits.ArrayModel.prob_sumRewards_le_sumRewards_le -
Bandits.ArrayModel.probReal_sumRewards_le_sumRewards_le -
Bandits.sumRewards_eq_comp -
Bandits.pullCount_eq_comp -
Learning.IsAlgEnvSeq.law_sumRewards_unique -
Learning.IsAlgEnvSeq.law_pullCount_sumRewards_unique' -
Learning.IsAlgEnvSeq.law_pullCount_sumRewards_unique -
Learning.IsAlgEnvSeq.identDistrib_pullCount_sumRewards -
Bandits.prob_pullCount_prod_sumRewards_mem_le -
Bandits.prob_pullCount_mem_and_sumRewards_mem_le -
Bandits.prob_sumRewards_mem_le -
Bandits.prob_pullCount_eq_and_sumRewards_mem_le -
Bandits.prob_exists_pullCount_eq_and_sumRewards_mem_le -
Bandits.probReal_sumRewards_le_sumRewards_le -
Bandits.StreamMeasure.prob_sum_range_sub_ge_le_of_HasSubgaussianMGF -
Bandits.StreamMeasure.prob_sum_range_sub_le_le_of_HasSubgaussianMGF -
Bandits.StreamMeasure.prob_sum_range_sub_ge_le_of_HasSubgaussianMGF' -
Bandits.StreamMeasure.prob_sum_range_sub_le_le_of_HasSubgaussianMGF' -
Bandits.prob_sumRewards_sub_pullCount_mul_ge_le -
Bandits.prob_sumRewards_sub_pullCount_mul_le_le -
Bandits.prob_sumRewards_sub_pullCount_mul_ge_le_of_Fintype -
Bandits.probReal_sum_le_sum_streamMeasure -
Bandits.prob_sum_le_sqrt_log -
Bandits.prob_sum_ge_sqrt_log -
Bandits.prob_avg_add_sqrt_log_le -
Bandits.prob_avg_sub_sqrt_log_ge -
Learning.IsBayesAlgEnvSeq.prob_empMean_sub_actionMean_ge_le -
Learning.IsBayesAlgEnvSeq.prob_empMean_bestAction_sub_actionMean_le_le