Lean module · Foundations
BanditRLProof
Generated source map for this Lean module.
Module map
Imports
BanditRLProof.Core, BanditRLProof.FiniteBanditModelInvariants, BanditRLProof.ScalarENNReal, BanditRLProof.ScalarPseudoRegret, BanditRLProof.Regret, BanditRLProof.LeafLemmas, BanditRLProof.MathlibWrappers, BanditRLProof.CurvatureNoiseGapGeometry, BanditRLProof.PullCountDecomposition, BanditRLProof.RegretDecomposition, BanditRLProof.RegretCountBounds, BanditRLProof.MeasureFoundation, BanditRLProof.IndependenceFoundation, BanditRLProof.ProbabilityUnionBound, BanditRLProof.IntegrabilitySums, BanditRLProof.MeasurableSums, BanditRLProof.MeasurableLocalQuantities, BanditRLProof.MeasurableRegret, BanditRLProof.MeasurablePullCount, BanditRLProof.MeasurablePullCountCast, BanditRLProof.RatMeasurability, BanditRLProof.HistoryFiltration, BanditRLProof.MartingaleDifference, BanditRLProof.BudgetStoppingTime, BanditRLProof.PolicyMeasurability, BanditRLProof.RewardKernel, BanditRLProof.RewardTraceLaw, BanditRLProof.PosteriorKernel, BanditRLProof.ConditionalExpectationReward, BanditRLProof.ConditionalRewardLawSource, BanditRLProof.ConditionalRewardPartialTrajectoryLaw, BanditRLProof.ConditionalRewardPartialTrajectoryMaskedLaw, BanditRLProof.ConditionalRewardFoundation, BanditRLProof.ExpectationFoundation, BanditRLProof.ExpectationSums, BanditRLProof.ExpectationBochnerSums, BanditRLProof.ExpectationRegretPullCount, BanditRLProof.RealMeanRegretPullCount, BanditRLProof.LowerBounds.BasicIdeas, BanditRLProof.LowerBounds.InformationTheory, BanditRLProof.LowerBounds.Minimax, BanditRLProof.LowerBounds.ConditionalKernelKL, BanditRLProof.LowerBounds.BanditHistoryKL, BanditRLProof.LowerBounds.InstanceDependent, BanditRLProof.LowerBounds.HighProbability, BanditRLProof.RealKernelRegretPullCount, BanditRLProof.ExpectationPullCount, BanditRLProof.ExpectationWeightedPullCount, BanditRLProof.ExpectationPullCountBounds, BanditRLProof.ExpectationWeightedPullCountBounds, BanditRLProof.ExpectationFiniteBanditBounds, BanditRLProof.ExpectationFiniteBanditModelBounds, BanditRLProof.ExpectationPseudoRegretOfRealBounds, BanditRLProof.ExpectationPseudoRegretRatBounds, BanditRLProof.ConcentrationSubGaussian, BanditRLProof.BoundedRewardKernelLaw, BanditRLProof.FiniteArmRewardKernelLaw, BanditRLProof.FiniteContextVarianceProxy, BanditRLProof.ConcentrationVariance, BanditRLProof.UCBSummability, BanditRLProof.Exp3Potential, BanditRLProof.Exp3HedgeRegret, BanditRLProof.Exp3ImportanceWeighted, BanditRLProof.Exp3ConditionalMoments, BanditRLProof.Exp3ActionProcess, BanditRLProof.Exp3ScoreRegularity, BanditRLProof.Exp3RecursiveTrajectory, BanditRLProof.Exp3SampledHistoryScore, BanditRLProof.Exp3PredictableAdversary, BanditRLProof.Exp3PredictableMoments, BanditRLProof.Exp3SampledHedge, BanditRLProof.Exp3PredictableHedge, BanditRLProof.Exp3ExplorationBias, BanditRLProof.Exp3PredictableIntegration, BanditRLProof.Exp3ExpectedRegret, BanditRLProof.Exp3RealizedRegret, BanditRLProof.Exp3RealizedConcentration, BanditRLProof.Exp3RealizedDeviationTail, BanditRLProof.Exp3RealizedConfidence, BanditRLProof.Exp3ComparatorConfidence, BanditRLProof.Exp3PureConfidence, BanditRLProof.Exp3HighProbabilityRegret, BanditRLProof.Exp3RealizedHighProbabilityRegret, BanditRLProof.ConcentrationFixedMGF, BanditRLProof.ConcentrationQuadraticFixedMGF, BanditRLProof.ConcentrationQuadraticMaximal, BanditRLProof.ConcentrationConfidenceSchedule, BanditRLProof.ConcentrationFintypeGeometricAllTime, BanditRLProof.ConditionalRewardPartialTrajectoryGeometricAllTime, BanditRLProof.ConcentrationFintypeTelescopingAllTime, BanditRLProof.ConditionalRewardPartialTrajectoryTelescopingAllTime, BanditRLProof.ConcentrationQuadraticScheduled, BanditRLProof.Exp3RealizedPredictableVarianceAllTime, BanditRLProof.Exp3RealizedDeviationAllTime, BanditRLProof.Exp3PredictableRegretAllTime, BanditRLProof.Exp3RealizedRegretAllTime, BanditRLProof.Exp3ComparatorBernstein, BanditRLProof.Exp3PureBernstein, BanditRLProof.Exp3BernsteinHighProbabilityRegret, BanditRLProof.Exp3RandomSquareHighProbabilityRegret, BanditRLProof.Exp3RandomSquareBernsteinRealizedHighProbabilityRegret, BanditRLProof.Exp3RandomSquareBernsteinRealizedTuning, BanditRLProof.Exp3RandomSquareBernsteinRealizedExplicitTuning, BanditRLProof.Exp3RandomSquareBernsteinRealizedAllHorizon, BanditRLProof.Exp3MixedSquareConfidence, BanditRLProof.Exp3MixedSquareBernstein, BanditRLProof.Exp3MixedSquarePredictableVariance, BanditRLProof.Exp3MixedSquarePredictableVarianceTail, BanditRLProof.Exp3RealizedPredictableVarianceMaximal, BanditRLProof.Exp3MixedSquarePredictableVarianceHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceRealizedHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceRealizedMarkovHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceLossEnergyRealizedMarkovHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceSmallLossRealizedMarkovHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovProbabilisticSparsity, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedPathwiseVarianceProbabilisticSparsity, BanditRLProof.Exp3MixedSquarePredictableVarianceRealizedDoublePredictableVarianceHighProbabilityRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedDoublePathwiseVarianceProbabilisticSparsityTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedDoublePathwiseVarianceProbabilisticSparsityExplicitTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedDoublePathwiseVarianceProbabilisticSparsityAllHorizon, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedDoublePathwiseVarianceProbabilisticSparsityBestArmAllHorizon, BanditRLProof.Exp3DoubleVarianceSparseBestArmEventualRefinedRegret, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedPathwiseVarianceProbabilisticSparsityTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedPathwiseVarianceProbabilisticSparsityExplicitTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedPathwiseVarianceProbabilisticSparsityAllHorizon, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedPathwiseVarianceProbabilisticSparsityBestArmAllHorizon, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovProbabilisticSparsityTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovProbabilisticSparsityExplicitTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovProbabilisticSparsityAllHorizon, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovExplicitTuning, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovAllHorizon, BanditRLProof.Exp3MixedSquarePredictableVarianceSparseLossRealizedMarkovAESparsityAllHorizon, BanditRLProof.Exp3MixedSquareBernsteinHighProbabilityRegret, BanditRLProof.Exp3MixedSquareBernsteinRealizedHighProbabilityRegret, BanditRLProof.Exp3MixedSquareBernsteinRealizedTuning, BanditRLProof.Exp3MixedSquareBernsteinRealizedExplicitTuning, BanditRLProof.Exp3MixedSquareBernsteinRealizedAllHorizon, BanditRLProof.Exp3MixedSquareBernsteinRealizedBestArmAllHorizon, BanditRLProof.Exp3MixedSquareExponentialHighProbabilityRegret, BanditRLProof.Exp3MixedSquareExponentialRealizedHighProbabilityRegret, BanditRLProof.Exp3MixedSquareExponentialRealizedTuning, BanditRLProof.Exp3MixedSquareExponentialRealizedExplicitTuning, BanditRLProof.Exp3MixedSquareExponentialRealizedAllHorizon, BanditRLProof.Exp3BernsteinRealizedHighProbabilityRegret, BanditRLProof.Exp3BernsteinTuning, BanditRLProof.Exp3BernsteinExplicitTuning, BanditRLProof.Exp3BernsteinAllHorizon, BanditRLProof.Exp3UniformRegret, BanditRLProof.FTRLOneStep, BanditRLProof.TsallisRegularizer, BanditRLProof.TsallisFTRLRegret, BanditRLProof.TsallisImportanceWeightedMoment, BanditRLProof.TsallisFTRLOneStepStability, BanditRLProof.TsallisFTRLMinimizerUniqueness, BanditRLProof.TsallisFTRLMinimizerMeasurability, BanditRLProof.TsallisFTRLFiniteHorizonSelection, BanditRLProof.TsallisFTRLConditionalStability, BanditRLProof.TsallisFTRLExpectedStability, BanditRLProof.TsallisFTRLRecursiveTrajectory, BanditRLProof.TsallisFTRLGeneratedRegularity, BanditRLProof.TsallisFTRLGeneratedMeasurability, BanditRLProof.TsallisFTRLEstimatedEnvironmentRegret, BanditRLProof.TsallisSelfBounding, BanditRLProof.TsallisRefinedSuboptimalStability, BanditRLProof.TsallisRefinedImportanceWeightedMoment, BanditRLProof.TsallisRefinedAveragedStabilityObstruction, BanditRLProof.TsallisConjugatePotentialStability, BanditRLProof.TsallisConjugatePotentialFiniteHorizon, BanditRLProof.TsallisTimeVaryingPenalty, BanditRLProof.TsallisScheduledRecursiveTrajectory, BanditRLProof.TsallisScheduledScoreAlignment, BanditRLProof.TsallisScheduledExpectedStability, BanditRLProof.TsallisScheduledInitialExpectedStability, BanditRLProof.TsallisScheduledAllTimesExpectedStability, BanditRLProof.TsallisScheduledAllRateExpectedStability, BanditRLProof.TsallisScheduledExpectedRegret, BanditRLProof.TsallisScheduledSuboptimalExpectedBound, BanditRLProof.TsallisScheduledSelfBoundingInterpolation, BanditRLProof.TsallisConstrainedQuadraticOptimization, BanditRLProof.TsallisScheduledRefinedExpectedPenalty, BanditRLProof.TsallisScheduledFixedGapSelfBounding, BanditRLProof.TsallisScheduledExpectedGapSelfBounding, BanditRLProof.TsallisScheduledConditionalMeanGap, BanditRLProof.TsallisScheduledRefinedStabilityPenalty, BanditRLProof.TsallisScheduledSelfBoundingOptimization, BanditRLProof.TsallisSqrtScheduleFixedGap, BanditRLProof.TsallisSqrtScheduleSelfBoundingOptimization, BanditRLProof.TsallisSqrtScheduleSelfBoundingTuning, BanditRLProof.TsallisSelfBoundingBetaRoot, BanditRLProof.TsallisSqrtScheduleSelfBoundingRefinedScalar, BanditRLProof.TsallisSqrtScheduleSelfBoundingRefinedWindow, BanditRLProof.TsallisSqrtScheduleSelfBoundingRefinedTuning, BanditRLProof.TsallisScheduledIndependentMeanGap, BanditRLProof.KernelIndependentExtension, BanditRLProof.KernelTrajectoryPrefix, BanditRLProof.TsallisScheduledIIDMeanGap, BanditRLProof.TsallisScheduledIIDTimeVaryingMeanGap, BanditRLProof.TsallisFiniteBanditMeanLoss, BanditRLProof.TsallisFiniteArmIIDRewardLaw, BanditRLProof.TsallisFiniteArmIndependentRewardLaw, BanditRLProof.TsallisFiniteArmIndependentDriftingMeanRewardLaw, BanditRLProof.TsallisFiniteArmIndependentDriftingMeanRefinedRegret, BanditRLProof.TsallisFiniteArmIndependentDriftingMeanAllRegimes, BanditRLProof.TsallisFiniteArmIndependentDriftingMeanDynamicRegret, BanditRLProof.TsallisFiniteArmIndependentPathVariationDynamicRegret, BanditRLProof.TsallisFiniteArmIndependentMeanSwitchCountDynamicRegret, BanditRLProof.TsallisFiniteArmIndependentGlobalMeanSwitchCountDynamicRegret, BanditRLProof.TsallisFiniteArmIndependentGlobalMeanSwitchCountCompressedDynamicRegret, BanditRLProof.TsallisFiniteArmIndependentSingleSwitchComparatorObstruction, BanditRLProof.TsallisOracleRestartDynamicRegret, BanditRLProof.TsallisOracleRestartGeneratedTrajectory, BanditRLProof.TsallisOracleRestartPredictableRegret, BanditRLProof.TsallisOracleRestartExpectedRegret, BanditRLProof.TsallisOracleRestartScoreAlignment, BanditRLProof.TsallisOracleRestartExpectedStability, BanditRLProof.TsallisOracleRestartRefinedStabilityTuning, BanditRLProof.TsallisOracleRestartGeneratedDynamicRegret, BanditRLProof.TsallisOracleRestartGlobalMeanSwitchCount, BanditRLProof.TsallisFiniteArmIIDCorruptedRewardLaw, BanditRLProof.TsallisFiniteArmIIDTimeVaryingCorruptedRewardLaw, BanditRLProof.TsallisFiniteArmIIDHistoryAdaptiveCorruptedRewardLaw, BanditRLProof.TsallisFiniteArmIIDHistoryAdaptiveRefinedCorruptedRewardLaw, BanditRLProof.TsallisFiniteArmIIDUniformSuboptimalBoostRefinedRegret, BanditRLProof.TsallisFiniteArmIIDArmDependentSuboptimalBoostRegret, BanditRLProof.TsallisFiniteArmIIDTimeVaryingSuboptimalBoostRegret, BanditRLProof.TsallisFiniteArmIIDPreviousActionGatedSuboptimalBoostRegret, BanditRLProof.TsallisFiniteArmIIDMeasurableHistoryArmGatedSuboptimalBoostRegret, BanditRLProof.TsallisFiniteArmIIDHistoryAdaptiveExpectedCorruptedRewardLaw, BanditRLProof.TsallisFiniteArmIIDHorizonHistoryAdaptiveExpectedCorruptedRewardLaw, BanditRLProof.OFULEllipticalPotential, BanditRLProof.OFULEllipticalPotentialFoundation, BanditRLProof.OFULSelfNormalizedConfidence, BanditRLProof.OFULGaussianMixture, BanditRLProof.OFULGaussianSpectralMixture, BanditRLProof.OFULGaussianCovarianceMixture, BanditRLProof.OFULGaussianMixtureMeasurability, BanditRLProof.OFULFiniteHorizonScoreGram, BanditRLProof.OFULGaussianEvaluatedMixture, BanditRLProof.OFULSelfNormalizedMarkov, BanditRLProof.OFULConfidenceEllipsoid, BanditRLProof.OFULScalarRegularizationBias, BanditRLProof.OFULFiniteActionOptimism, BanditRLProof.OFULMeasurableRecursiveSelection, BanditRLProof.OFULConcreteHistoryRidgeSelection, BanditRLProof.OFULUniformTimeConfidence, BanditRLProof.OFULAllTimeConfidence, BanditRLProof.OFULScheduledAllTimeConfidence, BanditRLProof.OFULSelectedWidthSummation, BanditRLProof.OFULGeneratedTrajectoryConfidenceGap, BanditRLProof.OFULGeneratedTrajectoryUniformConfidence, BanditRLProof.OFULGeneratedTrajectoryPredictableConfidence, BanditRLProof.OFULHistoryEnvironmentRewardLaw, BanditRLProof.OFULGeneratedTrajectoryRadiusWidth, BanditRLProof.OFULNormalizedRadiusWidth, BanditRLProof.OFULScheduledAllHorizonCumulativeGap, BanditRLProof.OFULInitialRoundGap, BanditRLProof.OFULExpectedRegret, BanditRLProof.OFULExpectedRegretRate, BanditRLProof.OFULExpectedRegretAsymptotics, BanditRLProof.OFULExpectedRegretConsistency, BanditRLProof.OFULHighProbabilityRegretRate, BanditRLProof.OFULScheduledAllHorizonAllRoundGap, BanditRLProof.OFULScheduledAllHorizonHighProbabilityRegretRate, BanditRLProof.OFULScheduledBoundedStoppingTimeHighProbabilityRegretRate, BanditRLProof.OFULScheduledBoundedStoppingTimeExpectedRegret, BanditRLProof.OFULScheduledBoundedStoppingTimeExpectedRegretRate, BanditRLProof.OFULScheduledBoundedStoppingTimeExpectedRegretAsymptotics, BanditRLProof.OFULScheduledBoundedStoppingTimeExpectedRegretConsistency, BanditRLProof.OFULScheduledUnboundedStoppingTimeExpectedRegret, BanditRLProof.OFULScheduledUnboundedStoppingTimeExpectedRegretRate, BanditRLProof.OFULScheduledUnboundedStoppingTimeExpectedRegretClosed, BanditRLProof.OFULScheduledUnboundedStoppingTimeExpectedRegretSecondMoment, BanditRLProof.OFULScheduledUnboundedStoppingTimeExpectedRegretExactMoment, BanditRLProof.OFULScheduledBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledUnitGrowthBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledCumulativePositiveCostBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledPositiveActionCostBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledCumulativeAlignedWindowPositiveCostBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledAEAlignedWindowPositiveActionCostBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledBlockStartForcedPositiveActionCostBudgetExhaustionExpectedRegret, BanditRLProof.OFULScheduledBlockStartForcedHistoryAlgorithm, BanditRLProof.OFULScheduledBlockStartForcedPseudoRegretDecomposition, BanditRLProof.OFULScheduledBlockStartForcedAllTimeConfidence, BanditRLProof.OFULScheduledBlockStartForcedActionChargeBound, BanditRLProof.OFULScheduledBlockStartForcedHorizonWindowFiniteHorizonTail, BanditRLProof.OFULScheduledBlockStartForcedHorizonIndexedHighProbabilityRegretRate, BanditRLProof.OFULScheduledPowerOfTwoForcedIndexCount, BanditRLProof.OFULScheduledPowerOfTwoForcedHistoryAlgorithm, BanditRLProof.OFULScheduledPowerOfTwoForcedPseudoRegretDecomposition, BanditRLProof.OFULScheduledPowerOfTwoForcedAllTimeConfidence, BanditRLProof.OFULScheduledPowerOfTwoForcedScalarChargeBound, BanditRLProof.OFULScheduledPowerOfTwoForcedHighProbabilityRegretRate, BanditRLProof.OFULScheduledPowerOfTwoForcedHighProbabilityAverageRegret, BanditRLProof.OFULScheduledPowerOfTwoForcedHighProbabilityAverageConsistency, BanditRLProof.Algorithms.ETC, BanditRLProof.Algorithms.ETCTrace, BanditRLProof.Algorithms.ETCTraceCountLemmas, BanditRLProof.Algorithms.ETCEmpiricalMean, BanditRLProof.Algorithms.ETCSumRewardsDiff, BanditRLProof.Algorithms.ETCCenteredDiffRewardIndependence, BanditRLProof.Algorithms.ETCEmpiricalMeanMeasurability, BanditRLProof.Algorithms.ETCCountLemmas, BanditRLProof.Algorithms.ETCRegretLemmas, BanditRLProof.Algorithms.ETCMeasurability, BanditRLProof.Algorithms.ETCArgmaxOracle, BanditRLProof.Algorithms.ETCPairwiseTailContract, BanditRLProof.Algorithms.ETCPairwiseSubGaussianTail, BanditRLProof.Algorithms.ETCPairwiseCenteredSubGaussianTail, BanditRLProof.Algorithms.ETCCenteredDiffSubGaussianWitnesses, BanditRLProof.Algorithms.ETCCenteredDiffCanonicalTail, BanditRLProof.Algorithms.ETCCondSubGaussianWitnesses, BanditRLProof.Algorithms.ETCWrongCommitCanonicalTail, BanditRLProof.Algorithms.ETCCenteredDiffRewardSubGaussian, BanditRLProof.Algorithms.ETCBoundedRewardSubGaussian, BanditRLProof.Algorithms.ETCBoundedRewardSource, BanditRLProof.Algorithms.ETCBoundedRewardInfinitePiSource, BanditRLProof.Algorithms.ETCWrongCommitRegretAssembly, BanditRLProof.Algorithms.ETCExpectedPullCount, BanditRLProof.Algorithms.ETCRealEmpiricalMean, BanditRLProof.Algorithms.ETCRealInfinitePiTail, BanditRLProof.Algorithms.ETCRealPrefixLawTransport, BanditRLProof.Algorithms.ETCRealSourceAdapter, BanditRLProof.Algorithms.ETCRealArgmaxTie, BanditRLProof.Algorithms.ETCRealHistoryScore, BanditRLProof.Algorithms.ETCRealLMLCompat, BanditRLProof.Algorithms.ETCExpectedRegretAssembly, BanditRLProof.Algorithms.ETCInfinitePiExpectedRegretAssembly, BanditRLProof.Algorithms.ETCGeneratedHistoryPolicy, BanditRLProof.Algorithms.ETCFiniteArmRewardLaw, BanditRLProof.Algorithms.ETCExactSubGaussianTail, BanditRLProof.Algorithms.ETCRatArmLawRealKernel, BanditRLProof.Algorithms.UCB, BanditRLProof.Algorithms.UCBRealHistoryIndex, BanditRLProof.Algorithms.UCBConditionalRewardLaw, BanditRLProof.Algorithms.UCBConditionalRewardPairTrajectory, BanditRLProof.Algorithms.UCBConditionalRewardPairTrajectoryReal, BanditRLProof.Algorithms.UCBConditionalRewardPairTrajectorySampledReal, BanditRLProof.Algorithms.UCBConditionalRewardPairTrajectorySampledAsymptotics, BanditRLProof.Algorithms.UCBFixedPolicyTelescopingAnytimeRegret, BanditRLProof.Algorithms.KLUCBBernoulli, BanditRLProof.Algorithms.KLUCBGeneratedRegret, BanditRLProof.Algorithms.UCBConditionalRewardLawPolicy, BanditRLProof.Algorithms.UCBConditionalRewardLawRegret, BanditRLProof.Algorithms.UCBConditionalRewardLawTrajMeasure, BanditRLProof.Algorithms.UCBConditionalRewardLawCenteredKernel, BanditRLProof.Algorithms.UCBConditionalRewardLawCenteredKernelReal, BanditRLProof.Algorithms.UCBBoundedFiniteArmRewardLaw, BanditRLProof.Algorithms.UCBBoundedFiniteArmSampledAsymptotics, BanditRLProof.Algorithms.UCBArmwiseBoundedFiniteArmSampledAsymptotics, BanditRLProof.Algorithms.UCBFiniteArmSubGaussianRewardLaw, BanditRLProof.Algorithms.UCBFiniteArmSubGaussianSampledAsymptotics, BanditRLProof.Algorithms.UCBContextDependentBoundedRewardKernel, BanditRLProof.Algorithms.UCBContextDependentSubGaussianRewardKernel, BanditRLProof.Algorithms.UCBFixedCountPeeling, BanditRLProof.Algorithms.UCBArmStreamSource, BanditRLProof.Algorithms.UCBArmStreamProcess, BanditRLProof.Algorithms.UCBArmStreamTail, BanditRLProof.Algorithms.UCBArmStreamExpectedPullCount, BanditRLProof.Algorithms.UCBArmStreamAsymptotics, BanditRLProof.Algorithms.UCBArmStreamFiniteArmRewardLaws, BanditRLProof.Algorithms.UCBRealLMLCompat, BanditRLProof.Algorithms.UCBRealStationaryFiniteArmRewardLaws, BanditRLProof.Algorithms.UCBRealStationaryMeasurePreservingSource, BanditRLProof.Algorithms.UCBRealStationaryCanonicalKernelTrajectory, BanditRLProof.Algorithms.UCBRealStationaryExplicitPolicy, BanditRLProof.Algorithms.UCBArmStreamConditionalReward, BanditRLProof.Algorithms.UCBRealStationarySelectedRewardConsistency, BanditRLProof.Algorithms.Thompson, BanditRLProof.Algorithms.ThompsonCanonicalSampler, BanditRLProof.Algorithms.ThompsonReferencePolicy, BanditRLProof.Algorithms.ThompsonAlgorithmDensity, BanditRLProof.Algorithms.ThompsonAlgorithmDensityProcess, BanditRLProof.Algorithms.ThompsonCanonicalTrajectory, BanditRLProof.Algorithms.ThompsonMeasurableTrajectory, BanditRLProof.Algorithms.ThompsonRecursiveSampler, BanditRLProof.Algorithms.ThompsonBayesRegretDecomposition, BanditRLProof.Algorithms.ThompsonClippedUCBScore, BanditRLProof.Algorithms.ThompsonStationaryReward, BanditRLProof.RL.FiniteHorizonMDP, BanditRLProof.RL.FiniteHorizonPolicy, BanditRLProof.RL.FiniteHorizonTrajectory, BanditRLProof.RL.FiniteHorizonStochasticRewardBellman, BanditRLProof.RL.FiniteHorizonStochasticRewardTrajectory, BanditRLProof.RL.FiniteHorizonStochasticRewardMarginal, BanditRLProof.RL.FiniteHorizonStochasticRewardConditionalLaw, BanditRLProof.RL.FiniteHorizonStochasticRewardConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardCumulativeConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardBellmanInnovationConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardTotalReturnConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardInitialLawTotalReturnConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardIIDTotalReturnConcentration, BanditRLProof.RL.FiniteHorizonStochasticRewardErasureLaw, BanditRLProof.RL.FiniteHorizonStochasticRewardIIDEmpiricalRewardConfidence, BanditRLProof.RL.FiniteHorizonStochasticRewardIIDAllCoordinateEmpiricalModelConfidence, BanditRLProof.RL.FiniteHorizonStochasticRewardIIDExplicitCalibration, BanditRLProof.RL.FiniteHorizonStochasticRewardIIDSelfConsistentCalibration, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentSchedule, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentExplicitRate, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCommonSpaceConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalSource, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalModelConfidence, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalReturnConcentration, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalRealizedSuccessorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalExplicitRate, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceL1Consistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceAlmostSureConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceAlmostSureBehaviorExpectedRegretConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceBehaviorExpectedRegretInMeasureConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceBehaviorExpectedRegretL1Consistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceBehaviorExpectedRegretExplicitIntegratedRate, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSelfConsistentCausalCommonSpaceBehaviorExpectedRegretFinitePrefixCumulativeAverageRate, BanditRLProof.RL.FiniteHorizonNaturalCausalBehaviorExpectedRegretLogRate, BanditRLProof.RL.FiniteHorizonNaturalCausalBehaviorExpectedRegretHighProbabilityLogRate, BanditRLProof.RL.FiniteHorizonNaturalCausalRealizedBehaviorRegretHighProbabilityLogRate, BanditRLProof.RL.FiniteHorizonNaturalCausalRealizedBehaviorRegretHighProbabilityBurninLogRate, BanditRLProof.RL.FiniteHorizonNaturalCausalRealizedBehaviorRegretHighProbabilityExplicitSchedule, BanditRLProof.RL.FiniteHorizonNaturalCausalRealizedBehaviorRegretUpperTailInProbability, BanditRLProof.RL.FiniteHorizonNaturalCausalRealizedBehaviorRegretInMeasureExplicitSchedule, BanditRLProof.RL.FiniteHorizonNaturalCausalAverageRealizedBehaviorRegretL1Consistency, BanditRLProof.RL.FiniteHorizonNaturalCausalAverageRealizedBehaviorRegretAlmostSureExplicitSchedule, BanditRLProof.RL.FiniteHorizonNaturalCausalAverageRealizedBehaviorRegretAlmostSureConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalRandomPrefixAverageRealizedBehaviorRegretAlmostSureConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalStoppingTimeAverageRealizedBehaviorRegretAlmostSureConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedWindowStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalGrowingWindowGridStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalPolynomialBaseGrowingRawWindowStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalRateControlledRawWindowStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalThresholdTriggeredDoubleLinearRawWindowStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalCappedDoubleLinearRawWindowFirstPassageStoppingTimeL1AverageRealizedBehaviorRegretConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalReciprocalThresholdCappedDoubleLinearRawWindowFirstPassageVanishingDelayProbabilityAndL1Consistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedDoubleLinearRawWindowFirstPassageSummableDelayAndEventualImmediateStoppingL1Consistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterAEFiniteEventualImmediateStoppingAndInMeasureConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterIntegrableFiniteStoppingTime, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterSquareIntegrableFiniteStoppingTime, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterIntegrableExpectedUpperBound, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterExplicitTailStartExpectedAbsoluteBound, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterPolynomialSecondMomentExpectedAbsoluteBound, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterPolynomialSecondMomentExpectedAbsoluteAsymptotics, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterCauchySchwarzExpectedAbsoluteAsymptotics, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterExpectedPositivePartConsistency, BanditRLProof.UnboundedStoppingTimeWeightedL2CoordinateIntegrability, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterL1Consistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterLpConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterUniformIntegrabilityExpectedConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterUniformAbsoluteContinuity, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterDelayedEventExpectedContribution, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterL1TruncationEquivalence, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterExpectedRegretTruncationReplacement, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdUnboundedHittingAfterStoppedBehaviorExpectedRegretAndReturnDeviationL1Consistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedBehaviorExpectedRegretAndReturnDeviationL1TruncationEquivalence, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedBehaviorExpectedRegretAndReturnDeviationExpectedTruncationReplacement, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedRealizedBehaviorRegretAndPolicyValueExpectedConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedAverageSampledReturnExpectedOptimality, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedSampledReturnAndSuccessorPolicyExpectedReturnConsistency, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedSampledAndSuccessorPolicyReturnL1Optimality, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedSampledAndSuccessorPolicyReturnInMeasureAlmostSureOptimality, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedSampledAndSuccessorPolicyReturnSimultaneousHighProbabilityOptimality, BanditRLProof.RL.FiniteHorizonNaturalCausalInverseSqrtThresholdCappedUnboundedHittingAfterStoppedSampledAndSuccessorPolicyReturnDeterministicTailHighProbabilityOptimality, BanditRLProof.RL.StoppedReturnJointErrorDeterministicTailHighProbability, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedStoppingTimeHighProbabilityAverageRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedStoppingTimeSingleModelEventHighProbabilityAverageRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedStoppingTimeExplicitThreeQuarterGoodEventAverageRealizedBehaviorRegret, BanditRLProof.MeasureL2Indicator, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedStoppingTimeExplicitExpectedAverageRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonNaturalCausalBoundedStoppingTimeExplicitDeterministicMomentExpectedAverageRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardEmpiricalOptimisticProjection, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticSource, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticConfidence, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticCumulativeRecommendedRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticCumulativeExploratoryBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardSampledEmpiricalOptimisticExplicitBudgetRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardEmpiricalOptimisticRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardTotalReturnConcentration, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonOptimality, BanditRLProof.RL.FiniteHorizonOccupancyRegret, BanditRLProof.RL.FiniteHorizonOptimisticCertificate, BanditRLProof.RL.FiniteHorizonEstimatedModelCertificate, BanditRLProof.RL.FiniteHorizonCoordinateModelConfidence, BanditRLProof.RL.FiniteHorizonEmpiricalModel, BanditRLProof.RL.FiniteHorizonIIDTrajectoryBatch, BanditRLProof.RL.FiniteHorizonIIDCountConcentration, BanditRLProof.RL.FiniteHorizonStageTransitionJointFactorization, BanditRLProof.RL.FiniteHorizonStageVisitFactorization, BanditRLProof.RL.FiniteHorizonIIDEligibleEmpiricalTransitionConfidence, BanditRLProof.RL.FiniteHorizonIIDGeneratedEmpiricalRewardExactness, BanditRLProof.RL.FiniteHorizonIIDAllCoordinateFiniteBatchConfidence, BanditRLProof.RL.FiniteHorizonIIDMultiBatchCumulativeConfidenceRegret, BanditRLProof.RL.FiniteHorizonAdaptiveEpisodeBatchLaw, BanditRLProof.RL.FiniteHorizonAdaptiveEmpiricalOptimisticSource, BanditRLProof.RL.FiniteHorizonAdaptiveEmpiricalOptimisticConfidence, BanditRLProof.RL.FiniteHorizonExploratoryReachabilityCalibration, BanditRLProof.RL.FiniteHorizonExploratoryPathSupportReachability, BanditRLProof.RL.FiniteHorizonExploratoryPathSupportExplicitCalibration, BanditRLProof.RL.FiniteHorizonExploratoryPathSupportEpisodeThreshold, BanditRLProof.RL.FiniteHorizonAdaptiveEmpiricalOptimisticOccupancyEnvelope, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeEmpiricalOptimisticRegret, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeCountMartingaleConfidence, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtCalibration, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeHoeffdingUCBVI, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeUCBVIExpectedRegret, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtExplicitRate, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtNormalizedRate, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtAverageRate, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtAverageConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeInverseSqrtHighProbabilityAverageConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeExploratoryBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeDecayingExplorationBehaviorConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeRealizedBehaviorRegret, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeDecayingExplorationRealizedBehaviorConsistency, BanditRLProof.RL.FiniteHorizonEpisodeBatchStandardBorel, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardCumulativeDecayingExplorationConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardCumulativeDecayingExplorationRegularityClosedConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardCumulativeDecayingExplorationCommonSpaceConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveStochasticRewardCumulativeDecayingExplorationCommonSpaceL1Consistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeEpisodewiseRealizedBehaviorConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeEpisodewiseCommonSpaceConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeEpisodewiseCommonSpaceExpectedConsistency, BanditRLProof.RL.FiniteHorizonAdaptiveCumulativeEpisodewiseCommonSpaceL1Consistency, BanditRLProof.RL.FiniteHorizonIIDSimultaneousCountConfidence, BanditRLProof.RL.FiniteHorizonIIDEligibleVisitCountPositivity, BanditRLProof.DelayedFeedback.Accounting, BanditRLProof.DelayedFeedback.ActiveAllocation, BanditRLProof.DelayedFeedback.ActionLaw, BanditRLProof.DelayedFeedback.CausalView, BanditRLProof.DelayedFeedback.Elimination, BanditRLProof.DelayedFeedback.StochasticGoodEvent, BanditRLProof.DelayedFeedback.StochasticGoodEventAssembly, BanditRLProof.DelayedFeedback.StochasticGapOrderingAudit, BanditRLProof.DelayedFeedback.MultiRegimeContract, BanditRLProof.DelayedFeedback.Processing, BanditRLProof.Literature, BanditRLProof.Automation, BanditRLProof.OpenProblems
Imported by
No project-local reverse dependency.
Declarations
Open an item to read its exact compact statement and source link. Detailed teaching notes are linked when registered.
This aggregator module contains imports but no indexed declaration.