In each round, the loop uses an acquisition policy to select an optimization claim, modifies content via the ideator, evaluates competitive rank using an ensemble ranker, and updates the Bayesian posterior distributions based on whether the position improved.
sequenceDiagram
participant Acq as Acquisition Policy
participant Ide as Ideator
participant Rnk as Ranker Model
participant Post as Bayesian Posterior
Acq->>Ide: Select claim & prior
Ide->>Rnk: Submit modified content variant
Rnk->>Post: Evaluate rank vs competitors
Post->>Acq: Update Beta(alpha, beta) distributionReferenced by