In each round, the loop uses an acquisition policy to select an optimization claim, modifies content via the ideator, evaluates competitive rank using an ensemble ranker, and updates the Bayesian posterior distributions based on whether the position improved.

sequenceDiagram
    participant Acq as Acquisition Policy
    participant Ide as Ideator
    participant Rnk as Ranker Model
    participant Post as Bayesian Posterior

    Acq->>Ide: Select claim & prior
    Ide->>Rnk: Submit modified content variant
    Rnk->>Post: Evaluate rank vs competitors
    Post->>Acq: Update Beta(alpha, beta) distribution