The loop models hypotheses as Beta distributions, samples strategic claims via an acquisition policy, generates targeted content edits, and evaluates rank changes using a target LLM judge to update posterior beliefs.