The LinkBERT architecture offloads inference to a dedicated local microservice running as a separate local process, computing word-level link probability scores and character spans over HTTP to keep heavy ML dependencies out of the core application process.