Explains hidden inference cost multipliers behind unexpectedly high LLM bills, including output token pricing dominance, invisible reasoning tokens, non-production traffic, model verbosity, and context tier surcharges, with measurement techniques for tracking real expenses.