ml_obs.span.llm.input.tokens | Number of tokens in the input sent to the LLM | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.output.tokens | Number of tokens in the output | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.output.reasoning.tokens | Number of reasoning tokens in the output | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.prompt.tokens | Number of tokens used in the prompt | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.completion.tokens | Tokens generated as a completion during the span | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.total.tokens | Total tokens consumed during the span (input + output + prompt) | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.input.cache_write.tokens | Number of input tokens written to the prompt cache in an LLM span | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.input.cache_read.tokens | Number of input tokens served from the prompt cache in an LLM span | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.input.non_cached.tokens | Number of input tokens that did not interact with the prompt cache in an LLM span | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.input.characters | Number of characters in the input sent to the LLM | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |
ml_obs.span.llm.output.characters | Number of characters in the output | Distribution | env, error, ml_app, model_name, model_provider, service, version, matched_model_name, matched_model_provider |