Skip to main content
Generate text with detailed metrics including latency, token count, and generation speed.

LLMGenerationOptions

LLMGenerationResult

Thinking Models

Some models support “thinking” tokens for chain-of-thought reasoning:

See Also

chat()

Simple one-liner

generateStream()

Stream tokens in real-time