yera.models.interfaces.llms.open_ai
Yera LLM interface for OpenAI models.
Symbols
OpenAILLM
BaseLLMInterfaceAzureOpenAILLMLLM interface implementation for OpenAI LLMs.
Methods
OpenAILLM.start
start() → NoneInitialise the OpenAI API client.
Creates and stores an OpenAI client instance using the configured connection settings (API key, organisation, etc.). This method must be called before making any API requests via the client property.
OpenAILLM.stop
stop() → NoneShut down and clear the OpenAI API client.
Releases the OpenAI client instance by setting it to None. After calling this method, start() must be called again before further API requests can be made.
OpenAILLM.chat
chat(
messages: list[Message],
reasoning_level: ReasoningLevel | None = None,
**overrides,
) → Iterator[LLMToken]Stream a chat response from OpenAI.
Thinking is only produced when effort and summary are both set on a model that reasons.
Parameters
The workspace conversation history.
Set the reasoning effort level overriding the default (medium)
Per-call inference parameters.
OpenAILLM.make_struct
make_struct(
messages: list[Message],
reasoning_level: ReasoningLevel | None = None,
**overrides,
) → Iterator[LLMToken]Stream a structured response conforming to a schema.
Parameters
The workspace conversation history.
A pydantic model class defining the output structure.
Set the reasoning effort level overriding the default (off)
Per-call inference parameters.
OpenAILLM.make_request_struct
make_request_struct(
messages: list[Message],
reasoning_level: ReasoningLevel | None = None,
**overrides,
) → Iterator[LLMToken]Generate a tool-like request structure with an initial call_id token.
Prepares a unique identifier for the tool call and streams structured output
tokens. This method is intended for tools that require a tool_call → tool_result
interaction pattern, where the call_id must be sent first to associate results.
Parameters
Conversation history.
Struct subclass defining the tool's input/output schema.
Set the reasoning effort level overriding the default (off)
Per-call LLM overrides (e.g., temperature, num_predict).