Skip to main content
The autogen_ext package provides model clients, integrations, and extensions for AutoGen.

Model Clients

Client for OpenAI chat completion models.
model
str
required
Model identifier (e.g., “gpt-4o”, “gpt-4-turbo”, “gpt-3.5-turbo”)
api_key
str | None
OpenAI API key (defaults to OPENAI_API_KEY env var)
base_url
str | None
Custom API base URL
temperature
float | None
Sampling temperature (0.0 to 2.0)
max_tokens
int | None
Maximum tokens in response
top_p
float | None
Nucleus sampling parameter
timeout
float | None
Request timeout in seconds
organization
str | None
OpenAI organization ID

Methods

create
async method
Generate a chat completion
Returns: CreateResult
create_stream
async generator
Stream chat completion chunks
Client for Azure OpenAI Service.
model
str
required
Model identifier
azure_endpoint
str
required
Azure OpenAI resource endpoint
api_key
str | None
Azure OpenAI API key (or use Azure AD auth)
api_version
str
required
Azure OpenAI API version
azure_deployment
str
required
Deployment name in Azure
azure_ad_token
str | None
Azure Active Directory token
azure_ad_token_provider
Callable | None
Function to provide Azure AD tokens
Client for Anthropic Claude models.
model
str
required
Model name (e.g., “claude-3-5-sonnet-20241022”, “claude-3-opus-20240229”)
api_key
str
required
Anthropic API key
max_tokens
int
Maximum tokens in response (required for Anthropic)
temperature
float | None
Sampling temperature
Client for local Ollama models.
model
str
required
Ollama model name
base_url
str
Ollama server URL (default: “http://localhost:11434”)
temperature
float | None
Sampling temperature
Client using Semantic Kernel integration.
kernel
Kernel
required
Semantic Kernel instance
service_id
str
required
Service identifier in the kernel
Client for llama.cpp models.
model_path
str
required
Path to GGUF model file
n_ctx
int
Context window size
n_gpu_layers
int
Number of layers to offload to GPU
Client that replays recorded responses for testing.
responses
List[str]
required
Pre-recorded responses to replay in order

Model Configuration

Configuration dataclass for OpenAI clients.
Configuration for Azure OpenAI clients.

Caching

Wrapper that caches model responses.
client
ChatCompletionClient
required
Underlying model client to cache
cache_dir
str
Directory for cache storage (default: “.autogen_cache”)
cache_seed
int | None
Seed for cache key generation

Code Execution

Execute code in Docker containers.
image
str
Docker image to use (default: “python:3.11-slim”)
timeout
int
Execution timeout in seconds
work_dir
str
Working directory in container
Execute code locally (use with caution).
timeout
int
Execution timeout in seconds
work_dir
str
Working directory for execution

Tools & Extensions

Tool for web searching.
Tools for file operations.

Memory Extensions

Vector-based semantic memory.
Redis-backed persistent memory.

Runtimes & Deployment

Distributed runtime using gRPC.
Cloud-based runtime for distributed agents.

Utilities

Rate limiting for API calls.
Count tokens for cost estimation.

Configuration Models

All model clients support declarative configuration through the component system:

See Also