Target Model Matrix

August 21, 2026 · View on GitHub

This document makes explicit the setups and target models defined in tests/integration/suites.py and the CI lanes configured in tests/integration/ci_matrix.json.

CI Lanes (Default)

These jobs come from the default section of ci_matrix.json. They all run in the merge queue, while PR-triggered execution still depends on which files changed.

SuiteSetupNotes
baseollama
bedrockbedrocklibrary client only; 3 roots
baseollama-postgresserver client only; Postgres store
visionollama-visiontest_vision_inference.py only
responsesgptresponses only; Responses coverage: 137/137 (100%)
responsesazureresponses only; Responses coverage: 112/137 (82%)
gpt-reasoninggpt-reasoning2 roots; Responses coverage: 137/137 (100%)
responseswatsonxresponses only; Responses coverage: 62/137 (45%)
responsesvertexairesponses only; Responses coverage: 70/137 (51%)
bedrock-responsesbedrock6 roots; Responses coverage: 27/137 (20%)
base-vllm-subsetvllminference only
vllm-reasoningvllmtest_reasoning.py only; Responses coverage: 3/137 (2%)
ollama-reasoningollama-reasoning5 roots; Responses coverage: 3/137 (2%)
messagesollamamessages only
messages-openaigptmessages only
interactionsgeminiinteractions only

CI Lanes (Scheduled)

Cron: 1 0 * * 0

SuiteSetupNotes
basevllm
basevllm-qwen3next

CI-backed Setups

SetupText ModelVision ModelEmbedding ModelSafety ModelDefault CIScheduled CI
azureazure/gpt-4oazure/gpt-4osentence-transformers/nomic-ai/nomic-embed-text-v1.5responses
bedrockbedrock/openai.gpt-oss-20b-1:0sentence-transformers/nomic-ai/nomic-embed-text-v1.5bedrock, bedrock-responses
geminigemini/gemini-2.5-flash-litegemini/text-embedding-004interactions
gptopenai/gpt-4oopenai/gpt-4oopenai/text-embedding-3-smallresponses, messages-openai
gpt-reasoningopenai/o4-minigpt-reasoning
ollamaollama/llama3.2:3b-instruct-fp16ollama/nomic-embed-text:v1.5base, messages
ollama-postgresollama/llama3.2:3b-instruct-fp16sentence-transformers/nomic-embed-text-v1.5base
ollama-reasoningollama/deepseek-r1:1.5bollama-reasoning
ollama-visionollama/llama3.2-vision:11bollama/nomic-embed-text:v1.5vision
vertexaivertexai/publishers/google/models/gemini-2.0-flashvertexai/publishers/google/models/gemini-2.0-flashsentence-transformers/nomic-ai/nomic-embed-text-v1.5responses
vllmvllm/Qwen/Qwen3-0.6Bsentence-transformers/nomic-embed-text-v1.5base-vllm-subset, vllm-reasoningbase
vllm-qwen3nextQwen3-Next-80B-A3B-Instruct-FP8sentence-transformers/nomic-ai/nomic-embed-text-v1.5base
watsonxwatsonx/meta-llama/llama-3-3-70b-instructresponses

Additional Named Setups

SetupText ModelVision ModelEmbedding ModelSafety ModelDefault CIScheduled CI
anthropicanthropic/claude-3-5-haiku-20241022
cerebrascerebras/gpt-oss-120b
databricksdatabricks/databricks-meta-llama-3-3-70b-instructdatabricks/databricks-bge-large-en
fireworksfireworks/accounts/fireworks/models/llama-v3p1-8b-instructfireworks/accounts/fireworks/models/qwen3-embedding-8b
groqgroq/llama-3.3-70b-versatile
llama-apillama_openai_compat/Llama-3.3-8B-Instruct
llama-cpp-serverllama-cpp-server/qwen2.5sentence-transformers/nomic-embed-text-v1.5
tgitgi/Qwen/Qwen3-0.6B
togethertogether/meta-llama/Llama-3.3-70B-Instruct-Turbo-Freetogether/togethercomputer/m2-bert-80M-32k-retrieval
vllm-gpu-gpt-ossvllm/gpt-oss:20b

Responses Coverage Summary

This section is derived from the same replay recordings used to generate docs/docs/api-openai/provider_matrix.md.

ProviderTestedPassingCoverage
OpenAI137137100%
Azure11211282%
Vertex AI707051%
WatsonX626245%
Bedrock272720%
Ollama332%
vLLM332%

Total Responses features counted: 137.