From da66858d2edee08696b214170a28f28e3b7d8bd9 Mon Sep 17 00:00:00 2001 From: erin2722 <16248113+erin2722@users.noreply.github.com> Date: Sun, 13 Sep 2026 10:27:27 +0000 Subject: [PATCH] chore: update model catalog from bot issues --- packages/proxy/schema/index.ts | 5 ++ packages/proxy/schema/model_list.json | 69 +++++++++++++++++++++++++++ 2 files changed, 74 insertions(+) diff --git a/packages/proxy/schema/index.ts b/packages/proxy/schema/index.ts index d699f285..7aebca9a 100644 --- a/packages/proxy/schema/index.ts +++ b/packages/proxy/schema/index.ts @@ -1431,6 +1431,11 @@ export const AvailableEndpointTypes: { [name: string]: ModelEndpointType[] } = { "anthropic.claude-mythos-5-1": ["bedrock"], "global.anthropic.claude-mythos-5-1": ["bedrock"], "accounts/fireworks/models/deepseek-v4p1-flash": ["fireworks"], + "openai.gpt-6-astra": ["bedrock"], + "nvidia.nemotron-nano-12b-v2": ["bedrock"], + "writer.palmyra-vision-7b": ["bedrock"], + "mistral.voxtral-mini-3b-2507": ["bedrock"], + "mistral.voxtral-small-24b-2507": ["bedrock"], }; const modelEndpointAvailableModels = getAvailableModels(); diff --git a/packages/proxy/schema/model_list.json b/packages/proxy/schema/model_list.json index 0c54e5b2..07738b6d 100644 --- a/packages/proxy/schema/model_list.json +++ b/packages/proxy/schema/model_list.json @@ -234,6 +234,9 @@ "input_cache_write_cost_per_mil_tokens": 12.5, "displayName": "GPT-6 Astra", "reasoning": true, + "fallback_models": [ + "openai.gpt-6-astra" + ], "max_input_tokens": 922000, "max_output_tokens": 128000, "available_providers": [ @@ -8327,6 +8330,72 @@ "flavor": "completion", "displayName": "Text-block" }, + "mistral.voxtral-small-24b-2507": { + "format": "converse", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.1, + "output_cost_per_mil_tokens": 0.3, + "displayName": "Voxtral Small 24B (2507)", + "max_input_tokens": 32000, + "available_providers": [ + "bedrock" + ] + }, + "mistral.voxtral-mini-3b-2507": { + "format": "converse", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.04, + "output_cost_per_mil_tokens": 0.04, + "displayName": "Voxtral Mini 3B (2507)", + "max_input_tokens": 32000, + "available_providers": [ + "bedrock" + ] + }, + "nvidia.nemotron-nano-12b-v2": { + "format": "converse", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.2, + "output_cost_per_mil_tokens": 0.6, + "displayName": "NVIDIA Nemotron Nano 12B v2 VL", + "max_input_tokens": 128000, + "max_output_tokens": 8000, + "available_providers": [ + "bedrock" + ] + }, + "writer.palmyra-vision-7b": { + "format": "converse", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 0.15, + "output_cost_per_mil_tokens": 0.6, + "displayName": "Palmyra Vision 7B", + "max_input_tokens": 4000, + "max_output_tokens": 4000, + "available_providers": [ + "bedrock" + ] + }, + "openai.gpt-6-astra": { + "format": "openai", + "flavor": "chat", + "multimodal": true, + "input_cost_per_mil_tokens": 11, + "output_cost_per_mil_tokens": 55, + "input_cache_read_cost_per_mil_tokens": 1.1, + "input_cache_write_cost_per_mil_tokens": 13.75, + "displayName": "GPT-6 Astra", + "reasoning": true, + "max_input_tokens": 1050000, + "max_output_tokens": 128000, + "available_providers": [ + "bedrock" + ] + }, "global.anthropic.claude-mythos-5-1": { "format": "anthropic", "flavor": "chat",