diff --git a/providers/stackit/models/qwen3-vl-235b.toml b/providers/stackit/models/Qwen/Qwen3-VL-235B-A22B-Instruct-FP8.toml similarity index 87% rename from providers/stackit/models/qwen3-vl-235b.toml rename to providers/stackit/models/Qwen/Qwen3-VL-235B-A22B-Instruct-FP8.toml index 6d5e26ca6..4df523123 100644 --- a/providers/stackit/models/qwen3-vl-235b.toml +++ b/providers/stackit/models/Qwen/Qwen3-VL-235B-A22B-Instruct-FP8.toml @@ -1,4 +1,5 @@ name = "Qwen3-VL 235B" +family = "qwen" release_date = "2024-11-01" last_updated = "2024-11-01" attachment = true @@ -9,8 +10,8 @@ structured_output = false open_weights = true [cost] -input = 1.77 -output = 2.07 +input = 1.64 +output = 1.91 [limit] context = 218_000 diff --git a/providers/stackit/models/qwen3-vl-embedding-8b.toml b/providers/stackit/models/Qwen/Qwen3-VL-Embedding-8B.toml similarity index 95% rename from providers/stackit/models/qwen3-vl-embedding-8b.toml rename to providers/stackit/models/Qwen/Qwen3-VL-Embedding-8B.toml index ef4c3df08..6d5236258 100644 --- a/providers/stackit/models/qwen3-vl-embedding-8b.toml +++ b/providers/stackit/models/Qwen/Qwen3-VL-Embedding-8B.toml @@ -1,4 +1,5 @@ name = "Qwen3-VL Embedding 8B" +family = "qwen" release_date = "2026-02-05" last_updated = "2026-02-05" attachment = true diff --git a/providers/stackit/models/llama-3.3-70b.toml b/providers/stackit/models/cortecs/Llama-3.3-70B-Instruct-FP8-Dynamic.toml similarity index 87% rename from providers/stackit/models/llama-3.3-70b.toml rename to providers/stackit/models/cortecs/Llama-3.3-70B-Instruct-FP8-Dynamic.toml index a4f70d8b2..468f3da31 100644 --- a/providers/stackit/models/llama-3.3-70b.toml +++ b/providers/stackit/models/cortecs/Llama-3.3-70B-Instruct-FP8-Dynamic.toml @@ -1,4 +1,5 @@ name = "Llama 3.3 70B" +family = "llama" release_date = "2024-12-05" last_updated = "2024-12-05" attachment = false @@ -9,8 +10,8 @@ structured_output = false open_weights = true [cost] -input = 0.53 -output = 0.77 +input = 0.49 +output = 0.71 [limit] context = 128_000 diff --git a/providers/stackit/models/gemma-3-27b.toml b/providers/stackit/models/google/gemma-3-27b-it.toml similarity index 87% rename from providers/stackit/models/gemma-3-27b.toml rename to providers/stackit/models/google/gemma-3-27b-it.toml index 28d206ac1..c25df2ab6 100644 --- a/providers/stackit/models/gemma-3-27b.toml +++ b/providers/stackit/models/google/gemma-3-27b-it.toml @@ -1,4 +1,5 @@ name = "Gemma 3 27B" +family = "gemma" release_date = "2025-05-17" last_updated = "2025-05-17" attachment = true @@ -9,8 +10,8 @@ structured_output = false open_weights = true [cost] -input = 0.53 -output = 0.77 +input = 0.49 +output = 0.71 [limit] context = 37_000 diff --git a/providers/stackit/models/e5-mistral-7b.toml b/providers/stackit/models/intfloat/e5-mistral-7b-instruct.toml similarity index 94% rename from providers/stackit/models/e5-mistral-7b.toml rename to providers/stackit/models/intfloat/e5-mistral-7b-instruct.toml index efdd3534f..c020a6343 100644 --- a/providers/stackit/models/e5-mistral-7b.toml +++ b/providers/stackit/models/intfloat/e5-mistral-7b-instruct.toml @@ -1,4 +1,5 @@ name = "E5 Mistral 7B" +family = "mistral" release_date = "2023-12-11" last_updated = "2023-12-11" attachment = false diff --git a/providers/stackit/models/llama-3.1-8b.toml b/providers/stackit/models/neuralmagic/Meta-Llama-3.1-8B-Instruct-FP8.toml similarity index 87% rename from providers/stackit/models/llama-3.1-8b.toml rename to providers/stackit/models/neuralmagic/Meta-Llama-3.1-8B-Instruct-FP8.toml index aed8a66f4..bdfbda001 100644 --- a/providers/stackit/models/llama-3.1-8b.toml +++ b/providers/stackit/models/neuralmagic/Meta-Llama-3.1-8B-Instruct-FP8.toml @@ -1,4 +1,5 @@ name = "Llama 3.1 8B" +family = "llama" release_date = "2024-07-23" last_updated = "2024-07-23" attachment = false @@ -9,8 +10,8 @@ structured_output = true open_weights = true [cost] -input = 0.18 -output = 0.30 +input = 0.16 +output = 0.27 [limit] context = 128_000 diff --git a/providers/stackit/models/mistral-nemo.toml b/providers/stackit/models/neuralmagic/Mistral-Nemo-Instruct-2407-FP8.toml similarity index 86% rename from providers/stackit/models/mistral-nemo.toml rename to providers/stackit/models/neuralmagic/Mistral-Nemo-Instruct-2407-FP8.toml index 92c60e517..2f35759aa 100644 --- a/providers/stackit/models/mistral-nemo.toml +++ b/providers/stackit/models/neuralmagic/Mistral-Nemo-Instruct-2407-FP8.toml @@ -1,4 +1,5 @@ name = "Mistral Nemo" +family = "mistral" release_date = "2024-07-01" last_updated = "2024-07-01" attachment = false @@ -9,8 +10,8 @@ structured_output = false open_weights = true [cost] -input = 0.53 -output = 0.77 +input = 0.49 +output = 0.71 [limit] context = 128_000 diff --git a/providers/stackit/models/gpt-oss-120b.toml b/providers/stackit/models/openai/gpt-oss-120b.toml similarity index 82% rename from providers/stackit/models/gpt-oss-120b.toml rename to providers/stackit/models/openai/gpt-oss-120b.toml index 64bf3e8e1..33acefc69 100644 --- a/providers/stackit/models/gpt-oss-120b.toml +++ b/providers/stackit/models/openai/gpt-oss-120b.toml @@ -1,4 +1,5 @@ name = "GPT-OSS 120B" +family = "gpt" release_date = "2025-08-05" last_updated = "2025-08-05" attachment = false @@ -9,11 +10,11 @@ structured_output = false open_weights = true [cost] -input = 0.53 -output = 0.77 +input = 0.49 +output = 0.71 [limit] -context = 128_000 +context = 131_000 output = 8_192 [modalities]