diff --git a/providers/ofox/models/deepseek/deepseek-v4-pro-0813.toml b/providers/ofox/models/deepseek/deepseek-v4-pro-0813.toml index 652d878d1..28bd1ad93 100644 --- a/providers/ofox/models/deepseek/deepseek-v4-pro-0813.toml +++ b/providers/ofox/models/deepseek/deepseek-v4-pro-0813.toml @@ -3,12 +3,15 @@ # Toggle: thinking.type = enabled|disabled # Effort: reasoning_effort = high|max (Pro; lab maps low/medium→high) base_model = "deepseek/deepseek-v4-pro-0813" -reasoning_options = [ - { type = "toggle" }, - { type = "effort", values = ["high", "max"] }, -] + +[[reasoning_options]] +type = "toggle" + +[[reasoning_options]] +type = "effort" +values = ["high", "max"] [cost] -input = 0.45 -output = 0.88 -cache_read = 0.0037 +input = 1.32 +output = 3.96 +cache_read = 0.044 diff --git a/providers/ofox/models/deepseek/deepseek-v4-pro.toml b/providers/ofox/models/deepseek/deepseek-v4-pro.toml index 791e377ee..b07a8d371 100644 --- a/providers/ofox/models/deepseek/deepseek-v4-pro.toml +++ b/providers/ofox/models/deepseek/deepseek-v4-pro.toml @@ -1,7 +1,13 @@ base_model = "deepseek/deepseek-v4-pro" -reasoning_options = [{ type = "toggle" }, { type = "effort", values = ["high", "max"] }] + +[[reasoning_options]] +type = "toggle" + +[[reasoning_options]] +type = "effort" +values = ["high", "max"] [cost] -input = 0.45 -output = 0.88 -cache_read = 0.0037 +input = 1.32 +output = 3.96 +cache_read = 0.044 diff --git a/providers/ofox/models/google/gemini-3.5-flash.toml b/providers/ofox/models/google/gemini-3.5-flash.toml index 459cc4b5a..5aced1c48 100644 --- a/providers/ofox/models/google/gemini-3.5-flash.toml +++ b/providers/ofox/models/google/gemini-3.5-flash.toml @@ -13,7 +13,7 @@ values = ["minimal", "low", "medium", "high"] input = 1.5 output = 9 cache_read = 0.15 -cache_write = 0.83 +cache_write = 0.083 input_audio = 3 [provider]