diff --git a/models/anthropic/claude-opus-4-1-20250805.yaml b/models/anthropic/claude-opus-4-1-20250805.yaml new file mode 100644 index 0000000..914f504 --- /dev/null +++ b/models/anthropic/claude-opus-4-1-20250805.yaml @@ -0,0 +1,96 @@ +# yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json +provider: anthropic +authType: api_key +model: claude-opus-4-1-20250805 +params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. Lower values make outputs more focused; higher values make them more + varied. + default: 1 + range: + min: 0 + max: 1 + step: 0.1 + group: sampling + applicability: + except: + - thinking.type: + - enabled + - top_p: + not: null + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling by limiting generation to tokens whose cumulative probability + reaches this value. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + - thinking.type: + - enabled + - temperature: + not: null + - path: top_k + type: integer + label: Top K + description: Limits token sampling to the top K most likely next tokens. + default: 0 + range: + min: 0 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: thinking.type + type: enum + label: Thinking mode + description: Controls the Anthropic thinking mode values supported by this model. + default: disabled + values: + - disabled + - enabled + group: reasoning + - path: thinking.budget_tokens + type: integer + label: Budget tokens + description: >- + Maximum token budget Anthropic may use for extended thinking before producing the final + answer. + default: 4096 + range: + min: 1024 + group: reasoning + applicability: + only: + thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - enabled diff --git a/models/anthropic/claude-opus-4.yaml b/models/anthropic/claude-opus-4-20250514.yaml similarity index 83% rename from models/anthropic/claude-opus-4.yaml rename to models/anthropic/claude-opus-4-20250514.yaml index 7b784ca..f46a9c4 100644 --- a/models/anthropic/claude-opus-4.yaml +++ b/models/anthropic/claude-opus-4-20250514.yaml @@ -1,7 +1,7 @@ # yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json provider: anthropic authType: api_key -model: claude-opus-4 +model: claude-opus-4-20250514 params: - path: max_tokens type: integer @@ -25,9 +25,8 @@ params: group: sampling applicability: except: - thinking.type: - - adaptive - - enabled + - thinking.type: + - enabled - path: top_p type: number label: Top P @@ -43,10 +42,7 @@ params: applicability: except: - thinking.type: - - adaptive - enabled - - temperature: - not: 1 - path: top_k type: integer label: Top K @@ -58,7 +54,6 @@ params: applicability: except: thinking.type: - - adaptive - enabled - path: thinking.type type: enum @@ -67,7 +62,6 @@ params: default: disabled values: - disabled - - adaptive - enabled group: reasoning - path: thinking.budget_tokens @@ -83,3 +77,16 @@ params: applicability: only: thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - enabled diff --git a/models/anthropic/claude-opus-4-5-20251101.yaml b/models/anthropic/claude-opus-4-5-20251101.yaml new file mode 100644 index 0000000..02f1fb9 --- /dev/null +++ b/models/anthropic/claude-opus-4-5-20251101.yaml @@ -0,0 +1,106 @@ +# yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json +provider: anthropic +authType: api_key +model: claude-opus-4-5-20251101 +params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. Lower values make outputs more focused; higher values make them more + varied. + default: 1 + range: + min: 0 + max: 1 + step: 0.1 + group: sampling + applicability: + except: + - thinking.type: + - enabled + - top_p: + not: null + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling by limiting generation to tokens whose cumulative probability + reaches this value. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + - thinking.type: + - enabled + - temperature: + not: null + - path: top_k + type: integer + label: Top K + description: Limits token sampling to the top K most likely next tokens. + default: 0 + range: + min: 0 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: thinking.type + type: enum + label: Thinking mode + description: Controls the Anthropic thinking mode values supported by this model. + default: disabled + values: + - disabled + - enabled + group: reasoning + - path: thinking.budget_tokens + type: integer + label: Budget tokens + description: >- + Maximum token budget Anthropic may use for extended thinking before producing the final + answer. + default: 4096 + range: + min: 1024 + group: reasoning + applicability: + only: + thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - enabled + - path: output_config.effort + type: enum + label: Effort + description: Controls Anthropic response thoroughness and token spend. + default: high + values: + - low + - medium + - high + group: reasoning diff --git a/models/anthropic/claude-opus-4-6.yaml b/models/anthropic/claude-opus-4-6.yaml index c7f567f..fa1b128 100644 --- a/models/anthropic/claude-opus-4-6.yaml +++ b/models/anthropic/claude-opus-4-6.yaml @@ -27,6 +27,7 @@ params: except: - thinking.type: - enabled + - adaptive - top_p: not: null - path: top_p @@ -45,6 +46,7 @@ params: except: - thinking.type: - enabled + - adaptive - temperature: not: null - path: top_k @@ -59,6 +61,7 @@ params: except: thinking.type: - enabled + - adaptive - path: thinking.type type: enum label: Thinking mode @@ -66,6 +69,7 @@ params: default: disabled values: - disabled + - adaptive - enabled group: reasoning - path: thinking.budget_tokens @@ -81,3 +85,28 @@ params: applicability: only: thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - adaptive + - enabled + - path: output_config.effort + type: enum + label: Effort + description: Controls Anthropic response thoroughness and token spend. + default: high + values: + - low + - medium + - high + - max + group: reasoning diff --git a/models/anthropic/claude-opus-4-7.yaml b/models/anthropic/claude-opus-4-7.yaml index 414f3f6..b6a2340 100644 --- a/models/anthropic/claude-opus-4-7.yaml +++ b/models/anthropic/claude-opus-4-7.yaml @@ -18,4 +18,30 @@ params: default: disabled values: - disabled + - adaptive + group: reasoning + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: omitted + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - adaptive + - path: output_config.effort + type: enum + label: Effort + description: Controls Anthropic response thoroughness and token spend. + default: high + values: + - low + - medium + - high + - xhigh + - max group: reasoning diff --git a/models/anthropic/claude-sonnet-4.yaml b/models/anthropic/claude-sonnet-4-20250514.yaml similarity index 83% rename from models/anthropic/claude-sonnet-4.yaml rename to models/anthropic/claude-sonnet-4-20250514.yaml index cc35e74..6c9c0df 100644 --- a/models/anthropic/claude-sonnet-4.yaml +++ b/models/anthropic/claude-sonnet-4-20250514.yaml @@ -1,7 +1,7 @@ # yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json provider: anthropic authType: api_key -model: claude-sonnet-4 +model: claude-sonnet-4-20250514 params: - path: max_tokens type: integer @@ -25,9 +25,8 @@ params: group: sampling applicability: except: - thinking.type: - - adaptive - - enabled + - thinking.type: + - enabled - path: top_p type: number label: Top P @@ -43,10 +42,7 @@ params: applicability: except: - thinking.type: - - adaptive - enabled - - temperature: - not: 1 - path: top_k type: integer label: Top K @@ -58,7 +54,6 @@ params: applicability: except: thinking.type: - - adaptive - enabled - path: thinking.type type: enum @@ -67,7 +62,6 @@ params: default: disabled values: - disabled - - adaptive - enabled group: reasoning - path: thinking.budget_tokens @@ -83,3 +77,16 @@ params: applicability: only: thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - enabled diff --git a/models/anthropic/claude-sonnet-4-6.yaml b/models/anthropic/claude-sonnet-4-6.yaml index 5e65af2..331fb62 100644 --- a/models/anthropic/claude-sonnet-4-6.yaml +++ b/models/anthropic/claude-sonnet-4-6.yaml @@ -27,6 +27,7 @@ params: except: - thinking.type: - enabled + - adaptive - top_p: not: null - path: top_p @@ -45,6 +46,7 @@ params: except: - thinking.type: - enabled + - adaptive - temperature: not: null - path: top_k @@ -59,6 +61,7 @@ params: except: thinking.type: - enabled + - adaptive - path: thinking.type type: enum label: Thinking mode @@ -66,6 +69,7 @@ params: default: disabled values: - disabled + - adaptive - enabled group: reasoning - path: thinking.budget_tokens @@ -81,3 +85,28 @@ params: applicability: only: thinking.type: enabled + - path: thinking.display + type: enum + label: Thinking display + description: Controls whether Anthropic returns summarized or omitted thinking content. + default: summarized + values: + - summarized + - omitted + group: reasoning + applicability: + only: + thinking.type: + - adaptive + - enabled + - path: output_config.effort + type: enum + label: Effort + description: Controls Anthropic response thoroughness and token spend. + default: high + values: + - low + - medium + - high + - max + group: reasoning diff --git a/models/deepseek/deepseek-chat.yaml b/models/deepseek/deepseek-chat.yaml index 3edd920..3dab4b2 100644 --- a/models/deepseek/deepseek-chat.yaml +++ b/models/deepseek/deepseek-chat.yaml @@ -3,12 +3,52 @@ provider: deepseek authType: api_key model: deepseek-chat params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. In DeepSeek thinking mode this parameter is accepted for compatibility + but has no effect. + default: 1 + range: + min: 0 + max: 2 + step: 0.1 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling. In DeepSeek thinking mode this parameter is accepted for + compatibility but has no effect. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + thinking.type: + - enabled - path: thinking.type type: enum label: Thinking mode - description: Controls whether DeepSeek thinking mode is enabled for this model. - default: enabled + description: Controls whether DeepSeek uses thinking mode before producing the final answer. + default: disabled values: - - enabled - disabled + - enabled group: reasoning diff --git a/models/deepseek/deepseek-reasoner.yaml b/models/deepseek/deepseek-reasoner.yaml index bd0409f..48bbd7c 100644 --- a/models/deepseek/deepseek-reasoner.yaml +++ b/models/deepseek/deepseek-reasoner.yaml @@ -3,12 +3,64 @@ provider: deepseek authType: api_key model: deepseek-reasoner params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. In DeepSeek thinking mode this parameter is accepted for compatibility + but has no effect. + default: 1 + range: + min: 0 + max: 2 + step: 0.1 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling. In DeepSeek thinking mode this parameter is accepted for + compatibility but has no effect. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: thinking.type + type: enum + label: Thinking mode + description: Controls whether DeepSeek uses thinking mode before producing the final answer. + default: enabled + values: + - enabled + - disabled + group: reasoning - path: reasoning_effort type: enum label: Reasoning effort - description: Controls DeepSeek thinking effort for the legacy thinking-mode model alias. + description: Controls DeepSeek thinking effort when thinking mode is enabled. default: high values: - high - max group: reasoning + applicability: + only: + thinking.type: enabled diff --git a/models/deepseek/deepseek-v3.1.yaml b/models/deepseek/deepseek-v3.1.yaml deleted file mode 100644 index 962826d..0000000 --- a/models/deepseek/deepseek-v3.1.yaml +++ /dev/null @@ -1,14 +0,0 @@ -# yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json -provider: deepseek -authType: api_key -model: deepseek-v3.1 -params: - - path: thinking.type - type: enum - label: Thinking mode - description: Controls whether DeepSeek thinking mode is enabled for this legacy model ID. - default: enabled - values: - - enabled - - disabled - group: reasoning diff --git a/models/deepseek/deepseek-v3.2.yaml b/models/deepseek/deepseek-v3.2.yaml deleted file mode 100644 index 468008b..0000000 --- a/models/deepseek/deepseek-v3.2.yaml +++ /dev/null @@ -1,14 +0,0 @@ -# yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json -provider: deepseek -authType: api_key -model: deepseek-v3.2 -params: - - path: thinking.type - type: enum - label: Thinking mode - description: Controls whether DeepSeek thinking mode is enabled for this legacy model ID. - default: enabled - values: - - enabled - - disabled - group: reasoning diff --git a/models/deepseek/deepseek-v4-flash.yaml b/models/deepseek/deepseek-v4-flash.yaml index 8a08870..f0dde90 100644 --- a/models/deepseek/deepseek-v4-flash.yaml +++ b/models/deepseek/deepseek-v4-flash.yaml @@ -3,6 +3,46 @@ provider: deepseek authType: api_key model: deepseek-v4-flash params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. In DeepSeek thinking mode this parameter is accepted for compatibility + but has no effect. + default: 1 + range: + min: 0 + max: 2 + step: 0.1 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling. In DeepSeek thinking mode this parameter is accepted for + compatibility but has no effect. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + thinking.type: + - enabled - path: thinking.type type: enum label: Thinking mode diff --git a/models/deepseek/deepseek-v4-pro.yaml b/models/deepseek/deepseek-v4-pro.yaml index 9d197d4..cb3ceda 100644 --- a/models/deepseek/deepseek-v4-pro.yaml +++ b/models/deepseek/deepseek-v4-pro.yaml @@ -3,6 +3,46 @@ provider: deepseek authType: api_key model: deepseek-v4-pro params: + - path: max_tokens + type: integer + label: Max tokens + description: Maximum number of output tokens the model may generate. + default: 4096 + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. In DeepSeek thinking mode this parameter is accepted for compatibility + but has no effect. + default: 1 + range: + min: 0 + max: 2 + step: 0.1 + group: sampling + applicability: + except: + thinking.type: + - enabled + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling. In DeepSeek thinking mode this parameter is accepted for + compatibility but has no effect. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + applicability: + except: + thinking.type: + - enabled - path: thinking.type type: enum label: Thinking mode diff --git a/models/deepseek/deepseek-v4.yaml b/models/deepseek/deepseek-v4.yaml deleted file mode 100644 index 22daa1c..0000000 --- a/models/deepseek/deepseek-v4.yaml +++ /dev/null @@ -1,14 +0,0 @@ -# yaml-language-server: $schema=https://modelparameters.dev/api/v1/schema.json -provider: deepseek -authType: api_key -model: deepseek-v4 -params: - - path: thinking.type - type: enum - label: Thinking mode - description: Controls whether DeepSeek thinking mode is enabled for this legacy model ID. - default: enabled - values: - - enabled - - disabled - group: reasoning