diff --git a/models/moonshot/moonshot-v1-8k-vision-preview.yaml b/models/moonshot/moonshot-v1-8k-vision-preview.yaml new file mode 100644 index 0000000..b30afcc --- /dev/null +++ b/models/moonshot/moonshot-v1-8k-vision-preview.yaml @@ -0,0 +1,75 @@ +# yaml-language-server: $schema=https://modelparams.dev/api/v1/schema.json +provider: moonshot +authType: api_key +model: moonshot-v1-8k-vision-preview +params: + - path: max_completion_tokens + type: integer + label: Max tokens + description: Maximum number of tokens to generate in the chat completion. + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: >- + Controls randomness. Lower values make outputs more focused; higher values make them more + varied. + default: 0.3 + range: + min: 0 + max: 1 + step: 0.1 + group: sampling + - path: top_p + type: number + label: Top P + description: >- + Controls nucleus sampling by limiting generation to tokens within the selected cumulative + probability. + default: 1 + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + - path: n + type: integer + label: Number of completions + description: How many chat completion choices to generate for the request. + default: 1 + range: + min: 1 + max: 5 + group: generation_length + - path: presence_penalty + type: number + label: Presence penalty + description: >- + Penalizes tokens that have already appeared, encouraging the model to talk about new topics. + default: 0 + range: + min: -2 + max: 2 + step: 0.1 + group: sampling + - path: frequency_penalty + type: number + label: Frequency penalty + description: Penalizes tokens by how often they have appeared, reducing verbatim repetition. + default: 0 + range: + min: -2 + max: 2 + step: 0.1 + group: sampling + - path: response_format.type + type: enum + label: Response format + description: Forces the response into plain text or a JSON object. + default: text + values: + - text + - json_object + group: output_format diff --git a/packages/modelparams/src/generated/data.ts b/packages/modelparams/src/generated/data.ts index 21b9c99..465759f 100644 --- a/packages/modelparams/src/generated/data.ts +++ b/packages/modelparams/src/generated/data.ts @@ -11305,6 +11305,99 @@ export const CATALOG = [ } ] }, + { + "provider": "moonshot", + "authType": "api_key", + "model": "moonshot-v1-8k-vision-preview", + "params": [ + { + "path": "max_completion_tokens", + "label": "Max tokens", + "description": "Maximum number of tokens to generate in the chat completion.", + "group": "generation_length", + "type": "integer", + "range": { + "min": 1 + } + }, + { + "path": "temperature", + "label": "Temperature", + "description": "Controls randomness. Lower values make outputs more focused; higher values make them more varied.", + "group": "sampling", + "type": "number", + "default": 0.3, + "range": { + "min": 0, + "max": 1, + "step": 0.1 + } + }, + { + "path": "top_p", + "label": "Top P", + "description": "Controls nucleus sampling by limiting generation to tokens within the selected cumulative probability.", + "group": "sampling", + "type": "number", + "default": 1, + "range": { + "min": 0, + "max": 1, + "step": 0.01 + } + }, + { + "path": "n", + "label": "Number of completions", + "description": "How many chat completion choices to generate for the request.", + "group": "generation_length", + "type": "integer", + "default": 1, + "range": { + "min": 1, + "max": 5 + } + }, + { + "path": "presence_penalty", + "label": "Presence penalty", + "description": "Penalizes tokens that have already appeared, encouraging the model to talk about new topics.", + "group": "sampling", + "type": "number", + "default": 0, + "range": { + "min": -2, + "max": 2, + "step": 0.1 + } + }, + { + "path": "frequency_penalty", + "label": "Frequency penalty", + "description": "Penalizes tokens by how often they have appeared, reducing verbatim repetition.", + "group": "sampling", + "type": "number", + "default": 0, + "range": { + "min": -2, + "max": 2, + "step": 0.1 + } + }, + { + "path": "response_format.type", + "label": "Response format", + "description": "Forces the response into plain text or a JSON object.", + "group": "output_format", + "type": "enum", + "default": "text", + "values": [ + "text", + "json_object" + ] + } + ] + }, { "provider": "nvidia", "authType": "api_key", diff --git a/packages/modelparams/src/generated/defaults.ts b/packages/modelparams/src/generated/defaults.ts index cbd36bb..056918f 100644 --- a/packages/modelparams/src/generated/defaults.ts +++ b/packages/modelparams/src/generated/defaults.ts @@ -849,6 +849,14 @@ export const DEFAULTS = { frequency_penalty: 0, "response_format.type": "text", }, + "moonshot/moonshot-v1-8k-vision-preview": { + temperature: 0.3, + top_p: 1, + n: 1, + presence_penalty: 0, + frequency_penalty: 0, + "response_format.type": "text", + }, "nvidia/gliner-pii": { threshold: 0.5, chunk_length: 384, diff --git a/packages/modelparams/src/generated/model-ids.ts b/packages/modelparams/src/generated/model-ids.ts index 91b724d..6f339f1 100644 --- a/packages/modelparams/src/generated/model-ids.ts +++ b/packages/modelparams/src/generated/model-ids.ts @@ -132,6 +132,7 @@ export const MODEL_IDS = [ "moonshot/moonshot-v1-128k", "moonshot/moonshot-v1-32k", "moonshot/moonshot-v1-8k", + "moonshot/moonshot-v1-8k-vision-preview", "nvidia/gliner-pii", "nvidia/llama-3.1-nemoguard-8b-topic-control", "nvidia/llama-3.1-nemotron-nano-8b-v1", diff --git a/packages/modelparams/src/generated/params-by-id.ts b/packages/modelparams/src/generated/params-by-id.ts index d941b55..0039e93 100644 --- a/packages/modelparams/src/generated/params-by-id.ts +++ b/packages/modelparams/src/generated/params-by-id.ts @@ -1068,6 +1068,15 @@ export type ParamsById = { frequency_penalty: number; "response_format.type": "text" | "json_object"; }; + "moonshot/moonshot-v1-8k-vision-preview": { + max_completion_tokens: number; + temperature: number; + top_p: number; + n: number; + presence_penalty: number; + frequency_penalty: number; + "response_format.type": "text" | "json_object"; + }; "nvidia/gliner-pii": { threshold: number; chunk_length: number;