No mezcles cuerpos de solicitud entre protocolos. Las API compatibles con OpenAI usan
https://moxus.ai/v1, las API compatibles con Anthropic usan https://moxus.ai, y las API compatibles con Google usan https://moxus.ai/v1beta.Campos comunes
| Parámetro | Tipo | Obligatorio | Predeterminado | Rango | Significado |
|---|---|---|---|---|---|
model | cadena | Sí | Ninguno | - | Nombre del modelo. Copia el nombre exacto desde Model Square. |
messages | arreglo | Obligatorio para chat / Claude | Ninguno | - | Mensajes de la conversación. La estructura de los mensajes difiere entre OpenAI y Anthropic. |
input | cadena / arreglo / objeto | Habitual en Responses | Ninguno | - | Campo de entrada principal para Responses y algunos modelos. |
prompt | cadena / arreglo | Algunas API de finalización o de imágenes | Ninguno | - | Prompt único o prompt de generación de imágenes. |
stream | booleano | No | false | true / false | Devuelve respuestas en streaming. |
metadata | objeto | No | Ninguno | - | Metadatos personalizados para trazabilidad del negocio. No incluyas secretos aquí. |
user | cadena / objeto | No | Ninguno | - | Identificador de usuario del lado del cliente. Algunos proveedores lo admiten; otros lo ignoran. |
Muestreo y longitud
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
temperature | número | Predeterminado del modelo | [0, 2] | Controla la aleatoriedad. Un valor más bajo es más estable; uno más alto es más diverso. |
top_p | número | Predeterminado del modelo | [0, 1] | Umbral de muestreo por núcleo (nucleus sampling). Evita cambiar temperature y top_p de forma agresiva al mismo tiempo. |
top_k | entero / número | Predeterminado del modelo | [1, +∞) | Limita los tokens candidatos. Es común en Anthropic y Google; no siempre es compatible con los modelos de OpenAI. |
max_tokens | entero | Predeterminado del modelo | [0, límite] | Máximo de tokens de salida para Chat Completions y llamadas al estilo de Anthropic. |
max_completion_tokens | entero | Predeterminado del modelo | [0, límite] | Límite de salida para algunos modelos más recientes de OpenAI. |
max_output_tokens | entero | Predeterminado del modelo | [0, límite] | Límite de salida para la API de Responses y las llamadas nativas de Google. |
stop | cadena / arreglo | Ninguno | - | Secuencia de parada compatible con OpenAI. |
stop_sequences | arreglo | Ninguno | - | Secuencias de parada nativas de Anthropic / Google. |
n | entero | 1 | [1, +∞) | Número de candidatos. Más candidatos suelen costar más. |
seed | número / entero | Ninguno | - | Intenta una salida determinista. La reproducibilidad depende del modelo y del proveedor. |
Parámetros de OpenAI Chat Completions
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
messages | arreglo | Ninguno | system / user / assistant / tool | Mensajes de la conversación. |
response_format | objeto | Ninguno | json_object / json_schema | Solicita al modelo que devuelva JSON o una salida restringida por esquema. |
tools | arreglo | Ninguno | - | Declara las herramientas que el modelo puede invocar. |
tool_choice | cadena / objeto | auto | auto / none / {...} | Controla si se llama a una herramienta o a cuál. |
parallel_tool_calls | booleano | Predeterminado del modelo | true / false | Permite múltiples llamadas a herramientas en una sola respuesta. |
logprobs | booleano | false | true / false | Devuelve las probabilidades logarítmicas de los tokens si es compatible. |
top_logprobs | entero | Ninguno | [0, 20] | Número de logprobs de tokens candidatos por posición. |
frequency_penalty | número | 0 | [-2, 2] | Penaliza la frecuencia de tokens repetidos. |
presence_penalty | número | 0 | [-2, 2] | Fomenta temas nuevos cuando es positivo. |
logit_bias | objeto | Ninguno | [-100, 100] | Ajusta la probabilidad de IDs de tokens específicos. |
modalities | arreglo | Predeterminado del modelo | text / audio | Modalidades de salida, según el soporte del modelo. |
audio | objeto | Ninguno | - | Configuración de salida de audio. |
Parámetros de OpenAI Responses
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
input | cadena / arreglo | Ninguno | - | Entrada principal de la API de Responses. |
instructions | cadena | Ninguno | - | Instrucciones globales, similares a un system prompt. |
previous_response_id | cadena | Ninguno | - | Continúa a partir de una llamada anterior a Responses. |
max_output_tokens | entero | Predeterminado del modelo | [0, límite] | Máximo de tokens de salida. |
reasoning | objeto | Predeterminado del modelo | - | Configuración de razonamiento para modelos de razonamiento. |
text | objeto | Predeterminado del modelo | - | Configuración del formato de salida de texto. |
tools | arreglo / objeto | Ninguno | - | Configuración de herramientas de Responses. |
tool_choice | cadena / objeto | auto | auto / none / {...} | Controla el uso de herramientas. |
truncation | cadena | Predeterminado del modelo | auto / disabled | Comportamiento cuando la entrada es demasiado larga. |
include | arreglo | Ninguno | - | Solicita campos adicionales en la respuesta. |
store | booleano | Predeterminado del upstream | true / false | Indica si el upstream puede almacenar la salida. La configuración del canal puede controlar el passthrough. |
Parámetros compatibles con Anthropic
| Parámetro | Tipo | Obligatorio | Predeterminado | Rango | Significado |
|---|---|---|---|---|---|
model | cadena | Sí | Ninguno | - | Nombre del modelo Claude o compatible con Anthropic. |
messages | arreglo | Sí | Ninguno | user / assistant | Contenido de mensajes de Claude Messages. |
system | cadena / arreglo | No | Ninguno | - | Instrucción del sistema. |
max_tokens | entero | Habitualmente obligatorio | Ninguno | [0, límite] | Máximo de tokens de salida. |
temperature | número | Predeterminado del modelo | [0, 1] | Controla la aleatoriedad. Algunos modelos Claude pueden rechazar parámetros de muestreo no predeterminados. | |
top_p | número | Predeterminado del modelo | [0, 1] | Muestreo por núcleo. | |
top_k | entero | Predeterminado del modelo | [1, +∞) | Límite de tokens candidatos. | |
stop_sequences | arreglo | Ninguno | - | Secuencias de parada. | |
stream | booleano | false | true / false | Devuelve respuesta en streaming. | |
tools | arreglo | Ninguno | - | Declara herramientas de Claude. | |
tool_choice | objeto | auto | auto / any / tool | Controla la selección de herramientas. | |
thinking | objeto | Predeterminado del modelo | enabled / disabled | Configuración de thinking de Claude, según el soporte del modelo. | |
metadata | objeto | Ninguno | - | Metadatos del negocio. Evita datos sensibles. |
Parámetros compatibles con Google
Las API nativas de Google suelen colocar los parámetros de generación engenerationConfig. Moxus AI también acepta algunos campos en snake_case, como top_p y max_output_tokens.
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
contents | arreglo / cadena | Ninguno | - | Entrada principal nativa de Google. |
systemInstruction | objeto / cadena | Ninguno | - | Instrucción del sistema nativa de Google. |
tools | arreglo / objeto | Ninguno | - | Declaraciones de herramientas o de búsqueda. |
generationConfig.temperature | número | Predeterminado del modelo | [0, 2] | Controla la aleatoriedad. |
generationConfig.topP / top_p | número | Predeterminado del modelo | [0, 1] | Muestreo por núcleo. |
generationConfig.topK / top_k | número | Predeterminado del modelo | [1, +∞) | Límite de tokens candidatos. |
generationConfig.maxOutputTokens / max_output_tokens | entero | Predeterminado del modelo | [0, límite] | Límite de tokens de salida. |
generationConfig.candidateCount | entero | 1 | [1, +∞) | Número de candidatos. |
generationConfig.stopSequences | arreglo | Ninguno | - | Secuencias de parada. |
generationConfig.responseMimeType | cadena | Ninguno | application/json / text/plain | Tipo MIME de la respuesta. |
generationConfig.responseSchema | objeto | Ninguno | - | Esquema de salida estructurada. |
generationConfig.presencePenalty | número | 0 | [-2, 2] | Penalización por repetición de temas. |
generationConfig.frequencyPenalty | número | 0 | [-2, 2] | Penalización por frecuencia de tokens. |
generationConfig.seed | entero | Ninguno | - | Semilla aleatoria. |
generationConfig.thinkingConfig | objeto | Predeterminado del modelo | - | Presupuesto o activación de thinking. |
generationConfig.responseModalities | arreglo | Predeterminado del modelo | TEXT / IMAGE | Modalidades de salida, según el soporte del modelo. |
Parámetros de generación de imágenes
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
model | cadena | Ninguno | - | Modelo de generación de imágenes. |
prompt | cadena | Ninguno | - | Prompt de generación de imágenes. |
n | entero | 1 | [1, 128] | Número de imágenes. Más imágenes cuestan más. |
size | cadena | Predeterminado del modelo | - | Tamaño de salida. Los valores permitidos dependen del modelo. |
quality | cadena | auto | - | Nivel de calidad de la imagen, según el modelo. |
response_format | cadena | Predeterminado del modelo | url / b64_json | Formato de respuesta de la imagen. |
background | cadena / objeto | Predeterminado del modelo | transparent / opaque / auto | Configuración del fondo. |
output_format | cadena | Predeterminado del modelo | png / jpeg / webp | Formato de la imagen de salida. |
output_compression | entero | Predeterminado del modelo | [0, 100] | Calidad de compresión, compatible con algunos formatos. |
stream | booleano | false | true / false | Transmite el progreso o imágenes parciales cuando es compatible. |
metadata / campos extra | objeto | Ninguno | - | Parámetros de passthrough específicos del proveedor. |
Parámetros de audio
| Parámetro | Tipo | Predeterminado | Rango | Significado |
|---|---|---|---|---|
model | cadena | Ninguno | - | Modelo de voz a invocar. |
input | cadena | Ninguno | - | Entrada para tareas de TTS o audio. |
voice | cadena | Predeterminado del modelo | - | Nombre de la voz, según el soporte del modelo. |
instructions | cadena | Ninguno | - | Indicaciones para la generación de voz. |
response_format | cadena | Predeterminado del modelo | mp3 / wav / json | Formato de la respuesta. |
speed | número | 1 | [0.25, 4] | Velocidad del habla, según el soporte del modelo. |
stream_format | cadena | Ninguno | sse | Formato de audio en streaming. |
metadata | objeto | Ninguno | - | Trazabilidad del negocio o extensiones del proveedor. |
Campos relacionados con la privacidad
| Parámetro | Tipo | Predeterminado | Comportamiento de la plataforma | Significado |
|---|---|---|---|---|
store | booleano | Predeterminado del upstream | Se pasa por defecto; se puede deshabilitar mediante la configuración del canal | Controla si el upstream puede almacenar la solicitud o la salida. |
safety_identifier | cadena | Ninguno | Filtrado por defecto salvo que un canal lo permita explícitamente | Identificador de seguridad del upstream. Úsalo con cuidado porque puede identificar a los usuarios. |
stream_options.include_obfuscation | booleano | Predeterminado del upstream | Filtrado por defecto salvo que se permita explícitamente | Controla el comportamiento de ofuscación en streaming. |
metadata | objeto | Ninguno | Puede registrarse o pasarse | Metadatos personalizados. No incluyas aquí claves de API, contraseñas ni datos personales sensibles. |
Recomendaciones
- Para una primera llamada, envía solo
modeljunto conmessagesoinput. - Si tienes dudas, ajusta primero un solo parámetro de muestreo, normalmente
temperature. - Configura
max_tokensomax_output_tokenscuando el costo o la longitud de la respuesta sean importantes. - Para la llamada a herramientas, empieza con un esquema simple antes de agregar campos complejos.
- No incluyas claves de API, URLs de bases de datos, números de identidad ni otros datos sensibles en
metadatao en los prompts.
