Completaciones de chat

Crea respuestas conversacionales con distintos modelos de IA a través de una API unificada.

Crear una completación de chat

POST https://aiberm.com/v1/chat/completions

1curl https://aiberm.com/v1/chat/completions \
2-H "Content-Type: application/json" \
3-H "Authorization: Bearer YOUR_API_KEY" \
4-d '{
5 "model": "gpt-4",
6 "messages": [
7 {"role": "system", "content": "You are a helpful assistant."},
8 {"role": "user", "content": "What is the capital of France?"}
9 ],
10 "temperature": 0.7
11}'

Parámetros de la solicitud

ParámetroTipoObligatorioDescripción
modelstringID del modelo que se usará
messagesarrayArreglo de objetos de mensaje
temperaturenumberNoTemperatura de muestreo (0-2). Predeterminado: 1
max_tokensintegerNoMáximo de tokens a generar
top_pnumberNoParámetro de muestreo nuclear
streambooleanNoSi se deben transmitir las respuestas

Roles de mensaje

Los mensajes deben incluir un role y un content:

  • system - Define el comportamiento/personalidad del asistente
  • user - Mensajes del usuario final
  • assistant - Respuestas anteriores de la IA

Respuestas en streaming

Activa el streaming para recibir las respuestas de forma incremental:

1from openai import OpenAI
2 
3client = OpenAI(
4 api_key="YOUR_API_KEY",
5 base_url="https://aiberm.com/v1"
6)
7 
8stream = client.chat.completions.create(
9 model="gpt-4",
10 messages=[{"role": "user", "content": "Tell me a story"}],
11 stream=True
12)
13 
14for chunk in stream:
15 if chunk.choices[0].delta.content:
16 print(chunk.choices[0].delta.content, end="")

Mejores prácticas

Optimiza tus solicitudes
  • Define max_tokens para limitar los costos
  • Usa valores de temperature adecuados (más bajos para hechos, más altos para creatividad)
  • Incluye mensajes de sistema para orientar el comportamiento
  • Transmite las respuestas para una mejor experiencia de usuario
Warning

Ten en cuenta los límites de tokens de cada modelo. Las conversaciones largas pueden requerir gestión del historial.