Completamenti chat

Crea risposte conversazionali usando vari modelli di IA tramite un’API unificata.

Creare un completamento chat

POST https://aiberm.com/v1/chat/completions

1curl https://aiberm.com/v1/chat/completions \
2-H "Content-Type: application/json" \
3-H "Authorization: Bearer YOUR_API_KEY" \
4-d '{
5 "model": "gpt-4",
6 "messages": [
7 {"role": "system", "content": "You are a helpful assistant."},
8 {"role": "user", "content": "What is the capital of France?"}
9 ],
10 "temperature": 0.7
11}'

Parametri della richiesta

ParametroTipoObbligatorioDescrizione
modelstringID del modello da utilizzare
messagesarrayArray di oggetti messaggio
temperaturenumberNoTemperatura di campionamento (0-2). Predefinito: 1
max_tokensintegerNoNumero massimo di token da generare
top_pnumberNoParametro di nucleus sampling
streambooleanNoSe inviare le risposte in streaming

Ruoli dei messaggi

I messaggi devono includere un role e un content:

  • system - Imposta il comportamento/la personalità dell’assistente
  • user - Messaggi dell’utente finale
  • assistant - Risposte precedenti dell’IA

Risposte in streaming

Abilita lo streaming per ricevere le risposte in modo incrementale:

1from openai import OpenAI
2 
3client = OpenAI(
4 api_key="YOUR_API_KEY",
5 base_url="https://aiberm.com/v1"
6)
7 
8stream = client.chat.completions.create(
9 model="gpt-4",
10 messages=[{"role": "user", "content": "Tell me a story"}],
11 stream=True
12)
13 
14for chunk in stream:
15 if chunk.choices[0].delta.content:
16 print(chunk.choices[0].delta.content, end="")

Best practice

Ottimizza le tue richieste
  • Imposta max_tokens per limitare i costi
  • Usa valori di temperature appropriati (più bassi per contenuti fattuali, più alti per quelli creativi)
  • Includi messaggi di sistema per guidare il comportamento
  • Trasmetti le risposte in streaming per una migliore UX
Warning

Fai attenzione ai limiti di token di ciascun modello. Le conversazioni più lunghe potrebbero richiedere una gestione della cronologia.