Complétions de chat
Créez des réponses conversationnelles à l’aide de différents modèles d’IA via une API unifiée.
Créer une complétion de chat
POST https://aiberm.com/v1/chat/completions
1curl https://aiberm.com/v1/chat/completions \2-H "Content-Type: application/json" \3-H "Authorization: Bearer YOUR_API_KEY" \4-d '{5 "model": "gpt-4",6 "messages": [7 {"role": "system", "content": "You are a helpful assistant."},8 {"role": "user", "content": "What is the capital of France?"}9 ],10 "temperature": 0.711}'Paramètres de la requête
| Paramètre | Type | Obligatoire | Description |
|---|---|---|---|
model | string | Oui | Identifiant du modèle à utiliser |
messages | array | Oui | Tableau d’objets message |
temperature | number | Non | Température d’échantillonnage (0-2). Par défaut : 1 |
max_tokens | integer | Non | Nombre maximal de jetons à générer |
top_p | number | Non | Paramètre d’échantillonnage nucleus |
stream | boolean | Non | Indique s’il faut diffuser les réponses |
Rôles des messages
Les messages doivent inclure un role et un content :
- system - Définit le comportement / la personnalité de l’assistant
- user - Messages de l’utilisateur final
- assistant - Réponses précédentes de l’IA
Réponses en streaming
Activez le streaming pour recevoir les réponses de façon incrémentale :
1from openai import OpenAI2 3client = OpenAI(4 api_key="YOUR_API_KEY",5 base_url="https://aiberm.com/v1"6)7 8stream = client.chat.completions.create(9 model="gpt-4",10 messages=[{"role": "user", "content": "Tell me a story"}],11 stream=True12)13 14for chunk in stream:15 if chunk.choices[0].delta.content:16 print(chunk.choices[0].delta.content, end="")Bonnes pratiques
Optimisez vos requêtes
- Définissez
max_tokenspour limiter les coûts - Utilisez des valeurs de
temperatureadaptées (plus basses pour le factuel, plus élevées pour le créatif) - Incluez des messages système pour guider le comportement
- Diffusez les réponses pour une meilleure expérience utilisateur
Warning
Tenez compte des limites de jetons de chaque modèle. Les conversations plus longues peuvent nécessiter une gestion de l’historique.