Chat Completions
Tạo phản hồi hội thoại bằng nhiều mô hình AI thông qua một API thống nhất.
Tạo Chat Completion
POST https://aiberm.com/v1/chat/completions
1curl https://aiberm.com/v1/chat/completions \2-H "Content-Type: application/json" \3-H "Authorization: Bearer YOUR_API_KEY" \4-d '{5 "model": "gpt-4",6 "messages": [7 {"role": "system", "content": "You are a helpful assistant."},8 {"role": "user", "content": "What is the capital of France?"}9 ],10 "temperature": 0.711}'Tham số yêu cầu
| Tham số | Kiểu | Bắt buộc | Mô tả |
|---|---|---|---|
model | string | Có | ID của mô hình cần dùng |
messages | array | Có | Mảng các đối tượng tin nhắn |
temperature | number | Không | Nhiệt độ lấy mẫu (0-2). Mặc định: 1 |
max_tokens | integer | Không | Số token tối đa được sinh ra |
top_p | number | Không | Tham số nucleus sampling |
stream | boolean | Không | Có stream phản hồi hay không |
Vai trò tin nhắn
Tin nhắn phải có role và content:
- system - Thiết lập hành vi/tính cách của trợ lý
- user - Tin nhắn từ người dùng cuối
- assistant - Các phản hồi trước đó từ AI
Phản hồi streaming
Bật streaming để nhận phản hồi theo từng phần:
1from openai import OpenAI2 3client = OpenAI(4 api_key="YOUR_API_KEY",5 base_url="https://aiberm.com/v1"6)7 8stream = client.chat.completions.create(9 model="gpt-4",10 messages=[{"role": "user", "content": "Tell me a story"}],11 stream=True12)13 14for chunk in stream:15 if chunk.choices[0].delta.content:16 print(chunk.choices[0].delta.content, end="")Thực hành tốt nhất
Tối ưu yêu cầu của bạn
- Đặt
max_tokensđể giới hạn chi phí - Dùng giá trị
temperaturephù hợp (thấp hơn cho nội dung thực tế, cao hơn cho sáng tạo) - Thêm tin nhắn system để hướng dẫn hành vi
- Stream phản hồi để UX tốt hơn
Warning
Hãy lưu ý giới hạn token của từng mô hình. Các cuộc hội thoại dài có thể cần quản lý lịch sử hội thoại.