Chat Completions

Tạo phản hồi hội thoại bằng nhiều mô hình AI thông qua một API thống nhất.

Tạo Chat Completion

POST https://aiberm.com/v1/chat/completions

1curl https://aiberm.com/v1/chat/completions \
2-H "Content-Type: application/json" \
3-H "Authorization: Bearer YOUR_API_KEY" \
4-d '{
5 "model": "gpt-4",
6 "messages": [
7 {"role": "system", "content": "You are a helpful assistant."},
8 {"role": "user", "content": "What is the capital of France?"}
9 ],
10 "temperature": 0.7
11}'

Tham số yêu cầu

Tham sốKiểuBắt buộcMô tả
modelstringID của mô hình cần dùng
messagesarrayMảng các đối tượng tin nhắn
temperaturenumberKhôngNhiệt độ lấy mẫu (0-2). Mặc định: 1
max_tokensintegerKhôngSố token tối đa được sinh ra
top_pnumberKhôngTham số nucleus sampling
streambooleanKhôngCó stream phản hồi hay không

Vai trò tin nhắn

Tin nhắn phải có rolecontent:

  • system - Thiết lập hành vi/tính cách của trợ lý
  • user - Tin nhắn từ người dùng cuối
  • assistant - Các phản hồi trước đó từ AI

Phản hồi streaming

Bật streaming để nhận phản hồi theo từng phần:

1from openai import OpenAI
2 
3client = OpenAI(
4 api_key="YOUR_API_KEY",
5 base_url="https://aiberm.com/v1"
6)
7 
8stream = client.chat.completions.create(
9 model="gpt-4",
10 messages=[{"role": "user", "content": "Tell me a story"}],
11 stream=True
12)
13 
14for chunk in stream:
15 if chunk.choices[0].delta.content:
16 print(chunk.choices[0].delta.content, end="")

Thực hành tốt nhất

Tối ưu yêu cầu của bạn
  • Đặt max_tokens để giới hạn chi phí
  • Dùng giá trị temperature phù hợp (thấp hơn cho nội dung thực tế, cao hơn cho sáng tạo)
  • Thêm tin nhắn system để hướng dẫn hành vi
  • Stream phản hồi để UX tốt hơn
Warning

Hãy lưu ý giới hạn token của từng mô hình. Các cuộc hội thoại dài có thể cần quản lý lịch sử hội thoại.