Skip to main content
Base URL: https://router.flatkey.ai Tạo văn bản chạy qua POST /v1/chat/completions, khớp hoàn toàn với OpenAI Chat Completions API. Mọi client tương thích OpenAI đều hoạt động sau khi bạn thay đổi base URL.

Không cần viết lại

Giữ nguyên code request hiện có và trỏ base_url vào https://router.flatkey.ai/v1.

Một key, mọi mô hình

Chuyển đổi mô hình bằng cách thay đổi trường model. Không có gì khác thay đổi.

Thực hiện lệnh gọi đầu tiên

Chọn mô hình

Liệt kê tất cả những gì tài khoản của bạn có thể truy cập và giữ lại các mô hình văn bản:
Duyệt danh sách tương tự với giá cả, độ dài context và độ trễ trên thư mục mô hình. Điểm khởi đầu thực tế:

Stream phản hồi

Đặt stream: true để nhận token ngay khi chúng được tạo ra:
Mỗi chunk mang một delta một phần thay vì một tin nhắn hoàn chỉnh.

Gọi các hàm của bạn

Truyền định nghĩa tool và mô hình sẽ quyết định khi nào gọi chúng:
Để hoàn tất vòng lặp, thêm tin nhắn assistant, sau đó một tin nhắn cho mỗi kết quả tool được khóa bởi tool_call_id, và gửi toàn bộ thread trở lại.
Khi một tool được kích hoạt, finish_reasontool_calls, không phải stop. Code chỉ kiểm tra stop sẽ bỏ qua lệnh gọi một cách lặng lẽ.
Gọi tool là khả năng của mô hình, không phải của Flatkey. Các dòng GPT, Claude, Gemini, Qwen, DeepSeek và GLM đều hỗ trợ. Các mô hình hình ảnh, video và giọng nói bỏ qua mảng tools.

Ép buộc một dạng JSON

Sử dụng response_format khi bạn cần phân tích cú pháp câu trả lời:
{"type": "json_object"} cũng hoạt động khi bạn chỉ cần JSON hợp lệ mà không có schema cố định.

Đọc lượng token sử dụng

Mọi phản hồi đều mang theo số đếm mà bạn được tính phí:
Các dòng mô hình khác nhau token hóa khác nhau, vì vậy cùng một văn bản sẽ tốn số token khác nhau trên các mô hình khác nhau. Sử dụng usage thay vì ước tính từ số ký tự. Chi phí mỗi request cũng xuất hiện trong Nhật ký sử dụng.

Khắc phục sự cố

No available channel for model ... Mô hình đó hiện không thể định tuyến. Chọn id khác từ /v1/models. Thử lại cùng một mô hình không giải quyết được vấn đề này. Phản hồi dừng giữa chừng finish_reasonlength. Tăng max_tokens. Các lệnh gọi tool không bao giờ kích hoạt Xác nhận mô hình hỗ trợ tool, và kiểm tra tool_choice không được đặt thành none.

Bước tiếp theo

Tài liệu tham khảo API

Mọi tham số và trường phản hồi.

Hướng dẫn OpenAI SDK

Tích hợp Flatkey vào dự án OpenAI hiện có.