Hướng dẫn sử dụng

Các ví dụ dưới đây chỉ dùng alias công khai thuộc ba nhóm GPT, Claude và Free. Hãy kiểm tra GET /v1/models trước khi gọi.

Gọi API trực tiếp

Biến môi trường

export AI_MODEL_MARK_URL=https://aimodelmark.com/v1
export AI_MODEL_MARK_KEY=YOUR_API_KEY

Yêu cầu văn bản

curl $AI_MODEL_MARK_URL/chat/completions \
  -H "Authorization: Bearer $AI_MODEL_MARK_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-fable-5-1","messages":[{"role":"user","content":"Giải thích đoạn mã này"}],"stream":false}'

Thêm "stream": true để nhận SSE. Khi retry một tác vụ quan trọng, gửi cùng X-Idempotency-Key và giữ nguyên payload.

curl $AI_MODEL_MARK_URL/chat/completions \
  -H "Authorization: Bearer $AI_MODEL_MARK_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"free-coding","messages":[{"role":"user","content":"Viết test cho hàm này"}],"stream":false}'

Free hoạt động theo khả năng sẵn sàng, không có SLA và có hạn mức thấp hơn. Không gửi dữ liệu nhạy cảm.

Tích hợp công cụ

Dùng cùng một API key, base URL và alias model công khai cho mọi client. Trạng thái dưới đây tách riêng khả năng cấu hình với khả năng chạy agent đầy đủ để bạn không nhầm một kết nối thành công với việc tool-call đã được hỗ trợ.

Thông số chung
Base URL của dịch vụ: https://aimodelmark.com/v1. Dùng đúng URL HTTPS này trong mọi công cụ.
API key: biến môi trường AI_MODEL_MARK_KEY. Model ví dụ: gpt-5.6-sol, claude-fable-5-1 hoặc free-coding.
Kiểm tra trước: GET /v1/models; inference văn bản: POST /v1/chat/completions.

Ứng dụng ChatGPT không có mục đổi trực tiếp sang một OpenAI-compatible API tùy chỉnh. Codex CLI dùng Responses API và vòng lặp công cụ, trong khi pilot hiện chỉ mở Chat Completions văn bản/streaming. Vì vậy chưa dùng API này làm backend đầy đủ cho ChatGPT hoặc Codex.

Muốn kiểm tra model GPT ngay, hãy dùng ví dụ cURL ở đầu trang với alias gpt-5.6-sol. Không đặt API key vào config.toml hoặc mã nguồn. Khi Responses được mở, Codex sẽ dùng một provider riêng trong ~/.codex/config.toml, base URL HTTPS và biến AI_MODEL_MARK_KEY.

Claude Code gọi Anthropic Messages và dùng tool-call nhiều vòng. Các biến cấu hình chuẩn là ANTHROPIC_BASE_URL, ANTHROPIC_API_KEYANTHROPIC_MODEL, nhưng không nên trỏ Claude Code vào gateway cho đến khi endpoint Messages được mở.

# Mẫu dành cho giai đoạn Messages được mở
export ANTHROPIC_BASE_URL=https://aimodelmark.com
export ANTHROPIC_API_KEY="$AI_MODEL_MARK_KEY"
export ANTHROPIC_MODEL=claude-fable-5-1
claude --model claude-fable-5-1

Hiện tại có thể đánh giá cùng alias qua Chat Completions trực tiếp; kết quả đó không chứng minh luồng sửa file/chạy test của Claude Code.

Qwen Code hỗ trợ provider giao thức OpenAI trong ~/.qwen/settings.json. Chỉ tham chiếu tên biến môi trường, không ghi API key thật vào file.

{
  "modelProviders": {
    "openai": [{
      "id": "gpt-5.6-sol",
      "name": "AI Model Mark — GPT 5.6 Sol",
      "envKey": "AI_MODEL_MARK_KEY",
      "baseUrl": "https://aimodelmark.com/v1"
    }]
  },
  "security": { "auth": { "selectedType": "openai" } },
  "model": { "name": "gpt-5.6-sol" }
}

Chọn model bằng /model, sau đó thử một câu hỏi không yêu cầu công cụ. Cấu hình dùng giao thức OpenAI nhưng chưa được nghiệm thu end-to-end với gateway pilot; chế độ coding của Qwen Code vẫn cần tool-call.

Thêm provider OpenAI-compatible vào ~/.config/opencode/opencode.jsonc. Cấu hình này phù hợp để kiểm tra chat văn bản; các thao tác đọc/sửa file và chạy lệnh chưa được cam kết.

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "aimodelmark": {
      "npm": "@ai-sdk/openai-compatible",
      "name": "AI Model Mark",
      "options": {
        "baseURL": "https://aimodelmark.com/v1",
        "apiKey": "{env:AI_MODEL_MARK_KEY}"
      },
      "models": {
        "gpt-5.6-sol": { "name": "GPT 5.6 Sol" },
        "claude-fable-5-1": { "name": "Claude Fable 5.1" }
      }
    }
  },
  "model": "aimodelmark/gpt-5.6-sol"
}

Mở OpenCode, chọn aimodelmark/gpt-5.6-sol và thử một câu hỏi không yêu cầu công cụ trước.

Hermes hỗ trợ provider OpenAI-compatible có tên. Xem đường dẫn cấu hình bằng hermes config path, rồi thêm cấu hình sau; key thật chỉ nằm trong biến môi trường.

model:
  default: "gpt-5.6-sol"
  provider: "aimodelmark"

providers:
  aimodelmark:
    base_url: "https://aimodelmark.com/v1"
    api_mode: chat_completions
    key_env: "AI_MODEL_MARK_KEY"

Kiểm tra cấu hình bằng hermes config check. Hermes là agent dùng công cụ nhiều vòng, do đó chưa coi là tương thích đầy đủ cho tới khi tool-call được mở và có bài test sửa file/chạy test thành công.

Trong phần cấu hình model provider của OpenClaw, chọn giao thức OpenAI Chat Completions và nhập bốn giá trị:

Provider ID: aimodelmark
Base URL:    https://aimodelmark.com/v1
API key env: AI_MODEL_MARK_KEY
Model ID:    gpt-5.6-sol

Không chọn chế độ OpenAI Responses. Hãy xác nhận OpenClaw nhìn thấy model trước; workflow điều khiển công cụ vẫn chờ backend hỗ trợ tool-call.

OpenHands dùng LiteLLM. Có thể chuẩn bị provider OpenAI-compatible bằng các biến sau trong môi trường chạy OpenHands:

LLM_MODEL=openai/gpt-5.6-sol
LLM_BASE_URL=https://aimodelmark.com/v1
LLM_API_KEY=${AI_MODEL_MARK_KEY}

Tiền tố openai/ để LiteLLM chọn giao thức; model gửi lên gateway vẫn là gpt-5.6-sol. OpenHands cần function/tool calling để thao tác workspace, nên chưa dùng cho công việc thật ở pilot hiện tại.

Tạo một provider OpenAI-compatible trong cấu hình Orca và ánh xạ các trường: base_url → URL có hậu tố /v1, api_key_envAI_MODEL_MARK_KEY, model → alias công khai, protocolchat_completions.

Thử endpoint /v1/models rồi chạy một prompt văn bản không có tool. Adapter điều phối và tool-call của Orca chưa được nghiệm thu, vì vậy chưa dùng cho luồng tự động sửa mã.

Trong cấu hình provider của Goose, chọn OpenAI-compatible và dùng:

Provider:  OpenAI-compatible
Base URL: https://aimodelmark.com/v1
API key:  lấy từ AI_MODEL_MARK_KEY
Model:    gpt-5.6-sol

Không lưu key trong repository. Goose dựa vào extension/tool calling để làm việc với máy tính; chỉ kiểm tra được kết nối chat cơ bản trước khi backend mở tool-call.

Với worker dùng OpenAI-compatible adapter, đặt endpoint là https://aimodelmark.com/v1/chat/completions, truyền Authorization: Bearer $AI_MODEL_MARK_KEY và dùng alias như gpt-5.6-sol. Giữ nguyên toàn bộ mảng messages khi retry để không mất history.

Chỉ bật một job văn bản không có công cụ để smoke test. Hàng đợi, resume phiên, tool-call và ghi file cần bài kiểm thử riêng trước khi cho worker xử lý tác vụ khách hàng.

Quy trình kiểm tra an toàn: gọi GET /v1/models → gửi một Chat Completions không stream → thử streaming → mới kiểm tra client. Không dùng tên model ngoài danh sách công khai và không coi một phản hồi văn bản thành bằng chứng cho tool-call. Tool-call, Responses và Messages hiện chưa mở; các tích hợp có nhãn cảnh báo chưa được cam kết cho tác vụ agent trong pilot.