Skip to main content

Tích hợp với Hermes Agent

Hermes Agent là agent mã nguồn mở của Nous Research, chạy trong terminal hoặc ứng dụng desktop. Hermes hỗ trợ custom endpoint theo chuẩn OpenAI Chat Completions, nên trỏ thẳng vào gateway được. Hướng dẫn này được kiểm tra với Hermes Agent v0.21.5.

Chọn model phù hợp​

Hermes gọi gateway qua /chat/completions. Qua endpoint này, các model OpenAI đời mới (gpt-6-*) không gọi được tool khi đang suy nghĩ (lỗi 400), nên hãy dùng:

ModelGhi chú
deepseek-flashRẻ, gọi tool tốt. Khuyên dùng
deepseek-v4-proMạnh hơn, đắt hơn khoảng 4 lần
gemini-3.5-flashNgữ cảnh dài

1. Cài đặt​

# macOS / Linux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows PowerShell
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Mở lại terminal sau khi cài để lệnh hermes có trong PATH. Kiểm tra bằng hermes --version.

2. Cấu hình gateway​

Cách 1: Lệnh hermes model​

hermes model
  1. Chọn Custom endpoint (self-hosted / VLLM / etc.).
  2. Base URL: https://api.thucchien.ai/v1
  3. API key: key của đội.
  4. Model: deepseek-flash.

Hermes kiểm tra kết nối bằng cách gọi /v1/models, rồi lưu cấu hình lại.

Cách 2: Sửa file cấu hình​

Đặt key vào ~/.hermes/.env (Windows: %LOCALAPPDATA%\hermes\.env). Với base URL api.thucchien.ai, Hermes tự đọc biến THUCCHIEN_API_KEY:

~/.hermes/.env
THUCCHIEN_API_KEY=<your_api_key>

Rồi sửa mục model: trong config.yaml cùng thư mục:

~/.hermes/config.yaml
model:
default: deepseek-flash
provider: custom
base_url: https://api.thucchien.ai/v1

File config.yaml mặc định rất dài và có sẵn các dòng default, provider, base_url. Sửa các dòng đó, đừng thêm khối model: thứ hai.

Hermes yêu cầu model có ngữ cảnh tối thiểu 64k token. Các model ở bảng trên đều đáp ứng. Nếu Hermes không tự nhận được độ dài ngữ cảnh, thêm context_length: 128000 vào mục model:.

3. Chạy thử​

cd du-an-cua-ban
hermes
Màn hình khởi động Hermes Agent với model deepseek-flash
Góc dưới bên trái khung chào hiện deepseek-flash, nghĩa là Hermes đang dùng gateway.
Hermes thêm hàm vào todo.py và tự chạy thử
Hermes đọc code, thêm hàm, tự chạy python -c để thử rồi tóm tắt thay đổi.

Chạy một lệnh không cần giao diện: hermes -z "Tóm tắt README".

Đổi model trong phiên​

Gõ /model trong phiên chat để chọn model khác của gateway. Ứng dụng desktop của Hermes cũng có mục chọn Custom endpoint với cùng các trường như trên.

Xử lý lỗi thường gặp​

  • 400 Function tools with reasoning_effort are not supported: bạn đang dùng model gpt-6-*. Đổi sang deepseek-flash hoặc gemini-3.5-flash.
  • 401: sai key, hoặc Hermes chưa đọc được THUCCHIEN_API_KEY (kiểm tra file .env nằm đúng thư mục Hermes).
  • 429 Budget has been exceeded: đội đã dùng hết budget.