Tài liệu Harogo
Harogo là dịch vụ đăng ký đa mô hình dành cho các agent lập trình. Trang này trình bày những gì được bao gồm, cách thiết lập, các mô hình được hỗ trợ và cách hoạt động của giới hạn sử dụng.
Giới thiệu
Harogo là dịch vụ đăng ký đa mô hình dành cho các agent lập trình.
Giá đăng ký ưu đãi là $4.90/tháng trong thời gian có hạn, sau đó là $9.90/tháng khi ưu đãi kết thúc. Hiện đang mở 100 suất đăng ký ưu đãi — số suất còn lại và mức giá thanh toán chính xác hiển thị trên trang đăng ký là thông tin chính thức.
Sau khi đăng ký, bạn có thể truy cập nhiều mô hình lập trình thông qua một điểm truy cập duy nhất. Tất cả các mô hình đều dùng chung một tài khoản Harogo, một API key và một hạn mức đăng ký — không cần đăng ký hay nạp tiền riêng cho từng nền tảng mô hình.
Vì sao chọn Harogo
Mỗi mô hình lại có thế mạnh riêng ở từng loại tác vụ lập trình. Dùng trực tiếp nhiều nhà cung cấp mô hình thường đồng nghĩa với việc phải quản lý nhiều tài khoản, API key, số dư, giới hạn tốc độ và hóa đơn.
Harogo kết nối một tập hợp các mô hình phù hợp cho agent lập trình đằng sau một dịch vụ duy nhất. Bạn có thể chuyển đổi mô hình theo tác vụ, và mọi lệnh gọi đều được tính vào cùng một hạn mức dùng chung.
Các mô hình hiện tại được chia thành các nhóm sau:
- Kimi K3, Claude Opus 5, GPT-5.6 Sol — phù hợp với codebase lớn, tác vụ ngữ cảnh dài và suy luận độ khó cao.
- Qwen3.8 Max, GLM-5.2, Claude Sonnet 5, GPT-5.6 Terra, MiniMax M3, DeepSeek V4 Pro — phù hợp với lập trình agent hằng ngày, sinh mã và gỡ lỗi.
- DeepSeek V4 Flash, Claude Haiku 4.5, GPT-5.6 Luna — phù hợp với các lệnh gọi tần suất cao, phản hồi nhanh và tác vụ cần tối ưu chi phí.
- Claude Fable 5 — phù hợp với các quy trình agent nhiều bước, chạy trong thời gian dài.
Các nhóm này chỉ là điểm khởi đầu để chọn mô hình. Kết quả thực tế phụ thuộc vào tác vụ cụ thể, ngữ cảnh và cách các công cụ được sử dụng.
Bắt đầu
- Đăng nhập vào Harogo và hoàn tất đăng ký.
- Tạo và sao chép API key trong console.
- Đặt Base URL thành https://api.harogo.ai.
- Dán API key vào.
- Bắt đầu sử dụng.
Lưu ý
Giữ API key của bạn an toàn. Không commit API key lên một kho lưu trữ công khai hay chia sẻ nó với bất kỳ ai khác.
Mô hình được hỗ trợ
Các mô hình hiện đang được hỗ trợ:
| Mô hình | ID mô hình | Phù hợp nhất cho |
|---|---|---|
| GLM-5.2 | glm-5.2 | Tác vụ chạy dài, codebase lớn và lập trình agent |
| Qwen3.8 Max | qwen3.8-max-preview | Suy luận phức tạp, hiểu hình ảnh và gọi công cụ tích hợp sẵn |
| Kimi K3 | kimi-k3 | Lập trình phức tạp, ngữ cảnh dài, tác vụ agent |
| MiniMax M3 | minimax-m3 | Lập trình tần suất cao, gọi công cụ, ngữ cảnh dài |
| DeepSeek V4 Pro | deepseek-v4-pro | Suy luận và sinh mã phức tạp |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | Hoàn thành nhanh, lệnh gọi tần suất cao và tác vụ theo lô |
| Claude Opus 5 | claude-opus-5 | Lập trình agent phức tạp và các tác vụ kỹ thuật độ khó cao |
| Claude Sonnet 5 | claude-sonnet-5 | Lập trình hằng ngày và các tác vụ phát triển tổng quát |
| Claude Fable 5 | claude-fable-5 | Tác vụ agent phức tạp, chạy trong thời gian dài |
| Claude Haiku 4.5 | claude-haiku-4-5 | Phản hồi nhanh, tác vụ nhẹ và xử lý theo lô |
| GPT-5.6 Luna | gpt-5.6-luna | Lập trình tần suất cao và tác vụ nhẹ |
| GPT-5.6 Sol | gpt-5.6-sol | Sinh mã độ khó cao, review và suy luận |
| GPT-5.6 Terra | gpt-5.6-terra | Lập trình agent hằng ngày và các tác vụ tổng quát |
Tên và ID mô hình ở trên là các định danh định tuyến mà Harogo sử dụng. Danh sách mô hình, phiên bản và tình trạng khả dụng có thể thay đổi — hãy tham khảo thông tin thực tế hiển thị trong console.
Sử dụng & Giới hạn
Harogo áp dụng các giới hạn sử dụng sau:
Cả ba giới hạn được áp dụng cùng một lúc. Mọi lệnh gọi mô hình đều trừ vào hạn mức đăng ký dùng chung, và một số mô hình có mức trần sử dụng tối đa thấp hơn — xem bảng giá bên dưới để biết chi tiết.
Giới hạn được xác định theo giá trị USD, không phải theo số lượng yêu cầu cố định. Số lượng yêu cầu thực tế bạn nhận được phụ thuộc vào mô hình bạn sử dụng — các mô hình giá thấp hơn thường cho phép nhiều yêu cầu hơn, còn các mô hình giá cao hơn cho phép ít yêu cầu hơn.
Bạn có thể kiểm tra mức sử dụng hiện tại và hạn mức còn lại trong console của Harogo.
Khối lượng yêu cầu ước tính
Bảng dưới đây đưa ra số lượng yêu cầu ước tính dựa trên các mẫu sử dụng điển hình của Harogo:
| Mô hình | Mỗi ngày ($12) | Mỗi tuần ($30) | Mỗi tháng ($60) |
|---|---|---|---|
| Kimi K3 | 1,040 | 2,600 | 5,200 |
| Claude Opus 5 | 300 | 750 | 1,500 |
| GPT-5.6 Sol | 1,130 | 2,820 | 5,630 |
| Qwen3.8 Max | 3,960 | 9,900 | 19,800 |
| GLM-5.2 | 7,920 | 19,790 | 39,580 |
| Claude Sonnet 5 | 2,350 | 5,880 | 11,760 |
| GPT-5.6 Terra | 2,640 | 6,600 | 13,200 |
| MiniMax M3 | 27,460 | 68,650 | 137,300 |
| DeepSeek V4 Pro | 34,250 | 85,640 | 171,270 |
| DeepSeek V4 Flash | 316,290 | 790,720 | 1,581,440 |
| Claude Haiku 4.5 | 18,050 | 45,110 | 90,230 |
| GPT-5.6 Luna | 2,060 | 5,150 | 10,300 |
| Claude Fable 5 | 220 | 560 | 1,110 |
Mỗi hàng giả định rằng hạn mức của khung thời gian đó chủ yếu được dùng cho mô hình tương ứng. Khi kết hợp nhiều mô hình, chúng sẽ cùng trừ vào một hạn mức dùng chung, nên số yêu cầu giữa các mô hình không thể đơn giản cộng dồn lại với nhau.
Số lượng yêu cầu thực tế thay đổi theo độ dài ngữ cảnh, tỷ lệ cache hit, mức độ suy luận và độ dài đầu ra. Một agent lập trình cũng có thể gửi nhiều yêu cầu mô hình cho một tác vụ duy nhất, nên một yêu cầu không đồng nghĩa với một tác vụ lập trình hoàn chỉnh.
Phương pháp ước tính
Các ước tính dựa trên những mẫu yêu cầu điển hình sau:
- GLM-5.2 — khoảng 700 token đầu vào, 52.000 token đọc từ cache và 150 token đầu ra mỗi yêu cầu.
- Qwen3.8 Max — khoảng 8.731 token đầu vào, 31.831 token đọc từ cache và 2.029 token đầu ra mỗi yêu cầu.
- Kimi K3 — khoảng 1.050 token đầu vào, 76.500 token đọc từ cache và 300 token đầu ra mỗi yêu cầu.
- MiniMax M3 — khoảng 4.381 token đầu vào, 28.768 token đọc từ cache và 1.108 token đầu ra mỗi yêu cầu.
- DeepSeek V4 Pro — khoảng 750 token đầu vào, 82.000 token đọc từ cache và 290 token đầu ra mỗi yêu cầu.
- DeepSeek V4 Flash — khoảng 790 token đầu vào, 68.000 token đọc từ cache và 280 token đầu ra mỗi yêu cầu.
- Claude Opus 5 — khoảng 580 token đầu vào, 386.230 token đọc từ cache, 19.476 token ghi vào cache và 2.025 token đầu ra mỗi yêu cầu.
- Claude Sonnet 5 — khoảng 159 token đầu vào, 129.804 token đọc từ cache, 6.260 token ghi vào cache và 850 token đầu ra mỗi yêu cầu.
- Claude Fable 5 — khoảng 399 token đầu vào, 315.393 token đọc từ cache, 12.907 token ghi vào cache và 1.016 token đầu ra mỗi yêu cầu.
- Claude Haiku 4.5 — khoảng 700 token đầu vào, 52.000 token đọc từ cache và 150 token đầu ra mỗi yêu cầu.
- GPT-5.6 Luna — khoảng 45.726 token đầu vào, 10.720 token đọc từ cache và 1.905 token đầu ra mỗi yêu cầu.
- GPT-5.6 Sol — khoảng 6.032 token đầu vào, 112.138 token đọc từ cache và 678 token đầu ra mỗi yêu cầu.
- GPT-5.6 Terra — khoảng 6.825 token đầu vào, 69.476 token đọc từ cache và 734 token đầu ra mỗi yêu cầu.
Qwen3.8 Max, MiniMax M3 và các dòng Claude, GPT-5.6 sử dụng cấu trúc yêu cầu trung bình đã quan sát được. Các mô hình còn lại sử dụng cấu trúc yêu cầu lập trình điển hình. Claude Opus 5 hiện đang tham chiếu dữ liệu sử dụng thực tế từ các mô hình cấp Opus ở cùng mức giá.
Các con số này được dùng để ước tính mức sử dụng điển hình và không phải là cam kết về một số lượng yêu cầu cố định.
Giá mô hình & Hạn mức sử dụng
Bảng dưới đây liệt kê giá tham chiếu API của từng mô hình trên mỗi 1 triệu token, cùng với hạn mức sử dụng mà Harogo áp dụng cho mô hình đó.
| Mô hình | ID mô hình | Đầu vào / 1M | Đầu ra / 1M | Đọc cache / 1M | Hạn mức sử dụng |
|---|---|---|---|---|---|
| Kimi K3 | kimi-k3 | $3.00 | $15.00 | $0.30 | $15 |
| Claude Opus 5 | claude-opus-5 | $5.00 | $25.00 | $0.50 | $60 |
| GPT-5.6 Sol | gpt-5.6-sol | $5.00 | $30.00 | $0.50 | $60 |
| Qwen3.8 Max | qwen3.8-max-preview | $1.69 | $5.03 | $0.17 | $60 |
| GLM-5.2 | glm-5.2 | $1.40 | $4.40 | $0.26 | $60 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.00 | $10.00 | $0.20 | $60 |
| GPT-5.6 Terra | gpt-5.6-terra | $2.50 | $15.00 | $0.25 | $60 |
| MiniMax M3 | minimax-m3 | $0.30 | $1.20 | $0.06 | $60 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.44 | $0.87 | — | $15 |
| DeepSeek V4 Flash | deepseek-v4-flash-0731 | $0.14 | $0.28 | — | $60 |
| Claude Haiku 4.5 | claude-haiku-4-5 | $1.00 | $5.00 | $0.10 | $60 |
| GPT-5.6 Luna | gpt-5.6-luna | $1.00 | $6.00 | $0.10 | $60 |
| Claude Fable 5 | claude-fable-5 | $10.00 | $50.00 | $1.00 | $60 |
"—" nghĩa là mục này hiện không được tính phí riêng, hoặc không áp dụng cho mô hình đó.
Số lượng yêu cầu ước tính được tính toán dựa trên sự kết hợp giữa giá mô hình, cấu trúc yêu cầu điển hình, dữ liệu sử dụng thực tế và hạn mức sử dụng của từng mô hình. Giá và tình trạng khả dụng của các mô hình preview có thể thay đổi.
Giá mô hình, hạn mức sử dụng và số lượng yêu cầu ước tính có thể thay đổi khi dịch vụ phát triển — hãy tham khảo console của Harogo và phiên bản hiện tại của trang này để biết thông tin mới nhất.