计费规则
100元 = 1000万Token
1元 = 10万Token
VIP升级
累计消费满500元
自动升级为包月用户
新手福利
注册即送
100元测试券
示例:使用500万Token ≈ 50元,累计消耗600元自动成为VIP
$ curl -X POST /v1/messages
# Routing to upstream...
200 OK
{ "content": "Hello!" }

快速开始

https://api.kanghuiai.com/v1

使用上述地址作为 OpenAI SDK 或其他兼容客户端的 base_url

一键接入

只需一个 API 密钥即可调用所有已连接的 AI 模型,无需单独申请。

永远可靠

跨多个上游账号的智能路由,具备自动故障转移功能,告别错误。

按需付费

基于使用量的计费模式,支持配额限制,完全透明的团队消费统计。

AI 模型编程对比

根据场景选择最适合的模型

正在加载模型列表…

模型能力对比

不同模型在代码生成、推理能力、速度和成本方面各有优势。以下为各模型的编程能力对比:

qwen3.8:latest

最新版本、综合优化、通用任务
  • 代码能力★★★★★
  • 推理能力★★★★★
  • 速度★★★★★
  • 成本★★★★★

qwen3-coder-next:q8_0

代码生成、调试优化
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

deepseek-coder:33b

代码生成、数学推理
  • 代码能力★★★★★
  • 推理能力★★★★★
  • 速度★★★★☆
  • 成本★★★★★

laguna-s-2.1:f16

代码生成、通用任务
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

ornith:35b

通用编程、多语言支持
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

qwen3.6:35b

通用编程、多语言支持
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

laguna-s-2.1:latest

代码生成、通用任务
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

qwen3-coder:latest

代码生成、通用任务
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

glm-4.7-flash:q8_0

快速响应、通用任务
  • 代码能力★★★★☆
  • 推理能力★★★★☆
  • 速度★★★★★
  • 成本★★★☆☆

qwen3-coder-next:q4_K_M

代码生成、量化优化
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★★★

qwen3.6:latest

通用编程、多语言支持
  • 代码能力★★★★★
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

qwen3.5:latest

通用编程、多语言支持
  • 代码能力★★★★☆
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆

nemotron3:33b

代码生成、复杂推理
  • 代码能力★★★★★
  • 推理能力★★★★★
  • 速度★★★☆☆
  • 成本★★☆☆☆

llama3.2:1b

轻量级任务、边缘计算
  • 代码能力★★★☆☆
  • 推理能力★★★☆☆
  • 速度★★★★★
  • 成本★★★★★

laguna-xs-2.1:latest

轻量级任务、快速响应
  • 代码能力★★★★☆
  • 推理能力★★★★☆
  • 速度★★★★★
  • 成本★★★★★

qwen3-vl:8b

多模态任务、视觉理解
  • 代码能力★★★★☆
  • 推理能力★★★★☆
  • 速度★★★★☆
  • 成本★★★☆☆
模型典型场景代码能力推理能力速度成本
qwen3.8:latest最新版本、综合优化、通用任务★★★★★★★★★★★★★★★★★★★★
qwen3-coder-next:q8_0代码生成、调试优化★★★★★★★★★☆★★★★☆★★★☆☆
deepseek-coder:33b代码生成、数学推理★★★★★★★★★★★★★★☆★★★★★
laguna-s-2.1:f16代码生成、通用任务★★★★★★★★★☆★★★★☆★★★☆☆
ornith:35b通用编程、多语言支持★★★★★★★★★☆★★★★☆★★★☆☆
qwen3.6:35b通用编程、多语言支持★★★★★★★★★☆★★★★☆★★★☆☆
laguna-s-2.1:latest代码生成、通用任务★★★★★★★★★☆★★★★☆★★★☆☆
qwen3-coder:latest代码生成、通用任务★★★★★★★★★☆★★★★☆★★★☆☆
glm-4.7-flash:q8_0快速响应、通用任务★★★★☆★★★★☆★★★★★★★★☆☆
qwen3-coder-next:q4_K_M代码生成、量化优化★★★★★★★★★☆★★★★☆★★★★★
qwen3.6:latest通用编程、多语言支持★★★★★★★★★☆★★★★☆★★★☆☆
qwen3.5:latest通用编程、多语言支持★★★★☆★★★★☆★★★★☆★★★☆☆
nemotron3:33b代码生成、复杂推理★★★★★★★★★★★★★☆☆★★☆☆☆
llama3.2:1b轻量级任务、边缘计算★★★☆☆★★★☆☆★★★★★★★★★★
laguna-xs-2.1:latest轻量级任务、快速响应★★★★☆★★★★☆★★★★★★★★★★
qwen3-vl:8b多模态任务、视觉理解★★★★☆★★★★☆★★★★☆★★★☆☆

qwen3.8:latest - 最新版本

阿里云通义千问最新一代模型,全面优化和升级

代码生成能力
支持 Python、JavaScript、Go、Rust 等主流编程语言,代码理解和生成能力达到 SOTA 水平
推理能力
数学推理复杂问题解决能力大幅提升,支持多步推理和逻辑分析
性能优化
响应速度优化,token生成速度提升,吞吐量增强
成本优势
综合成本最低,性能与价格达到最佳平衡点
推荐场景:
  • 🚀 通用编程和开发任务
  • 💡 AI应用开发和集成
  • 📚 文档生成和技术写作
  • 🔄 代码重构和优化
  • 🔍 代码调试和Bug修复

💡 使用建议

⭐ 最新推荐:首选 qwen3.8:latest - 综合性能最佳,最新特性,性价比之王

⚡ 轻量级快速任务:推荐使用 glm-4.7-flash:q8_0qwen3-coder-next:q4_K_M,速度极快、成本最低

🛠️ 高质量代码生成:选择 qwen3-coder-next:q8_0deepseek-coder:33b,代码能力卓越

🧠 复杂算法和系统设计:使用 nemotron3:33blaguna-s-2.1:f16,最佳推理能力

🌍 多语言开发:推荐 qwen3.6:35bornith:35bqwen3-coder:latest

💰 成本优化方案:量化模型 qwen3-coder-next:q4_K_M 性能不减且更便宜

Hermes Agent - AI 爱马仕桌面代理

Ollama + Qwen 代码模型最优选,自进化闭环越用越智能

⚡ 自进化闭环:任务完成自动复盘,导出可复用技能文档
🧠 四层记忆:常驻 Prompt/会话检索/程序技能/用户画像
🔌 Ollama 原生适配:智能模型路由,代码链式执行
🚀 部署极简:一行命令安装,最低 2 核 4G 内存
🛠️ 40+ 工具 + 并行子 Agent,内置 Cron 调度
🔒 MIT 开源,数据 100% 留存本地
立即下载 Hermes AI
分享成功!已赠送100元代金券