数据状态
同步自 OpenRouter Providers · 109 家托管商 · source=openrouter · 2026-09-18T21:24:55.774Z
InferenceNet
总部 美国
5 模型8 端点日可用 97.4%
托管模型5
端点8
日可用率均97.4%
最低输入 $/M$0.030
最大上下文1.0M
托管端点 · 8
来自 OpenRouter 各模型 Endpoints API:同一模型可能有多量化 / 多区域端点。
| 模型 | Tag | 量化 | 上下文 | 输入 | 输出 | 5m | 30m | 1d | 延迟 | 吞吐 | 缓存 |
|---|---|---|---|---|---|---|---|---|---|---|---|
| schematron-v2-turbo inference-net/schematron-v2-turbo | inference-net | — | 128k | $0.030 | $0.150 | — | — | 100.00% | — | — | — |
| schematron-v2-small inference-net/schematron-v2-small | inference-net | — | 128k | $0.050 | $0.230 | 100.00% | 100.00% | 100.00% | — | — | — |
| kimi-k3 moonshotai/kimi-k3 | inference-net/fp4 | fp4 | 1.0M | $2.10 | $11.0 | 97.5% | 98.8% | 97.6% | — | — | — |
| kimi-k3 moonshotai/kimi-k3 | inference-net/fp4 | fp4 | 1.0M | $2.10 | $11.0 | 97.5% | 98.8% | 97.6% | — | — | — |
| glm-5.3-flash z-ai/glm-5.3-flash | inference-net/fp4 | fp4 | 1.0M | $0.090 | $0.280 | 94.2% | 94.9% | 96.5% | — | — | — |
| glm-5.3-flash z-ai/glm-5.3-flash | inference-net/fp4 | fp4 | 1.0M | $0.090 | $0.280 | 94.2% | 94.9% | 96.5% | — | — | — |
| glm-5.3 z-ai/glm-5.3 | inference-net/fp4 | fp4 | 1M | $0.900 | $3.00 | 99.0% | 91.0% | 95.6% | — | — | — |
| glm-5.3 z-ai/glm-5.3 | inference-net/fp4 | fp4 | 1M | $0.900 | $3.00 | 99.0% | 91.0% | 95.6% | — | — | — |
覆盖模型 · 5
元数据与端点观测同步自 OpenRouter 公开 API。GrokCode 不做路由转发;自建测速请用 API 实验室。
站内推荐
同系工具:Clavue CLI / imux IDE / clavue-2.1
Clavue · CLI 与 Agent 平台
CLI / GUI Agent 运行时、设备登录、会员额度与 OpenAI 兼容 API(api.clavue.com)。开发脚本、CI 与本地工具一条链路。
打开 Clavue ↗imux · 原生 macOS AI IDE
Clavue 平台的原生 IDE:多 Agent 分屏、Ghostty 级终端、Agent Chat、浏览器自动化与 Supervisor——不是又一个 Electron 壳。
了解 imux ↗Clavue 2.1 · 产品级大模型
旗舰模型 clavue-2.1(及 fast / pro / rev):适合复杂推理与长程 Agent 循环。Chat、imux、API 共用会员额度。
查看模型 ↗