模型 · API · 本地硬件

先算清成本,
再选择模型。

为中国 AI 用户和开发者整理可追溯的模型价格、Provider 路线和本地硬件信息。首版先把内容跑通,不用广告排名替代判断。

普通官网入口优先关键数据回到官方核验第三方反馈明确标注

成本计算器

估算每月 API 成本

按百万 Token 单价
30 天估算
¥33.23
单价与汇率由你输入;结果不构成 Provider 报价。
内容先行不等待返佣申请即可上线
来源可追溯价格、主体和条款保留原始来源
低频观测不主动持续压测 Provider API
排序独立合作关系不进入推荐结论

持续同步

中转与 API 服务状态

持续汇总亚洲区域的网络响应与可达性,帮助你快速发现服务波动,再结合价格、模型支持与条款做选择。

查看数据口径 →
6已覆盖现有 Provider
亚洲(东京)过去 24 小时观测区域
2026/09/01 13:17正在连接状态服务
服务商当前状态p50 边缘响应p95 边缘响应24h 可达率样本量
Fireworks AI观测正常18 ms67 ms100%287
OpenRouter观测正常52 ms109 ms100%287
Novita AI观测正常153 ms211 ms100%288
Replicate观测正常157 ms366 ms100%288
Together AI观测正常187 ms370 ms100%287
SiliconFlow观测正常377 ms400 ms100%288

数据来源:LLM Latency Tracker(CC-BY-4.0);经 Nex Scout 规范化并由 Cloudflare 缓存 5 分钟。 “边缘响应”指 DNS → TCP → TLS → 首字节(TTFB),不等于首 Token 或完整生成耗时。完整口径

首批内容

模型与开通路线

当前价格是带日期的公开目录观测,不包装成厂商官方统一报价。

查看全部模型 →
模型系列主要场景可用路线价格状态
GPT-5.6 Luna对话 / 分类OpenRouter$0.2 / $1.2公开目录观测
Qwen3.8 FlashCoding / AgentOpenRouter$0.15 / $0.47公开目录观测
GLM-5.3 FlashCoding / AgentOpenRouter$0.075 / $0.25公开目录观测
DeepSeek V4 Flash 0731Coding / 推理OpenRouter$0.065 / $0.18公开目录观测
Gemini 3.7 Flash多模态 / CodingOpenRouter$0.75 / $3.75公开目录观测
Claude Sonnet 5Coding / AgentOpenRouter$2 / $10公开目录观测

Provider 目录

先看证据,再去开通

首发使用普通官网入口;后续根据真实点击逐个接入合作计划。

全部 Provider →

OpenRouter

通过统一接口访问多个模型与底层 Provider,并公开模型和路线信息。

多 Provider 路由
内容状态:部分核验合作状态:尚未接入
查看结论与接入步骤 →

SiliconFlow

面向生成式 AI 的模型云服务,提供文本、图像、视频和语音等模型入口。

模型云服务
内容状态:部分核验合作状态:尚未接入
查看结论与接入步骤 →

Novita AI

提供模型 API、GPU 与生成式 AI 基础设施入口。

API 与基础设施
内容状态:部分核验合作状态:尚未接入
查看结论与接入步骤 →

本地 AI 硬件

API 之外,也要算清本地成本。

首版用显存分档回答常见问题,后续再增加模型、量化、上下文和速度估算。

8–12GB:小模型与入门量化
16GB:更灵活的本地开发区间
24GB:更大模型、上下文与并行空间

决策指南

从真实问题开始

成本基础

Token 是什么,怎样计算一次 API 调用成本

理解输入、输出、缓存与月度调用量。

使用计算器 →
路线比较 · 已发布

官方 API、中转 Provider 和本地部署怎么选

把结算、隐私、稳定性和维护成本放在一起比较。

阅读决策指南 →
硬件入门

8GB–24GB 显存分别适合哪些本地模型

从显存、量化与上下文解释可运行范围。

查看显存分档 →