分类、抽取、格式整理
输入量通常明显高于输出量,适合先用 50–100 条真实样本比较正确率和总成本。
单位都是人民币 / 百万 Token。最低档适合成本敏感验证;Plus、Pro 为不同价格与当时可用性选择。
| 号池 | 输入 | 输出 | 适合怎么验证 |
|---|---|---|---|
| Sale | ¥0.12 | ¥0.72 | 先跑小样本,接受可能补量 |
| Plus | ¥0.20 | ¥1.20 | 用同一任务对比实时可用性 |
| Pro | ¥0.40 | ¥2.40 | 按控制台可用路由选择 |
价格来自 LinkAGI 公共 pricing API 与模型广场快照;实际扣费以调用日志为准。
输入量通常明显高于输出量,适合先用 50–100 条真实样本比较正确率和总成本。
先让 Luna 做筛选或预处理,只把高价值样本送给更高档模型,成本更容易控制。
输出可能快速增加,预算时必须把输出 Token 单独乘以 ¥0.72、¥1.20 或 ¥2.40。
先用少量请求核对模型名、返回格式、Token 日志和失败情况,再决定是否批量运行。
总费用 = 输入 Token ÷ 1,000,000 × 输入单价 + 输出 Token ÷ 1,000,000 × 输出单价。1 亿纯输入按 Sale 快照是 100 × ¥0.12 = ¥12,并非“不到 10 元”。
输入和输出单价相差 6 倍,合并乘一个价格会严重低估输出成本。
先算单次平均输入与输出,再乘日调用量和月天数,预算才可执行。
上线前取 20–50 条真实请求,把控制台 Token 和实际扣费带回成本模型。
不一定。低单价不等于某项任务的效果最好,应使用自己的提示词、工具调用和验收标准做小样本验证。
最低档号池可能补量、暂停或调整;需要继续运行时可查看 Plus、Pro 和系统公告。
当前计算器只覆盖普通输入与输出。缓存、长上下文、工具调用和特殊任务应按实时页面与账单另算。
输入单次 Token、输出 Token 和调用次数,先得到人民币预算,再决定号池。