文档目录

10.3 用量配额

用量配额功能解决AI费用不可控问题,通过实时监控、多维度分析和配额限制,让企业清楚掌握Token消耗与费用,实现预算可管可控。

  • 实时查看每日每周Token用量与费用
  • 按功能、部门、用户多维分析用量
  • 设置配额上限,超限自动提醒或限流
  • 基于历史数据预测本月用量趋势

一句话定位:AI 用了多少 Token、花了多少钱、谁用最多——用量心中有数,预算不超标。

用量配额是灵枢的"水电表"——让 AI 的消费看得见、管得住。

您现在的问题

场景一:AI 费用是笔"糊涂账"。 月底收到供应商账单才知道这个月花了多少钱——月中就已经超预算了,但没人知道。没有实时监控的企业,平均超支 25%~40% 才被发现。

场景二:不知道谁在用、用在哪。 AI 调用量上去了,但不知道是哪个部门、哪个功能、哪个用户消耗最多——无法优化。通常 Top 3 功能消耗了 70% 的 Token——找到它们就找到了优化方向。

场景三:没有预算控制。 没有限额、没有告警、没有熔断——AI 可以无限制地调用,直到账单来了才发现问题。一次异常循环调用(如 Prompt 死循环)可在 1 小时内烧掉整月预算。

场景四:成本分摊说不清。 市场部和销售部都在用 AI 写内容——但费用算谁的?老板问"AI 投入产出比",没人答得上。成本不分摊,优化无抓手。

功能全景

用量配额让"AI 费用不可控"变成"AI 费用可预算":

所有 AI 调用(文章/SEO/问答/外呼/分类/翻译...)
        ↓
用量采集(每次调用记录:功能/用户/部门/Token数/费用/时间)
        ↓
├─ 实时面板(今日/本周/本月 → 调用次数/Token/费用)
├─ 多维分析(按功能/按部门/按用户/按供应商 → 找出"大户")
├─ 配额管控(部门/功能设上限 → 超限告警/限流/熔断)
└─ 趋势预测(基于历史 → 预测本月总用量 → 提前预警)
        ↓
汇入 3.4 智慧经营 → 经营报表
  • 实时用量面板。 每日/每周/每月的 Token 用量、调用次数、费用——实时可查。
  • 多维度分析。 按功能、按部门、按用户分析用量——找出"大户",针对性优化。
  • 配额管理。 为不同部门/功能设置用量上限——超出配额自动提醒或限流。
  • 趋势预测。 基于历史数据预测本月用量——提前预警可能超预算的风险。

操作指南

  1. 查看面板 → AI 引擎 → 用量配额 → 用量看板:今日/本周/本月总览;
  2. 多维分析 → 切换维度(功能/部门/用户/供应商)→ 查看分布和趋势;
  3. 设配额 → 配额管理 → 选择对象(部门/功能)→ 设月度上限 → 设告警阈值(如 80%);
  4. 查看告警 → 告警记录:哪些配额触发了告警、什么时候触发的;
  5. 导出报表 → 月度用量报表 → 导出 Excel(含分摊明细)。

关键配置项:

  • 配额维度:按部门/按功能/按用户(可组合)
  • 告警阈值:达到配额的 80% 告警(默认)
  • 超限策略:告警/限流/熔断(三选一)
  • 统计周期:日/周/月/自定义

最佳实践

  1. 先"看"再"管"。 上线第一个月不设配额,只看用量分布——了解"谁在用、用多少"之后,再设合理的上限。
  2. 配额不是"卡人"。 配额的目的是"让花钱花得明白"——不是"不让人用"。设配额时留 20% 余量。
  3. 关注"异常峰值"。 某天用量突然翻 5 倍——可能是 Prompt 死循环、可能是有人批量测试。设"单日超均值 3 倍"告警。
  4. 每月做一次"成本复盘"。 这个月花了多少、比上月多了还是少了、哪个功能成本涨了——15 分钟就够。

常见误区

误区一:配额设太低,影响业务。 为了"省钱"把配额卡得死死的——结果文章写到一半被限流、客户问答答到一半断了。配额是"安全网",不是"紧箍咒"。

误区二:只看总量,不看结构。 总用量没超——但 80% 被一个测试脚本消耗了。看结构比看总量更重要。

与其他能力的配合

  • 用量数据来自所有 AI 功能的调用记录;
  • 供应商维度的费用统计在 10.1 供应商管理 中查看;
  • 配额超限的告警通过 11.2 邮件短信 通知管理者;
  • 用量数据汇入 3.4 智慧经营,成为经营报表的一部分;
  • 模型选择影响成本——见 10.2 模型配置

关键指标

指标健康值说明
月度预算偏差<15%实际用量与预算的偏差
异常峰值响应<30min发现异常到处理完成的时间
配额利用率60%~90%太低=设太高,太高=需扩容
成本/产出比逐月优化每元AI投入产生的业务价值

常见问题

用量配额是什么?主要解决哪些问题?

用量配额是灵枢平台的"水电表",用于实时监控和管理AI调用的Token用量、调用次数和费用。它主要解决三大问题:

  • 费用糊涂账:月底才知道花费,月中已超预算。
  • 不知道谁在用、用在哪:无法分析部门、功能或用户的使用量。
  • 没有预算控制:缺乏限额、告警和熔断机制,AI调用无限制。
如何设置用量上限并收到超限告警?

在用量配额模块中,您可以为不同部门或功能设置用量上限。当调用量接近或达到上限时,系统会自动触发告警或限流。告警通知通过 11.2 邮件短信 能力发送给管理者,确保及时处理。

  • 设置方式:在配额管理配置界面,指定上限数值(如Token或费用)。
  • 告警机制:支持超出配额后自动提醒、暂停服务(熔断)等策略。
用量配额功能有哪些?如何帮助企业控制AI成本?

用量配额提供四大核心功能:

  • 实时用量面板:每日/周/月的Token用量、调用次数、费用实时可查,无需等到月底。
  • 多维度分析:按功能(文章/SEO/问答/外呼)、部门、用户分析用量,找出消耗大户进行优化。
  • 配额管理:为不同部门/功能设置用量上限,超出自动提醒或限流,确保预算可控。
  • 趋势预测:基于历史数据预测本月用量,提前预警超预算风险。
用量配额与供应商管理(10.1)有什么区别?

两者关注维度不同:

  • 用量配额(10.3):聚焦企业内部消耗,实时监控各部门/功能的AI使用量,并设置配额控制预算。
  • 供应商管理(10.1):统计供应商维度的费用,例如不同AI服务提供商的账单。

用量数据来自所有AI功能的调用记录,供应商维度的费用在供应商管理中查看,两者数据关联但分别服务于内部控制和外部成本核算。