01
REAL-TIME METERING实时成本计量
记录模型、Token、延迟、缓存与实际成本,请求级可见。
每次调用可见,每笔预算可控。浪费发生前,策略先行动
AIephant AI 网关位于应用与模型之间,实时计量 Token、成本与延迟,将支出归因到团队、Agent 与 Virtual Key,并自动执行预算、告警与限流。
保留现有 SDK 与模型,把成本、归因、预算和优化信号统一到一个请求入口。
记录模型、Token、延迟、缓存与实际成本,请求级可见。
按团队、成员、Agent、Virtual Key、项目与模型拆分支出。
设置上限、告警、限流与硬停止,策略在超支前执行。
识别模型错配、重复请求、缓存机会与异常突增。
请求先计量、归因、检查预算,再写入团队与项目账本。工程和财务共享同一套成本事实。
添加 Provider Key,或启用 AIephant 托管路由。
Base URL 指向 AIephant,现有 SDK 无需重构。
查看支出、设置护栏、持续优化。
按 Workspace、团队、项目或 Agent 设置支出边界。告警、限流、降级与停止,自动执行。
API 密钥始终归企业所有。AIephant 提供网关;密钥由企业保管,策略由企业执行。
Provider Key 由企业接入、轮换与撤销,不向应用和终端用户暴露。
为团队、Agent 与环境发行独立密钥,限制模型、预算、速率与期限。
身份、预算、模型白名单与安全策略,在请求进入模型前完成检查。
保留请求、策略、密钥归属与成本记录,支持治理与合规核查。
看清 Token 效率、模型表现与成本结构,用实时数据持续优化 LLM 支出。