Skip to content

安全与成本提示

API Key 安全

存储安全

措施说明
AES 加密存储API Key 使用 AES 算法加密后存入数据库
列表脱敏展示时保留前 4 后 4,中间显示 ****
日志脱敏日志中不打印完整 API Key
传输加密前后端通过 HTTPS 传输

访问控制

  • 供应商配置仅管理员可操作
  • API Key 查看需要二次验证
  • 生产环境的 Key 与开发环境隔离

Token 消耗预估

Token 计算规则

类型说明估算方法
输入 Token发送给模型的内容中文约 1.5 字/Token,英文约 4 字母/Token
输出 Token模型返回的内容同上
知识库检索检索的文档块计入输入分块大小 × Top K

消耗场景预估

场景单次消耗(估算)说明
简单问答200-500 Token一问一答,无上下文
多轮对话500-2000 Token含历史消息
知识库问答1500-3000 Token含检索的文档块
文档总结3000-8000 Token长文档输入
图片生成固定计费按张计费,不按 Token

成本控制策略

限制策略

策略配置位置说明
每日调用上限Agent 配置限制 Agent 每天最多调用次数
单次 Token 上限模型配置限制 maxTokens 输出长度
会话轮次上限Agent 配置限制单次会话最大对话轮数
用户级配额系统配置限制每个用户每日调用次数

优化建议

优化方向建议
模型选择简单任务用小模型(如 gpt-4o-mini),复杂任务用大模型
Prompt 精简系统 Prompt 避免冗余,减少输入 Token
上下文管理设置合理的对话历史保留轮数
缓存策略相同问题直接返回缓存结果
知识库分块合理设置分块大小,避免召回过多内容

监控与告警

监控指标

指标说明
调用次数每日/每周调用统计
Token 消耗输入/输出 Token 分类统计
费用估算按供应商定价估算费用
错误率调用失败的比例
平均延迟响应时间统计

告警规则

  • 日消耗 Token 超过阈值时告警
  • 错误率超过 10% 时告警
  • API Key 到期前提醒

下一步

Forge Admin — 基于 Vue3 + Spring Boot 的企业级后台管理框架