模型配置
每个供应商下可配置多个模型,模型是 Agent 调用的具体 AI 实例。
新增模型
- 进入「AI 中心」→「模型管理」
- 点击「新增」,填写信息:
| 字段 | 说明 | 示例 |
|---|---|---|
| 模型名称 | 显示名称 | GPT-4o |
| 模型标识 | 供应商的模型 ID | gpt-4o |
| 所属供应商 | 选择已配置的供应商 | OpenAI 生产环境 |
| 模型类型 | 对话/图片/语音 | 对话 |
| 上下文长度 | 最大上下文 Token 数 | 128000 |
| 状态 | 启用/禁用 | 启用 |
- 点击保存
模型参数
每个模型可配置以下运行参数:
| 参数 | 说明 | 取值范围 | 建议 |
|---|---|---|---|
| temperature | 输出随机性 | 0.0 - 2.0 | 事实性任务 0.3,创意任务 0.7 |
| maxTokens | 最大输出长度 | 1 - 4096 | 根据任务复杂度调整 |
| topP | 核采样概率 | 0.0 - 1.0 | 默认 1.0 |
| presencePenalty | 话题惩罚 | -2.0 - 2.0 | 默认 0 |
参数选择建议
| 场景 | temperature | maxTokens |
|---|---|---|
| 代码生成 | 0.2 | 2048 |
| 文档总结 | 0.3 | 1024 |
| 客服对话 | 0.5 | 1024 |
| 创意写作 | 0.9 | 4096 |
默认模型
- 系统支持设置一个全局默认模型
- 新建 Agent 时自动选择默认模型
- 默认模型可在模型列表中切换
模型测试
- 在模型列表中点击「测试」按钮
- 在测试对话框中输入消息
- 系统使用该模型发送请求
- 查看返回结果和响应时间
测试时关注的指标:
| 指标 | 说明 |
|---|---|
| 响应内容 | 模型输出是否符合预期 |
| 响应时间 | 从发送到收到回复的耗时 |
| Token 消耗 | 输入 Token + 输出 Token |
模型类型说明
| 类型 | 说明 | 支持的操作 |
|---|---|---|
| 对话模型 | 文本对话 | 文本问答、总结、翻译 |
| 图片模型 | 图片生成/理解 | 文生图、图片描述 |
| 语音模型 | 语音识别/合成 | ASR、TTS |
并非所有供应商都支持全部模型类型,具体能力取决于供应商。
