模型集成与配置
GeniSpace 接入了多种 AI 模型,让您的智能体可以运行在最适合需求的模型上。可用模型集合由平台管理员管理,在各 SaaS 版本与独立部署之间可能有所不同。
模型在 GeniSpace 中的工作方式
- 每个智能体绑定一个模型:每个智能体绑定单一模型。您在创建或编辑智能体时选择模型,该模型用于此智能体的对话与任务执行。(不存在按请求自动切换模型的机制。)
- 模型由管理员配置:模型目录存储在平台数据库中。智能体编辑器中显示的列表来自平台的模型注册表(
GET /models),因此实际可用的模型取决于管理员为您的部署配置了哪些模型。 - 平台默认模型:支持的创建流程或内置智能体未指定模型时,平台会解析管理员配置的默认模型。不同版本和部署不应假设固定 Identifier。
本页中的模型列表仅为示例。您所在环境中实际可用的模型由管理员按部署配置。
支持的模型提供商
GeniSpace 通过各提供商专用的适配器接入模型。支持以下提供商类型(API 类型):
| 提供商类型 | 说明 |
|---|---|
| OpenAI 兼容 | 通过 OpenAI 兼容契约提供的模型 |
| 阿里云 / DashScope | Qwen 及支持的阿里云模型 |
| Anthropic 兼容 | 配置后可用的 Claude 模型 |
| Google 兼容 | 配置后可用的 Gemini 模型 |
| 自托管网关 | 管理员显式注册的模型 |
实际 Provider/Channel 类型与能力由 Models 服务目录定义,未知 Provider 不保证自动可用。
示例模型
以下是部署中可能配置的模型示例。可用性由管理员按部署配置,不作保证。
- 通义千问(Qwen) 系列 — 例如
qwen-max、qwen-plus、qwen-turbo - OpenAI GPT 模型
- Anthropic Claude 模型
- DeepSeek 模型
- Google Gemini 模型(通过 Vertex AI)
- 通过 Ollama 或 Hugging Face 端点提供的自托管 / 开源模型
部署方案
SaaS 云服务
GeniSpace SaaS 版本提供即开即用的云端服务:
- 无需维护:模型可用性与升级由 GeniSpace 团队负责
- 即开即用:在配置智能体时选择一个可用模型
- 区域版本:中国版与国际版可能提供不同的模型集合
独立部署
GeniSpace 独立部署版(Standalone)让您在自有环境中接入模型:
- 数据可控:在自有基础设施上托管的模型上运行智能体
- 定制集成:对接企业已有的 AI 基础设施(例如通过
ollama或兼容 OpenAI 的提供商类型) - 使用自有凭据:将提供商凭据配置为部署配置的一部分(见下文)
智能体的模型选择
在创建或编辑智能体时,您从部署中可用的模型列表中选择一个模型。不同模型各有所长,因此您可以为不同的智能体选择不同的模型:
| 应用场景 | 示例模型特点 |
|---|---|
| 创意内容生成 | 生成 / 创造能力较强的模型 |
| 代码生成 | 针对代码与推理优化的模型 |
| 数据分析 | 结构化输出与推理能力较强的模型 |
| 简单问答 | 更轻量、成本更低的模型 |
| 多语言处理 | 跨语言能力较强的模型 |
适合各场景的具体模型取决于您部署中可用的模型。
模型连接与凭据
模型凭据和路由由 Models 服务 Channel 与平台模型目录管理。终端用户只选择可用模型,不会获得 Provider 凭据。
简而言之:
- 管理员注册可路由模型及其能力。
- Models 服务在受保护的管理数据中保存 Provider 路由与凭据。
- 平台把用户或空间上下文带入 Models 请求,用于授权、用量和计费。
- 终端用户从已启用目录中选择模型。
RAG 知识库集成
GeniSpace 提供检索增强生成(RAG)能力,让智能体可以基于您自有的知识进行回答:
知识库构建
- 多源数据接入:支持文档等多种数据源
- 文档处理:处理文档结构并提取内容
- 向量化:使用嵌入模型生成语义向量
- 增量更新:支持随时间更新知识库
检索增强生成
- 语义检索:为智能体检索相关内容
- 上下文注入:将检索到的内容加入提示上下文
- 来源溯源:帮助将生成内容溯源到其知识来源
知识库嵌入和检索统一通过平台模型网关。Dataset 向量化是独立的数据集能力,使用该数据集绑定的模型。详见数据与知识库。
成本管理
所有 AI 服务都会消耗账户余额中的配额。控制成本的建议:
- 监控用量 — 在 分析 模块跟踪配额消耗
- 选择合适的模型 — 简单任务使用更轻量的模型,将更强的模型留给高要求的工作
- 优化提示与参数 — 简洁的提示与合理的 Token 上限可降低单次调用消耗
关于配额与计费的工作方式,详见 账单与订阅。
常见问题解答
单个智能体可以使用多个模型吗?
不可以。每个智能体绑定单一模型。如需不同表现,请创建使用不同模型的多个智能体,或在现有智能体的配置中更改其模型。
我能使用哪些模型?
您可选择的模型来自部署的模型注册表,由管理员配置。本文档中的列表为示例,可能与您的环境不一致。请以智能体编辑器中的模型选择器为准。
提供商凭据如何保证安全?
Provider 凭据存放在受保护的 Models 服务 Channel 配置中,不会暴露给终端用户;用户只从已启用目录中选择模型。