跳到主要内容

模型集成与配置

GeniSpace 接入了多种 AI 模型,让您的智能体可以运行在最适合需求的模型上。可用模型集合由平台管理员管理,在各 SaaS 版本与独立部署之间可能有所不同。

模型在 GeniSpace 中的工作方式​

  • 每个智能体绑定一个模型:每个智能体绑定单一模型。您在创建或编辑智能体时选择模型,该模型用于此智能体的对话与任务执行。(不存在按请求自动切换模型的机制。)
  • 模型由管理员配置:模型目录存储在平台数据库中。智能体编辑器中显示的列表来自平台的模型注册表(GET /models),因此实际可用的模型取决于管理员为您的部署配置了哪些模型。
  • 平台默认模型:支持的创建流程或内置智能体未指定模型时,平台会解析管理员配置的默认模型。不同版本和部署不应假设固定 Identifier。
信息

本页中的模型列表仅为示例。您所在环境中实际可用的模型由管理员按部署配置。

支持的模型提供商​

GeniSpace 通过各提供商专用的适配器接入模型。支持以下提供商类型(API 类型):

提供商类型说明
OpenAI 兼容通过 OpenAI 兼容契约提供的模型
阿里云 / DashScopeQwen 及支持的阿里云模型
Anthropic 兼容配置后可用的 Claude 模型
Google 兼容配置后可用的 Gemini 模型
自托管网关管理员显式注册的模型

实际 Provider/Channel 类型与能力由 Models 服务目录定义,未知 Provider 不保证自动可用。

示例模型​

以下是部署中可能配置的模型示例。可用性由管理员按部署配置,不作保证。

  • 通义千问(Qwen) 系列 — 例如 qwen-max、qwen-plus、qwen-turbo
  • OpenAI GPT 模型
  • Anthropic Claude 模型
  • DeepSeek 模型
  • Google Gemini 模型(通过 Vertex AI)
  • 通过 Ollama 或 Hugging Face 端点提供的自托管 / 开源模型

部署方案​

SaaS 云服务​

GeniSpace SaaS 版本提供即开即用的云端服务:

  • 无需维护:模型可用性与升级由 GeniSpace 团队负责
  • 即开即用:在配置智能体时选择一个可用模型
  • 区域版本:中国版与国际版可能提供不同的模型集合

独立部署​

GeniSpace 独立部署版(Standalone)让您在自有环境中接入模型:

  • 数据可控:在自有基础设施上托管的模型上运行智能体
  • 定制集成:对接企业已有的 AI 基础设施(例如通过 ollama 或兼容 OpenAI 的提供商类型)
  • 使用自有凭据:将提供商凭据配置为部署配置的一部分(见下文)

智能体的模型选择​

在创建或编辑智能体时,您从部署中可用的模型列表中选择一个模型。不同模型各有所长,因此您可以为不同的智能体选择不同的模型:

应用场景示例模型特点
创意内容生成生成 / 创造能力较强的模型
代码生成针对代码与推理优化的模型
数据分析结构化输出与推理能力较强的模型
简单问答更轻量、成本更低的模型
多语言处理跨语言能力较强的模型

适合各场景的具体模型取决于您部署中可用的模型。

模型连接与凭据​

模型凭据和路由由 Models 服务 Channel 与平台模型目录管理。终端用户只选择可用模型,不会获得 Provider 凭据。

简而言之:

  1. 管理员注册可路由模型及其能力。
  2. Models 服务在受保护的管理数据中保存 Provider 路由与凭据。
  3. 平台把用户或空间上下文带入 Models 请求,用于授权、用量和计费。
  4. 终端用户从已启用目录中选择模型。

RAG 知识库集成​

GeniSpace 提供检索增强生成(RAG)能力,让智能体可以基于您自有的知识进行回答:

知识库构建​

  1. 多源数据接入:支持文档等多种数据源
  2. 文档处理:处理文档结构并提取内容
  3. 向量化:使用嵌入模型生成语义向量
  4. 增量更新:支持随时间更新知识库

检索增强生成​

  1. 语义检索:为智能体检索相关内容
  2. 上下文注入:将检索到的内容加入提示上下文
  3. 来源溯源:帮助将生成内容溯源到其知识来源

知识库嵌入和检索统一通过平台模型网关。Dataset 向量化是独立的数据集能力,使用该数据集绑定的模型。详见数据与知识库。

成本管理​

所有 AI 服务都会消耗账户余额中的配额。控制成本的建议:

  1. 监控用量 — 在 分析 模块跟踪配额消耗
  2. 选择合适的模型 — 简单任务使用更轻量的模型,将更强的模型留给高要求的工作
  3. 优化提示与参数 — 简洁的提示与合理的 Token 上限可降低单次调用消耗

关于配额与计费的工作方式,详见 账单与订阅。

常见问题解答​

单个智能体可以使用多个模型吗?

不可以。每个智能体绑定单一模型。如需不同表现,请创建使用不同模型的多个智能体,或在现有智能体的配置中更改其模型。

我能使用哪些模型?

您可选择的模型来自部署的模型注册表,由管理员配置。本文档中的列表为示例,可能与您的环境不一致。请以智能体编辑器中的模型选择器为准。

提供商凭据如何保证安全?

Provider 凭据存放在受保护的 Models 服务 Channel 配置中,不会暴露给终端用户;用户只从已启用目录中选择模型。

下一步​