本文档由英文原版机器翻译而成。如果翻译版本与英文原版之间存在任何冲突,请以英文原版为准。 阅读英文原版


AI 提供商和 API 密钥

Caiioo 通过一小部分提供商连接到 500 多种 AI 模型。您自备 API 密钥 —— 这意味着您直接向提供商付费,Caiioo 绝不触碰您的支出。

支持的提供商

目前普遍提供七个提供商:

  • OpenRouter(默认)— 使用单个密钥即可解锁 500 多个模型,包括 Anthropic Claude、Google Gemini、OpenAI GPT、Mistral、Groq、Llama 等。这是大多数用户的推荐途径 —— Caiioo 的工具需要依赖 OpenRouter 的模型注册表,并且您只需管理一个密钥。
  • Google AI — 使用您自己的 Google AI 密钥直接连接到 Gemini API。Google 提供真正的免费额度,因此这是一种无需信用卡即可运行前沿模型的真实方式 —— 具备原生思考能力和高达 200 万的上下文。设置(Settings)会引导您获取免费密钥。
  • Anthropic — 使用您自己的 Anthropic 密钥直接连接到 Claude API,在工具使用的同时支持原生的扩展思考。请在 console.anthropic.com 创建密钥,或者在您批准访问您的 Claude 账户后由 Caiioo 创建一个。该密钥将计费到您的 Anthropic Console 账户;Caiioo 不会保留用于创建它的 Claude 登录信息。
  • xAI (Grok) — 通过 api.x.ai 直接访问 Grok 模型。使用 xAI 控制台 API 密钥连接,或者只需使用您的 Grok 账户登录(SuperGrok 或 X Premium+ 订阅)—— 在浏览器中批准访问即可连接,无需复制密钥。注意:xAI 会在其端根据账户和订阅级别启用 API 访问权限;如果连接后聊天因权限错误而失败,请改用 xAI API 密钥。
  • CometAPI — 通过一个按需付费的 CometAPI 密钥访问 500 多个模型(GPT、Claude、Gemini、DeepSeek 等)。模型选择器为其目录显示基准测试级别的奖牌,并且总的 CometAPI 使用量会在设置(Settings)中进行跟踪。
  • Poe — 通过一个 Poe API 密钥访问来自 Anthropic、Google、OpenAI、xAI、Meta 等机构的模型,按您的 Poe 订阅积分(而不是按每 Token 美元)计费。应用程序中会显示您的剩余积分余额以及对话线程已花费的积分。请在 poe.com/api/keys 获取密钥。
  • Ollama — 在您的本地机器上运行开源模型。完全私密、无需联网、免费。适用于离线工作或当您希望完全掌控推理过程的情况。(Ollama Cloud 也可以配合可选的 API 密钥使用。)

直接连接到其他提供商(OpenAI、MLX 等)目前正在测试中,尚未普遍推出。目前,请通过您的 OpenRouter 密钥使用这些模型 —— 这正是 OpenRouter 的作用所在。

有关政策,请参阅使用条款

开始使用(两种选项)

选项 1:使用免费预配的密钥

我们提供了一个免费的 OpenRouter 密钥,让你能够立即体验 Caiioo。它可访问部分带有使用限制的免费模型,非常适合进行测试。

要继续使用它:只需打开 Caiioo 并开始聊天。无需进行任何设置。Pro 订阅者除了现有的余额之外,还将在此密钥上自动获得额外的 $5/月 OpenRouter 额度奖励

当你使用自带的密钥时,设置中的 OpenRouter 密钥字段会显示相应说明,而不是空白——你会看到一条提示,说明你正在使用的是 Caiioo 的账户密钥以及你的剩余余额。你的密钥存储在你的设备上;开启 Private Sync 后,无论是自带的密钥还是你自己的 OpenRouter 密钥,都会随加密备份一起同步到你的其他设备上。

消耗额度的工具——图像、视频和音乐生成、高级 OCR 以及 Perplexity AI 搜索——需要 OpenRouter 额度,而不仅仅是一个密钥。在免费预配的密钥上,这些工具会提示“无额度”。你有两种解决方案:在 设置 > AI 设置 > AI 提供商 中输入你自己的 OpenRouter API 密钥 (BYOK),或者升级你的 Caiioo 方案——付费方案每个月会为此预配密钥充入额度,从而让这些工具直接可用。

选项 2:使用你自己的密钥 (BYOK)

想要在没有免费层限制的情况下获得完全访问权限?添加你自己的密钥。

OpenRouter(推荐):

  1. openrouter.ai 注册并创建一个 API 密钥
  2. 前往 设置 → AI 设置 → AI 提供商
  3. 选择 OpenRouter 并粘贴你的密钥——或者点击 Sign in with OpenRouter 来连接你的账户,无需复制任何内容
  4. 就是这样——密钥保留在你的设备上,绝不会到达 Caiioo 的服务器

Google AI(直接连接 Gemini):

  1. 前往 设置 → AI 设置 → AI 提供商 并选择 Google AI
  2. 按照引导式的“获取免费密钥”步骤操作(Google AI Studio 免费发放密钥,无需信用卡)
  3. 粘贴密钥——它会保留在你的设备上,并且请求会直接发送给 Google

Anthropic(直接连接 Claude):

  1. 前往 设置 → AI 设置 → AI 提供商 并选择 Anthropic
  2. 点击 Anthropic 凭据 旁边的 管理
  3. 已连接账户 下,点击 从你的 Claude 账户创建密钥
  4. 在浏览器中批准访问,将授权码粘贴回 Caiioo,然后点击 连接

你也可以点击 添加 API 密钥 并粘贴你在 Anthropic Console 中创建的密钥。

Poe:

  1. 前往 设置 → AI 设置 → AI 提供商 并选择 Poe
  2. poe.com/api/keys 创建一个密钥——密钥字段下方的说明也指向该地址
  3. 将密钥粘贴到 Poe API 密钥

你的点数余额会显示在密钥下方。对话成本将同时以 Poe 点数和美元形式显示。

Ollama(本地):

  1. ollama.com 安装 Ollama 并拉取一个模型(ollama pull llama3.2
  2. 前往 设置 → AI 设置 → AI 提供商
  3. 选择 Ollama 并确认服务器 URL(默认 http://localhost:11434
  4. 选择你在本地安装的任意模型

当你选择本地聊天模型时,会将数据发送到远程 AI 提供商的 AI 驱动工具会首先提示你进行批准。请参阅 隐私与数据远程 AI 提供商

显示默认模型和最大步骤的模型配置

快捷任务模型

这是一个独立且更便宜的模型,Caiioo 会在后台自动将其用于生成对话标题、分类意图、选择调用哪个工具以及其他简短的辅助查询等任务——你永远不需要直接对其进行提示。请在 设置 → AI 设置 → 模型配置 中进行配置(一个较小的 OpenRouter 免费模型或本地 Ollama 模型就足够了)。如果未设置,系统将回退到你的默认模型。

工具 BYOA(自带身份验证)— Pro

BYOA 不同于 BYOK。它不适用于大语言模型 (LLM) —— 而是用于工具连接(Google Workspace、Microsoft 365、GitHub 等)。在 Pro 层级中,设置 → 账户 → 账户授权与权限 允许您在组织不愿将 Caiioo 的默认客户端 ID 加入白名单时,接入您自己的 OAuth 客户端:

  • 使用您自己的 Google OAuth 应用 — 按照步骤创建一个 Google Cloud 项目并粘贴客户端 ID 和密钥
  • 使用您自己的 Microsoft Azure 应用 — 针对 Azure 注册应用的相同流程
  • 添加自定义 OAuth Provider — 针对支持它的任何提供商的通用 OAuth 2.0 流程

向导会将凭据直接写入凭据保险库。它们永远不会离开您的设备。

每个提供商保留多个账户或密钥

每个提供商可以容纳多个凭据 —— 工作密钥与个人密钥并存,或者登录账户与 API 密钥并存 —— 每次使用其中一个。无需再覆盖密钥并在以后重新粘贴。

设置 > 账户 > 账户授权与权限中的AI 提供商账户(包含已连接账户API 密钥标签页)下进行管理 —— 或者点击设置 > AI 设置 > AI 提供商中提供商旁边的管理。您可以为每个凭据命名(例如“工作”),处于活动状态的凭据带有使用中徽章,只需点击使用即可切换。从 Caiioo 中移除凭据不会在提供商处撤销任何权限 —— 您在那里的账户不受影响,以后还可以再次添加。

API 密钥安全

您的 API 密钥存储在您的本地设备上。开启私密同步后,您的密钥和已连接的提供商账户在进入同步备份之前会在设备上进行加密,然后仅在您的其他设备上解密。Caiioo 服务器绝不会接收到可读的凭据。当您发出请求时,运行对话的设备会将自身的活动凭据直接发送给 AI 提供商。请参阅隐私与数据了解完整详情。

性能取决于您选择的模型

Caiioo 负责协调编排——工具、上下文、多步骤工作流。但 AI 的回答质量最终取决于您选择的模型。

对于复杂任务(研究、分析、长文档):请使用前沿模型——Claude Sonnet、GPT 级别或 Gemini Pro——均可通过您的 OpenRouter 密钥访问。它们在处理多步骤推理和工具调用方面表现最佳。

对于快速解答(问答、摘要、简单编辑):轻量快速的模型——Claude Haiku、较小版本的 GPT 或 Gemini Flash 变体——价格更低且速度更快。非常适合日常任务。

对于探索尝试:OpenRouter 让您仅凭一个 API 密钥即可试用 500 多种模型。无需绑定单一供应商,即可找到最适合您工作流的模型。

模型选择器会描述实际提供各模型服务的供应商的能力,并在已有评估数据时显示基准评测奖牌。新发布或未测量的模型仍然可见,只是暂时没有奖牌。总费用采用提供服务的供应商公开的费率;如果 Caiioo 无法确定费率,则会省略费用显示,而不是进行估算。

两枚奖牌,两种考量。 模型可在以下任一或两个维度上获得金牌、银牌或铜牌:

  • Best for Caiioo 仅按能力进行排名。价格不计入其中,因此廉价的快速模型不会名列“最佳”榜首。
  • Value for Caiioo 则综合了价格因素——代表在相应成本下所能获得的最佳质量(性价比)。

自动路由遵循同样的分类逻辑:Value Router 会权衡成本,其他路由则不会。您在选择器中看到的内容就是应用程序实际用于做出选择的依据。

查看奖牌背后的评估数据。 Model Intelligence(Caiioo Benchmarks,Pro)对质量、吞吐量、首字生成时间(time-to-first-token)、工具准确率和定价进行对比,并详细说明了评测方法——包括每个数字的来源以及性价比得分所考虑的因素。针对每类任务的排名发布后,将同时供应用程序和 caiioo.ai 上的排行榜读取,因此路由系统的选择与排行榜展示的内容完全一致。如果您想了解哪个模型在编程、研究或写作方面处于领先地位,而不仅限于总体表现,排行榜还提供了 Best by Use Case(按用例细分)视图。

关于“创意度”(Creativity)滑块的说明:最新的模型(如 Claude Sonnet 5 及更高版本)会自动管理自身的创意度,不接受温度(temperature)设置。当您选择此类模型时,“模型配置”中的“创意度”滑块将被禁用并附带简短说明——这是正常现象,并非程序错误。

对于离线/完全隐私的工作:Ollama 可以在您的本地机器上运行开源模型。虽然速度慢于云端前沿模型,但任何数据都不会离开您的硬件设备。

Caiioo 的工具、上下文层和编排能力可以充分放大您所选模型的潜能。一个优秀的模型在获得恰当的上下文和工具支持后,将变得格外卓越。

另请参阅


This guide is maintained by the Caiioo team using Slate, our built-in editor.