自带 AI 提供商:在 Archyl 中使用 OpenAI、Claude、Gemini 或 Bedrock
我第一次向一家财富 500 强架构团队演示 Archyl 时,对话进行得非常顺利 — 直到第 23 分钟。
"这真的很棒,认真的。但我们的安全团队不会让我们把代码传给你们的 AI。我们通过 Bedrock 有 Anthropic 合同。所有内容都必须经过那个端点。"
那时我已经听过同样这句话的不同版本十几次了。不同的公司、不同的提供商、同一堵墙:
"我们已经在付 Azure OpenAI 的钱了。" "我们的数据必须留在 eu-central-1。" "法务批准的是 Mistral,不是你们用的那个。" "我们能用自己的 GitHub Models 合同吗?它和我们已经买的席位是捆绑的。"
直到今天,答案一直是:还不行。
今天可以了。 Archyl 的每一项 AI 功能现在都可以通过您的 AI 提供商、用您的 API 密钥、在您的合同下进行路由。从 OpenAI、Anthropic (Claude)、Google (Gemini)、AWS Bedrock,或任何 OpenAI 兼容端点中选择 — Archyl 的配额限制不再适用,因为您直接付费给提供商。
让我解释一下改变了什么、为什么这比听起来更重要,以及如何启用它。
为什么这不只是"我们加了一个配置字段"
Archyl 是围绕 AI 构建的。架构发现读取您的代码库并生成 C4 模型。ADR 解析将 markdown 转换为结构化决策。聊天助手回答跨项目的问题。托管代理对您的代码库执行多步骤任务。洞察在架构问题成为事故之前将其浮现出来。
两年来,所有这些都运行在我选择的模型上,由我拥有的 OpenAI 密钥支付。大多数客户对此完全满意 — 少了一个供应商关系要管理。但"大多数"不是"所有",而我正在失去的客户恰恰是我最想要的:有严肃架构实践和真实预算的大型工程组织。
阻碍他们的不是价格。是另外三件事:
- 数据驻留。 他们的安全团队批准了特定地区的特定供应商。我的提供商不在名单上,而新增供应商需要数月时间。
- 现有合同。 他们已经与 Anthropic、Azure OpenAI、AWS Bedrock 或 Mistral 谈好了企业定价。让我在不同提供商的 token 上加价对采购部门来说毫无意义。
- 合规。 GDPR、SOC 2、HIPAA、金融监管。审计跟踪必须落在他们的 tenant 中,而不是我的。
解决方案必须同时给他们三样东西:他们的密钥、他们的模型,以及不为 AI 用量重复付费。这正是 BYO Provider 所做的。
您可以接入的内容
今天上线五个提供商。四个是一流的原生集成;一个是通用适配器,用一个配置覆盖一长串兼容端点。
OpenAI — 直接使用您自己的密钥访问 api.openai.com。默认模型是 gpt-5.4-mini,但可以按功能覆盖。
Anthropic (Claude) — Messages API,包含流式传输。默认 claude-sonnet-4-6。这是大多数企业团队最终选择的。
Google (Gemini) — Generative Language API,带原生 JSON 模式。默认 gemini-2.0-flash。
AWS Bedrock — Converse API,在所有 Bedrock 托管的模型上统一。所以一个集成涵盖 Bedrock 上的 Anthropic Claude、Mistral、Llama、Titan、Cohere — 任何您账户启用的模型。您以 <access_key_id>:<secret_access_key> 形式提供 AWS 凭据(可选 STS session token),加上区域。
OpenAI 兼容(其他所有) — 一个适配器,一个基础 URL 字段。这一个集成涵盖 Azure OpenAI、GitHub Models、OpenRouter、Mistral La Plateforme、Groq、Together AI、Fireworks、DeepInfra、vLLM、llama.cpp,以及大致任何使用 OpenAI Chat Completions 协议的端点。您指向基础 URL,粘贴密钥,完成。
最后这个设计起来最有意思。每六个月就会出现一个新的"质量相同价格便宜 30%"的提供商 — 它们都汇聚到 OpenAI 的协议格式,正是因为其他人都根据它进行集成。把这一长串当作一个带可配置基础 URL 的提供商来处理,意味着我们免费获得这些新端点,您也不用等我添加它们。
每个功能一个模型,不只是一个提供商
让所有 Archyl 功能都通过 gpt-5.4-mini 路由是我为平台做的选择。这不是每个客户的正确选择。发现是 token 密集型的,需要强大的推理模型。聊天需要流式感。托管代理本质上是 Claude 形态的。文档标题生成可以用最便宜的。
所以当您启用 BYO Provider 时,您不只选一个模型 — 您选一个默认值,然后按功能覆盖:
- 聊天
- 发现(及其三个子阶段:结构、优化、文件分析)
- ADR 解析
- 文档标题生成
- 洞察
- 托管代理
任何字段留空,就会回退到提供商的合理默认值。填入确切的模型标识符 — claude-opus-4-5、gpt-4o、mistral-large-latest、anthropic.claude-sonnet-4-20250514-v1:0,任何 — Archyl 直接传递。
这比听起来更重要。一个客户想要 Claude Sonnet 用于聊天(低延迟),Claude Opus 用于发现(推理质量)。另一个想要 Bedrock Llama 用于一切,除了托管代理 — 想要直接 Anthropic 的。两者都只需要几个下拉菜单就能达到理想配置。
您的配额会怎样
这是采购真正关心的部分。Archyl 的免费和付费层级各包含每月 AI 发现操作、聊天查询和托管代理运行的配额。该配额的存在是为了覆盖我的 OpenAI 账单。
启用 BYO Provider 时,所有配额限制都被跳过。 您的提供商直接向您开发票计费用量。Archyl 不再计入您的月度上限,因为您没有消耗 Archyl 的池化 AI 支出。
实际上:启用 BYO Provider 的 Business 层级组织可以无限发现、无限聊天、无限代理运行 — 仅受您愿意在 Anthropic 或 AWS 上花费的金额限制。Archyl 席位价格涵盖平台;您涵盖 token。
对于希望保留平台管理模型的组织,什么都不变。该开关是选择加入,默认关闭,一键可逆。
如何启用
设置 → AI 选项卡。五个步骤,可能两分钟:
- 选择您的提供商。
- 粘贴您的 API 密钥。(对于 Bedrock:
<access_key_id>:<secret_access_key>加 AWS 区域。) - 可选地按功能覆盖模型。留空使用提供商默认值。
- 点击测试连接 — Archyl 用一个微小的 completion ping 您的提供商,以在您提交之前确认凭据有效。
- 切换启用并保存。
就是这样。组织内任何人发出的下一个 AI 请求 — 发现、聊天、代理运行、ADR 导入 — 都将通过您的提供商、您的模型、您的密钥。
API 密钥使用平台加密密钥以 AES-256-GCM 静态加密,从不在 API 响应中回显(UI 显示 •••••••• 和"密钥已存储"指示器),仅在请求需要时进程内解密。删除配置会清除密钥。
只有组织管理员可以配置此项。成员将看到 AI 功能透明地继续工作 — 路由对他们不可见。
接下来
根据早期客户对话,有几件事已经在路线图上:
- Bedrock Provisioned Throughput 用于具有预留容量合同的组织。
- 每个项目的提供商覆盖,以便处理敏感项目的团队可以仅通过特定端点路由该项目,而组织其余部分使用默认值。
- BYO 审计日志,显示哪个功能用哪个模型调用了哪个提供商,供需要证明这一点的合规团队使用。
如果其中任何一个会为您解锁 — 或者如果有第六个提供商我应该添加 — 我很乐意听到。回复这篇文章,在应用内聊天找我,或者预约 20 分钟。
如果您一直在等待"我们已经使用 {您的 AI 提供商}"不再成为采用 Archyl 的障碍,这就是那个版本。开通一个组织,放入您的密钥,让每个 AI 功能通过您已经拥有的合同路由。
您的架构,您的提供商,您的密钥。产品保持不变 — 只是账单换了地方。