能做真正工作、受你掌控的代理
在许多运营、财务和支持团队中,一天的大部分时间都花在系统之间搬运信息上:读取发票、为客户做入职、准备报告、保持记录同步。我们构建的 AI 代理将语言模型推理与你的 API 相结合,因此它们能够处理僵化的基于规则的自动化无法处理的输入。每个代理都有一个明确的职责、只拥有该职责所需的权限、对重大操作设有审批点、一条审计记录,以及一个界面,让你的团队可以监督、纠正或接管。
AI 辅助、专家主导的代理工程
AI 如何协助
- 编码代理在工程师设定的范围内起草集成代码、工具定义和工作流逻辑。
- AI 从获准的示例中起草评估用例,包括边缘情况以及试图滥用代理的行为。
- AI 将失败和已纠正的运行归类,使工程师能够将反复出现的问题追溯到其根源。
- AI 协助根据商定的工作流和权限设计编写运行手册和文档。
我们的专家负责什么
- 哪些操作由代理自行执行,哪些需要等待某个人的批准
- 权限范围、凭据,以及每个代理可以读取或更改的数据
- 故障处理:重试、回退、升级,以及由人接管的那个节点
- 评估标准,以及每个工作流的上线决策
一次受监督的智能体运行
示意性运行;哪些操作需要审批、由谁审批,会在我们梳理您的工作流程时商定。
触发
一封新的发票邮件、一次表单提交或一次定时检查启动一次运行,并被记录为已接收。
智能体准备操作
智能体读取输入,通过其工具收集上下文,并提出带有证据的操作建议。
权限检查
策略规则确认该操作符合智能体的范围、支出限额和允许的系统。
检查点: 超出范围的操作在此被阻止
人工审批
有重大影响的操作,例如发起一笔付款或向客户发送邮件,会等待指定的审核人处理。
检查点: 审核人批准、编辑或拒绝
执行
已批准的操作通过该智能体自身的受限凭证运行,并会检查每个系统的响应。
审计日志
输入、提案、审批人、结果和时间都会被记录下来,这样您的团队就能追溯发生了什么以及为什么发生。
当出现故障时: 如果某个步骤失败或智能体不确定,它会停止并将任务连同完整背景交给相关人员处理。
谁把工作交给智能体
您的员工从电子邮件和 PDF 中复制详细信息到多个系统,并每周追踪相同的跟进事项,而当输入看起来不同时,固定规则的自动化就会失效。您希望把这些工作从他们的案头移走,同时不让软件在未经核查的情况下转移资金、更改记录或联系客户。
- 手动将供应商发票录入会计系统的财务团队
- 入驻步骤横跨 CRM、电子邮件和电子表格的运营负责人
- 将智能体试点从演示推进到日常使用的团队
您将获得什么
从映射好的工作流到受监控的代理
面向既定工作流程的智能体
每个智能体处理一项特定工作,例如发票处理、客户入驻、工单分类或报告准备,并具有明确的输入、输出和停止点。
带审批的编排
跨 CRM、ERP 和自定义系统的多步骤工作流程,包含条件逻辑、在重大操作前的审批步骤,以及每一步的错误处理。
监督与接管控制台
一个审查界面,您的团队可在此批准、纠正或接管任务,同时可查看智能体的输入、建议操作及来源。
评估套件
从获准的真实示例和边缘情况中生成的测试用例,在每次发布前进行评分,使提示、模型或集成的更改不会悄然破坏某个工作流程。
范围受限的系统集成
通过 webhook 和范围受限的凭据连接到 Salesforce、HubSpot、QuickBooks 或您自己的 API,使每个智能体只能访问其工作所需的内容。
审计日志、监控与告警
记录每一项操作,在出现故障或异常流量时发出告警,并在某一步骤无法完成时升级至指定人员。
范围、准备工作与支持
从明确定义的范围开始
从一个工作流开始:它的触发条件、它跨越的系统、预期的处理量以及异常负责人。在确定性规则足够的地方我们就使用确定性规则,只在解析非结构化输入有用的地方才加入 AI。CRM 自动化和 API 工作流自动化并不总是需要智能体。
你需要提供什么
提供当前任务的操作演示、移除了敏感数据的示例输入、业务规则、访问权限负责人以及失败案例。确认哪些操作需要审批,以及哪些系统具有可用的 API 访问权限。
交付后的支持
交接内容包括工作流文档、故障恢复和告警归属。连接器变更、凭证、任务用量和异常需要持续关注;监控与维护另行约定。
智能体构建不包含的内容
- 在您的网站或 WhatsApp 上面向客户的助手属于 AI Chatbots;此处的智能体运行后台工作流程,不过它们可以起草客户消息供审批。
- 没有可用 API 的系统,或记录过于不一致而无法据此操作的情况,需要先修复;我们将其界定为 API Development 或 Application Modernization & Stabilization。
- 在您控制的基础设施上托管开放权重模型是一项单独的服务,即 Private AI Infrastructure;此处的智能体可以使用它或经批准的托管模型。
- 如果您只想对现有智能体进行权限和提示注入测试,而不进行重建,AI Evaluation & Testing 可涵盖此项,并可单独预订。
典型的自动化需求
我们所界定范围的典型场景,而非客户案例研究。
通过电子邮件到达的供应商发票
发票以各种布局的 PDF 形式到达。我们会构建一个智能体来读取每一份发票,将其与采购订单匹配并准备录入,而不匹配的情况和首次合作的供应商则等待财务审批人处理。
分散在多个工具中的入驻流程
合同签署后,员工将相同的详细信息重新录入计费系统、CRM 和欢迎清单。我们会让智能体准备这些记录并起草欢迎邮件,供人在任何内容被保存或发送前审批。
无人能够监督的原型智能体
一个内部智能体在演示中可以运行,但使用管理员密钥且不记录任何日志。我们会将其工作拆分为范围受限的工具,添加审批点和运行日志,并在更广泛使用前用真实案例对其进行测试。
我们如何构建自动化智能体
- 01
梳理工作流程
我们与您的团队一同梳理当前流程,选择值得自动化的步骤,并商定智能体可独立执行哪些操作、哪些需要人工审批。
- 02
设计控制措施与测试
集成、权限、审批步骤、回退机制和监督界面将一同设计,同时设计定义优良结果的测试集。
- 03
并行构建与运行
工程师构建智能体和集成,QA 对照测试集为其评分,并在人工流程旁进行并行运行以显示其在哪些方面表现稳定。
- 04
分阶段上线,然后改进
在有限范围内上线,配备监控和团队培训,然后在结果允许的情况下,按照商定的支持计划扩大覆盖范围和权限。
设计、QA 和运维如何支持您的智能体
为审查与接管而设计
设计师打造审批队列、纠正界面和接管流程,使您的团队能够了解智能体做了什么以及为什么这样做,并能在无需费力查找上下文的情况下介入。
使用评估集的 QA
QA 针对评估集测试输出质量、工具权限和故障处理,并在提示、模型或集成发生更改时重新运行回归检查。
具备清晰可见性的运维
DevOps 以范围受限的凭据部署智能体,配备日志、告警和成本跟踪,可在托管模型或您的数据规则要求的私有基础设施上运行。
上线后的改进
我们与您一同审查故障和纠正情况,更新提示、工具和测试,并仅在结果支持时才扩大智能体的职责范围。
常见问题
常见问题解答
自动化智能体可以处理哪些类型的工作?
具有明确输入且结果可供人核查的重复性数字化工作:发票和文档处理、入驻步骤、工单分类、报告准备以及在系统之间同步记录。智能体还可以准备需要判断的工作,例如回复草稿或建议的退款,供人审批。如果基于规则的自动化(例如 Zapier 工作流程)能更好地完成这项工作,我们会告诉您。
智能体会在无人核查的情况下行动吗?
仅在您批准的权限范围内。我们共同决定哪些步骤自行运行、哪些需等待人工,例如付款、删除记录或向客户发送消息。每一项操作都会被记录,告警会标记故障,并且您的团队可随时暂停智能体或接管某项任务。自主权会根据结果逐步扩大,绝不会从一开始就默认拥有。
我们如何知道一个智能体是否值得?
我们在构建前就商定衡量标准,例如每个案例的处理时间、审查中发现的错误以及员工纠正智能体的频率,并在并行运行期间将它们与人工流程进行比较。运行成本(包括模型使用)从首次发布起便被跟踪,使您能够基于证据而非估算来评判智能体。
智能体和我们的数据在哪里运行?
这会在范围界定期间商定。智能体可以在商定的账户和数据保留设置下使用托管模型,例如 OpenAI 的 GPT 模型或 Claude,也可以在您控制的基础设施上使用开放权重模型,例如 Llama 或 Mistral。我们的开发工作遵循您选择的套餐:私有 / 本地 AI 工程 或 Claude Code / OpenAI Codex 工程。
相关阅读
- 准备 B2B 商务集成
将客户定价、订单审批和履约需求转化为可测试的 API 集成范围。
- 减少 RAG 应用中的无依据回答
检索质量、文档权限、证据和评估如何能减少无依据的回答——以及一个知识助手在哪些方面仍然需要设定限制。



