AI 代理与自动化

自动化智能体

跨越你的 CRM、文档和运营系统的业务工作流自动化,具有已定义的触发器、权限、审批点和恢复路径。在任务需要时使用 AI。

能做真正工作、受你掌控的代理

在许多运营、财务和支持团队中,一天的大部分时间都花在系统之间搬运信息上:读取发票、为客户做入职、准备报告、保持记录同步。我们构建的 AI 代理将语言模型推理与你的 API 相结合,因此它们能够处理僵化的基于规则的自动化无法处理的输入。每个代理都有一个明确的职责、只拥有该职责所需的权限、对重大操作设有审批点、一条审计记录,以及一个界面,让你的团队可以监督、纠正或接管。

AI 辅助、专家主导的代理工程

AI 如何协助

  • 编码代理在工程师设定的范围内起草集成代码、工具定义和工作流逻辑。
  • AI 从获准的示例中起草评估用例,包括边缘情况以及试图滥用代理的行为。
  • AI 将失败和已纠正的运行归类,使工程师能够将反复出现的问题追溯到其根源。
  • AI 协助根据商定的工作流和权限设计编写运行手册和文档。

我们的专家负责什么

  • 哪些操作由代理自行执行,哪些需要等待某个人的批准
  • 权限范围、凭据,以及每个代理可以读取或更改的数据
  • 故障处理:重试、回退、升级,以及由人接管的那个节点
  • 评估标准,以及每个工作流的上线决策

一次受监督的智能体运行

示意性运行;哪些操作需要审批、由谁审批,会在我们梳理您的工作流程时商定。

  1. 触发

    一封新的发票邮件、一次表单提交或一次定时检查启动一次运行,并被记录为已接收。

  2. 智能体准备操作

    智能体读取输入,通过其工具收集上下文,并提出带有证据的操作建议。

  3. 权限检查

    策略规则确认该操作符合智能体的范围、支出限额和允许的系统。

    检查点: 超出范围的操作在此被阻止

  4. 人工审批

    有重大影响的操作,例如发起一笔付款或向客户发送邮件,会等待指定的审核人处理。

    检查点: 审核人批准、编辑或拒绝

  5. 执行

    已批准的操作通过该智能体自身的受限凭证运行,并会检查每个系统的响应。

  6. 审计日志

    输入、提案、审批人、结果和时间都会被记录下来,这样您的团队就能追溯发生了什么以及为什么发生。

当出现故障时: 如果某个步骤失败或智能体不确定,它会停止并将任务连同完整背景交给相关人员处理。

谁把工作交给智能体

您的员工从电子邮件和 PDF 中复制详细信息到多个系统,并每周追踪相同的跟进事项,而当输入看起来不同时,固定规则的自动化就会失效。您希望把这些工作从他们的案头移走,同时不让软件在未经核查的情况下转移资金、更改记录或联系客户。

  • 手动将供应商发票录入会计系统的财务团队
  • 入驻步骤横跨 CRM、电子邮件和电子表格的运营负责人
  • 将智能体试点从演示推进到日常使用的团队

您将获得什么

从映射好的工作流到受监控的代理

  • 面向既定工作流程的智能体

    每个智能体处理一项特定工作,例如发票处理、客户入驻、工单分类或报告准备,并具有明确的输入、输出和停止点。

  • 带审批的编排

    跨 CRM、ERP 和自定义系统的多步骤工作流程,包含条件逻辑、在重大操作前的审批步骤,以及每一步的错误处理。

  • 监督与接管控制台

    一个审查界面,您的团队可在此批准、纠正或接管任务,同时可查看智能体的输入、建议操作及来源。

  • 评估套件

    从获准的真实示例和边缘情况中生成的测试用例,在每次发布前进行评分,使提示、模型或集成的更改不会悄然破坏某个工作流程。

  • 范围受限的系统集成

    通过 webhook 和范围受限的凭据连接到 Salesforce、HubSpot、QuickBooks 或您自己的 API,使每个智能体只能访问其工作所需的内容。

  • 审计日志、监控与告警

    记录每一项操作,在出现故障或异常流量时发出告警,并在某一步骤无法完成时升级至指定人员。

智能体构建不包含的内容

  • 在您的网站或 WhatsApp 上面向客户的助手属于 AI Chatbots;此处的智能体运行后台工作流程,不过它们可以起草客户消息供审批。
  • 没有可用 API 的系统,或记录过于不一致而无法据此操作的情况,需要先修复;我们将其界定为 API Development 或 Application Modernization & Stabilization。
  • 在您控制的基础设施上托管开放权重模型是一项单独的服务,即 Private AI Infrastructure;此处的智能体可以使用它或经批准的托管模型。
  • 如果您只想对现有智能体进行权限和提示注入测试,而不进行重建,AI Evaluation & Testing 可涵盖此项,并可单独预订。

典型的自动化需求

我们所界定范围的典型场景,而非客户案例研究。

  • 通过电子邮件到达的供应商发票

    发票以各种布局的 PDF 形式到达。我们会构建一个智能体来读取每一份发票,将其与采购订单匹配并准备录入,而不匹配的情况和首次合作的供应商则等待财务审批人处理。

  • 分散在多个工具中的入驻流程

    合同签署后,员工将相同的详细信息重新录入计费系统、CRM 和欢迎清单。我们会让智能体准备这些记录并起草欢迎邮件,供人在任何内容被保存或发送前审批。

  • 无人能够监督的原型智能体

    一个内部智能体在演示中可以运行,但使用管理员密钥且不记录任何日志。我们会将其工作拆分为范围受限的工具,添加审批点和运行日志,并在更广泛使用前用真实案例对其进行测试。

我们如何构建自动化智能体

  1. 01

    梳理工作流程

    我们与您的团队一同梳理当前流程,选择值得自动化的步骤,并商定智能体可独立执行哪些操作、哪些需要人工审批。

  2. 02

    设计控制措施与测试

    集成、权限、审批步骤、回退机制和监督界面将一同设计,同时设计定义优良结果的测试集。

  3. 03

    并行构建与运行

    工程师构建智能体和集成,QA 对照测试集为其评分,并在人工流程旁进行并行运行以显示其在哪些方面表现稳定。

  4. 04

    分阶段上线,然后改进

    在有限范围内上线,配备监控和团队培训,然后在结果允许的情况下,按照商定的支持计划扩大覆盖范围和权限。

使用 AI 工具的两种方式

选择在我们构建期间 AI 编码代理可以在何处处理您的代码。无论哪种方式,工程标准都是一致的。

不确定?我们会在界定范围时为您推荐一个。 比较 AI 交付选项

设计、QA 和运维如何支持您的智能体

  • 为审查与接管而设计

    设计师打造审批队列、纠正界面和接管流程,使您的团队能够了解智能体做了什么以及为什么这样做,并能在无需费力查找上下文的情况下介入。

  • 使用评估集的 QA

    QA 针对评估集测试输出质量、工具权限和故障处理,并在提示、模型或集成发生更改时重新运行回归检查。

  • 具备清晰可见性的运维

    DevOps 以范围受限的凭据部署智能体,配备日志、告警和成本跟踪,可在托管模型或您的数据规则要求的私有基础设施上运行。

  • 上线后的改进

    我们与您一同审查故障和纠正情况,更新提示、工具和测试,并仅在结果支持时才扩大智能体的职责范围。

常见问题

常见问题解答

自动化智能体可以处理哪些类型的工作?

具有明确输入且结果可供人核查的重复性数字化工作:发票和文档处理、入驻步骤、工单分类、报告准备以及在系统之间同步记录。智能体还可以准备需要判断的工作,例如回复草稿或建议的退款,供人审批。如果基于规则的自动化(例如 Zapier 工作流程)能更好地完成这项工作,我们会告诉您。

智能体会在无人核查的情况下行动吗?

仅在您批准的权限范围内。我们共同决定哪些步骤自行运行、哪些需等待人工,例如付款、删除记录或向客户发送消息。每一项操作都会被记录,告警会标记故障,并且您的团队可随时暂停智能体或接管某项任务。自主权会根据结果逐步扩大,绝不会从一开始就默认拥有。

我们如何知道一个智能体是否值得?

我们在构建前就商定衡量标准,例如每个案例的处理时间、审查中发现的错误以及员工纠正智能体的频率,并在并行运行期间将它们与人工流程进行比较。运行成本(包括模型使用)从首次发布起便被跟踪,使您能够基于证据而非估算来评判智能体。

智能体和我们的数据在哪里运行?

这会在范围界定期间商定。智能体可以在商定的账户和数据保留设置下使用托管模型,例如 OpenAI 的 GPT 模型或 Claude,也可以在您控制的基础设施上使用开放权重模型,例如 Llama 或 Mistral。我们的开发工作遵循您选择的套餐:私有 / 本地 AI 工程 或 Claude Code / OpenAI Codex 工程。

相关阅读

  • 电子商务

    准备 B2B 商务集成

    将客户定价、订单审批和履约需求转化为可测试的 API 集成范围。

  • 人工智能

    减少 RAG 应用中的无依据回答

    检索质量、文档权限、证据和评估如何能减少无依据的回答——以及一个知识助手在哪些方面仍然需要设定限制。

从一个工作流程开始

告诉我们哪个流程拖慢了您的团队,或哪个现有智能体需要审查。我们会梳理出智能体可以安全承担的工作,以及人员在哪里保持掌控。