
签约前向 AI 智能体供应商提问的 24 个问题
在与 AI 智能体供应商签约之前,在六个领域拿到 24 个问题的书面答案:范围与匹配、证明、数据与安全、架构、商务与所有权,以及上线后生活。其中五个决定多数交易:第一条工作流的固定价、书面成功指标、约定的叫停阈值、分手时谁拥有提示词与代码,以及在你真实量级下智能体每月运行成本。这五个中任一模糊答案就是信号。
Gartner 估计,在数千家销售智能体 AI 的供应商中,只有约 130 家是真的,其余从事它所谓的智能体洗白:把聊天机器人、助手与机器人流程自动化(RPA)脚本重新包装为智能体。同一公司、同一发布:到 2027 年底,超过 40% 的智能体 AI 项目将被取消,驱动因素是成本攀升、业务价值不清与风险控制不足。

那三种失败模式都能在销售通话中检测。下面是检测它们的问题。打印清单,按顺序问,并要求书面答案。
要点
- 要求第一条工作流的固定价。不愿给一条有界工作定价的供应商,是在告诉你他们无法划定范围。
- 在任何构建开始前,要求书面成功指标与约定的叫停阈值。Gartner 的取消驱动是成本、价值不清与弱风险控制;三者都是合同问题,不是技术问题。
- 提示词、代码与配置的所有权是新的锁定之争。拿到书面答案,否则你会付钱才能离开。
- 问在你真实量级下智能体每月运行成本,而不是按席位。模型用量加监控是多数报价省略的行。
- 只有 21% 的组织报告有成熟的智能体 AI 治理模型,因此问谁审批什么,以及审计轨迹在哪里。
第 1 节:范围与匹配
1. 我们的哪些工作流还不该自动化,为什么? 本清单上最能揭示的单一问题。卖产能的供应商会自动化任何东西。卖判断的供应商会点名两三个太模糊、量太低,或太依赖你尚未清理的数据的工作流。通话前自己按工时乘频率排序,方法见服务型企业应从何处开始 AI 自动化,以便判断他们的答案是否匹配你的数字。
2. 你会从哪一条有界工作流开始,完成是什么样? 你要一件有清晰起止的工作,不是平台。若答案是路线图,范围未定义。
3. 成功指标是什么,如何度量,谁度量? 归还的工时、错误率、周期时间、每次交易成本。选一个主要的。若供应商自己度量且没有独立读取,指标是装饰。
4. 叫停阈值是什么,谁能叫停? 低于此试点停止且无人争论的数字。具名人、书面数字、构建前约定。抵制叫停阈值的供应商在告诉你他们的信心。
第 2 节:证明与业绩
5. 给我看一个你今天在自己业务中生产运行的智能体。 为别人构建智能体却自己一个都不跑是警告。问它做什么、坏过什么、他们如何发现。
6. 你构建的智能体在生产中最长跑过多久? 演示容易。第九个月难,因为到那时三个对接工具已发了破坏性变更。
7. 带我走一遍失败的智能体构建,以及之后你改了什么。 有真实部署的人都有一个。没有失败故事的供应商要么没有生产历史,要么没有坦诚,两者都让你付出代价。
8. 究竟谁会构建这个,他们是这个房间里的人吗? 要名字,并问工作是否分包。若构建团队与销售团队不同,下次通话请来构建团队。
第 3 节:数据、安全与合规
9. 你们使用的模型会用我们的输入与输出训练吗? 答案必须是否,且必须可追溯到供应商与模型提供方的商务条款,而不是口头保证。
10. 我们的数据去哪里,哪些子处理方碰它,我们能看到清单吗? 拿不出子处理方清单的供应商,还没想过你的采购团队。
11. 你们实际持有哪些安全认证,若没有,你们用什么运营控制代替? 常出现三个。System and Organization Controls(SOC)2 报告是对供应商安全控制的独立审计;ISO 27001 与 ISO 42001 是国际标准化组织(ISO)覆盖信息安全与 AI 管理的认证。认证对许多企业是真实门槛。但诚实描述运营控制,胜过两年前 Type I 或「进行中」却未聘请审计师的认证主张。问是哪一种、问日期、要报告。
12. 你们会签署数据处理协议(DPA,管辖我们数据如何被处理的合同)吗,多快能返回填完的安全问卷? 这里的速度预测其他一切。几天内回答的供应商以前做过。
第 4 节:架构与集成
13. 智能体会碰我们的哪些系统,在每个系统中需要什么权限? 最小权限,按系统,书面。集成(不是 AI)是多数预算与多数故障所在。
14. 那些工具之一改 API 时会发生什么? 你要具名负责人、监控方法,以及谁付钱的答案。「我们会修」不是支持模型。
15. 人在环在哪里,智能体无需审批可采取哪些动作? 明确划线。任何不可逆、任何花钱、任何触达客户的,默认应要求人。出站邮件是教科书案例:真正有效的 AI 线索获取系统 让智能体研究并起草,发送留给人,因为无人值守发送正是烧域名的东西。
16. 审计轨迹是什么,我们能否不请求你们就读取? Deloitte 2026 年对 3,235 名 IT 与业务领导者的调查发现,只有 21% 有成熟的智能体 AI 治理模型,点名的缺口正是这些:决策边界、实时监控与审计轨迹。不要接受黑箱。
第 5 节:商务与所有权
17. 第一条工作流的固定价是多少? 不是区间,不是变成区间的发现费。一件有界工作一个数字。我们公布的 AI 智能体成本区间 把小作坊简单单工作流自动化放在 3,000 至 8,000 美元。我们自己的有界工作流试点在我们的定价页上是固定价 25,000 至 60,000 美元,含影子模式、有监督上线与书面叫停阈值。那些是你判断答案是否严肃的参考点。
18. 在我们真实量级下每月模型与监控成本是多少? 请他们从你的交易计数计算。每年为运行预算构建成本的 15% 至 25%。没有持续行项的报价是不完整,不是便宜。
19. 若我们分手,谁拥有提示词、代码、配置与评估集? 这是新的网站人质问题。你要的答案是你拥有全部并可导出。写进合同。
20. 加第二条、第三条工作流要花多少,该价格现在固定吗? 范围蔓延在供应商议价力最强时定价,也就是第一条刚奏效之后。尽早固定数字。
第 6 节:上线之后
21. 「维护」包含什么,列成清单? 监控、事件响应时间、模型更新、集成修复、提示词调优、报告。若未枚举,就不包含。
22. 若我们想自己跑,你们如何交接? 文档、运行手册、访问、培训会。问那要花多少。对自己价值有信心的供应商不需要握着钥匙。
23. 智能体在生产中做错事时你们的响应时间是多少? 是错误,不是正常运行时间。智能体以自信地不正确的方式失败,没有任何正常运行时间服务级别协议(SLA)能抓住。
24. 什么会让你们告诉我们停止? 最后一个问题,也是告诉你买的是判断还是产能的问题。
三个应结束对话的答案
- 对问题 17 两次「视情况而定」。 严肃供应商给有界工作流定价。
- 对问题 19「我们拥有提示词」。 你买的是依赖,不是系统。
- 对问题 11 无法出示报告与日期的认证主张。 若他们在销售通话中扭曲真相,审计轨迹也救不了你。

我们如何自己回答这些问题
公平起见,这里是我们对四个最尖锐问题的答案。
我们每天在生产中运行自己的智能体舰队,每周在团队中回收 50 小时或更多。我们还在 mcp.strataigize.com 运营公开 Model Context Protocol(MCP)服务器(让 AI 智能体调用外部系统的标准),这意味着智能体可以直接查询我们的业务,我们尚未发现另一家机构运行一个。
在安全与合规上,我们没有 SOC 2。那写在我们的信任与安全页上,不在脚注里。该页承载我们实际运营的:最小权限、客户授予的访问、托管存储中的凭证、对齐美国国家标准与技术研究院(NIST)AI 风险管理框架四项功能的治理摘要、我们的子处理方清单,以及应要求提供的 DPA。被要求时我们填写供应商安全问卷。
在价格上,我们为第一条工作流报固定数字,并在构建开始前书面约定叫停阈值。在所有权上,你拥有提示词、代码与配置。
常见问题
什么是智能体洗白?
把现有产品(通常是聊天机器人、助手或 RPA 脚本)重新包装为自主智能体,却没有底层能力。Gartner 估计数千家智能体 AI 供应商中只有约 130 家是真的。问题 5 与问题 13 是最快测试:问他们自己跑什么,问智能体实际持有什么权限。
AI 智能体供应商评估应多久?
有界第一条工作流两至四周,多数时间花在安全审查而不是演示。在第一次通话前发送问题 9 至 12,使合规答案与商务答案并行到达。
我们应跑付费试点还是免费概念验证?
付费,且有界。免费试点由谁有空谁来做,对着什么也不度量。见能挺过采购的试点是什么样了解在安全审查中站得住的结构。
若我们仍在决定是否内部构建?
先跑构建还是购买对比。供应商问题只有在你决定供应商在范围内时才重要。
把这份清单带到我们这里
我们会在通话上按顺序回答全部 24 个,并书面写下答案。预约增长审计或阅读我们的 AI 智能体开发 合作包含什么。决策阶段版本的对话是 AI 咨询。
联系我们