跳到主要内容

AI 干活。发不发,你的人说了算。

cken 给每个智能体三件东西:一个可以领任务的队列、一个它跨不过去的花费上限,以及最后一位审核人。于是你可以把 AI 放到真实工作上,同时还讲得清它做了什么。

无需信用卡。失败的运行从不计费。

多数 AI 项目栽在第二个问题上。

第一个问题——模型能不能干这件事——早就有答案了。卡住团队的是第二个:出错时谁负责?花了多少钱?它到底做了什么?谁说了可以发出去?聊天窗口回答不了这里的任何一个,所以这些工作要么永远停在演示阶段,要么上线之后没人讲得清。

  • 01

    它跑过了,但没人说得清它做了什么。 结果在某个 Slack 消息里,提示词后来又改过两次,当时运行它的人已经离职了。

  • 02

    钱是真花掉了,之后才有人发现。 没有设上限,于是账单就是上限。

  • 03

    演示效果更好了,实际工作反而更差了。 改一次提示词修好了有人投诉的那个例子,同时悄悄弄坏了四个没人盯着的。

四个步骤,按它们发生的顺序。

一个任务会依次经过这四种状态,一个都跳不过去。

  1. 01

    把工作交给它。

    把 cken 指向一个队列、一个定时任务,或者一个入站 webhook。任务是一行带状态的数据,不是一段需要你全程盯着的对话。一万个任务和一个任务的行为是一样的。

  2. 02

    它在上限之内运行。

    每次运行开始前就定好花费上限、超时和重试策略。碰到上限它就停下并说明原因。不存在「从账单上才知道」的这种情况。

  3. 03

    由人签字放行。

    完成的工作进入审核队列——批准、修改或退回,键盘优先,按规则路由给负责这类工作的人。只有批准才会放行结果。

  4. 04

    评测让它保持诚实。

    审核人批准过的例子会变成测试集。改提示词或换模型时,cken 会先拿它们给这次改动打分,再决定是否进入生产环境——于是「变好了」是量出来的,不是盼出来的。

六个模块,每一个都是一种控制手段,不是一项功能。

下面每个标题都是从运维者这一侧写的:你从此可以保证什么。

队列与定时

工作进来,就有东西把它领走。

推一个任务、定时创建一个,或者让事件来创建。每个任务都是持久的——中途挂掉的运行会被重新领走,而不是丢掉。

  • 优先级、重试与死信处理
  • 按计划重复执行的工作
  • 背压,而不是静默丢弃
预算

没有上限,就不会开始运行。

按单次运行、按工作区、按月设置上限。会超出上限的运行在花钱之前就停下,并告诉排它进队列的人为什么。

  • 单次运行与工作区两级上限
  • 真实的单次运行成本,不是估算
  • 失败的运行从不计费
审核与批准

没有署名,就不会发出去。

结果排队等人处理:批准、修改或退回——修改会被保留下来,因为一个被人改过的结果,是你手上最有价值的训练信号。

  • 按规则路由、指派,以及一个 SLA 计时器
  • 键盘优先,为整天做审核的人设计
  • 修改被记录为样例,而不是覆盖掉原稿
评测

在客户之前发现质量漂移。

你批准和退回的结果会变成一个可打分的测试集。每次改提示词或换模型都先跑一遍,分数附在这次改动上。

  • 测试集来自真实审核过的工作
  • 每次改动上线前先打分
  • 拦下会导致回退的发布
记忆

它记住的是你的偏好,不只是你的提示词。

审核人做过的修正会留下来。同一类工作的第十次运行,是从你的团队在前九次里定下的结论开始的。

  • 按工作区和项目分别隔离
  • 可读、可编辑——你能看到它以为自己知道什么
  • 可以一条一条删除
审计记录

每一次运行都可回放。

输入、输出、调用过的工具、成本、耗时、批准人、时间戳。几个月之后,你依然可以把当时到底发生了什么摆给别人看。

  • 完整的运行历史,可筛选
  • 留存期限由你设定,不是我们替你挑的

你其实已经在做的那个比较。

不是在 cken 和某个竞品之间选,而是在 cken 和你手上已经有的三样东西之间选。

Capability聊天窗口流程编排工具团队自己写的脚本cken
谁在干活一个人,在写提示词你画出来的步骤代码,直到它坏掉一个智能体,从队列里领
谁负责谁粘贴的谁负责没人作者,但找不到人一位署名的批准人
出错的时候你也许会发现它照样跑完它无限重试在发出去之前被退回
花了多少钱不知道按任务算,不按模型调用算不知道按单次运行,事前与事后都有
拿什么给审计看一段 Slack 消息一份运行日志应用日志那次运行本身,可回放
到一万个任务时到不了按任务计费开始咬人有人得开始值班还是同一件事,排队进行

流程编排工具是好东西。如果你的任务是确定性的,就用它们——更便宜,而且每次都对。这里的区别在于审核人和记录,不在能力。

一次运行,是智能体领走并完成的一个任务。

同一个任务的重试不会算两次。还没产出任何东西就失败的运行不计费。整个计量就这么简单。

没跑完的运行,我们不收钱。

如果一次运行在产出结果之前就失败了,它对你就是零成本——不用申请退款,也不用开工单。

在你开口之前先回答。

什么算一次运行?

智能体领走并完成的一个任务,无论成功还是失败。同一个任务的重试仍然算一次运行。还没产出结果就失败的运行完全不计费。

可以不经人批准就运行吗?

可以——当某一类工作的评测分数足以支撑时,你可以让它自动批准,同时对其余工作保留审核。默认是开启审核,因为这是人们最容易后悔关掉的那个开关。

AI 出错的时候会怎样?

审核人退回或修改它,结果不会离开 cken。这次修改会作为样例保留下来,于是下次有人改提示词时,同样的错误会被评测集拦住。

这和流程自动化工具有什么不同?

那些工具执行的是你画出来的步骤。cken 执行的是你没有完全指定的工作,在预算之内,并且在结果前面放了一个人。如果你的任务是确定性的,就用流程工具——更便宜,而且每次都对。

给每一次 AI 运行配上队列、预算和审核人。

无需信用卡。失败的运行从不计费。

免费开始