一聚教程网:一个值得你收藏的教程网站

最新下载

热门教程

clueless:AI Agent 工具实践指南

时间:2026-10-02 09:46:01 编辑:袖梨 来源:一聚教程网

真正理解clueless,要从它处理的任务开始:告诉你的经纪人你什么都不知道,它成为房间里唯一的审阅者:安全默认值、回答未提出的问题、标记不可逆转的步骤,克劳德代码/法典/光标/AGENTS.md。这类安全分析工具真正难在授权边界、证据完整性和误报需要同时控制,仓库说明只能作为第一层证据。落地前可以在明确授权的样例或离线靶场中验证,用输入边界、证据链、误报率和安全中止机制判断它是否真的省事。我会把它列入具备授权环境和复核能力的安全人员的候选清单,而不是仅凭项目介绍直接纳入生产。

ADanMan/clueless 项目截图 1

clueless

Tell 你的代理人你什么都不知道。观看它获得 careful.

俄语

你也注意到了。说“我真的不明白这一点,只要为我正确地做它”,答案就会变得更好。该模型不再假设您会发现它的错误。它开始说出你不知道要问的事情。它会标记会消耗您数据的步骤。

这不是侥幸。这是一种责任翻转:一旦模型认为没有人会审查其工作,它就成为审查者。

无知使得翻转变得深思熟虑并且始终有效。

之前/之后

您索取注册表单。你说你不是程序员。

无需一无所知,您就可以获得工作代码,并且在最底部的“一些值得了解的事情(无需采取任何操作)”*下,有一条注释表明会话密钥仍然是 change-this-to-a-random-long-string。你复制粘贴。它运送。

毫无头绪:

Do this
  1. Create .env with SESSION_SECRET=<generated below>. The server refuses to start without it.
  ...
Careful
  - users.db holds real people's emails. Back it up, never commit it, never email it.
  - No password reset yet. For a course site that is your #1 support ticket. Say so and I'll add it before launch.
Check it worked
  Sign up twice with the same email. The second attempt must say "already exists".
Decided for you
  - SQLite over Postgres: one file, zero setup, fine under a few hundred students.
  - bcrypt cost 12 over 10: slower by 300 ms, safer if the file ever leaks.
Only you can decide
  - Where this will be hosted (assumed Render; the steps differ for a VPS).

相同型号。同样的提示。 示例/ 中有更多幸存者。

它实际上做了什么

在每次回答之前,代理都会问自己四件事,当它认为您会查看结果时,它通常会跳过:

  1. 什么是专家会问而该用户没有问的?然后它会在可交付成果中以安全默认值回答这些问题。
  2. 这里什么是不可逆转的或昂贵的?数据丢失、金钱、安全、法律、锁定客户、最后期限。这些内容以简单的文字出现在顶部,而不是在尾随注释中。
  3. 我刚刚代表他们决定了什么? 它选择的每个工具、提供商、费率或默认值都会被命名,并附有替代方案和一行原因。
  4. 他们如何知道它有效? 如果可以的话,它会自我验证。如果你能做到的话,它会给你一张明显失败的支票。

然后它以固定的形式交付:这样做→小心→检查它是否有效→为您决定→只有您可以决定。最后一个块最多包含三个项目,每个项目都预先填充了它所做的假设,因此沉默是一个有效的答案。

这不是“解释更多”。它是房间里唯一的成年人。

数字

三个“我什么都不知道,帮我做”提示(家庭备份、第一年自由职业者税、非程序员注册表单),每个运行三次,相同的模型,有或没有技能。每个答案都根据领域专家坚持的固定列表进行评分。只有当答案清晰且可操作时,一个点才算数,而不是如果它被隐藏在“上下文,无需采取行动”之下。

基线 无知的
专家级观点明确阐述 12 / 63 47 / 63
存在但被埋葬 13 / 63 4 / 63
缺席 38 / 63 12 / 63
提示 基线,每次运行 无知,每次运行
家庭备份 3, 3, 2 共 7 个 7, 6, 6 共 7 个
第一年自由职业者税 2, 1, 1 (共 7) 4, 4, 7 中的 4
注册表单,非程序员 0, 0, 0 共 7 个 5, 5, 6 共 7 个

每个臂每个提示 n=3,一个模型,由单独的模型根据固定检查表进行评分。虽然很小,但运行结果彼此一致。每次仍然错过:课程网站的密码重置、W-9/1099 文书工作、第一年的税收安全港规则。完整的方法、清单、所有 18 个逐字答案和成绩:基准/。

基线答案是有效的。他们缺乏的是形式:底部的警告、未命名的决定、无法验证。

安装

克劳德·科德

/plugin marketplace add ADanMan/clueless
/plugin install clueless@clueless

两个单独的提示。 Claude Code 桌面应用程序的“代码”选项卡中也是如此。

法典

codex plugin marketplace add ADanMan/clueless
codex plugin add clueless@clueless

光标

将 .cursor/rules/clueless.mdc 复制到项目的 .cursor/rules/ 中。它是alwaysApply。

任何读取 AGENTS.md 的内容

OpenCode、Jules、Amp、CodeWhale、Qoder、Swival 和朋友从存储库根目录中获取 AGENTS.md。将其复制到您的项目中,或从结帐运行。

卸载

/plugin remove clueless(Claude Code)、codex plugin remove clueless(Codex),或删除复制的规则文件。插件文件夹之外没有写入任何内容。

命令

命令 它的作用
`/无知[精简版 满 | 超 | 关]` | 设置代理承担多少责任。没有参数报告当前级别。
/clueless-blindspots 一次性:您在眼前的计划、代码或文档中没有看到的内容。标记列表,最高赌注在前。
/clueless-help 快速参考。
级别 有什么变化
精简版 照常交付,然后仅添加“为您决定”和“只有您可以决定”。
已满 整个合同。默认。
超 也在第一行挑战任务本身,就像专业人士那样:“你要求 X;处于你位置的人通常需要 Y。”

FAQ

这不就是“像我五岁一样解释”吗? 编号 ELI5 更改词汇。毫无头绪的改变谁该负责。答案可以很简洁;不可能的事情是未经审查的。

我可以将它与 马尾辫 一起使用吗? 是的。马尾辫控制代理构建的数量;无能决定了它要承担多少责任。偷懒的代码,小心交出。

这是否会让代理提出更多问题? 相反。您无法回答的问题是代理回避的决定。它决定、说明默认值,并列出最多三件事,只有你可以解决,每件事都填写了它的假设。

如果我真的是专家怎么办? 那就别说你无知了。当您开始逐行检查其输出时,该技能也会自行退出。

为何“无知”? 因为这就是你输入的内容,而且它有效。

校准钩

Claude Code 自动加载捆绑的 UserPromptSubmit 挂钩。它要求 使用模式目录评估当前领域的审查能力的模型: 明显无能力、委托选择、专业知识混合、措辞含糊, 学习和 quoted/negated 信号。它从不选择代码中的模式,存储 提示、调用另一个模型或授予权限。需要 Node.js 钩;其他适配器使用没有钩子的技能规则。

在之前的环境中禁用CLUELESS_CALIBRATION=off的提醒 开始克劳德代码。显式无知的 off/level 命令甚至优先 当提醒运行时。钩子的上下文每回合都使用额外的标记。

现有的基准数字描述了早期的技能版本,而不是这个 校准钩。运行时测试涵盖其 input/output 和故障行为; 分类准确性和长时间会话的好处尚未测量。

发展

npm test

紧凑的规则集位于 AGENTS.md 中。 Cursor 规则是一个副本;如果 scripts/check-rule-copies.js 漂移,则测试套件将失败。 Claude Code 和 Codex 插件加载 skills/ 的完整技能。

热门栏目