杠精派
派聪明
0/512

热门评论

东呆西萌 2026年07月10日 10:59
引用原文:PaiCLI 早期 execute_command 的描述写得太简洁,LLM 经常用 cat 代替 read_file 读文件。后来在描述里加了“在项目根目录执行的短时 Shell 命令,如 ls、mvn compile,不要用来读取文件内容”,准确率就上去了。
@派聪明 这句话是什么意思?我不太理解
点赞
回复5 取消回复
派聪明 2026年07月10日 10:59
这句话讲的是一个**AI Agent开发中的实践经验**,核心是:**工具的描述写得清不清楚,直接影响大模型能不能选对工具**。 让我拆开解释一下: --- ### 1. 背景是什么? PaiCLI 是一个 AI 助手(Agent),它有很多工具可用,比如: - `read_file` —— 专门用来读取文件内容的工具 - `execute_command` —— 用来执行 Shell 命令的工具(比如 `ls`、`mvn compile`) ### 2. 出了什么问题? 早期 `execute_command` 的描述写得太简单,比如只写了"执行命令"。结果 **LLM 分不清该用哪个工具**: > 用户说"帮我看一下 pom.xml 的内容",LLM 明明应该调用 `read_file`,但它却通过 `execute_command` 执行了 `cat pom.xml` 来读文件。 这就像:你有两把螺丝刀(一把十字、一把一字),但标签都写"拧螺丝",你很容易拿错。 ### 3. 后来怎么解决的? 把 `execute_command` 的描述改成了: > **"在项目根目录执行的短时 Shell 命令,如 ls、mvn compile,不要用来读取文件内容"** 这句描述暗示了三点: - ✅ 适合执行的场景:短时命令、项目构建等 - ❌ 不适合的场景:读取文件内容(应该用 `read_file`) - 💡 给了示例:`ls`、`mvn compile` 改完之后,LLM 选工具的准确率就上去了。 --- ### 一句话总结 这句话想表达的是:**写工具描述时不能太笼统,要给 LLM 明确的边界和示例,告诉它"什么时候该用、什么时候不该用",这样模型才能做出正确的判断**。这也是 Agent 开发中一个很实用的经验。
点赞
回复 取消回复
展开剩余 4 条回复

115 条评论

Lee 2026年08月15日 11:36
引用原文:先判断任务特征
@派聪明 这个判断是交给大模型判断吗?
点赞
回复1 取消回复
派聪明 2026年08月15日 11:36
这是我从文章中选择的一段文本:"先判断任务特征" 这个判断是交给大模型判断! 当前模型还在开发当中,请右上角下拉框切换到其他模型
点赞
回复 取消回复
Lee 2026年08月15日 11:02
引用原文:应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次
@派聪明 如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢?
点赞
回复1 取消回复
派聪明 2026年08月15日 11:02
这是我从文章中选择的一段文本:"应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次" 如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢! 当前模型还在开发当中,请右上角下拉框切换到其他模型
点赞
回复 取消回复
Lee 2026年08月15日 11:01
引用原文:应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次
@派聪明 如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢?@杠精派
点赞
回复1 取消回复
杠精派 2026年08月15日 11:01
请围绕下面这段划线内容回复:"应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次" 如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢! 当前模型还在开发当中,请右上角下拉框切换到其他模型
点赞
回复 取消回复
Lee 2026年08月15日 11:01
引用原文:应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次
如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢?@杠精派
点赞
回复2 取消回复
杠精派 2026年08月15日 11:01
请围绕下面这段划线内容回复:"应该在 prompt 里引导 LLM 把有依赖关系的操作分到不同轮次" 如果是multi-Agent模式下如何防止多个woker之间同时写文件冲突呢! 当前模型还在开发当中,请右上角下拉框切换到其他模型
点赞
回复 取消回复
展开剩余 1 条回复
鱼腥草 2026年08月07日 09:15
引用原文:如果模型判断置信度低,就默认走 ReAct,或者先生成计划让用户确认;如果执行过程中发现任务比预期复杂,也可以从 ReAct 升级到 Plan,而不是一开始就定死。
置信度低是因为什么,机制是什么@派聪明
点赞
回复1 取消回复
派聪明 2026年08月07日 09:15
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
过时的草莓 2026年08月05日 20:50
引用原文:Plan 模式强调可预测性,自动重试会让执行过程变得不可控。
@派聪明 如何理解这句话
点赞
回复3 取消回复
派聪明 2026年08月05日 20:50
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
展开剩余 2 条回复
清净日子 2026年07月30日 02:27
引用原文:Code Review
@派聪明 是什么
点赞
回复1 取消回复
派聪明 2026年07月30日 02:27
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
清净日子 2026年07月30日 02:26
引用原文: Code Review
是什么
点赞
回复 取消回复
叶当当 2026年07月28日 15:42
引用原文:所有直接或间接依赖它的下游任务自动标记为 SKIPPED——不执行,因为前置条件不满足
@派聪明 那后续的任务不执行的话,不就代表整个任务也失败了吗
1
回复1 取消回复
派聪明 2026年07月28日 15:42
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
叶当当 2026年07月28日 15:26
引用原文:PaiCLI 源码里有四层防护:
@派聪明 不是会有最大次数吗,超过ReAct的最大次数就推出循环了?
点赞
回复1 取消回复
派聪明 2026年07月28日 15:26
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复

目录