杠精派
派聪明
0/512

热门评论

柒眠 2026年06月11日 15:19
引用原文:统一封装 Ollama 本地模型和 OpenAI 兼容远程 API,通过环境变量丝滑切换 provider
@派聪明 详细解释一下
点赞
回复1 取消回复
派聪明 2026年06月11日 15:19
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复

14 条评论

小时月 2026年08月13日 09:40
引用原文:建立 Java Code Agent 自动评测体系,基于 SWE-bench Multilingual 与 Harbor 构建 43 个真实开源 Issue 测试集,在固定代码版本及隔离环境下自动验证 Patch,成功修复 27 个任务,Pass@1 达到 62.8%。
@派聪明 这个数字怎么来的?做过测试吗
点赞
回复1 取消回复
派聪明 2026年08月13日 09:40
这是我从文章中选择的一段文本:"建立 Java Code Agent 自动评测体系,基于 SWE-bench Multilingual 与 Harbor 构建 43 个真实开源 Issue 测试集,在固定代码版本及隔离环境下自动验证 Patch,成功修复 27 个任务,Pass@1 达到 62.8%。" 这个数字怎么来的!做过测试 当前模型还在开发当中,请右上角下拉框切换到其他模型
点赞
回复 取消回复
nyl 2026年08月12日 11:27
引用原文:长期记忆用 SQLite 持久化跨会话知识
长期记忆不是落到json文件吗
点赞
回复 取消回复
枫原万叶 2026年07月28日 21:02
引用原文:项目名称:PaiCLI — Java Agent CLI 项目简介:基于 ReAct 范式从零实现的 Java Agent 命令行工具,集成 Plan-and-Execute、Memory、RAG、Multi-Agent、HITL 人工审批和异步并行执行,完整覆盖 AI Agent 核心技术栈。 核心职责: 设计并实现统一的并行工具执行引擎,使用 ExecutorService + 批次超时实现最多 4 路并发,超时工具自动取消并返回可返回结果供 LLM 重新决策 将 ReAct、Plan-and-Execute、Multi-Agent 三条执行路径的工具调用统一接入并行引擎 在 Plan-and-Execute 模式中实现 DAG 批次调度,按依赖层级将独立任务并行执行,通过 ByteArrayOutputStream 缓冲实现并行输出的有序展示 使用 BlockingQueue 实现 Multi-Agent Worker 池化分配,保证同一 Worker 不被并发占用,Reviewer 按步骤独立创建避免对话历史竞
@派聪明 这段简历对应的技术栈怎么写
点赞
回复1 取消回复
派聪明 2026年07月28日 21:02
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
爱听歌的橘子 2026年07月25日 16:57
引用原文:实现三层记忆系统
@派聪明 哪来的三层
点赞
回复1 取消回复
派聪明 2026年07月25日 16:57
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
xuxinyi 2026年06月21日 16:36
@派聪明 这个paiCLI Agent如何做效果测评
点赞
回复1 取消回复
派聪明 2026年06月21日 16:36
根据提供的参考资料,PaiCLI Agent项目的效果测评体系主要包含**具体的量化指标、对照评测机制**以及**完善的自动化测试保障**,具体测评方法如下: **1.建立标准化评测体系与对照实验** * **Benchmark场景覆盖**:专门构建了评测体系,全面覆盖上下文管理、记忆管理、任务恢复与回归测试等核心场景。 * **模型与Agent能力差异分析**:通过 Benchmark 和对照实验,深入分析大模型基础能力与 Agent封装后的能力差异,为后续优化提供数据支撑。 **2.核心维度的量化指标测评** * **上下文管理效果**:通过引入分层上下文管理与 Token预算裁剪机制,对比提示词长度变化,实现平均 Prompt长度压缩(例如从7082降至5664),平均压缩率达到 **16.19%**。 * **检索性能与召回率**:针对 RAG代码库检索,测算 Top5准确率达到生产可用级别;使用混合检索策略(语义打底+分词加权等),实现单项目千行级代码块检索耗时 **< 100ms**,单次 Agentic Search延迟 **< 200ms**。 * **执行与调度效率**:对比串行执行,通过多 Agent 并行引擎和 DAG 任务调度大幅提升执行效率;并集成 **Token消耗与耗时统计**,方便不同模型间进行成本和性能的直观对比。 **3. 异常场景处理与全量回归测试** * **长任务异常恢复**:针对长任务中断、文件变更、状态失效等设计了 **10 类异常场景**进行测评,确保基于 Checkpoint 的任务恢复机制有效。 * **自动化测试用例验证**:通过编写大量单元测试(例如使用 Mockito验证 HITL审批逻辑和拦截策略,项目测试用例总数增至 **152个** 甚至 **119个**测试全量通过),保障系统迭代的质量底线与稳定性。
1
回复 取消回复
柒眠 2026年06月11日 15:20
引用原文:统一封装 Ollama 本地模型和 OpenAI 兼容远程 API,通过环境变量丝滑切换 provider
@派聪明 详细解释一下
点赞
回复1 取消回复
派聪明 2026年06月11日 15:20
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
柒眠 2026年06月11日 15:19
引用原文:统一封装 Ollama 本地模型和 OpenAI 兼容远程 API,通过环境变量丝滑切换 provider
@派聪明 详细解释一下
点赞
回复1 取消回复
派聪明 2026年06月11日 15:19
小派正在努力回答中, 耐心等待一下吧...
点赞
回复 取消回复
Andrew Du 2026年05月07日 22:37
请问piclient 的github地址怎么失效了呀 github.com/itwanger/paicli
4
回复 取消回复

目录