Engineering Decision Skills:评审、排期、复盘时,我想让 AI 多做一步
方案明天要评审,三件事排不进一个双月,项目又延期了:五个独立 Skill,各给一份具体输入和可直接拿去讨论的产出。
查看项目标签
围绕“智能体”的写作、研究、项目与影像。
方案明天要评审,三件事排不进一个双月,项目又延期了:五个独立 Skill,各给一份具体输入和可直接拿去讨论的产出。
查看项目有些关系让人不舒服,却又说不清哪里不对。我希望 RelationForge 能帮人把事情理清楚些,也看看自己在其中做了什么。
查看项目从候选链、失败分类、per-turn identity 到成本公式,解释一个可控、可审计的 DSH 多来源模型路由器如何工作。
查看项目从长任务中的实际使用出发,讨论 Agent 如何依据不确定性、等待、失败和接管需求调节状态、证据与行动反馈;也记录执行委托如何改变人的压力、信任和能力边界。
约 28 分钟阅读
阅读摘要从 ChatLab 的实际设计出发,记录如何借用人和人协作中的在场、回应、等待和交付语法,让 Agent 的运行状态更容易被理解;这是一篇关于反馈、证据、关键介入和结果确认的 HCI 设计观察。
约 26 分钟阅读
阅读摘要DeepSeek Harness 的纯策略插件:按任务选择有序、可解释、可审计的模型候选链,并在配额、限流或传输失败时沿链有界前进。
查看项目从公开资料、可观察行为与可运行的微内核出发,学习怎样把 coding agent 的权限、工具调用和运行轨迹变成可验证的系统边界。
查看项目一个命令驱动的长篇小说生产工作流:作者用短命令驱动,Agent 负责创作,Python 做确定性校验,作者在每个关键节点做选择和批准。
查看项目