爱折腾的工程师

未来的你会感谢现在努力的自己

在动手之前先把想法跑起来:Claude Design 作者的 10 条工作方法

Claude Design 的作者 Nate Parrott 写下 10 条工作方法,但真正值得抄的是那条被藏起来的分工线

拆解 Anthropic 产品设计师 Nate Parrott 关于 Claude Design 的自述:它如何从一个失败的截图实验变成正式产品,10 条工作方法按「人出力 / 模型出力」重排后长什么样,原型成本坍塌之后设计流程发生了什么变化,以及这套方法对写代码、写文档的人同样成立的六条原则。

用 Skills 构建验证循环:让 Claude Code 自己闭合反馈回路

把你每次都要亲手复查的那几件事,写成 Skill 交给 Claude 自己收口

基于 Claude 官方博客《Building verification loops in Claude Code with skills》的中文技术解读。文章先厘清验证循环的定义与它在 agentic 循环中的位置,梳理六种内置验证能力,再重点拆解 standalone / embedded / chained / on-every-PR 四种落位方式各自的适用边界、代价与换挡信号,并给出可直接照抄的 SKILL.md 片段与六步落地路径。核心判断是:验证循环的难点从来不是写检查内容,而是决定它在哪里跑。

WorkBuddy 飞书套件 lark-unified vs 官方 larksuite/cli skills:两种飞书 Skill 实现的完整对比

从单体聚合到领域拆分,从市场分发快照到 go:embed 编译内嵌,一次贴着源码的 Agent Skill 范式对账

对比 WorkBuddy 内置的飞书套件 lark-unified(单体聚合型 Skill)与 larksuite/cli 官方 27 个领域 Skill(领域拆分 + go:embed 内嵌),从架构拓扑、功能模块、代码实现、配置认证、安全模型到扩展性逐维拆解,并给出 8 处实测契约漂移证据与 Skill 设计的通用选型判据。

WorkBuddy Bench源码深度解析:如何构建可复现、可审计、可扩展的 Coding Agent 评测系统

从四层配置、Harbor 沙箱、Harness split-mount、协议代理、分片调度到 CompositeVerifier,拆解真实工作型 Agent Benchmark 的工程内核

基于 workbuddy-bench b516950 源码快照,深入分析四层配置合并、Resolved Manifest、Docker split-mount Harness、Anthropic/OpenAI 协议代理、难度感知分片、CompositeVerifier 插件体系与防分母收缩的指标聚合,并给出可复现实验数据和落地指南。

AgentScope 2.0 源码深度解析:把 Agent 做成可暂停、可恢复的生产运行时

从 ReAct 状态机、事件协议、工具权限到服务化与团队协作,拆解 AgentScope 2.0 的运行时设计

基于 AgentScope 2.0.5 源码快照,深入分析其 Agent ReAct 状态机、Msg/Event 协议、模型适配、Toolkit 与权限引擎、上下文压缩、中间件、FastAPI 服务层、SSE 事件流和多智能体团队机制。