爱折腾的工程师

未来的你会感谢现在努力的自己

让 Claude 替你值班:Anthropic 用 AI 智能体接管 CI/CD on-call 的全链路拆解

从晚上十点的 44 个丢失测试说起,拆解 Claude Tag 如何成为 CI/CD 故障的第一响应者

基于 Claude 官方博客《Claude on call: How Claude Tag serves as Anthropic's first responder for CI/CD failures》的中文技术解读。文章先还原 22:00 测试丢失事故场景,再拆解值班智能体的四要素(记忆 / 连接与访问 / 调度 / 指令)与动态工作流架构,逐段分析检测、分类、解决、验证、交接五个环节的设计取舍,并给出关键数据、反常识判断以及基于开源 oncall-kit 的四步落地路径。

Harness 不该亲自做研究:NVIDIA AI-Q Deep Research Skill 工程解读

通用 Agent Harness 擅长编排但做不好研究——NVIDIA 把多文档综合、引文溯源、企业数据接入打包成一个可移植的 Skill,让 Claude Code / Codex 通过『委托』而非『拥有』获得研究能力。本文按四阶段流水线 → 三种 MCP 认证 → 数据治理反转 → 模型混合策略的顺序拆开 AI-Q 的工程取舍,并给出落地决策清单。

把 Agent 真正发上线:Google Cloud《生产级 AI Agent 开发者指南》深读

Google Cloud 把 Agent 工程化压缩成 5 个阶段:定义、工具互操作、上下文工程、测试评估、生产部署。本文按这条骨架展开,但不复述原文——逐节追问『传统工程范式为什么失效』,给出可量化的判断标准与真实工程场景,并把 Trajectory 评估、Sandbox→Canary→Production 三阶段发布单拎出来重点解读。文末附给上线者的落地清单与按角色分流的学习路径地图。

华尔街的新同事:拆解 Anthropic 金融服务 Agent 发布

Anthropic 一次性发布了 10 个即用金融 Agent 模板、Claude 与 Microsoft 365 的深度集成,以及 8 个新连接器 + Moody's MCP 应用。本文从产品、架构、生态、客户侧写四个角度,拆解这次发布真正改变了什么。

生产级 MCP Agent 深度解析:让智能体真正接入外部系统

从 Direct API、CLI 到 Remote MCP Server,系统拆解生产级 Agent 的外部系统集成架构

基于 Anthropic 官方博客 Building agents that reach production systems with MCP 的深度技术解读。文章系统分析 MCP 如何把 Agent 与 SaaS、数据库、云平台和企业内部 API 连接起来,并结合架构图、代码示例与工程清单,讨论远程 MCP Server、工具建模、认证授权、沙箱执行、Elicitation 与生产治理最佳实践。