AI 自动评测与自我进化:让系统自己写用例、跑测试、修 Bug 的工程实践

告别刀耕火种的手工测试,拥抱 AI First 的自动化演进平台

bash ckhuang@macbookpro:~$ 写代码 1 小时,造测试数据、点 UI、排查联调问题 3 小时?在 AI 时代,还在靠堆人力做回归测试的研发团队,注定要被降维打击。今天我们来聊聊如何让 AI 接管整个系统的评测与自我优化。 [Read More]

告别 MCP 上下文膨胀!谷歌开源 Agent Skill 超级工具箱,AI 架构新范式

从被动 API 调用到主动知识注入,解析 Google Cloud 官方 Skills 仓库的底层逻辑

bash ckhuang@macbookpro:~$ 你以为给 AI 塞满各种 MCP 服务器和工具,它就能变成全栈工程师?现实是,过度投喂只会导致“上下文膨胀”,AI 彻底迷失在海量 API 参数中,而你的 Token 账单却直接原地起飞。今天我们来聊聊谷歌刚刚祭出的大杀器 —— Agent Skill。 [Read More]

深入解析 Agent 工程实践:不只是大模型,更是系统架构的重构

为什么你的 Agent 总是跑不稳?揭秘控制流、上下文工程与工具设计的工程真相

bash ckhuang@macbookpro:~$ 很多人以为换个更贵、更强的大模型,Agent 就能从“人工智障”变成“人工智能”。但真相是:模型能力只是天花板,而决定 Agent 能否在生产环境跑稳的,往往是被你忽视的 Harness(验证设施)、上下文工程和工具设计。读完本文,你将了解如何从工程架构视角构建一个真正可用的工业级 Agent。 [Read More]

深度解析 Claude Code:顶尖 AI Coding Agent 的工程化设计哲学

从 Prompt, Context 到 Harness 的高阶实践,打造 95 分的智能体

bash ckhuang@macbookpro:~$ 很多开发者以为写个花哨的 Prompt 就是做好了提示词工程,结果一到长程复杂任务,Agent 就开始“胡言乱语”或“原地转圈”。如果你想做一个 95 分的 Agent,光靠 Prompt 顶多拿 70 分。剩下的 25 分,全藏在 Context(上下文)和 Harness(脚手架)的极致工程打磨里。 [Read More]