告别“玄学”调优:零侵入 AI Profiling 如何终结 GPU 性能黑洞

从算力闲置到 OOM,揭开 AI 集群性能诊断的神秘面纱

bash ckhuang@macbookpro:~$ 训练任务跑了几小时,一看 GPU 利用率不到 30%;大模型推理服务刚上线,显存就像脱缰的野马一路狂飙直到 OOM。你是不是也常常对着一堆报错,发出灵魂拷问:我的算力究竟被谁吃掉了?读完这篇,带你彻底告别 AI 集群性能调优的“盲人摸象”。 [Read More]

告别“黑盒”与“主观”:基于 AgentLoop 的 DeepSeek Harness 深度评测实践

从“二值通过率”到“轨迹级归因”,Agent 评测工程化的必由之路

bash ckhuang@macbookpro:~$ 当我们谈论 Agent 评测时,究竟在评测什么?如果连“失败原因”都无法追溯,所谓的“胜率”不过是碰运气的数字游戏。今天,我们拆解 DeepSeek Harness,看看如何用工程化的手段,把 Agent 评测从“玄学”变成“科学”。 [Read More]

OpenAgentPack 开源:云端 Agent 终于可以像代码一样管理了

把 Prompt、Skill、MCP、知识与部署声明带回 Git,让 Agent 工作流可复现、可验证、可迁移

bash ckhuang@macbookpro:~$ 真正值得沉淀的不是某一次 Agent 对话,而是那套能被复现、验证、协作迭代的工作流。OpenAgentPack 的价值,正是把云端 Agent 从“控制台资产”变成“工程资产”。 [Read More]