开放平台产品经理 · AI × 平台生态

AI 与开放平台,
经验和想法的沉淀。

我是朱亚威(Henson)—— 一名开放平台产品经理。这里记录我在 AI 和开放平台方向的经验、思考、想法,以及对行业进展的持续跟进。

10 年开放平台产品多行业 · 跨阶段 · 国际化管理 + 一线能力

最新动态

文章 + AI 实践
文章2026 · 08 · 21
通用 Harness 开源之后:Personal Agent 还必须自己负责什么?
Claude Code 的源码泄露让人看到成熟 Coding Agent 背后的产品工程,DeepSeek 先开源 DSH,把 Harness 做成可组合的插件体系;更晚公开的 Codex Harness 与 App Server,则展示了共享运行时怎样服务多个产品界面。把这些公共能力与我的 Personal Agent 放在一起,我不再问谁的 Harness 更强,而是复盘六个真实决策:我有哪些选项、为什么选择这一边、主动放弃了什么,又为此承担了什么代价。Finance 是已经打通真实写入、真机验收和恢复演练的第一条纵向链路,也是本文唯一的落地案例。
文章2026 · 08 · 16
如何评测一个 Agent:测量装置、统计纪律与判官校准
给我自己的记账 Agent 做评测时,我最意外的一条结论是:我以为我在测模型,其实我在测一个已经学会了配合模型的人。本文以 Personal Agent 一期的真实评测为主线,把踩出来的结论边界、三种「假绿」、统计纪律与证据绑定,同公开方法论体系(τ-bench、LLM-as-judge 校准、benchmark 审计)逐项对照,最后落在一条回路上:错误无法避免,所以每次错误都必须可诊断、可纠正、可回流成守门用例。
文章2026 · 08 · 07
用 Vibe Coding 完成 Personal Agent 一期
从模型与编码智能体路由、单一时间线与自动会话、受治理的财务 MCP,到真实 iPhone、ECS、备份与恢复,我用 16 天完成了一个只服务自己的 Personal Agent。本文记录最重要的产品决策、生产事故、评测补洞,以及为什么模型说“已经记录”从来不算完成。

去各个角落