把 AI Agent 放进生产环境,难的从来不是写 prompt

某天 agent 突然开始乱答,代码没人动,prompt 没人改,最后发现是供应商在同一个 API 后面悄悄换了模型版本。这种事在 demo 里刷新一下就过去,在投资金融这类受监管领域却是一起事故。Agent 从能跑到敢上线,中间隔的不是一个更好的 prompt,而是一整套分层的 evaluation 和 audit。这是我们实际在用的六层做法,从 tracing 地基一直讲到监管级的审计链路。

把 AI Agent 放进生产环境,难的从来不是写 prompt

看戏剧学电影的女孩,后来去了AI行业做市场

她高考差北京电影学院1分,之后复读、考研、申学校,总在临门一脚摔下来。在艺术学院学电影、读哲学,着迷于麦克白和安娜·卡列尼娜那种破碎的美。后来辗转到伦敦,端过盘子、做过marketing,最后阴差阳错跳进AI行业,用一个只有20个粉丝的素人号跑出20万流量。困了她十年的问题在这里有了答案:高考是一锤子买卖,差一点就出局;可算法不是,只要爆一条就够了。这个时代真正奖励的,不是聪明,是韧性。

看戏剧学电影的女孩,后来去了AI行业做市场