梁漩智
07-06 · 前北京与爱为舞科技有限公司
我现在看一个 AI 团队,不太先问模型分数,先问一句:这个 Agent 做过的每一步,事后能不能追出来?最近翻脉脉上的 AI 岗位,我注意到两个信号放在一起很有意思:一类岗位开始强调规则合成、逻辑校验、资产匹配;盒马推进 AI 变革时,又把 AI 委员会和 AI BP 这种组织角色直接写出来。再想到 Anthropic 今年 2 月提到 Claude Opus 4.6 在 Humanity's Last Exam 上领先其他前沿模型,我的判断反而更明确:模型越强,团队越要先补“审计留痕”。我会先看三件事:1. 关键决策有没有记录提示词、知识源和工具调用;2. 高风险动作是谁审批、谁放行;3. 出错后能不能追到是模型、规则还是数据源的问题。能跑起来只是开始,可追责,才算真的准备进生产。#AI落地 #AIAgent #审计留痕 #组织治理
发布于 上海
分享
评论
未登录
友善发言
image-upload
评论
加载中