Amplitude Agent Analytics新增访问控制与隐私脱敏
DataHot 速览
Agent Analytics是Amplitude推出的Agent轨迹数据治理方案,通过基于角色的访问控制管理谁能查看会话、创建评估器或启用在途评估。它支持full、redacted等隐私模式,在SDK层面于数据离开应用前进行PII脱敏,并确保AI功能不超越用户已有权限。即使敏感文本不传输,信号、评估器和队列仍可保留,兼顾治理与洞察。
为什么值得关注:数据从业者应关注Agent可观测性与数据治理的落地机制,尤其是权限隔离和隐私脱敏如何在不损失分析能力的前提下实现。
译文
AI 逐段翻译Agent 追踪包含了你技术栈中最原始的数据。用户输入的准确词语、模型的回复、传递给每个工具的参数、跨度之间移动的状态。这正是团队犹豫是否将其发送到任何地方的原因,也是“咱们别把追踪数据导入另一个系统”是我们听到的关于 Agent Analytics 最常见的反对意见。
所以我们构建了 Agent Analytics,以便你可以控制什么离开你的应用、谁能看到它、以及它存在多久。而大多数人忽略的部分是:即使敏感文本从未传输出网,你仍然保留信号、评估器和群体。治理不应让你付出洞察的代价。
谁能看到追踪:基于角色的访问控制
对 Agent Analytics 的访问通过 Amplitude 的基于角色的访问控制进行。三个权限控制着该产品:
- 查看 Agent Analytics 对象允许角色打开会话、评估器及相关对象。角色需要使用该权限才能使用此产品。
- 管理非活动评估和运行允许角色创建评估器并启动试运行。
- 激活评估允许角色将评估器转为活跃或归档。
你决定哪些角色拥有哪些权限,因此支持分析师可以读取会话,而只有你的机器学习负责人才能将评估器推入生产环境。
同样的模式也管理着我们自己的 AI 功能。它们遵循你账户中已设置的权限和数据访问控制。当 AI 功能运行时,不会向用户授予新的数据访问权限。代表你操作的代理只能访问你已经获准查看的数据,并且不能超过你的权限。管理员可以审计用户输入和代理输出,因此有请求和返回内容的记录。你设置访问权限。它不是继承的。
什么离开你的应用:PII 编辑和隐私模式
对追踪的真正担忧是自由文本。用户在支持聊天中留下电话号码,现在它就在你的分析中。Agent Analytics 在 SDK 级别处理这一点,在数据离开你的基础设施之前,通过你设置的隐私模式。
有三种模式:
- full 是默认模式,它发送提示和响应文本,并默认开启个人可识别信息(PII)编辑。这是完全可配置和可扩展的,客户可以按需编辑,超越 SDK 自带的 PII 清理规则。
- metadata_only 发送令牌、延迟、模型和成本,不发送任何文本,这是针对受监管或敏感工作负载的设置。
- customer_enriched 只发送来自你自己评估堆栈的预评分摘要,不发送其他内容。
我们默认编辑的一些字段包括电子邮件、电话、信用卡、社会安全号码、IP 地址。当这些值发送到 Amplitude Agent Analytics 时,生成的追踪将显示为 [email]、[phone]、[credit_card]、[ssn]、[ip_address],以便隐藏实际值。
包含文本的字段:消息文本、工具输入和输出、跨度输入和输出状态、系统提示、推理内容,只有在隐私模式允许时才发送。附件仅以元数据形式传递,从不包含文件内容。甚至工具定义也可以保持私密:我们发送工具模式的稳定哈希,以便你检测工具集变化,而不暴露模式本身。
Agent Analytics 不需要 PII 也能工作。PII 值的编辑不会影响实际的即用信号或自定义评估。我们对每个已结束会话运行始终在线的信号:任务完成度、响应质量、用户摩擦、用户意图、会话安全性和基于代码的数据质量检查。仅会话安全性就将每个会话分类为正常、离题、提示注入、滥用、探测、不安全输出或数据泄露。你自己的评估器,无论是基于规则还是 LLM 作为评判者,都在此基础上运行。所有这些增强都读取结构和允许的字段,因此你可以看到计费会话任务完成失败并触发摩擦信号,而从未看到客户的号码。你掩盖敏感值但保留质量图景。
它底下的信任层
超过 4,900 家公司和财富 100 强中的 26% 在 Amplitude 上运行,超过 2,000 家信任它处理其数据。我们运行 GDPR、CCPA 和 HIPAA 项目,将签署涵盖实体的业务伙伴协议,并根据欧盟-美国数据隐私框架进行自我认证。数据存储在 AWS 中,位于美国或欧盟法兰克福地区(如果你需要欧盟居留权),基础设施已通过 ISO 27001 和 SOC 2 Type II 认证。完整的认证集在客户信任门户中。
AI 方面同样严格。我们在合同中禁止我们的 AI 合作伙伴使用你的数据进行训练。在 AWS Bedrock 上的工作流将你的数据保留在 Amplitude 的 AWS 环境中,模型提供商从未收到它。使用 OpenAI 或 Google 的工作流通过零数据保留端点运行。如果你在欧盟数据中心配置,那么当你使用 Amplitude AI 时,你的数据永远不会离开欧盟。
证据在于谁已经在这里发送敏感数据。ClearScore,处理数百万人的信用数据,是 Amplitude 在其安全页面上展示的案例研究。Salt Bank在 Amplitude 上建立了数字银行,并以 2 倍的优势超过了发布目标。ACKO,一家数字保险公司,通过 Amplitude 中衡量的 GenAI 提高了 13% 的转化率,并减少了一半的支持电话。The Economist Group使用 Agent Analytics 运行的方法为其 AI 质量设定了一个确切的数字。
将代理性能与业务成果联系起来
将追踪锁定在独立的可观测性工具中感觉更安全,但它搁置了最重要的一件事:代理质量与业务成果之间的联系。因为代理会话与你的产品事件共享 Amplitude 用户身份,你可以建立一个用户群组,其会话未完成,并将他们的 30 天留存率与会话成功的用户进行对比。纯可观测性工具无法进行这种关联。这就是发送数据的原因,而上述控制措施使其安全。
我们已经开源了隐私/清理模式此处并随着时间推移,可以进一步扩展,将它们自动打包到SDK中。
这篇内容对你有用吗?
反馈只用于改善内容筛选,不等同于收藏