Customer Experience Insights 音频隐去是一个开源框架,可自动检测音频录音中的敏感个人身份信息 (PII) 并将其隐去。它为需要处理音频数据并同时遵守隐私权法规的组织提供安全、可伸缩且可自定义的解决方案。
此解决方案充当原始音频注入点与长期存储或分析平台之间的中间件。它会自动处理音频文件,以移除以下敏感数据:
- 信用卡号
- 社会保障号
- 电话号码
- 电子邮件地址
- 贵组织定义的自定义实体
通过在永久存储之前隐去此信息,您可以确保数据湖和分析工具中不包含有害数据,从而降低合规风险和数据泄露风险。
主要特性
- 自动隐去:使用 Speech-to-Text 和 Sensitive Data Protection 转录、识别音频文件中的敏感 片段并将其隐去。
- 双触发器支持:灵活的部署选项让您可以选择在将文件上传到 Cloud Storage 后立即触发 隐去,也可以在 Customer Experience Insights 处理后在下游 触发隐去。
- 企业级安全性:Customer Experience Insights 音频隐去采用“默认安全”架构,支持专用 VPC、VPC Service Controls 和供应链安全检查,以防止未经授权的访问和代码篡改。
- 可扩缩性:该流水线基于 Dataflow 构建,可自动 扩缩以处理大量音频数据,因此非常适合 高吞吐量的联络中心。
- 可验证的输出:生成隐去后的音频文件和隐去 转录,以便进行验证和审核跟踪。
工作原理
该解决方案遵循线性处理流水线:
注入和触发:
- 选项 A(直接):将音频文件上传到“原始” Cloud Storage 存储桶。Cloud Run 触发器会立即启动流水线。
- 选项 B (Insights):CX Insights 处理 对话。Pub/Sub 消息会触发 Cloud Run 服务,然后启动流水线。
处理 (Dataflow) 。Dataflow worker 会执行以下操作:
- 检索音频文件。
- 将音频发送到 Speech-to-Text 以生成带时间戳的转录。
- 将转录发送到 Sensitive Data Protection 以识别敏感信息的时间偏移量。
- 使用
ffmpeg将与识别出的 PII 对应的音频片段静音。
输出 。Cloud Run 函数会执行以下操作:
- 可选:将原始音频移至安全的“归档”存储桶。
- 将隐去后的音频写回原始位置或指定的输出存储桶,将敏感片段替换为静音或音调。
开始使用
如需使用此解决方案,您需要一个已启用结算功能的 Google Cloud 项目。
前提条件
- Google Cloud 项目
- 已安装
gcloudCLI 并通过身份验证 - 已启用 Dataflow、Speech-to-Text 和 Sensitive Data Protection Google Cloud 服务并拥有相应服务的访问权限。
访问和部署
如需查看完整源代码和部署说明,请参阅 GitHub 代码库。