·tian
Prompt 中的 PII:你的 AI 流水线缺失的数据最小化模式
客户个人数据正无形地流入上下文窗口、向量数据库和微调数据集。本文介绍了在不破坏模型质量的前提下,使 AI 流水线符合 GDPR/CCPA 合规要求的分类、清洗和架构模式。
ai-engineering
privacy
security
llm
+1·tian
第三份副本:向量存储、删除完整性以及 RAG 团队一直忽视的 GDPR 缺口
当用户行使被遗忘权时,删除源文本并不代表删除了嵌入向量。大多数团队从未将向量存储建模为用户数据的“第三份副本” —— 而关于逆向攻击的相关文献表明,他们理应这样做。
security
privacy
rag
vector-databases
+1·tian
主权崩塌:记录你的 Prompt 究竟去了哪里
应用日志显示请求发送到了 eu-west-1,但提供商在故障转移期间将其路由到了美国和新加坡。构建单次请求的主权路径,将审计转化为可查询的资产。
insider
llm
compliance
gdpr
+2·tian
你的微调语料库是 GDPR 数据产物,而不仅仅是机器学习资产
微调后的权重编码了客户的个人身份信息 (PII),这些信息在数据库删除后依然存在。这是一份将训练语料库视为 GDPR 下数据产物的实用指南——涵盖谱系文档、适配器隔离,以及在首个微调模型发布前需要进行的合规对话。
insider
gdpr
fine-tuning
privacy
+2·tian
GDPR 的删除难题:为什么你的 LLM 记忆存储是法律风险
RAG 管道和长期 LLM 记忆存储在 GDPR 下属于个人数据处理器。被遗忘权带来的删除传播问题是标准向量数据库无法干净解决的——以下是使 LLM 记忆在欧盟合法运营的架构模式。
insider
gdpr
llm
vector-database
+2·tian
多区域 LLM 服务:没人警告过你的缓存局部性问题
在不同区域部署 LLM 推理会产生无状态 HTTP 服务所没有的一致性和延迟问题。本文将介绍一种既能解决这些问题,又不会让你的运维负担增加三倍的路由架构。
insider
llm
infrastructure
mlops
+2·tian
构建符合 GDPR 标准的 AI Agent:真正至关重要的合规架构决策
每一位受监管行业的工程师在发布 AI Agent 之前必须解决的四个结构性冲突:矢量库中的被遗忘权缺口、欧盟 AI 法案下的审计追踪要求、数据驻留的误区,以及不会阻碍未来扩展的同意模式。
insider
gdpr
compliance
ai-agents
+2显示第 13–19 篇,共 19 篇
上一页2 / 2