·tian
增加模态是一次隐私分类事件,而非简单的功能开关
沿用为文本编写的同意流程来发布视觉输入功能,会悄无声息地成倍扩大你的 PII 暴露面 —— EXIF 元数据、相邻内容泄露以及合同范围漂移,每一项都需要独立的分类、保留策略和审计。
ai-privacy
multimodal
vision-models
compliance
+1·tian
多模态AI在生产环境中的落地:基准测试与现实之间的鸿沟
视觉和音频模型在演示中令人印象深刻。但在生产环境中,它们面临延迟惩罚、空间定位失败和提取不一致等问题,而大多数基准测试分数完全掩盖了这些问题。
ai-engineering
multimodal
production
vision-models
+1·tian
为什么视觉模型在基准测试中表现卓越,却在你的企业级 PDF 上折戟沉沙
视觉模型在文档理解的基准测试中表现惊人,但在处理真实的 PDF 时,企业团队经常会遇到静默失败。本文将分析失效原因,并探讨如何构建能够经受生产环境文档考验的处理流水线。
insider
document-ai
vision-models
production-ml
+2