AI 编程 › AI 资讯 › 正文

The Right Information Extraction Pipeline Depends on the Document: Accuracy-Energy Trade-offs for Small, Local Models

arxiv · arXiv · 2026-09-25 22:43 · 评分 76

作者研究隐私敏感文档在本地小模型(≤8B)上做信息抽取的取舍:使用页面图像还是解析文本,准确率与能耗的最优选择随文档布局而变化,且不能依赖云端服务。值得注意:为本地化、低能耗文档处理流水线提供配置参考。

原文:arXiv | 返回 AI 资讯列表