观点 / 方法普通
腾讯EVIE与百度PaddleOCR-VL对比:Document AI转向视觉检索
原始标题:最近把腾讯刚出的 EVIE 和百度 PaddleOCR-VL 放在一起看,感觉 Document AI 正在发生一个很重要的变化。 过去做 RAG,有一个几乎没人质疑的前提: 先把世界变成文字,再…
内容摘要
腾讯EVIE与百度PaddleOCR-VL对比显示Document AI正从"先转文字再理解"转向视觉检索。PaddleOCR-VL约1B参数可直接结构化文字、表格、公式与图表;EVIE则将整页作为视觉信息Embedding,在视觉空间完成检索,再按需解析。两者拼出"视觉检索→文档解析→LLM推理"的下一代Document RAG雏形。