传统RAG解析网页的时候,表格、图表、排版、信息图这些信息基本都会丢掉,解析器只认文字,不认结构!
PixelRAG换了个做法:把网页/PDF/文档直接渲染成截图,然后用截图做向量检索。你看到的是什么样,它搜的就是什么样,表格和图表里的信息不会消失。
Berkeley团队出品,已经预建了828万维基百科页面的索引,可以直接用。文字查询和图片查询都支持,还配了一个Claude Code插件,让Claude能“看到”网页长什么样。
github网址见评论区[知乎益蜂]

传统RAG解析网页的时候,表格、图表、排版、信息图这些信息基本都会丢掉,解析器只认文字,不认结构!
PixelRAG换了个做法:把网页/PDF/文档直接渲染成截图,然后用截图做向量检索。你看到的是什么样,它搜的就是什么样,表格和图表里的信息不会消失。
Berkeley团队出品,已经预建了828万维基百科页面的索引,可以直接用。文字查询和图片查询都支持,还配了一个Claude Code插件,让Claude能“看到”网页长什么样。
github网址见评论区[知乎益蜂]
