铭鸿体育资讯网

让DeepSeek读网页不再"烧token"! 最近用 DeepSeek 智能体

让DeepSeek读网页不再"烧token"!
最近用 DeepSeek 智能体做资料调研,被一件事狠狠劝退 😅
让它"读一下这个网页",结果它调用官方 web_fetch,把整页(含导航、广告、页脚)全转成 markdown,默认还要拉 20 万字符……
一顿操作下来,token 哗哗掉,速度和钱包一起崩 💸
作为效率控,我忍不了,干脆自己写了个开源小插件 👇
📦 它叫 dsh-read-url(DeepSeek Harness 的网页阅读插件)
一句话:给智能体装一双"会读正文、不乱码、还省 token"的眼睛 👀
✨ 它到底香在哪:
✅ 只取正文,不要垃圾 优先抓 / 容器,自动剥离导航、广告、页脚,喂给模型的都是干货
✅ 中文 / 老站 / 繁体 / 日文 通通不乱码 自动识别 GBK / GB2312 / UTF-8 / Big5 / Shift-JIS 再也不用在"锘垮、脰脦"的乱码里怀疑人生了
✅ 真·省 token 默认 6000 字符截断 + 智能缓存;海外站还做了代理竞速,实测从 11 秒降到 0.6 秒 ⚡ (省下来的 token,够我多问好几个问题)
✅ 零依赖 · 不用 API key · 纯本地 Node 20+ 自带能力,装完即走,无遥测、不偷数据,隐私党狂喜 🔒
✅ 批量和站点树也不在话下 一次读 10 个链接、递归爬整站生成站点地图,竞品分析 / 文献汇总一把梭
📊 还拿 152 个真实网站做了扫测,基本都能干净读出来。
💡 谁适合用:
在玩 DeepSeek Harness / 本地智能体的朋友
常抓中文老站、繁体、日文资料的研究党
对 token 成本和隐私都比较在意的打工人
🙏 完全 MIT 开源、免费。项目就放在 GitHub 上,搜 dsh-read-url 就能找到。
如果你也受够了"读个网页被收智商税",顺手点个 ⭐ star 就是对我最大的鼓励啦~ 冲冲冲!

AI工具 DeepSeek 开源项目 效率工 程序员日常 人工智能 打工人神器