主 题:【轻量折腾】无需第三方商业 API,用 Docker 给本地大模型(DeepSeek-R1 / Ollama)搞定实时联网与引用来源
发 布 者:lyt455885919
标签分类: 技术
时 间:2026-09-14 20:18:44
内容预览:各位老哥好,刚来论坛报道,分享一个自己日常开发踩坑后写的小工具和折腾方案。痛点背景平时用本地 Ollama 跑 DeepSeek-R1 或者接入 Claude/GPT 写代码、查资料,最蛋疼的就是知识库截止,或者无法查实时文档、最新汇率和当天下跌行情。市面上的联网方案(Perplexity、Exa、Tavily)调用成本高,而且很多需要专门改客户端代码换成他们的专属 SDK,对于只想在 Open-WebUI、Cherry Studio 或者 Cursor 里直接用的人来说很不友好。因此写了一个完全兼容 OpenAI 标准协议的本地/VPS 极简反代中间件,几分钟就能跑起来。架构与思路零代码改动接入:只需要在你的 WebUI 或客户端里把 API Base URL 改成本地或 VPS 的反代端口(例如 http://127.0.0.1:8088/v1)。时效性意图自动分流:如果问题是“写一个快速排序算法”,直接透传给后端模型,零延迟;如果问题包含“今天”、“最新”、“现在股价”、“2026 年 XX 最新政策”,自动触发并发搜索。并发多引擎抓取与 Markdown 清洗:后台并行检索关键网页,把混乱的 HTML DOM、广告、无用导航剥离,提取出高信息密度的 Markdown 纯文本。注入上下文并让模型在生成回答时流式输出 [1], [2] 带有跳转来源的真实引用脚注。Docker 快速体验 启动反向代理网关docker run -d \ -p 8088:8088 \ --name llm-web-grounding \ --restart always \ ghcr.io/antonli-pm/llm-web-grounding-proxy:latest
直达链接: https://www.nodeseek.com/post-928621-1
 
 
Back to Top