我建立了一個 MCP 伺服器,使任何本地 LLM 能夠實現真實的 Google 搜尋和視覺識別功能。
科技 65
展示 HN:我教 GPT-OSS-120B 使用 Google Lens 和 OpenCV 進行視覺識別
一位開發者分享了他如何讓開源大型語言模型 GPT-OSS-120B 具備視覺識別能力,透過建立一個 MCP 伺服器,整合 Google Lens 和 OpenCV 技術,使其能夠執行真實的 Google 搜尋及圖像辨識任務,為本地 LLM 帶來更強大的功能。
值得注意展示了開源 LLM 在視覺識別和網路搜尋方面的潛力,技術整合具啟發性。
原文來源: Hacker News